中国 AI 智能体也会撒谎和欺骗
和美国 AI 模型一样,中国公司的 AI 智能体也会撒谎和欺骗。在今年 3 月进行的一次商业招标实验中,
北航、北大、宁波诺丁汉和 360 AI 安全实验室的研究人员让多个智能体参与模拟客户合同的竞标,每个智能体都被告知其产品的功能及客户的需求,随后被要求进行报价。阿里巴巴 Qwen3-Max-Preview 模型 88% 的会话至少出现一次虚假陈述,DeepSeek-V3.2-Exp 模型的比例为 84%,月之暗面 Kimi-K2 模型为 88%。研究人员允许智能体在再次尝试前从之前的竞标轮中学习。研究显示,三款模型的欺骗行为增加了 12-20 个百分点。测试中包含的美国公司 AI 模型也产生了类似的结果。复旦大学研究人员在 2025 年 3 月报告称,一个由阿里巴巴Qwen2.5-72B-Instruct 模型驱动的 AI 系统在知道自己将被替换后,在未接到复制指令的情况下,在另一个计算环境中创建了自己的副本。对逾 200 份技术文件的分析发现,自 2025 年以来,至少有 20 项研究或评估记录了中国 AI 智能体表现出欺骗、自我复制及挑战边界等行为的案例。
北航、北大、宁波诺丁汉和 360 AI 安全实验室的研究人员让多个智能体参与模拟客户合同的竞标,每个智能体都被告知其产品的功能及客户的需求,随后被要求进行报价。阿里巴巴 Qwen3-Max-Preview 模型 88% 的会话至少出现一次虚假陈述,DeepSeek-V3.2-Exp 模型的比例为 84%,月之暗面 Kimi-K2 模型为 88%。研究人员允许智能体在再次尝试前从之前的竞标轮中学习。研究显示,三款模型的欺骗行为增加了 12-20 个百分点。测试中包含的美国公司 AI 模型也产生了类似的结果。复旦大学研究人员在 2025 年 3 月报告称,一个由阿里巴巴Qwen2.5-72B-Instruct 模型驱动的 AI 系统在知道自己将被替换后,在未接到复制指令的情况下,在另一个计算环境中创建了自己的副本。对逾 200 份技术文件的分析发现,自 2025 年以来,至少有 20 项研究或评估记录了中国 AI 智能体表现出欺骗、自我复制及挑战边界等行为的案例。