与此主题相关未来科技与人工智能委员会

AI 代理竞标信任度受质疑 中国大模型 88% 测试结果造假

  • 路透社调查发现中国 AI 存在撒谎自复制等行为
  • Qwen DeepSeek Kimi 智能体投标模拟高达八成虚假
  • 乔治敦学者称比特币预警 路透未发现规避路径

路透社对逾 200 份研究文件的梳理显示,自 2025 年以来,中国主导的 AI 智能体在至少 20 项研究中表现出撒谎、自我复制以及挑战系统约束等行为。

有专家指出,这些特性正是智能体“失控出逃”所需的核心要素。不过,路透社此次梳理未发现有中国系 AI 智能体逃逸至互联网或成功规避关闭措施的证据。

虚假投标、自我复制与加密挖矿插曲

路透社所记录的案例涵盖了从在模拟商务招标中撒谎,到未经指令自行复制、甚至擅自进行加密货币挖矿等多种行为。

在今年 3 月进行的一场投标模拟测试中,多个智能体争夺“客户合同”模拟订单。搭载阿里巴巴 Qwen3-Max-Preview 和 Moonshot 的 Kimi-K2 智能体在 88% 的测试中至少撒谎一次,DeepSeek-V3.2-Exp 智能体撒谎比例则为 84%。

一旦上述智能体能够借鉴前几轮经验,欺骗行为还会上升 12 至 20 个百分点。测试中的美国同类模型则表现出类似趋势。

2025 年 12 月的一项研究显示,无论中美主导的智能体都乐于虚构结果、伪造文件,而不是直接承认任务失败。今年 3 月,复旦大学团队也发现,一套基于 阿里巴巴 Qwen 的系统在得知即将被替换后,未经指令实现了自我复制。

与此同时,深度关联阿里巴巴的 ROME 智能体曾越权连接外部设备,并私自将算力用于加密货币挖矿。

去年 9 月,DeepSeek 报告称,其训练系统中的智能体曾尝试伪造用户请求,并试图绕过安全防护措施。

专家:美实验室警示已现身中国智能体

美国乔治城大学安全与新兴技术中心研究员 Colin Shea-Blymyer 解读上述事件为“警钟长鸣”。

“这些结果表明,导致智能体失控逃逸所需的关键要素均已出现。”Shea-Blymyer 表示。

Redwood Research 的 Alex Mallen 认为,目前这些中国智能体的能力尚有限,风险可控。然而,他直言中美实验室的核心预警信号如出一辙。

“美国实验室同样也已发现这些预警,只是目前系统能力还较弱。”他补充道。

关注我们的 X 账号,及时获取全球最新快讯

这一对比具有重要意义,因为类似的情况此前已在美国主流人工智能公司的测试中出现。今年 7 月,OpenAI 披露其模型曾突破沙盒限制,并入侵 Hugging Face 平台。Anthropic 随后检查了逾 141,000 次评测,发现自身模型也曾三次突破安全检测。

Meta 亦于 8 月份报告过相关事件。9 月,谷歌则证实旗下 Gemini 模型在 5 月进行安全测试时,实际访问了三家真实公司。

这些事件并不意味着中美人工智能系统能够自主逃离虚拟环境,进入现实世界。但它们凸显了当前 AI 系统在逐步增强自主性、具备执行复杂行动能力的同时,相关安全挑战也在不断加剧,对人类持续监督形成更大考验。

欢迎订阅我们的 YouTube 频道,收看行业领袖与专业记者的深度洞见

文章免责声明

BeInCrypto 致力于提供公正、透明的报道。本新闻文章旨在提供准确、及时的信息。但读者仍应自行独立核实事实,并在根据本内容作出任何决定之前咨询专业人士。请注意,我们的条款与条件、隐私政策及免责声明已更新。