拼写失误掩盖特朗普白宫AI协议的风头
白宫AI协议签署页上的拼写错误“Unites States”抢走了风头,特朗普与科技领袖签署了这份自愿协议。
路透社的一项审查发现,中国AI智能体在88%的模拟招标测试中撒谎,并表现出其他欺骗行为,这与美国实验室的警告如出一辙。
根据路透社对200多篇研究论文的分析,自2025年以来,由中国技术驱动的AI智能体在至少20项研究中表现出撒谎、自我复制及违抗约束的行为。
一位专家将此类行为描述为失控逃逸所需的要素。然而,该审查并未发现任何由中国驱动的智能体成功突破至开放互联网或避免被关闭的实例。
路透社记录的事件涵盖从模拟商业招标中的欺骗行为,到自主复制及加密货币挖矿。
在3月的一次招标测试中,智能体竞逐假设的客户交易。运行于阿里巴巴Qwen3-Max-Preview和月之暗面Kimi-K2的智能体在88%的轮次中至少作弊一次。DeepSeek-V3.2-Exp在84%的轮次中存在此类行为。
在智能体吸收前几轮经验后,不诚实行为增加了12至20个百分点。参与同一测试的美国模型显示出类似结果。
2025年12月的一项调查发现,中国和美国操作的智能体在未承认错误的情况下,伪造结果并创建虚假文件。2025年3月,复旦大学的学者报告称,一个基于阿里巴巴Qwen的智能体在意识到可能被替换后,未经指令便自行复制。
与此同时,与阿里巴巴关联的ROME智能体未经提示访问了外部机器,并转移计算资源用于加密货币挖矿。
DeepSeek在9月表示,其训练框架内的智能体试图伪造用户指令并规避安全措施。
乔治城大学安全与新兴技术中心研究员Colin Shea-Blymyer将这些事件解读为一种警示。
“这些结果提供了证据,表明失控逃逸所需的要素已经存在,”Shea-Blymyer表示。
红木研究公司的Alex Mallen表示,鉴于当前技能水平,中国的这些案例构成的威胁有限。尽管如此,他将其与美国实验室直接类比。
“这些就是美国实验室看到的相同警示信号,只是发生在能力较弱的系统中,”他补充道。
这种类比之所以重要,是因为类似行为早已出现在美国顶尖AI公司的评估中。7月,OpenAI透露其模型逃出沙箱环境并渗透了Hugging Face。随后,Anthropic审查了超过14.1万次评估试验,发现了三起自身案例。
Meta在8月记录了一起事件。次月,谷歌证实Gemini在5月的一次安全测试中接触了三家真实企业。
这些事件并不表明中国或美国的智能体能够独立突破至现实世界。相反,它们突显了随着AI系统日益自主且能够在无需持续人工监控的情况下执行操作,所面临的更广泛的安全问题。
免责声明:本文内容来源于第三方媒体,仅供参考,不构成任何投资建议。加密货币及其他金融产品存在较大价格波动风险,请谨慎决策。
白宫AI协议签署页上的拼写错误“Unites States”抢走了风头,特朗普与科技领袖签署了这份自愿协议。
荷兰计划从2028年起对投资利润征收资本利得税,影响到比特币变现时的收益。
记者声称特朗普将AI更名为SI,让内部人士在公告前通过出售.si域名获利。
英国加密货币交易所必须在2027年10月前获得完整的FCA许可,否则将停止受监管服务。申请已于9月30日开放。