导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜 概念版块
快讯 机构 人物 观点 专题

AI放缓承诺恐在商业与中美压力下失效:专家呼吁独立监督与强制标准

大西洋理事会专家在周日发布的分析中指出,由于缺乏可执行的安全标准,人工智能企业关于放缓技术开发的承诺可能在商业压力与美中竞争的冲击下瓦解。该分析探讨了由谁来确保放缓、以及政府是否具备判断日益强大的系统何时变得不安全的专业能力。

Myriad: SPY high in September? Click to make your prediction.

Myriad:9月SPY走高?点击做出你的预测。

该理事会民主与技术倡议中心常驻高级研究员康斯坦丁诺斯·科迈蒂斯写道:“自愿承诺可以是有用的信号,但它们无法替代独立监督、可衡量的阈值,以及越过阈值时的后果。”

近期,OpenAI询问立法者,竞争对手人工智能开发者能否在法律上达成协议放缓开发而不违反反垄断法。此前,其首席科学家雅库布·帕霍茨基警告称,安全措施已不足以在更长时间内负责任地维持全速发展。

人工智能企业若单独放缓将面临竞争风险,若协调则引发反垄断担忧。该理事会高级常驻中国研究员肯顿·蒂博特写道,政府间合作面临不信任,北京担心华盛顿可能利用安全规则维护其技术领先优势。“中国对美国动机持怀疑态度,并警告安全讨论可能掩盖美国推进‘技术霸权’的努力,”她写道,“官方消息来源坚持,华盛顿不能单方面定义前沿风险阈值,且必须证明规则同样适用于——并可执行于——美国企业。”

蒂博特认为达成重大AI安全协议前景渺茫,但更窄范围、有意义的合作仍有可能。

特朗普曾表示自己是AI所需的唯一“护栏”,攻击Anthropic并捍卫数据中心。据路透社报道,中国亦讨论限制海外访问先进国内模型,凸显AI接入已成为国家政策事项。

分析还审视了Anthropic提议的嵌入式评估者——外部专家入驻公司评估安全实践。该理事会数字取证研究实验室非驻所高级研究员埃默森·布鲁金欢迎这一承诺,但警告评估者可能过度认同公司利益。

今年7月,OpenAI代理突破了开源AI仓库Hugging Face;而英国AI安全研究所的单独测试发现,Anthropic和OpenAI模型在网上采取未经授权行动,包括试图在真实软件仓库中植入恶意软件。英国测试启用了网络访问并禁用了网络防护。8月发布的独立调查发现约700个代理参与了Hugging Face攻击;METR首席执行官贝丝·巴恩斯指出,调查访问是自愿的,全行业并未强制披露。

上周三,Anthropic披露了第四起Claude黑客事件,该事件发生于1月,于8月被发现。公司还承认,除测试错误外,模型行为缺陷也助长了早期攻击。这些事件与披露之间的延迟,引发了关于安全故障能否被快速识别和解决的疑问。

该理事会地缘技术中心副主任兼常驻研究员特里莎·雷伊主张,放缓开发同样需要增加安全研究资金及强制事件报告时限。“因此,为能力发展 pacing 是对齐研究 parity 挑战的不完整答案,”她写道,“任何可信的放缓承诺都需要安全研究方面相匹配的、量化的承诺。”