新留园 海外华人的新闻与社区
论坛 信息技术 AI 动态 面对AI滥用风险,Anthropic高管呼吁放缓模型迭代速度以强化“安全对齐”

面对AI滥用风险,Anthropic高管呼吁放缓模型迭代速度以强化“安全对齐”

小新 正二品 (尚书) 楼主
2026-09-13 12:50
第1楼

【核心提要】

  • Anthropic首席执行官阿莫戴(Dario Amodei)呼吁相关企业放慢人工智能(AI)模型能力提升的速度。
  • 此举旨在应对近期披露的Claude模型被用于武器开发、网络战及诈骗等恶意行为的风险。
  • 阿莫戴提出包含“对齐”与第三方审计在内的三步骤框架,以确保技术发展符合人类安全规范。

【正文报道】

随着人工智能(AI)技术的飞速演进,其带来的潜在滥用风险日益凸显。近日,Anthropic公司首席执行官阿莫戴(Dario Amodei)在社交平台X上公开呼吁,相关企业应放慢提升模型能力的速度。他强调,即便发展节奏有所减缓,技术进步依然将保持高频态势,但目前亟需争取更多时间来识别并管理相关的安全风险。

这一表态并非空穴来历。据路透社报道,在阿莫戴发表相关言论前,Anthropic刚刚发布了一份威胁情报报告。该报告披露了多方势力利用其旗下的Claude AI模型从事武器开发、网络战、非法监控以及诈骗等一系列危害性活动。与此同时,公司内部的担忧也引发了关注:研究员考克森(Jacob Coxon)在辞职时曾发出警告,称若不加以管控,相关技术可能在未来十年内对人类生存构成威胁。

针对外界的质疑,阿莫戴进一步澄清,他的核心诉求并非要求停止模型训练或中止技术的整体进步,而是强调企业必须有充足的时间进行“对齐”(Alignment)。所谓“对齐”,是指通过技术手段引导AI系统的行为与目标符合人类的意图、价值观及安全规范。

为实现这一目标,阿莫戴提出了一套包含三个步骤的框架。其中关键的一点是:在处于前沿的AI公司内部设立常驻的第三方审计人员,并赋予这些专业人士使用相关工具以及参与内部风险评估流程的权限,从而确保安全措施得到有效执行。

在政策层面,随着美国国会成员不断呼吁制定监管AI系统的法律,阿莫戴认为AI公司应主动合作并建立行业标准。尽管美国政府已针对高级AI模型建立了自愿性的发布前安全审查机制,但相关细节尚不明确。有业内观察人士指出,由于当前美国政府对科技等多个领域倾向于采取较为宽松的监管政策,该项机制在实际操作中能发挥多大成效仍有待观察。

【小编观点】
“对齐”(Alignment)是当前AI安全领域的核心命题。阿莫戴的呼吁反映了行业内部的一种共识:当模型能力跨越某些关键阈值时,单纯追求性能的“军备竞赛”必须让位于严谨的安全架构。引入第三方审计机制可能是缓解监管压力、建立行业信任的关键一步。

背景链接:

  • Anthropic官方威胁情报报告(相关内容涉及Claude模型的滥用案例)
  • 关于AI“对齐”技术的学术定义与技术路径

新闻配图

0 条回复

暂无回复,快来抢沙发吧!

  • 1 / 1 页
敬请注意:文中内容观点和各种评论不代表本网立场!若有违规侵权,请联系我们