Anthropic承诺向独立评估机构开放永久员工级访问权限,Amodei呼吁放慢前沿AI竞赛
Anthropic于2026年9月12日承诺给独立评估者永久员工级访问权,Amodei同日发文呼吁放慢AI能力提升
Anthropic首席执行官Dario Amodei于2026年9月12日发表题为“We Must Pace the Frontier”的文章,并宣布公司承诺向独立评估机构开放永久、员工级的访问权限。据Fortune报道,按这一承诺,外部评估者的权限将与Anthropic内部风险评估团队相同,发表结论也无需经公司编辑审批。 Amodei在文中提出三步方案:一是所有前沿AI公司都给予独立评估者永久员工级权限,用来核实安全承诺、通报事故;二是民主国家的AI公司在政府协助下制定共同安全标准,不让能力提升的速度失去约束;三是民主国家政府与威权国家就双方都有利的事项(例如禁止生物武器开发)进行协调。Anthropic目前只对第一步作出单方面承诺。据Engadget报道,Amodei把失控、网络攻击、生物恐怖主义和经济冲击列为主要风险,尤其点名“递归自我改进”能力,并写道“我们欠人类一次尝试”。 Amodei在文中承认,近期行业内、包括Anthropic自身都出过安全事故,这也是他主张引入常驻外部评估的理由之一。同日,OpenAI首席执行官Sam Altman接受Fortune采访时暗示,与Amodei等人的行业安全协作“会发生”,但拒绝透露细节。
过去前沿实验室的外部评估通常是一次性的、模型发布前的短期安排,评估者能看到什么、能否公开说,都由公司说了算。这次承诺的不同在于三个可核查的结构性条件:权限永久、与内部风险团队同级、发表不受公司编辑控制。一旦兑现,外界将第一次有可能持续验证一家前沿实验室是否真的做到了自己写下的安全承诺,而不是只能听公司自述。Amodei还把这项安排作为向整个行业提出的第一步标准,等于把单一公司的做法变成对同行的公开施压。
对同业的压力最直接:Anthropic把“永久员工级外部评估”定成行业门槛,OpenAI、Google DeepMind等若不跟进,就得解释为什么不。Altman同日表示行业协作“会发生”,说明各家至少在公开姿态上不愿落后。对监管方而言,这一安排提供了一个现成模板——公司既然自愿接受常驻评估,立法者可以直接写进规则,不必从零设计。对Anthropic自身,风险在于评估者可以自由发表,一旦发现问题就没有缓冲余地;但这也正是承诺可信的原因。Amodei呼吁放慢能力提升节奏,但三步方案的后两步都要靠同行和政府配合,短期内对模型发布节奏的实际影响有限。
后续关注
一看Anthropic何时把承诺落实为具体安排:入驻的评估机构名单、人数和首份独立报告的时间表——两家媒体都没有点名机构。二看Altman所说的行业联合声明是否在下周Salesforce Dreamforce前后落地,以及是否包含同等的外部评估承诺。三看OpenAI、Google DeepMind、xAI等是跟进开放同级权限,还是只签署原则性文件。四看美国及加州的AI安全立法是否引用这一常驻评估模式。
信息来源
GFT Finance 整理归纳公开信息并总结要点,不构成投资建议。数据以来源原文为准。