Anthropic新模型Model 2内部评估达标,暂不对外发布

Source

品玩8月18日讯,据 geeky-gadgets 报道,Anthropic在2026年风险概述中披露,其最新内部模型Model 2在内部评估中表现优于前代Mythos 5,在自研Codebench测试中获得62.8%的成绩,但尚未达到85%的广泛部署门槛。该模型目前仅作为内部工具使用,暂不对外发布。

Model 2的改进侧重于精细化与精确度,而非颠覆性创新。该模型在处理复杂任务方面有所提升,但整体进步属于渐进式迭代。Anthropic表示,Model 2尚未完成严格的部署前评估,出于风险管理和负责任AI开发的原则,决定暂不公开发布。

在AI行业竞争日趋激烈的背景下,Anthropic此举体现了其在技术创新与安全可靠性之间寻求平衡的战略取向。公司表示,将继续推进负责任创新,确保新技术在降低潜在风险的前提下为社会带来积极价值。