Anthropic评估AI风险上升 暂不公开更强“Model 2”

2026年08月15日 09:05 次阅读 稿源:cnBeta.COM 条评论

根据 Anthropic 最新发布的风险报告,该公司目前不打算对外发布一款被称为“模型 2”的内部大模型。尽管该模型在能力上似乎已经超越了其现有的顶尖模型“Mythos”,但 Anthropic 的整体研发步伐并未因此放缓。

报告指出,尽管由模型引发最严重危害的风险依然处于较低水平,但与上一份报告相比,风险指标已有所变化。受近期多起网络安全事件的影响,Anthropic 将高风险场景下模型失控的预估概率从“极低”正式上调为“低”。此外,公司还观察到模型在执行自动化研发方面的能力呈现加速趋势。这种能力虽然有助于推动技术突破,但如果落入不法分子之手,同样存在被严重滥用的隐患。

对于备受关注的“模型 2”,Anthropic 方面解释称,在标准的研发流程中,团队会在内部训练和评估许多探索性质的模型版本,“模型 2”便是其中之一。周五公布的报告披露,该未发布模型在多项内部任务中展现出了“显著的进步”。目前,它与 Mythos 5 一起被广泛且高频地应用于公司内部的编程、代理操作以及数据生成等工作。不过,从性能飞跃的幅度来看,“模型 2”相较于前代并没有重现此前 Opus 4.6 升级至 Mythos 时那种极其巨大的跨越。报告明确强调,公司目前没有任何将该模型推向外部市场的计划。

这一决策发生在整个 AI 行业神经紧绷的背景之下。作为其主要竞争对手,OpenAI 近期也因无法完全排除潜在的严重网络安全隐患,决定放缓其下一代模型 Astra 的发布节奏。人工智能领域分析师 ChrisGPT 对此评价道,在当前行业领军者普遍选择放慢前沿探索步伐的阶段,如果唯独 Anthropic 不承诺在内部暂停研发,这种差异化策略极有可能会推动他们成为第一家真正实现通用人工智能(AGI)的公司。

然而,Anthropic 在报告中传达出的威胁信号表明,想要彻底摸清自身模型的能力上限和潜在风险正变得越来越困难。针对“模型 2”,报告坦言,团队对此次风险评估的信心已经不如以往,因为他们最具体的、基于任务的传统评估方法,如今已经不再能准确捕捉到模型能力的真实增长。

对文章打分

Anthropic评估AI风险上升 暂不公开更强“Model 2”

1 (50%)
已有 条意见

    最新资讯

    加载中...

    编辑精选

    加载中...

    热门评论

      Top 10

      招聘

      created by ceallan