人工智能

Anthropic评估AI风险上升 暂不公开更强“Model 2”

字号+作者:cnBeta.COM 来源:cnBeta 2026-08-15 09:05 评论(创建话题) 收藏成功收藏本文

根据Anthropic最新发布的风险报告,该公司目前不打算对外发布一款被称为“模型2”的内部大模型。尽管该模型在能力上似乎已经超越了其现有的顶尖模型“My'...

根据Anthropic最新发布的风险报告,该公司目前不打算对外发布一款被称为“模型2”的内部大模型。尽管该模型在能力上似乎已经超越了其现有的顶尖模型“Mythos”,但Anthropic的整体研发步伐并未因此放缓。9wK品论天涯网

9wK品论天涯网

报告指出,尽管由模型引发最严重危害的风险依然处于较低水平,但与上一份报告相比,风险指标已有所变化。受近期多起网络安全事件的影响,Anthropic将高风险场景下模型失控的预估概率从“极低”正式上调为“低”。此外,公司还观察到模型在执行自动化研发方面的能力呈现加速趋势。这种能力虽然有助于推动技术突破,但如果落入不法分子之手,同样存在被严重滥用的隐患。9wK品论天涯网

对于备受关注的“模型2”,Anthropic方面解释称,在标准的研发流程中,团队会在内部训练和评估许多探索性质的模型版本,“模型2”便是其中之一。周五公布的报告披露,该未发布模型在多项内部任务中展现出了“显著的进步”。目前,它与Mythos5一起被广泛且高频地应用于公司内部的编程、代理操作以及数据生成等工作。不过,从性能飞跃的幅度来看,“模型2”相较于前代并没有重现此前Opus4.6升级至Mythos时那种极其巨大的跨越。报告明确强调,公司目前没有任何将该模型推向外部市场的计划。9wK品论天涯网

这一决策发生在整个AI行业神经紧绷的背景之下。作为其主要竞争对手,OpenAI近期也因无法完全排除潜在的严重网络安全隐患,决定放缓其下一代模型Astra的发布节奏。人工智能领域分析师ChrisGPT对此评价道,在当前行业领军者普遍选择放慢前沿探索步伐的阶段,如果唯独Anthropic不承诺在内部暂停研发,这种差异化策略极有可能会推动他们成为第一家真正实现通用人工智能(AGI)的公司。9wK品论天涯网

然而,Anthropic在报告中传达出的威胁信号表明,想要彻底摸清自身模型的能力上限和潜在风险正变得越来越困难。针对“模型2”,报告坦言,团队对此次风险评估的信心已经不如以往,因为他们最具体的、基于任务的传统评估方法,如今已经不再能准确捕捉到模型能力的真实增长。9wK品论天涯网

本网除标明“PLTYW原创”的文章外,其它文章均为转载或者爬虫(PBot)抓取; 本文只代表作者个人观点,不代表本站观点,仅供大家学习参考。本网站属非谋利性质,旨在传播马克思主义和共产主义历史文献和参考资料。凡刊登的著作文献侵犯了作者、译者或版权持有人权益的,可来信联系本站删除。 本站邮箱[email protected]