Model 2性能披露

  • Anthropic新模型略超最强Claude

    Anthropic低调披露内部代号为“Model 2”的最新系统,称其综合性能略微超过目前公开可用的最强模型Claude Mythos 5。该模型在MMLU-Pro、BIG-Bench Hard、HumanEval等主流评测上领先2%至4%,在Agentic任务上优势接近5%,且推理成本与延迟保持不变。消息引发研究社区广泛关注,业界猜测这可能是一个独立于现有Scaling Law体系的并行项目,或代表架构与训练目标的重大变化。Anthropic选择以“披露”而非“发布”的方式公开该模型,被视为一场精心设计的战略行动,既维护现有产品周期,又向高端客户释放技术储备信号。此次披露也引发了关于安全对齐、监管透明度及行业竞争比较基准的深刻讨论,标志着AI行业进入新的透明化阶段。

    5天前
    0
小编
分享本页
返回顶部