关于 Claude Mythos 5.1 的报道
共 2 篇相关报道
Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1:终端科学性能降低 52.6%,缓存读取成本降低 75%
Anthropic Releases Claude Fable 5.1 and Claude Mythos 5.1: 52.6% on Terminal-Bench-Science and 75% Cheaper Cache Reads
AI 洞察Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1。Fable 5.1 在 Terminal-Bench-Science 0.1 上得分 52.6%,是 Fable 5(24.7%)的两倍多,同时缓存读取成本降至每百万 token 0.25 美元,降幅 75%。这意味着科学终端任务自动化能力显著跃升,且长上下文推理成本大幅下降。核心结论性能翻倍且缓存读取成本降低75%。为什么重要科学任务基准分从24.7%升至52.6%属代际级提升,缓存降价75%直接降低开发者推理成本,或加速终端智能体落地。影响谁- 开发者缓存成本降低75%,但需适配三个破坏性API变更。
- 企业1M上下文与低成本缓存使科学研发类智能体更具经济可行性。
- AI 研究者Terminal-Bench-Science分数跃升为评估模型科学操作能力提供新参照。
后续看点关注Mythos 5.1在Project Glasswing下的安全评估结果,以及API破坏性变更对现有应用的迁移影响。重要度 70/100克劳德寓言5.1和克劳德神话5.1
Claude Fable 5.1 and Claude Mythos 5.1
AI 洞察Anthropic发布Claude Fable 5.1和Mythos 5.1,两者为同一模型但安全防护级别不同:Fable公开可用,Mythos仅限可信访问,面向网络安全和生命科学。相比Fable 5,新模型在token计费场景降价约25%,对高Agentic工作最高降约45%,通过降低缓存读取价格实现。这意味着Anthropic在能力提升的同时,用价格分层和安全分级扩大企业采用。核心结论相比Fable 5,新模型降价25%-45%并推出安全分级双版本。为什么重要这显示前沿模型开始用价格战和安全分级争夺AI编程与知识工作市场,同时为高风险领域提供受控能力。影响谁- 开发者可更低价使用高能力编码模型,agentic工作成本显著下降。
- 企业降低AI工作负载成本,且可评估是否申请Mythos获取高级能力。
- 网络安全从业者Mythos提供专门防护但需受限访问,可能改变攻防工具格局。
- 生命科学研究人员Mythos支持科研但安全限制严格,需通过可信渠道使用。
后续看点观察Fable 5.1实际定价与采用率,以及Mythos可信访问计划是否扩展至更多机构。重要度 80/100