美国 AI 公司 Anthropic 正式推出旗下 “神话级”(Mythos-class)全新模型系列,包括面向大众的Claude Fable 5与满血旗舰Claude Mythos 5,在代码开发、科学研究、视觉理解三大核心领域实现跨越式突破,综合性能超越前代所有公开模型,刷新行业基准纪录36氪。
双版本架构:同源不同定位,安全与性能兼顾
两款模型共享同一底层架构,核心能力高度一致,差距仅 1-3 个百分点,核心差异在于安全机制与开放范围。
- Claude Fable 5(公开版):面向全球用户与企业开放,内置智能安全分类器。当触发网络安全、生物化学等高风险请求时,自动降级至 Claude Opus 4.8 响应,平衡能力与安全,定价为每百万输入 token 10 美元、输出 token 50 美元。
- Claude Mythos 5(旗舰版):仅对经审核的 “受信任安全合作伙伴” 开放,解除高风险领域安全限制,主打顶尖网安攻防与前沿生物科研能力,是 Anthropic 迄今能力最强的 AI 模型。
三大核心能力全面突破,重塑行业标杆
1. 代码能力:效率天花板,百万级工程一键落地
新模型将长周期复杂编码能力拉至新高度,SWE-Bench Pro 基准达 80.3%,远超 Opus 4.8(69.2%)与 GPT-5.5(58.6%);高难度编程测试(FrontierCode Diamond)得分 29.3%,近乎前代两倍。
- 企业级实战:Stripe 测试中,1 天完成 5000 万行 Ruby 代码库迁移,同等工作量人类团队需 2 个多月。
- 全栈自主:支持从需求分析、代码编写、测试生成到视觉校验的全流程自主执行,CLI 编程测试(Terminal-Bench 2.1)得分 88%,超越 Codex CLI(83.4%)。
2. 科研能力:赋能前沿突破,加速生命科学与基础研究
Mythos 5 聚焦高价值科研场景,在分子生物学、药物设计、流体力学等领域表现突出。
- 药物研发:蛋白设计流程提速约 10 倍,14 个蛋白目标中 9 个产出强候选方案;分子生物学假设盲测中,80% 结果获科研人员优先认可。
- 学术研究:可解析复杂科学图表、提取精准实验数据,自主生成研究假设与验证方案,支持跨学科长周期科研项目持续推进。
3. 视觉能力:原生视觉理解,“盲打” 操作突破想象
Fable 5 实现原生视觉端到端处理,无需辅助工具链,仅凭图像输入完成复杂任务。
- 视觉编程:仅靠网页截图还原完整源代码,精准复现界面逻辑与交互功能。
- 自主操作:纯视觉通关《宝可梦火红版》,识别游戏画面、决策行动路径,展现强视觉推理与自主决策能力。
- 文档解析:精准识别 PDF 图表、表格与结构化数据,适配金融、建筑、法律等领域复杂文档处理。
长时自主与高效能:复杂任务的终极解决方案
两款新模型支持数天级长时自主运行,可独立完成规划、执行、验证、迭代全流程,任务复杂度越高,相对前代优势越显著。同时 token 效率大幅提升,在长上下文处理、多模态融合等场景下,为企业提供低成本、高性能的 AI 解决方案。
行业影响:AI 进入 “权限分层” 时代,安全与创新并行
Anthropic 此次发布标志着前沿 AI 正式进入分层权限时代:公开版 Fable 5 降低顶尖 AI 使用门槛,旗舰版 Mythos 5 定向赋能高敏感科研与网安领域,通过 “安全护栏 + 分级开放” 模式,平衡技术创新与风险管控。
截至目前,Claude Fable 5 已通过 API 全面上线,付费用户可直接调用,免费体验期至 6 月 22 日;Claude Mythos 5 仅对 Glasswing 项目合作伙伴开放,后续将逐步扩大科研领域授权范围36氪。