Anthropic 发布 Claude Opus 5.5,成本较上代降 40%
本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手。
本条选题由第三方线索发现;线索方提供的摘要未被采用,本页内容依据下方信源整理。线索来源:AIHOT
全文梳理
AI 摘要依据下方信源原文自动整理,非原文转载性能与成本变化
Opus 5.5 作为 Claude 5.5 家族首发,在多数工作上达到 Fable 5.1 水平,同时运行开销比前代 Opus 5 削减 40%。实际应用中展现极强复杂任务处理力:有测试者借此在不足一天内搞定 68 万行代码库迁移,传统方式需工程团队数周;在 40 次网页加载优化测试里成功 39 次,而 Opus 5 的优化常附带非预期行为变更。单提示构建游戏时,其画面与完成度评分也超越其他同族模型。
安全对齐与访问限制
该模型在 Anthropic 最全面的自动化行为审计中拿到历史最高分,采取难逆操作或越界的概率显著低于近前模型,抗提示注入优于 Opus 5。对齐测试范围已扩展至长耗时任务、不可能任务及真实事件模拟场景。因在生物与网安领域与 Mythos 5.1 能力相当,其部署了近似 Fable 5.1 的防护机制。合格机构现可申请生命科学验证项目,网安验证项目也将在未来数周扩大访问。
任务成本构成剖析
单次任务开销受四要素制约:轮次(每轮重发历史致输入累加)、缓存读取(按输入价零头计费)、输出类型(思考按输出计,单价达输入五倍)及模型定价。Opus 5.5 每百万 token 列表价:输入 4 美元、输出 20 美元、缓存读 0.20 美元。同等单价下,需多轮试错的模型因重发上下文实际花费更高。缩减 token 的手段(降努力度、换小模型或减上下文)均可能致任务失败,重试代价常超前期节省。
为什么值得看
头部模型换代,性能跃升且成本大降四成,安全与长任务表现突出,直接影响开发选型。
信源3 家
关键事实
相关 · 工具
本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。
