AI 圈大事记

Anthropic 发布 Claude Opus 5.5,成本较上代降 40%

工具AI 评分 95/100Anthropic:Newsroom(网页) 等 3 家待复核
AI 聚合

本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手

本条选题由第三方线索发现;线索方提供的摘要未被采用,本页内容依据下方信源整理。线索来源:AIHOT

Anthropic 推出 Claude 5.5 系列首款模型 Opus 5.5,多数任务表现与 Fable 5.1 持平,运行成本比 Opus 5 低 40%。该模型在自动化行为审计中取得迄今最高分,抗提示注入能力更强,并配备与 Fable 5.1 相似的安全防护。实测中,它一天内完成 68 万行代码迁移,网页加载优化成功率 39/40。API 定价为输入 4 美元、输出 20 美元、缓存读取 0.20 美元(每百万 token)。生物与网络安全验证项目即将开放申请。

全文梳理

AI 摘要依据下方信源原文自动整理,非原文转载

性能与成本变化

Opus 5.5 作为 Claude 5.5 家族首发,在多数工作上达到 Fable 5.1 水平,同时运行开销比前代 Opus 5 削减 40%。实际应用中展现极强复杂任务处理力:有测试者借此在不足一天内搞定 68 万行代码库迁移,传统方式需工程团队数周;在 40 次网页加载优化测试里成功 39 次,而 Opus 5 的优化常附带非预期行为变更。单提示构建游戏时,其画面与完成度评分也超越其他同族模型。

安全对齐与访问限制

该模型在 Anthropic 最全面的自动化行为审计中拿到历史最高分,采取难逆操作或越界的概率显著低于近前模型,抗提示注入优于 Opus 5。对齐测试范围已扩展至长耗时任务、不可能任务及真实事件模拟场景。因在生物与网安领域与 Mythos 5.1 能力相当,其部署了近似 Fable 5.1 的防护机制。合格机构现可申请生命科学验证项目,网安验证项目也将在未来数周扩大访问。

任务成本构成剖析

单次任务开销受四要素制约:轮次(每轮重发历史致输入累加)、缓存读取(按输入价零头计费)、输出类型(思考按输出计,单价达输入五倍)及模型定价。Opus 5.5 每百万 token 列表价:输入 4 美元、输出 20 美元、缓存读 0.20 美元。同等单价下,需多轮试错的模型因重发上下文实际花费更高。缩减 token 的手段(降努力度、换小模型或减上下文)均可能致任务失败,重试代价常超前期节省。

为什么值得看

头部模型换代,性能跃升且成本大降四成,安全与长任务表现突出,直接影响开发选型。

AnthropicClaude对齐安全定价

信源3

  1. [1]Anthropic:Newsroom(网页)线索来自 AIHOTAnthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%
  2. [2]Claude:Blog(网页)线索来自 AIHOTAnthropic 详解 Opus 5.5 上一个任务的成本构成与优化方法
  3. [3]IT之家(RSS)线索来自 AIHOTAnthropic 发布 Claude Opus 5.5:成本比 Opus 5 低 40%,输出快 30% 以上

关键事实

  • Opus 5.5 运行成本较 Opus 5 降低 40%[2]

  • 早期测试者用 Opus 5.5 在不到一天内完成了 680,000 行代码迁移[2]

  • 在网页加载优化任务中,Opus 5.5 成功 39 次而 Opus 5 的改动改变了应用行为[2]

  • Opus 5.5 API 列表价为每百万 token 输入 4 美元、输出 20 美元、缓存读取 0.20 美元[1]

  • Opus 5.5 在自动化行为审计中取得迄今最强对齐得分[2]

相关 · 工具

本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。