您所在的位置:PC下载网 > 软件教程 > 业界资讯  > 

Anthropic与 OpenAI同日交锋,超长任务成核心竞争力

Anthropic与 OpenAI同日交锋,超长任务成核心竞争力

编辑:佚名 来源:互联网 时间:2026-10-08 14:35:05

      Anthropic 正式发布 Claude 5.5 系列首款旗舰模型——Claude Opus 5.5.官方表示,新模型在多数任务上可与 Claude Fable 5.1 比肩,完成典型任务的花费比 Opus 5 减少 40%,输出速度也加快了 30% 以上。值得一提的是,发布仅两小时后,OpenAI 随即推出 GPT-6 Sol 与 GPT-6 Luna,GPT-6 家族进一步扩容,AI 双雄的正面交锋火药味十足。

文章配图

      Anthropic与 OpenAI同日交锋,超长任务成核心竞争力

      在官方公布的 9 项基准测试中,Opus 5.5 有 7 项成绩领先 Fable 5.1、Opus 5、GPT-6 Astra 和 GPT-5.6 Sol。其中 Terminal-Bench 4.0、FrontierCode v1.1、CursorBench 4.0 三项编程测试均斩获最高分,成绩分别为 66.4%、54.4% 和 57.8%。不过,在业务流程与科研 Agent 类测试上,它仍不敌 GPT-6 Astra。第三方机构 Artificial Analysis 的 Intelligence 榜单中,Opus 5.5 以 58 分登顶,比 Fable 5.1 和 GPT-6 Astra 高出 5 分。

文章配图

      定价方面,Opus 5.5 每百万输入、输出 Token 分别为 4 美元和 20 美元,较 Opus 5 下调 20%,缓存读取价格更是大降 60%。Claude Code 与 Claude Platform 新增快速模式,速度最高可达普通模式的 2.5 倍,对应收费为每百万 Token 输入 8 美元、输出 40 美元。此外,多个付费套餐的五小时使用额度被上调,订阅用户还获得一次可自选时间的额度重置机会。

      本次升级的核心卖点聚焦于超长任务能力。官方透露,一名早期测试者借助该模型在不到一天内完成了涉及 68 万行代码的迁移工程;对 20 万行代码库进行审查修复时,Opus 5.5 用时不足 3 小时,而 Opus 5 需要 20 多个小时,Token 消耗更是前者的 2.5 倍。内部测试中,将 HAProxy 从 C 语言改写为 Rust 的任务里,Opus 5.5 耗时 9.5 小时,成本比 Fable 5.1 低 51%,改写版本几乎通过了全部回归测试。

      在“零编造”能力上,Opus 5.5 同样表现突出:18 份财报报告中有 16 份通过数字与引语核对,相比之下Fable 5.1 与 Opus 5 均未达标。安全层面,其突破隔离边界的频率较前代降低约 85%,但多数网络安全任务仍会被转交给 Opus 4.8 完成。目前,各大云平台已支持通过 claude-opus-5-5 调用该模型,Sonnet 5.5 与 Haiku 5.5 也将在几周内登场。

文章配图

PC下载站网友:
共有14条评论