跳到正文
热点事件观察中

Claude Opus 5.5及GPT-6等前沿模型发布与评测

1 篇报道1 个报道来源2 天前更新

先了解这件事

报道摘要

Claude Opus 5.5 在 SimpleBench 得分 88.4%,视觉能力优于 Fable 5,成本降低约 60%。其推理努力度在 Terminal-Bench-Science 上从低效的 24% 提升至 xhigh 的 62%,但 max 模式因强制最小预算导致性能降至 59%。社区反馈显示 $200 Claude Code 计划现已超越 Codex。

摘自 Latent Space

报道时间线

沿着报道,了解事件的不同侧面。

9月29日
  1. Latent Space
    Claude Opus 5.5 领跑 SimpleBench 并优化解释视频生成

    Claude Opus 5.5 在 SimpleBench 得分 88.4%,视觉能力优于 Fable 5,成本降低约 60%。其推理努力度在 Terminal-Bench-Science 上从低效的 24% 提升至 xhigh 的 62%,但 max 模式因强制最小预算导致性能降至 59%。社区反馈显示 $200 Claude Code 计划现已超越 Codex。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。