热点事件观察中
Claude Opus 5.5及GPT-6等前沿模型发布与评测
1 篇报道1 个报道来源2 天前更新
先了解这件事
报道摘要
Claude Opus 5.5 在 SimpleBench 得分 88.4%,视觉能力优于 Fable 5,成本降低约 60%。其推理努力度在 Terminal-Bench-Science 上从低效的 24% 提升至 xhigh 的 62%,但 max 模式因强制最小预算导致性能降至 59%。社区反馈显示 $200 Claude Code 计划现已超越 Codex。
摘自 Latent Space
报道时间线
沿着报道,了解事件的不同侧面。
9月29日
- Latent SpaceClaude Opus 5.5 领跑 SimpleBench 并优化解释视频生成
Claude Opus 5.5 在 SimpleBench 得分 88.4%,视觉能力优于 Fable 5,成本降低约 60%。其推理努力度在 Terminal-Bench-Science 上从低效的 24% 提升至 xhigh 的 62%,但 max 模式因强制最小预算导致性能降至 59%。社区反馈显示 $200 Claude Code 计划现已超越 Codex。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。