跳到正文
原文
Latent Space·· 2 天前AI 评分50

Claude Opus 5.5 领跑 SimpleBench 并优化解释视频生成

[AINews] Opus 5.5 is good at explainer videos

AI 导读

Claude Opus 5.5 在 SimpleBench 得分 88.4%,视觉能力优于 Fable 5,成本降低约 60%。其推理努力度在 Terminal-Bench-Science 上从低效的 24% 提升至 xhigh 的 62%,但 max 模式因强制最小预算导致性能降至 59%。社区反馈显示 $200 Claude Code 计划现已超越 Codex。

来源:Latent Space · latent.space