摘要由 AI 生成
2026 年 9 月 1 日,Anthropic 发布了 Claude Fable 5.1 模型。该模型在 Terminal-Bench-Science 0.1 基准测试中取得 52.6% 的分数。在一次 Pelican 绘图测试中,不同推理模式下的表现差异显著:low 和 medium 模式会跳过推理步骤;xhigh 模式生成了 36,767 个输出令牌并耗时 7 分 51 秒;max 模式最终生成了一张包含蓝色帽子、鱼篮及详细自行车布局的 SVG 图像,共消耗 65,927 个输出令牌,耗时 13 分 54 秒,费用为 3.30 美元。
关键实体KEY ENTITIES
AnthropicClaude FableGPT-5.6 SolOpus 5Terminal-Bench-Science
事件框架EVENT FRAME
产品发布
Anthropic
Fable 5.1
发布新版本并公布科学基准成绩
报道态势 · 每日报道量LANGUAGE SPLIT
实体关系
信号强度SIGNALS
关键词热度
- Claude Fable1
- Anthropic1
- Terminal-Bench-Science1
- Opus 51
- GPT-5.6 Sol1
全部报道(1)SOURCES
↗
Anthropic 发布 Claude Fable 5.1,在 Terminal-Bench-Science 0.1 基准测试中取得 52.6% 的分数。作者对该模型进行 Pelican 绘图测试,发现其在 low、medium 推理模式下跳过推理步骤,而在 high 模式仅做少量规划;xhigh 模式生成 36,767 个输出令牌并耗时 7 分 51 秒;max 模式最终生成包含蓝色帽子、鱼篮及详细自行车布局的 SVG,共消耗 65,927 个输出令牌,耗时 13 分 54 秒,费用为 3.30 美元。