💬 观点Simon Willison
GPT‑6 Astra — OpenAI发布GPT
OpenAI发布GPT-6 Astra,性能对标Claude Fable,但推理成本与基准测试细节值得关注。
2026-09-03原文
本文为要点摘要,完整细节以原文为准。
🧭 一图看懂
由原文自动提炼 · 以原文为准点击任一分支,查看这一点的一句话解读
OpenAI 发布 GPT-6 Astra
今日起向部分机构开放,随后覆盖 ChatGPT 付费版与 API、AWS
- API 定价 $10/百万输入、$50/百万输出
- 与 Claude Fable 5 同价,定位其竞品
- API 模型名 gpt-6-astra
🔗 涉及的概念与玩家
- OpenAI公司
- GPT-6 Astra模型
- Claude Fable 5模型
- GPT-5.6 Sol模型
- ARC-AGI 3概念
- Artificial Analysis公司
- Simon Willison人物
- Provider Adapter harness方法
- OpenAI—发布→GPT-6 Astra
- GPT-6 Astra—对标→Claude Fable 5
- GPT-6 Astra—超越→GPT-5.6 Sol
- GPT-6 Astra—评测于→ARC-AGI 3
- Provider Adapter harness—提升成绩→GPT-6 Astra
- Simon Willison—报道→GPT-6 Astra
- GPT-6 Astra API定价与Claude Fable 5相同,为$10/百万输入和$50/百万输出,但OpenAI自报基准分数更高,尤其在ARC-AGI 3上达到99.9%。
- 然而,99.9%的分数是通过自定义的Provider Adapter harness实现的,默认harness下仅为62.7%,提示基准测试结果可能受测试环境显著影响。
- 在安全任务上表现突出,ExploitBench满分,但Artificial Analysis的智能指数显示其仍落后于Claude Fable 5.1和Meta的Muse Spark 1.3,表明并非全面领先。
原文:GPT‑6 Astra · 作者 Simon Willison
🕸 顺着图谱继续读
- [AINews] GPT-6 Astra: OpenAI’s biggest LLM launch of — OpenAI发布GPT2026-09-04 · 共同涉及 OpenAI、GPT-6 Astra、GPT-5.6 Sol
- Kimi K3, and what we can still learn from the pelican — Simon Willison用“鹈鹕骑自行车”测试新模型Kimi K3,揭示其成2026-07-16 · 共同涉及 Simon Willison、Claude Fable 5、GPT-5.6 Sol
- [AINews] Claude Opus 5: Fable-level performance at Opus — Claude Opus 5 发布,基准测试争议与真实编码能力并存。2026-07-25 · 共同涉及 Claude Fable 5、Artificial Analysis、GPT-5.6 Sol
- The Pelican comparison grid for Astra is pretty — Simon Willison用骑自行车鹈鹕对比GPT2026-09-04 · 共同涉及 Simon Willison、GPT-6 Astra、GPT-5.6 Sol