💬 观点Latent Space
[AINews] GPT-6 Astra: OpenAI’s biggest LLM launch of — OpenAI发布GPT
OpenAI发布GPT-6 Astra,号称最智能且对齐,但独立评测显示提升不均且成本更高。
2026-09-04原文
本文为要点摘要,完整细节以原文为准。
🧭 一图看懂
由原文自动提炼 · 以原文为准点击任一分支,查看这一点的一句话解读
GPT-6 Astra 发布
OpenAI 称其为最智能、最对齐的模型,主打电脑操作与软件工程
- 9 小时获 3600 万浏览、16.4 万赞
- 先向有限组织开放,再推 ChatGPT 与 API
⚙️ 流程拆解
STEP 1有限组织先行开放
STEP 2扩展至 ChatGPT 各档
STEP 3开放 API 与 AWS
STEP 4用户获补偿重置
🔗 涉及的概念与玩家
- OpenAI公司
- GPT-6 Astra模型
- Claude Fable 5.1模型
- GPT-5.6 Sol模型
- ARC-AGI-3概念
- Codex产品
- Artificial Analysis公司
- Anthropic公司
- OpenAI—发布→GPT-6 Astra
- GPT-6 Astra—对标→Claude Fable 5.1
- GPT-6 Astra—取代→GPT-5.6 Sol
- GPT-6 Astra—评测于→ARC-AGI-3
- Artificial Analysis—评测→GPT-6 Astra
- OpenAI—竞争→Anthropic
- OpenAI称Astra为“最智能且对齐的模型”,主打计算机使用、软件工程和科学推理,但发布过程混乱,用户抱怨延迟和早期访问不公。
- 独立评测(Artificial Analysis)显示Astra在编码上仅与Claude Opus 5持平,智能指数低于Fable 5.1,且每任务成本比前代高75%,引发对“全面超越”叙事的质疑。
- ARC评测显示Astra在ARC-AGI-3上通过特定适配器达99.9%,但标准测试仅63%,凸显评测方式对结果影响巨大,对开发者意味着需谨慎看待基准分数。
原文:[AINews] GPT-6 Astra: OpenAI’s biggest LLM launch of all time · 作者 Latent Space
🕸 顺着图谱继续读
- GPT‑6 Astra — OpenAI发布GPT2026-09-03 · 共同涉及 OpenAI、GPT-6 Astra、GPT-5.6 Sol
- GPT-6 Astra: The next generation in intelligence for — OpenAI 发布 GPT2026-09-09 · 共同涉及 OpenAI、GPT-6 Astra、Codex
- [AINews] Claude Fable/Mythos 5.1: new SOTA model, 75% — Claude 5.1 发布:缓存降价 75%,但输出 token 增加,单任务成2026-09-02 · 共同涉及 Anthropic、Claude Fable 5.1、GPT-5.6 Sol
- Claude Fable 5.1 made me a really nice animated pelican — Simon Willison用“鹈鹕骑自行车”测试Claude Fable 5.2026-09-01 · 共同涉及 Anthropic、Claude Fable 5.1、GPT-5.6 Sol