6
2026.09.03 発表/09.04 一般公開
AGI宣言のその下
GPT-6 Astra の公式ベンチ表を 最後まで 読んだ
派手な数字の下に、Claude が上のままの行が3つある
GPT-6 ASTRA / CLAUDE FABLE 5.1
01 / 17
結論
全部で最強ではなく、方向を変えたモデル
画面操作は圧勝。総合的な賢さは Claude が上
乗り換えではなく 使い分け が答えになる
GPT-6 ASTRA / CLAUDE FABLE 5.1
02 / 17
9月3日に出たもの
限定公開の翌日に、有料プラン全体へ開いた
9月3日
一部の組織へ限定プレビュー
9月4日
Plus・Pro・Business・Enterprise へ一般公開
Pro 以上は Astra Pro も使える。Enterprise は既定でオフ
出典:OpenAI 公式発表ページ GPT-6 Astra: A new generation of intelligence(2026-09-05 取得)|openai.com
GPT-6 ASTRA / CLAUDE FABLE 5.1
03 / 17
基本仕様
gpt-6-astra
コンテキスト 1,050,000
最大出力 128,000
知識カットオフ 2026年4月30日
推論エフォート 5段階
エフォートは low / medium / high / xhigh / max。入力は画像も通る
出典:OpenAI 公式 API ドキュメント gpt-6-astra(2026-09-05 取得)|developers.openai.com
GPT-6 ASTRA / CLAUDE FABLE 5.1
04 / 17
01
まず派手な方
未知の環境を解く力が、前世代と桁で違う
GPT-5.6 Sol ARC-AGI-3
GPT-6 Astra ARC-AGI-3
7.8% から 99.9% へ
出典:OpenAI 公式発表ページ GPT-6 Astra: A new generation of intelligence(2026-09-05 取得)|openai.com
GPT-6 ASTRA / CLAUDE FABLE 5.1
05 / 17
勝っている所
前世代との差が、桁で開いている項目もある
GPT-6 Astra が明確に前に出た6項目の比較表(ARC-AGI-3・FrontierMath・Terminal-Bench Science・Terminal-Bench 4.0・AutomationBench・ExploitBench)
数学は 97.6%、既知脆弱性の実証は 100%
出典:OpenAI 公式発表ページ GPT-6 Astra: A new generation of intelligence(2026-09-05 取得)|openai.com
GPT-6 ASTRA / CLAUDE FABLE 5.1
06 / 17
本丸
答えるのではなく、画面を操作して終わらせる
コンピュータ操作の比較表。Agents' Last Exam・OSWorld 2.0・ScreenSpot-Pro の3項目
画面上の正しい要素を見つける力は 76.9% → 92.7%
出典:OpenAI 公式発表ページ GPT-6 Astra: A new generation of intelligence(2026-09-05 取得)|openai.com
GPT-6 ASTRA / CLAUDE FABLE 5.1
07 / 17
02
速さの意味
同じ作業を、半分近い時間で終える
GPT-5.6 Sol 1タスク 約75分
GPT-6 Astra 1タスク 約40分
スコアは上げたまま、時間は約47%短い
出典:OpenAI 公式発表ページ GPT-6 Astra: A new generation of intelligence(2026-09-05 取得)|openai.com
GPT-6 ASTRA / CLAUDE FABLE 5.1
08 / 17
03
ここから本題
同じページを、下までスクロールする
負けが3つある
しかもこれは他社の主張ではなく、OpenAI 自身の発表ページの表
GPT-6 ASTRA / CLAUDE FABLE 5.1
09 / 17
公式表の下の方
総合指数・知識の難問・コーディングの3つ
同じ公式表で Claude Fable 5.1 が上のままの3項目。総合知能指数・Humanity's Last Exam・コーディング指数
コーディングでは Claude Fable 5 の 68.1 が最も高い
出典:OpenAI 公式発表ページ GPT-6 Astra: A new generation of intelligence(2026-09-05 取得)|openai.com
GPT-6 ASTRA / CLAUDE FABLE 5.1
10 / 17
負け その1
総合的な知能指数は、4番手
Claude Fable 5.1
GPT-6 Astra
65.7 に対して 61.2
Opus 5(63.1)と Fable 5(62.1)にも抜かれている
出典:OpenAI 公式発表ページ GPT-6 Astra: A new generation of intelligence(2026-09-05 取得)|openai.com
GPT-6 ASTRA / CLAUDE FABLE 5.1
11 / 17
負け その2・その3
知識の難問と、コーディングエージェント
Humanity's Last Exam Astra 57.2% / Fable 5.1 65.0%
コーディング指数 Astra 67.0 / Fable 5.1 67.2 / Fable 5 68.1
最下位と3位
出典:OpenAI 公式発表ページ GPT-6 Astra: A new generation of intelligence(2026-09-05 取得)|openai.com
GPT-6 ASTRA / CLAUDE FABLE 5.1
12 / 17
どう読むか
賢さの総量ではなく、振った方向が違う
Astra が振った先
画面操作・長い文脈・数学。作業を終わらせる
Claude が保った所
知識の難問と総合指標。考え抜く
だから「新しい方が全部上」にはならない
GPT-6 ASTRA / CLAUDE FABLE 5.1
13 / 17
料金
前世代の2.5倍。Claude とは同額
100万トークンあたりの価格比較表。GPT-6 Astra・GPT-5.6 Sol・Claude Fable 5.1・Claude Opus 5
同じ値段の Claude Fable 5.1 の方が、総合指数は上
出典:OpenAI 公式 API ドキュメント/Anthropic 公式価格表(2026-09-05 取得)|developers.openai.com・platform.claude.com
GPT-6 ASTRA / CLAUDE FABLE 5.1
14 / 17
04
実測してみた
API を契約しなくても、手元で回せる
codex exec -m gpt-6-astra
provider: openai
reasoning effort: high
7,674 tokens
API課金ゼロ
Codex CLI の既定モデルがすでに gpt-6-astra になっていた
出典:本チャンネルによる実測(Codex CLI 0.153.3・2026-09-05)
GPT-6 ASTRA / CLAUDE FABLE 5.1
15 / 17
使う前に
つまずきやすい3点
Enterprise は既定オフ
高度なセキュリティ作業は拒否
思考の過程が見えにくい
recurrent depth という新しい推論手法で、書かれた推論が追いにくくなった
監視しづらくなったと OpenAI 自身が明記している
任せるときは、途中のログではなく 成果物 で検証する設計に寄せる
出典:OpenAI 公式発表ページ GPT-6 Astra: A new generation of intelligence(2026-09-05 取得)|openai.com/出典:Fortune/Axios/The Verge(2026-09-03)・TechCrunch(2026-09-02)
GPT-6 ASTRA / CLAUDE FABLE 5.1
16 / 17
まとめ
用途で割る
GPT-6 Astra
画面操作/50万超の長文脈/数学・研究の難問
Claude Fable 5.1
知識の難問/総合的な賢さ/じっくり考えさせる仕事
コーディングエージェントは ほぼ互角。自分の課題で1本試してから決める
費用を抑えたいなら GPT-5.6 Sol が $4 / $20
GPT-6 ASTRA / CLAUDE FABLE 5.1
17 / 17
▶ 再生する