メインコンテンツへスキップ
← ブログに戻る
お知らせ2026年6月27日by K.hirano

GPT-5.6は何が確定で、なぜ触れないのか——事実・報道・推測を分けて読む

2026-06-26発表のGPT-5.6限定プレビューを、公式確定情報・報道・推測に三分離して整理。価格、性能、安全性、政府レビューの意味を短時間で把握できます。

#OpenAI#GPT-5.6#aiニュース

関連記事としては GPT-5.6 Sol×Terra、コスパ最強のEffort組み合わせは?実測で検証BlogGPT-5.6 Sol×Terra、コスパ最強のEffort組み合わせは?実測で検証GPT-5.6 Sol(設計・計画役)とTerra(コーディング実装役)を組み合わせて使う際、どのreasoning effortが最もコスパが良いかをArtificial Analysisの実測データで検証。Solはhighで頭打ち、Terraはhighまで気軽に上げてよい理由を出典付きチャートで確認します。 もあわせて読むと、今回の論点とのつながりを把握しやすくなります。

GPT-5.6 は約20社の限定プレビューで、筆者もまだ手元では試せていません。2026-06-26 の発表時点で、公式に確定している情報と、報道・観測ベースの情報を分けて整理します。話題の中心はモデル性能だけではなく、「なぜ一般にはまだ触れないのか」という点にあります。

見出しだけ追うと、Sol / Terra / Luna という新しい名前、max reasoning effort と ultra mode、そして政府レビューという言葉が同時に出てきます。ここが混ざると、どこまでが事実でどこからが観測なのか分かりにくい。まず結論から言うと、性能の前進はありつつ、いちばん気になるのは「なぜ一般にはまだ触れないのか」のほうです。なので、この記事では最初に確度を切り分けます。煽らず、冷やしすぎず、判断材料だけを残します。

いま確定していること(公式発表・システムカード)

2026-06-26、OpenAI は GPT-5.6 を限定プレビューとして発表しました。モデル体系は Sol、Terra、Luna の3本立てです。Sol は旗艦、Terra は日常用途とのバランス、Luna は高速・低コストという位置づけです。新命名では、数字が世代を、Sol/Terra/Luna が能力ティアを表します。発表時点で公式に読めるのは、この構造そのものです。出典: https://9to5mac.com/2026/06/26/openai-upgrading-chatgpt-and-codex-with-new-gpt-5-6-models-in-limited-release/

機能面では、Sol に最大の推論時間を与える max reasoning effort と、サブエージェントを使って複雑作業を速くさばく ultra mode が新設されました。提供形態は API と Codex 経由の限定プレビューです。ここで重要なのは、単に「新しいモデルが増えた」のではなく、推論時間を厚く取る系と、並列化で仕事を回す系を明示的に分けてきた点です。実務では、長考させたいタスクと、回転率を上げたいタスクを同じ箱で扱わなくてよくなります。出典: https://9to5mac.com/2026/06/26/openai-upgrading-chatgpt-and-codex-with-new-gpt-5-6-models-in-limited-release/

公式システムカードでは、サイバーセキュリティは High、ただし Critical ではないと分類されています。生物・化学も High、AI 自己改善も High 閾値未満です。OpenAI は「これらのモデルはサイバー能力で意味ある前進だが、リスク枠組みの最高位(Critical)には達していない」と述べています。安全側の評価が上がっている一方で、最上位扱いではない、というのが公式の立ち位置です。出典: https://deploymentsafety.openai.com/gpt-5-6-preview

HealthBench Professional(length-adjusted)は、Sol 60.5、Terra 57.7、Luna 55.7 です。数字だけを見ると Sol が最上位ですが、ここで読めるのは「健康系ベンチで相対的にどの順か」という範囲までです。横並びで GPT-5.5 とどう違うか、標準化された比較は公式未公表です。そこはまだ断定できません。出典: https://deploymentsafety.openai.com/gpt-5-6-preview

モデル入力/出力価格根拠
SolUSD 5 / USD 30 per 1M tokens報道ベース
TerraUSD 2.5 / USD 15 per 1M tokens報道ベース
LunaUSD 1 / USD 6 per 1M tokens報道ベース

この価格表は、報道による USD での値です。OpenAI 公式システムカードには未記載で、日本円換算も未公表です。キャッシュ書き込み 1.25 倍、読み出し 90% 割引、最低キャッシュ寿命 30 分という条件も、報道ベースとして扱うべきです。出典: https://9to5mac.com/2026/06/26/openai-upgrading-chatgpt-and-codex-with-new-gpt-5-6-models-in-limited-release/https://kingy.ai/news/openai-gpt-5-6-sol-benchmarks-specs-pricing-safety-evals/

安全分類 / 指標SolTerraLuna
サイバーセキュリティ分類HighHighHigh
生物・化学分類HighHighHigh
AI自己改善High閾値未満High閾値未満High閾値未満
HealthBench Professional60.557.755.7

この表は公式システムカードの確定値だけを並べています。ここに載っていないコンテキストウィンドウや GPT-5.5 との標準化比較は、まだ未公表です。未公表を無理に補わないほうが、後で読み直したときに混乱しません。出典: https://deploymentsafety.openai.com/gpt-5-6-preview

まだ確定していない・報道ベースのこと

限定プレビューの配布先は、「政府に参加を共有した信頼パートナー」に限られます。VentureBeat は約20社と報じました。背景には 2026-06-02 のトランプ大統領令があり、一定の AI 企業に対して、リリース最大30日前の advanced model を政府レビューに提出するよう求める枠組みがあるとされています。これは報道であり、公式システムカードだけで全体が説明されているわけではありません。出典: https://techcrunch.com/2026/06/26/openai-limits-gpt-5-6-rollout-after-government-request-says-restrictions-shouldnt-be-the-norm/https://venturebeat.com/technology/openai-unveils-gpt-5-6-sol-terra-and-luna-models-but-only-accessible-to-limited-preview-partners-for-now-per-us-gov

OpenAI は、この種の政府アクセス手続きが長期的な既定になるべきではないと反発しています。ユーザー、開発者、企業、サイバー防御者、グローバルパートナーから最良のツールを遠ざける、と明言しています。限定プレビューは、あくまで数週間で広く提供するための short-term step という位置づけです。元ホワイトハウスAI顧問の Dean Ball は、明確な安全基準なき「事実上の非自発的ライセンス制度」になり、米国の対中競争力を損なう恐れがあると指摘しました。ここも報道ベースです。出典: https://techcrunch.com/2026/06/26/openai-limits-gpt-5-6-rollout-after-government-request-says-restrictions-shouldnt-be-the-norm/

性能の話も、全部が同じ確度ではありません。OpenAI は Terminal-Bench 2.1 で Sol が SOTA だと主張し、GeneBench v1 では GPT-5.5 より少トークンで改善、ExploitBench では競合と互角で出力は約3分の1だとしています。ただし、kingy.ai は「OpenAI は GPT-5.5 との標準化された比較スコアを公表していない」と注記しています。つまり、主張として読める部分と、標準化された比較としては未公表の部分が混在しています。しかも、Sol/Terra は脆弱性や exploit primitive は見つけられても、Chromium / Firefox で完全なフルチェーン exploit は自律生成できなかった、と抑制された結果も併記されています。出典: https://kingy.ai/news/openai-gpt-5-6-sol-benchmarks-specs-pricing-safety-evals/

最初に引っかかるのは、たぶん「価格が安いのか高いのか」より「そもそも自分の環境でいつ触れるのか」のほうです。そこはまだ、はっきりした答えがありません。日本円価格も未公表ですし、コンテキストウィンドウも未公表です。未公表のままでは、移行判断に使える材料はまだ足りないです。

管理人の私見(ここからは推測です)

ここからは20年ハードウェア/開発現場を見てきたエンジニアとしての見立てです。確証はありませんし、あくまで私見です。

先端AIが、パブリックな道具というより国家管理下の「戦略物資」寄りに見えてくる流れは、もう始まっているのかもしれません。2026-06-02 の政府レビュー要請がリリース直前の足かせになると、開発者が新モデルを即座に試し、業務改善に組み込むフットワークは落ちます。そういう見方もできます。

約20社の限定プレビューという形も、広い現場での実測検証が回りにくい構造に見えます。ベンチの数字は出ても、実運用で詰まるところは別です。権限管理、長文の失速、ツール呼び出しの癖、社内のレビュー工程との相性。そこが広く回らないまま普及すると、実用面の熟成は遅れるかもしれません。

安全分類が High であること自体は、手続きを重くする理由としては理解できます。ただ、その枠組みが恒久化すると、OpenAI が反発している通り、政府アクセスが既定路線になる可能性もゼロではありません。ここは強く警戒したくなりますが、まだ断定はしません。あくまで、そうなりうるという見立てです。

開発計画の側でも、供給リスクっぽい匂いがあります。モデル更新のタイミングが、製品ロードマップではなく規制当局の審査スケジュールに引っ張られると、現場はかなりやりにくい。ツールチェーンの更新は、だいたい「今日必要」なので、そこが外部要因に縛られるのは地味に効きます。

よくある質問

Q. GPT-5.6 はもう誰でも使えますか。 A. いいえ。2026-06-26 時点では限定プレビューで、一般公開ではありません。公式に確認できるのは、限られたパートナー向け提供です。

Q. 価格の $5/$30 って日本円でいくらですか。 A. 日本円換算は未公表です。本文で扱った価格は、報道による USD の per 1M tokens 価格です。

Q. ベンチの数字は全部公式ですか。 A. いいえ。HealthBench Professional や安全分類は公式システムカードで確認できますが、Terminal-Bench 2.1 や GeneBench v1、ExploitBench の一部は OpenAI の主張と報道ベースで、標準化比較は未公表です。

Q. いまの判断材料は何ですか。 A. まずは、公式に確定しているモデル構成、安全分類、HealthBench を押さえることです。そのうえで、報道ベースの価格や限定配布の背景を切り分けて読むのが安全です。一般公開後に実測で確かめる、という順番で十分です。

参考リンク

注意点・制約

この記事は公式発表・システムカードに加えて報道経由の情報も含み、価格やベンチの一部は正式発表ベースでは未確認です。提供条件や仕様は一般公開まで変わる可能性があるため、社内説明や移行判断では、報道ベース・未公表の情報だけを確定根拠にしないほうが安全です。

どのように整理したか

公式発表・報道・観測情報を分けて確認し、事実・報道・推測の三層で整理しました。

関連記事

この記事を書いた人

HW系エンジニアとして20年以上、10,000件を超える顧客訪問と2,000件を超える単独ソリューション実績。AIツールを使った個人開発やIoT農園など、Raspberry Piを使ったオートメーション化なども実践中です!エンジニア専門結婚相談所も運営中、ClaudeCodeで解決できない心の課題も解決いたします!

月3万円のCodex Pro 20xはAPI約80万円分?5時間枠を実開発ベースで換算した
NEW
2026年9月9日
開発ログ

月3万円のCodex Pro 20xはAPI約80万円分?5時間枠を実開発ベースで換算した

Codex Pro 5x・20xの5時間枠をOpenAI公式の25 credits=$1レートでAPI料金へ換算し、Azure上で30日に流れた約4.97億トークンの実測と重ねて「APIで数千ドル」が起きる条件を示します。

#Codex#OpenAI#API料金#AIコーディング#開発環境
GPT-5.6 Luna xhigh: 知能49・タスク単価$0.04・待ち時間40秒、安い理由まで実測
2026年7月31日
開発ログ

GPT-5.6 Luna xhigh: 知能49・タスク単価$0.04・待ち時間40秒、安い理由まで実測

2026年7月30日の80%値下げ後、通常セッションのモデルをLunaに切り替えるべきか。OpenAI公式発表と第三者ベンチの実測データ(Intelligence Index、TTFT、タスク単価)から、API従量とCodex定額それぞれの判断材料を整理します。

#OpenAI#GPT-5.6#API#Luna#Terra
2秒 vs 15秒:Codex・Claude Code・Grok、通常セッションの最適モデルを実測で選ぶ
2026年7月13日
チュートリアル

2秒 vs 15秒:Codex・Claude Code・Grok、通常セッションの最適モデルを実測で選ぶ

CodexのGPT-5.6 Terra High、Claude CodeのSonnet 5 High、Grok 4.5 Highを、第三者実測のタスク単価・知能指標・応答開始時間で比較。通常セッションと難問での切り替え基準を整理します。

#Codex#Claude Code#Grok#GPT-5.6#AI比較
GPT-5.6 Sol×Terra、コスパ最強のEffort組み合わせは?実測で検証
2026年7月11日
チュートリアル

GPT-5.6 Sol×Terra、コスパ最強のEffort組み合わせは?実測で検証

GPT-5.6 Sol(設計・計画役)とTerra(コーディング実装役)を組み合わせて使う際、どのreasoning effortが最もコスパが良いかをArtificial Analysisの実測データで検証。Solはhighで頭打ち、Terraはhighまで気軽に上げてよい理由を出典付きチャートで確認します。

#GPT-5.6#OpenAI#Artificial Analysis#reasoning effort#Sol

AI年表で詳しく見る

📅

GPT-5.6 Sol

GPT-5.6 Sol——限定プレビューを経て一般公開、新フラグシップに

META-MARK × AI

ローカルAIを動かすGPU、ちゃんと選べていますか?

VRAM・性能・コスパをMetaScoreで数値化。AIアプリ別の推奨ハードウェア要件も確認できます。