GPT‑6 Sol / Luna、API価格を半額に――AIエージェントは「働き続けられるコスト」へ

GPT‑6 Sol / Luna、API価格を半額に――AIエージェントは「働き続けられるコスト」へ

記事
IT・テクノロジー


OpenAIは2026年9月22日、GPT‑6ファミリーの新モデル「GPT‑6 Sol」と「GPT‑6 Luna」を発表しました。

ニュースの核心は、単に“新しいモデルが増えた”ことではありません。API価格は、GPT‑5.6世代の販促価格との比較で50%引き。さらに、長い会話やエージェントが同じ文脈を再利用する「プロンプトキャッシュ」も強化されました。

つまり、AIエージェントを数回試す段階から、長く働かせ、何度も改善し、複数の仕事へ展開する段階へ進むときの費用が下がります。複数AIで制作・調査・検証を回すMORIにとって、かなり直球の変化です。

【まず何が変わったのか】

GPT‑6 Solは中上位、Lunaは軽量・低価格側を担うモデルです。最上位のGPT‑6 Astraをすべて置き換えるのではなく、仕事の重さや予算に応じて使い分ける構成になりました。

API価格は、標準処理・入力272Kトークン以下の場合、100万トークンあたり次の通りです。長い入力、キャッシュ書き込み、処理モードなどは別条件です。

・GPT‑6 Sol:入力2ドル、出力10ドル
・GPT‑6 Luna:入力0.10ドル、出力0.50ドル

OpenAIは両モデルを「50% cheaper」と表現しています。ただしLunaの出力単価は1.20ドルから0.50ドルなので、単純計算では約58%減です。比較元はGPT‑5.6の販促価格であり、通常価格や他社料金との一律比較ではありません。
diagram_01_pricing.png

【なぜ「長時間エージェント」に効くのか】

AIエージェントは、1回の質問で終わりません。指示、ツール定義、参照資料、直前までの会話を引き継ぎながら、何度もAPIへ問い合わせます。

同じ内容を毎回ゼロから処理すると、文脈が長いほど費用も待ち時間も増えます。そこでOpenAIは、共通部分を再利用するプロンプトキャッシュをGPT‑6向けに改善しました。

公式発表では、適格なキャッシュ済み入力トークンは最大90%割引。再利用対象となる共通prefixは30分以内に使い回せます。
diagram_02_cache.png

さらに、次の運用機能が追加されています。

・キャッシュ命中率を確認するダッシュボード
・missの原因を調べる診断ツール
・再利用するprefixの終点を指定する明示的breakpoint
・推論の強さや利用可能ツールを変えても、以前の文脈を再利用しやすくする仕組み
・最初の依頼前に共通文脈を準備するprewarming

GitHubは、OpenAIモデルへの数十億件のリクエストで、新規処理が必要なプロンプトトークンの割合が従来基準より50%以上減ったとOpenAI公式記事内で説明しています。これはGitHubの運用上の報告であり、すべてのアプリに同じ削減率が出るという保証ではありません。

【実務性能は「最強」より「価格との釣り合い」】

OpenAIは、業務ワークフロー、コーディング、PC操作などでSol / Lunaが旧世代より改善したとしています。

外部のAutomationBench 1.0.6も確認しました。このベンチマークは47のツールを使う業務フローを、回答文ではなく最終的なシステム状態で採点します。最新版ではGPT‑6 Sol(xhigh)が33.2%、1タスク0.27ドルでした。

ただし、総合スコア首位はClaude Opus 5.5(max、default fallbacksあり、42.47%)。拒否された工程をAnthropicの既定フォールバック先で再試行する条件が含まれており、モデル単体の同一条件比較ではありません。つまりSolは「どの条件でも最強」ではありません。高い絶対性能を狙うAstraやOpus 5.5と、費用あたりの反復回数を増やしやすいSol / Lunaを、仕事ごとに選ぶのが現実的です。

OpenAIが示すAgents’ Last Exam、DeepSWE、OSWorldの比較値は、外部ベンチマークを使っていますが、条件選定と比較の提示はOpenAIによるものです。本記事ではメーカー主張と独立した最新リーダーボードを分けて扱います。

【発表された日と、実際に使える場所】

発表日は2026年9月22日です。同日から、ChatGPT WorkとCodexではPlus、Pro、Business、Enterprise、Edu向けに利用可能とされました。Free / GoはデスクトップアプリでLunaのみ利用できます。

APIでは gpt-6-sol と gpt-6-luna が提供されています。一方、公式本文は「Chatにはまだ未提供」と明記し、ChatGPTへの反映も同日中の段階展開としています。
diagram_03_boundary.png

「発表された」と「全員の画面に同時に出た」は別です。利用可能性を判断するときは、製品名だけでなく、プラン、アプリ、API、段階展開を分けて見る必要があります。

【MORIの活動とどうつながるか】

今回の変化は、Human OSで重視してきた「Role Fit before Model Ranking」と相性が良いです。

すべてを最上位モデルに任せるのではなく、たとえば次のように分けられます。

・重要な統合判断・難しい検証:Astraや上位モデル
・長い調査、反復的な制作、コード修正:Sol
・分類、整形、軽い下処理、大量の小タスク:Luna

さらに、共有ルール・記事Profile・ツール定義など、繰り返し使う文脈をキャッシュしやすくなれば、複数AI協働の「毎回同じ前提を読み直す費用」を下げられます。

ただし、今回は公式情報と公開ベンチマークを確認したニュース記事であり、MORI環境でSol / Lunaの費用・品質・キャッシュ命中率を実測した記事ではありません。導入判断には、実際の仕事で小さく比較する工程が残ります。

【まとめ】

GPT‑6 Sol / Lunaの発表で重要なのは、最高性能の更新というより、AIが長く働くための経済性が一段進んだことです。

・Sol / LunaのAPI価格は、GPT‑5.6の販促価格比で50%安価
・キャッシュ済み入力は最大90%割引
・ダッシュボード、診断、breakpoint、prewarmingでキャッシュ運用を支援
・Solは最新AutomationBenchで首位ではないが、費用あたりの実務性能が魅力
・発表時点でWork / Codex / APIに提供。Chatは未提供、ChatGPTは段階展開

AIを“1回だけ賢く答える道具”から、“継続して仕事を進めるチーム”へ変えるには、性能だけでなく費用、文脈の再利用、役割分担が効きます。今回の発表は、その土台が静かに強くなったニュースです。

【出典】

・OpenAI「Introducing GPT‑6 Sol and Luna」(2026年9月22日)  
・OpenAI「Better prompt caching for GPT‑6」(2026年9月22日)  
・OpenAI API「GPT‑6 Sol」「GPT‑6 Luna」料金・モデル仕様(2026年9月28日確認)  
・Zapier「AutomationBench 1.0.6」(2026年9月28日確認)  
・Agents’ Last Exam(2026年9月28日確認)  
・DeepSWE 1.1(2026年9月28日確認)  
・OSWorld 2.0(2026年9月28日確認)  

#生成AI #OpenAI #AIエージェント #業務効率化
サービス数40万件のスキルマーケット、あなたにぴったりのサービスを探す