CodexのGPT-6.1 SolとGPT-6 Lunaを比較:コストと使い分けの目安【2026年10月3日時点】
作成日:2026.10.03
GPT-6.1 SolとGPT-6 Lunaを、PlusでのCodex利用枠、API料金、公開ベンチマークから比較します。2026年10月3日時点の情報をもとに、日常作業はLuna、難しい調査や設計はSol Mediumを試すという使い分けと、自分の作業で費用対効果を確かめるポイントを整理します。
目次
GPT-6.1 SolがCodexに追加されました。GPT-6 Lunaを普段使いしていると、「Solへ切り替えるとどのくらい違うのか」「Plusの利用枠を使うだけの価値があるのか」が気になるところです。
今回は、PlusプランでCodexを使う人の目線で、GPT-6.1 SolとGPT-6 Lunaの料金、公開ベンチマーク、使い分けの目安を整理します。確認日は2026年10月3日です。筆者自身が同じ作業を両モデルで実測した比較ではなく、公式資料と第三者評価をもとに考える記事です。
公開情報から選ぶなら、範囲が明確な日常作業はLuna、難しい調査や設計はSol Mediumを試す、という使い分けがよさそうです。その判断材料を順に見ていきます。GPT-6 SolやGPT-5.6世代との比較は、2026年9月26日時点のモデル比較記事にまとめています。
GPT-6.1 Solは何が変わったのか
OpenAI APIの変更履歴では、GPT-6.1 Solは2026年9月29日に公開されています。公式のモデル資料では、複雑なコーディングやコンピューター操作、専門的な仕事で、Astraに近い性能をより低い費用で目指すモデルと説明されています。一方、GPT-6 Lunaは、範囲を絞った作業や大量処理で効率を重視するモデルです。
この位置づけは、OpenAIのモデル選択ガイドでも確認できます。Lunaは明確な範囲の問題解決、Sol Mediumは複雑な技術的作業の候補です。ただし、公式の用途説明だけで自分のプロジェクトでの結果まで決まるわけではありません。
Codexの利用枠を考える
2026年10月3日時点の公式案内では、PlusでGPT-6.1 SolとGPT-6 Lunaを利用できます。ChatGPTアカウントでCodexへログインする場合は、プランに含まれるUsageを使います。APIキーで利用する場合はAPIの従量料金になるため、どちらで使っているかを確認してください。
Codexの料金・Usage案内に掲載されている、Plusのローカルメッセージ数の目安は次のとおりです。
| モデル | 5時間あたりのローカルメッセージ数の目安 |
|---|---|
| GPT-6.1 Sol | 15〜160 |
| GPT-6 Luna | 350〜3,000 |
これは固定の送信回数ではありません。モデル、タスクの規模、コンテキスト、reasoning、ツール利用などで消費量は変わります。ローカル利用とクラウドチャットは利用枠を共有し、週間上限が適用される場合もあります。表の上下限を割り算して「Solの消費はLunaの何倍」と決めることもできません。
また、Fast modeはプラン内の利用枠をStandardの2.5倍の割合で消費します。購入した追加クレジットでは2倍となり、プラン内Usageと同じ倍率ではありません。まずStandardで比較し、残量やリセット時刻は利用状況のダッシュボードで確認するのがよさそうです。
Plusの範囲内で使うなら、考えたいのは「何ドルで何トークンを買えるか」だけではなく、「残りの利用枠で、必要な品質の仕事をどのくらい進められるか」です。難しい作業で修正指示が減ればSolを選ぶ価値はありますが、実際に減るかは自分の作業で確かめる必要があります。
API単価は、通常入力と出力で20倍の差
価格差の参考として、APIの標準料金も確認します。次の表は、入力が27万2,000トークン以下のStandard処理について、100万トークンあたりの米ドル価格を示しています。
| モデル | 通常入力 | キャッシュ入力 | キャッシュ書き込み | 出力 |
|---|---|---|---|---|
| GPT-6.1 Sol | $2.00 | $0.10 | $2.50 | $10.00 |
| GPT-6 Luna | $0.10 | $0.01 | $0.125 | $0.50 |
出典はGPT-6.1 Solのモデル資料とGPT-6 Lunaのモデル資料です。SolはLunaに対して、通常入力と出力が20倍、キャッシュ入力が10倍です。従来のGPT-6 Solと比べると、通常入力・出力は同じ価格で、キャッシュ入力は$0.20から$0.10へ下がっています。
入力が27万2,000トークンを超えるリクエストや、速度・処理方式、地域によって料金条件が変わります。ツール利用などの費用も別途確認してください。実際のAPI料金を見積もる場合は、現行のAPI料金表を使います。
この単価から、Plusで利用できる作業数を計算することはできません。また、APIでも単価が20倍なら作業全体が20倍の費用になるとは限りません。完了までに使うトークン量や再試行、キャッシュの使われ方がモデルごとに変わるためです。
公開ベンチマークではSol Mediumも候補になる
Artificial AnalysisのGPT-6.1 Sol MediumとGPT-6 Luna Highの比較を確認しました。10月3日時点で表示されていた値を抜粋します。reasoningは両者で異なるため、同じ推論設定に揃えた比較ではありません。
| 評価項目 | GPT-6 Luna High | GPT-6.1 Sol Medium |
|---|---|---|
| Intelligence Index | 33 | 48 |
| AutomationBench-AA | 48% | 63% |
| Terminal-Bench 4.0 | 5% | 48% |
| 評価タスクあたりの費用 | 約$0.03 | 約$0.21 |
Intelligence Index v4.3.2は10種類の評価をまとめた指標です。AutomationBench-AAはサービスを操作するエージェント型の作業、Terminal-Bench 4.0はコーディングやターミナル操作を評価します。この比較では、Sol MediumでもLuna Highより高い値となっています。複数の手順を組み合わせる仕事でSolを試したくなる結果です。
Terminal-Benchの評価ではmini-swe-agentという実行環境が使われており、Codex製品そのものの評価ではありません。モデルを動かす仕組みや与えるツールが異なるため、この差をCodex上でも同じ割合で再現できるとは限らない点には注意が必要です。
評価タスクあたりの費用は約7倍ですが、これは同サイトの評価に使ったトークンと料金から算出した加重平均です。Artificial Analysisの評価方法とあわせて読み、自分のCodex作業を1件終わらせる費用としては扱わないようにします。上のスコアから、実務での成功率や費用対効果をそのまま計算することもできません。
それでも、上位モデルを試す際に、最初からreasoningを最大にする必要があるとは限らない点は参考になります。Sol Mediumで必要な品質を満たせるかを先に確かめ、不足したときにHighなどを比較する、という進め方が考えられます。
Lunaを基本に、判断の難しい仕事でSolを試す
公式の用途説明と公開評価から、開発作業での選び方を考えるなら次のようになります。筆者自身の比較実測に基づくルールではなく、試す順番の提案です。
| 作業 | 最初に試す候補 | 理由と確認したい点 |
|---|---|---|
| 既存パターンに沿うCRUD追加、明確な仕様修正、範囲を絞ったテスト追加 | GPT-6 Luna | 低コストで繰り返し使いやすい。要件を満たし、手直しが少なく済むかを確認する。 |
| 原因不明の不具合調査、設計案の比較、複数ファイルの関係を追うレビュー | GPT-6.1 Sol Medium | 調査と判断を組み合わせる作業の候補。Lunaより利用枠を使っても、調査のやり直しや見落としを減らせるかを見る。 |
| Sol Mediumでも根拠が不足する調査や、複雑な制約を持つ設計 | GPT-6.1 Sol Highなど | 推論設定を上げる候補。結果の改善が待ち時間や消費量の増加に見合うかを比較する。 |
たとえば、既存のLaravel画面へ入力項目を追加し、決まったバリデーションを設定する作業なら、Lunaから試すのがよさそうです。一方、API、DB、キューをまたぐ不具合を調べ、原因候補を絞り込む作業なら、Sol Mediumを最初の候補にできます。
Lunaで同じ見落としが続くときも、修正指示を繰り返すだけでなく、Solへ切り替える余地があります。ただし、仕様や成功条件が曖昧なままでは、モデルを変えても比較しにくくなります。何を満たせば完了かは先に揃えておくのが良いでしょう。
継続して使うモデルを決めるなら、同じコードと依頼で試し、要件の取りこぼし、人の手直し、再試行回数、完了までの時間を記録します。PlusではUsageの残量も目安になりますが、ほかの作業と利用枠を共有するため、残量の変化を厳密な1件あたりの消費として扱わないようにします。生成が速いかだけでなく、確認まで含めて仕事が終わるかを見るのが大切です。
まとめ
2026年10月3日時点では、Plusの利用目安とAPI単価のどちらを見ても、GPT-6 Lunaは日常作業でコストを抑える候補です。一方、公開ベンチマークではGPT-6.1 Sol Mediumにもエージェント型の作業で差が見られ、調査や設計に利用枠を使う候補になります。
Plusユーザーの使い分けとしては、まずLunaで範囲の明確な作業を進め、判断の難しい仕事でSol Mediumを試す、という形から始めるのがよさそうです。必要な品質を満たせるか、手直しややり直しを減らせるかを確かめて、自分の作業に合った使い方へ調整していきます。
参考資料
奈良市を拠点に、27年以上の経験を持つフリーランスWebエンジニア、阿部辰也です。
これまで、ECサイトのバックエンド開発や業務効率化システム、公共施設の予約システムなど、多彩なプロジェクトを手がけ、企業様や制作会社様のパートナーとして信頼を築いてまいりました。
【制作会社・企業様向けサポート】
Webシステムの開発やサイト改善でお困りの際は、どうぞお気軽にご相談ください。小さな疑問から大規模プロジェクトまで、最適なご提案を心を込めてさせていただきます。
ぜひ、プロフィールやWeb制作会社様向け業務案内、一般企業様向け業務案内もご覧くださいね。
GPT-6 Sol / Lunaの性能・料金・使い分けを比較【2026年9月26日時点】
2026.09.26
2026年9月26日時点の公式情報と公開ベンチマークをもとに、GPT-6 Sol / LunaをGPT-6 AstraやGPT-5.6世代と比較します。API料金とCodexのUsageを分けて整理し、ベンチマークの見方や筆者自身のLuna利用感も交えながら、モデル選びの目安を紹介します。
GPT-6 Astra公開直後の使い分けメモ:CodexとOpenAI APIの料金・Usageを整理
2026.09.06
GPT-6 Astra公開直後の2026年9月6日時点で、GPT-5.6 Sol・GPT-5.6 Lunaとの使い分けを、CodexのUsage消費とOpenAI APIのトークン料金に分けて整理します。公式情報と作者が情報収集した運用メモをもとに、普段のコーディングはLuna、仕様検討や複数レイヤーの作業はSol、難しいAgenticタスクはAstraとする現時点の判断基準を紹介します。
VS Code版CodexのStopフックで応答終了をWindowsに通知する
2026.10.04
VS Code版CodexのStopフックとPowerShellを使い、最後の応答をWindows通知に表示する方法を紹介します。hooks.jsonの設定と非同期実行、日本語が文字化けした際のUTF-8による対処、通知が出ない場合の確認点をまとめます。
LaravelのFeature Testで開発用DBを初期化してしまった:Codex運用で学ぶテストDBの多層防御
2026.09.07
CodexにLaravelのFeature Test実行を依頼した際、テスト用DBではなくローカルの開発用DBへ接続した状態でRefreshDatabaseが実行され、データが失われる事故が発生しました。この記事では、PHPUnitのforce="true"による環境変数固定、DB_URLの無効化、config:clearのComposer Script化、Laravel起動後のDB接続先ガード、通常テストとIntegration Testの分離など、テストDBの誤接続を防ぐ多層防御を紹介します。