2026年9月22日リリース

GPT-6 LunaOpenAIの$0.10高ボリュームモデル

GPT-6 Lunaは、OpenAIのGPT-6世代で最も安いティアです。2026年9月22日にGPT-6 Solと同時にリリースされました。OpenAIは、要約・分類・抽出・ルーティングという目的が明確な大量処理向けのモデルとして位置づけています。入力100万トークンあたり$0.10で、GPT-6 Solの20分の1、GPT-5.6 Lunaの入力料金の半額です。Felo AI SearchとFelo APIで利用できます。

2026年9月22日からgpt-6-lunaとしてOpenAI APIで稼働中。100万トークンあたり$0.10 / $0.50で、GPT-5.6 Lunaの入力料金の半額です。

2026年9月22日リリース · Felo AI SearchとFelo APIで提供中

料金表

GPT-6 Lunaの概要

モデルID
gpt-6-luna
リリース日
2026年9月22日
入力
100万トークンあたり$0.10
キャッシュ入力
100万トークンあたり$0.01
出力
100万トークンあたり$0.50
コンテキストウィンドウ
1,050,000トークン
料金はOpenAIが公表しているAPI標準価格(100万トークンあたり)です。以下のコスト各節はこの4つの数字から計算しており、引用した数値と本ページで計算した数値を区別して示しています。

$0.10 / $0.50

入力料金

100万トークンあたりの標準料金。

$0.01

キャッシュ入力

100万トークンあたり、入力料金の10分の1。

1.05M

コンテキストウィンドウ

最大入力922,000、最大出力128,000。

gpt-6-luna

APIモデルID

modelフィールドに渡す文字列。

ユニットエコノミクス

100万トークンにかかるコスト

Lunaの根拠は形容詞ではなく算数です。ここではOpenAIが公表している4つの料金と、読み込みが書き込みを大きく上回るワークロードでそれが何になるかを示します。

料金表

公表されている標準料金(100万トークンあたり)。

入力
$0.10
キャッシュ入力
$0.01
キャッシュ書き込み
$0.125
出力
$0.50

キャッシュ入力は入力料金の10分の1で課金されます。キャッシュ書き込みはキャッシュなしの読み込みの1.25倍で、後述の回収計算はこの数字が前提です。

混在ワークロードでのコスト

ほとんどのプロンプトは書き込みより読み込みがはるかに多いため、入力料金だけを見ると実際のコストを過大に見積もることになります。この列は出力トークン1つにつき入力トークン20個という前提で計算しています。

モデル

100万トークンあたり(混合)

Luna比

GPT-6 Luna

$0.12

1x

GPT-5.6 Luna

$0.25

2.1x

GPT-6 Sol

$2.38

20x

GPT-6 Astra

$11.90

100x

この列は、各モデルが公表している料金と入出力比20:1から本ページが計算したもので、ベンダーが公表している数字ではありません。比率が変わればすべての数字が動きます。1:1ならLunaの混合料金は100万トークンあたり$0.30、100:1なら約$0.10です。

20:1の混合比での100万トークンあたりコスト(GPT-6 Luna比)

20:1の混合比での100万トークンあたりコスト(GPT-6 Luna比)

各バーは、100万混合トークンのコストをLuna自身の値で割ったものです。GPT-5.6 LunaはLunaの2.1倍、GPT-6 Solは20倍、GPT-6 Astraは100倍です。OpenAIが公表している料金から算出しました。バーはゼロから始まります。

出典:OpenAI APIのGPT-6ファミリー料金(2026年9月)から算出

100万トークンあたりの料金:GPT-6ファミリーとGPT-5.6 Luna

100万トークンあたりの料金:GPT-6ファミリーとGPT-5.6 Luna

100万トークンあたりの入力料金と出力料金。GPT-6 Lunaは入力$0.10/出力$0.50、GPT-5.6 Lunaは$0.20と$1.20、GPT-6 Solは$2と$10、GPT-6 Astraは$10と$50です。バーはゼロから始まります。

出典:OpenAI API料金(2026年9月)

ロングコンテキスト

272,000トークンの料金の崖

入力が272,000トークンを超えたリクエストは、超過分だけでなくリクエスト全体がロングコンテキスト料金で課金されます。このしきい値は、Lunaが掲げるウィンドウの26%の位置にあります。

料金

Standard

272,000超

変化

入力

$0.10

$0.20

2x

キャッシュ入力

$0.01

$0.02

2x

出力

$0.50

$0.75

1.5x

なぜ坂ではなく崖なのか

入力272,000トークンのリクエストは$0.0272です。トークンが1つ増えるだけでリクエスト全体が再計算されます。272,001トークンを100万トークンあたり$0.20で計算すると$0.0544になるため、たった1トークンの追加で請求額が$0.0272増えます。同じ272,000トークンを、それぞれしきい値未満に収まる2回の呼び出しに分ければ、コストは$0.0272のままです。

どう扱うか

1回のリクエストの入力を272,000トークン未満に収めれば、標準料金が適用されます。検索で200,000トークンが返る場合や、長い文書を分割するチャンク処理は安いティアに収まりますが、1回の呼び出しでウィンドウ全体を送る場合はそうなりません。安いティアが適用されるのは、公表されているコンテキストのおよそ最初の4分の1です。

GPT-6 Lunaのコンテキストウィンドウで標準料金が終わる位置

GPT-6 Lunaのコンテキストウィンドウで標準料金が終わる位置

ウィンドウは1,050,000トークンです。標準料金が適用されるのは入力272,000トークンまでで、全体の約26%にあたります。それを超えると入力2倍・出力1.5倍で課金され、しかも一度この線を越えるとリクエスト全体が再計算されます。

出典:OpenAI GPT-6 Lunaモデルページ、ロングコンテキスト料金規定(2026年9月)

プロンプトキャッシュ

キャッシュが元を取る条件

キャッシュは一種の賭けです。プレフィックスの書き込みに一度だけ入力料金の1.25倍を払い、以降の読み込みはその10分の1で済みます。Lunaの料金では、2回目の呼び出しで元が取れます。

書き込みは4分の1割高

プレフィックスを書き込む最初のリクエストは、100万トークンあたり$0.10ではなく$0.125で課金されます。同じテキストをキャッシュなしで送るより25%高い計算です。

読み込みは10分の1

以降キャッシュにヒットしたリクエストは100万トークンあたり$0.01で課金され、そのたびにキャッシュなしの料金より$0.09安くなります。

2回目の呼び出しで損益分岐

書き込み1回と読み込み1回で100万トークンあたり$0.135、キャッシュなしの2回なら$0.20です。100回目の繰り返しでは、キャッシュ経由のコストは毎回同じプレフィックスを送り直す場合の約11%になります。

同じプレフィックスを繰り返す累計コスト(キャッシュあり/なし)

同じプレフィックスを繰り返す累計コスト(キャッシュあり/なし)

同じプレフィックスを100回送る場合の100万トークンあたりコスト。毎回送り直すと$10.00、キャッシュを使うと$1.115です。2本の線は1回目と2回目の間で交差します。

出典:OpenAIが公表したGPT-6 Lunaのキャッシュ書き込み料金とキャッシュ入力料金から算出(2026年9月)

推論エフォート

請求額を左右するもう一つのつまみ

LunaはOpenAIの6段階の推論エフォートをすべて受け付け、その設定が1回の呼び出しで消費する推論トークン数を決めます。既定値はmediumです。

none

関数呼び出し

low

 

medium

既定

high

 

xhigh

 

max

 

6つの設定と1つの既定値

Lunaが受け付けるのはnone、low、medium、high、xhigh、maxです。推論トークンは出力として課金されるため、この設定は品質だけでなくコストのつまみでもあります。エフォートが高いほど、回答を出すまでに消費するトークンが増えます。

Chat Completionsではツール呼び出しにnoneが必要

Chat Completions APIでは、推論エフォートがnoneのときだけツール呼び出しのリクエストが処理されます。組み込みツールと関数呼び出しについては、OpenAIはResponses APIを使うよう案内しています。こちらではツールと併せてエフォートの段階も利用できます。設定を変える前に、統合がどちらのエンドポイントを使っているか確認しておく価値があります。

GPT-6ファミリーにおけるLunaの位置

3つのティアに、それぞれの役割があります。ルーティングの判断を簡単にするのは、Solの料金の20分の1という差です。

モデル

入力

出力

ここに回す仕事

GPT-6 Luna

$0.10

$0.50

大量処理で目的がはっきりした仕事。要約、抽出、分類、ルーティング、そして単純な質問です。

GPT-6 Sol

$2

$10

繰り返し発生する複雑な作業。コードの作成とレビュー、デバッグ、データ分析です。

GPT-6 Astra

$10

$50

最も難しい一発勝負の推論、コンピュータ操作、科学・数学的な作業です。

性能

OpenAIが主張していること、測定したこと

OpenAIはLunaについて2種類の主張をしています。金額に見合う成果と、やらなくなったことです。どちらもベンダー側の数値であり、その旨を明記しています。

1ドルあたりの処理量

LunaについてのOpenAIの目玉の主張は、生のスコアではなくコストで正規化したものです。最大エフォートでは、中程度エフォートのGPT-5.6 Solを約10分の1のタスクコストで上回ります。発表時の報道では、DeepSWE v1.1で66.6%、高エフォートのGPT-5.6 Lunaを5.4ポイント上回り、タスクあたりのコストは58%低いとされています。Lunaが公表しているベンチマークはSolよりはるかに少ないため、本ページではベンチマーク表ではなく、公表された主張をそのまま掲載しています。

モデルが自分のコーディング作業について述べる誤った主張

OpenAIによると、LunaはAstraのアラインメント作業を安いティアに引き継いでおり、自分のコーディング作業について誤った主張をする割合も下がっています。複数の独立した記事で一致している数値はコーディング欺瞞率で、2.8%です。GPT-5.6 Lunaでは9.5%でした。

評価

GPT-5.6 Luna

GPT-6 Luna

コーディング欺瞞率(低いほど良い)

9.5%

2.8%

OpenAI自身のアラインメント評価による数値で、意図的に難しい、主に低リスクのシナリオを本番のセーフガードなしで実行したものです。通常利用時の失敗率を測ったものではないとOpenAIは明言しているため、本番環境の数値ではありません。発表時に別途出た数値は媒体によって報道がばらついていたため、平均せず本ページには掲載していません。

Lunaで動かすもの

OpenAIがこのティアを用意した用途です。呼び出しあたりのコストが、何を作る価値があるかの上限を決めます。

大量の要約

文書、スレッド、文字起こしを1段落に圧縮する用途です。トークン単価が、そもそもその処理を回すかどうかを決めます。

抽出

非構造のテキスト(請求書、出品情報、フォーム)から構造化フィールドを取り出し、パイプラインが扱える形にします。

分類とタグ付け

チケットの振り分け、コンテンツへのラベル付け、コーパス全体へのカテゴリ付与を、安い呼び出し1回ずつでこなします。

ルーティング

リクエストが何で、どこに送るべきかを判断する用途です。小さな判断であり、フラッグシップモデルの呼び出しを消費すべきものではありません。

簡単な質問

プロダクトが画面内でそのまま返す短い事実確認です。深さよりもレイテンシと価格が重視されます。

BatchとFlexの処理

OpenAIはBatchとFlexを標準料金の半額で課金するため、待てる処理ならLunaの入力は100万トークンあたり$0.05になります。

GPT-6 Lunaが動く場所

LunaはOpenAIのメインチャット以外のすべてのサーフェスに加え、同日中に掲載したプラットフォームでも提供されています。FeloではモデルID gpt-6-luna で動作します。

Felo AI Search

gpt-6-lunaとして稼働中で、GPT-6ファミリーの他のモデルと並んで利用できます。

OpenAI API

Chat Completions、Responses、Batchで、モデルIDはgpt-6-lunaです。

ChatGPT WorkとCodex

Plus、Pro、Business、Enterprise、Eduが対象で、Enterpriseでは管理者による有効化が必要です。

FreeとGo

デスクトップアプリから利用でき、ブラウザ版チャットでは使えません。

GitHub Copilot

Pro、Pro+、Max、Business、Enterpriseの各プラン。

Amazon BedrockとOpenRouter

どちらもリリース当日の2026年9月22日にLunaを掲載しました。

Lunaが対応していないもの

Lunaに合わせて実装する前に確認しておく価値があります。OpenAIのモデルページでは、以下がGPT-6 Lunaで未対応とされています。

  • RealtimeとLive API
  • Assistants API
  • ファインチューニング
  • 埋め込み
  • 画像生成と編集
  • 音声・動画・モデレーション

仕様

OpenAIがGPT-6 Lunaについて公表している内容です。

料金

GPT-6 Luna:100万トークンあたり$0.10 / $0.50、キャッシュ入力$0.01、キャッシュ書き込み$0.125。

標準料金です。BatchとFlexは半額、Fast modeは2倍で、入力が272,000トークンを超えるリクエストは全体が入力2倍・出力1.5倍になります。

コンテキストウィンドウ

1,050,000トークンで、最大入力922,000、最大出力128,000です。

GPT-6 Sol、GPT-6 Astraと同じウィンドウですが、標準料金が適用されるのは最初の272,000入力トークンまでです。

知識カットオフ

2026年5月18日で、GPT-6の3モデルの中で最も新しいカットオフです。

モダリティ

入力はテキストと画像、出力はテキストです。

推論エフォート

none、low、medium、high、xhigh、maxに対応し、既定値はmediumです。Chat Completionsでの関数呼び出しにはnoneが必要です。

Batchとリージョン別料金

BatchとFlexは標準の50%で課金されます。リージョン別処理は10%加算され、EUデータレジデンシーにはStandard処理が必要です。

よくある質問

GPT-6 LunaはOpenAIで最も安いGPT-6モデルで、2026年9月22日にGPT-6 Solと同時にリリースされ、SolとフラッグシップのAstraの下に位置づけられています。OpenAIはこれを自社で最も効率的なモデルと説明しており、目的が明確な大量処理、つまり文書の要約、情報の抽出、分類、単純な質問への回答向けに作られています。料金は入力100万トークンあたり$0.10、出力100万トークンあたり$0.50です。

FeloでGPT-6 Lunaを試す

OpenAIで最も安いGPT-6モデル。100万トークンあたり入力$0.10・出力$0.50、キャッシュ読み込み$0.01、ウィンドウは1,050,000トークンです。

Felo AI SearchとFelo APIで利用できます