Dilancarkan 22 September 2026

GPT-6 LunaModel volum tinggi OpenAI pada $0,10

GPT-6 Luna ialah peringkat termurah dalam generasi GPT-6 OpenAI, dilancarkan pada 22 September 2026 bersama GPT-6 Sol. OpenAI meletakkannya untuk kerja volum tinggi dengan sasaran yang jelas: meringkaskan, mengelaskan, mengekstrak dan melakukan penghalaan. Pada $0,10 setiap juta token input, harganya satu per dua puluh GPT-6 Sol dan separuh harga input GPT-5.6 Luna. Ia berjalan di Felo AI Search dan Felo API.

Aktif di OpenAI API sebagai gpt-6-luna sejak 22 September 2026, pada $0,10 / $0,50 setiap juta token — separuh harga input GPT-5.6 Luna.

Dilancarkan 22 September 2026 · Kini tersedia di Felo AI Search dan Felo API

Kad kadar

GPT-6 Luna secara ringkas

ID model
gpt-6-luna
Dilancarkan
22 September 2026
Input
$0,10 setiap juta
Input cache
$0,01 setiap juta
Output
$0,50 setiap juta
Tetingkap konteks
1.050.000 token
Kadar yang disenaraikan ialah harga API standard OpenAI setiap juta token. Bahagian kos di bawah membuat kiranya sendiri daripada empat angka ini, dan menandakan angka mana yang dikira sendiri dan bukan dipetik.

$0,10 / $0,50

Harga input

Setiap juta token, kadar standard.

$0,01

Input cache

Satu persepuluh kadar input, setiap juta token.

1,05M

Tetingkap konteks

Maksimum 922.000 input, 128.000 output.

gpt-6-luna

ID model API

Rentetan yang dihantar dalam medan model.

Ekonomi unit

Berapa kos satu juta token

Hujah Luna ialah aritmetik, bukan kata adjektif. Ini empat kadar yang diterbitkan OpenAI, dan hasilnya pada beban kerja yang jauh lebih banyak membaca daripada menulis.

Kad kadar

Kadar standard setiap juta token, seperti yang diterbitkan.

Input
$0,10
Input cache
$0,01
Penulisan cache
$0,125
Output
$0,50

Input cache dicaj satu persepuluh kadar input. Penulisan cache berharga 1,25 kali bacaan tanpa cache, dan inilah yang menentukan kiraan pulang modal di bawah.

Kos pada beban kerja bercampur

Kebanyakan gesaan jauh lebih banyak membaca daripada menulis, jadi kadar input yang menonjol melebih-lebihkan kos sesuatu beban kerja. Lajur ini menganggap 20 token input bagi setiap token output.

Model

Setiap 1 juta bercampur

berbanding Luna

GPT-6 Luna

$0,12

1x

GPT-5.6 Luna

$0,25

2,1x

GPT-6 Sol

$2,38

20x

GPT-6 Astra

$11,90

100x

Dikira di halaman ini daripada kadar terbitan setiap model pada nisbah input kepada output 20:1; tiada vendor menerbitkan lajur ini. Nisbah lain akan mengalihkan setiap angka — pada 1:1 kadar bercampur Luna ialah $0,30 setiap juta, dan pada 100:1 lebih kurang $0,10.

Kos setiap juta token pada campuran 20:1, berbanding GPT-6 Luna

Kos setiap juta token pada campuran 20:1, berbanding GPT-6 Luna

Setiap bar ialah kos satu juta token bercampur, dibahagi angka Luna sendiri. GPT-5.6 Luna ialah 2,1 kali Luna, GPT-6 Sol 20 kali, dan GPT-6 Astra 100 kali. Dikira daripada kadar terbitan OpenAI; bar bermula dari sifar.

Sumber: dikira daripada harga OpenAI API untuk keluarga GPT-6, September 2026

Harga setiap juta token, keluarga GPT-6 dan GPT-5.6 Luna

Harga setiap juta token, keluarga GPT-6 dan GPT-5.6 Luna

Kadar input dan output setiap juta token. GPT-6 Luna $0,10 input dan $0,50 output; GPT-5.6 Luna $0,20 dan $1,20; GPT-6 Sol $2 dan $10; GPT-6 Astra $10 dan $50. Bar bermula dari sifar.

Sumber: harga OpenAI API, September 2026

Konteks panjang

Batas harga 272.000 token

Permintaan yang melebihi 272.000 token input dicaj pada kadar konteks panjang untuk keseluruhan permintaan, bukan hanya token yang melepasi garis itu. Ambang itu terletak pada 26% daripada tetingkap yang diiklankan Luna.

Kadar

Standard

Melebihi 272.000

Perubahan

Input

$0,10

$0,20

2x

Input cache

$0,01

$0,02

2x

Output

$0,50

$0,75

1,5x

Mengapa ini jurang, bukan cerun

Pada 272.000 token input, satu permintaan dicaj $0,0272. Tambah satu token lagi dan keseluruhan permintaan dikira semula: 272.001 token pada $0,20 setiap juta ialah $0,0544, jadi satu token tambahan menambah $0,0272 pada bil. 272.000 token yang sama, dipecahkan kepada dua panggilan yang masing-masing kekal di bawah ambang, berharga $0,0272.

Apa yang perlu dilakukan

Pastikan input satu permintaan kekal di bawah 272.000 token dan kadar standard terpakai. Retrieval yang memulangkan 200.000 token, atau proses pemotongan yang membahagi dokumen panjang, kekal dalam peringkat murah; satu panggilan yang membawa keseluruhan tetingkap tidak. Peringkat murah ini merangkumi kira-kira suku pertama konteks yang diiklankan.

Di mana kadar standard berakhir dalam tetingkap konteks GPT-6 Luna

Di mana kadar standard berakhir dalam tetingkap konteks GPT-6 Luna

Tetingkapnya 1.050.000 token. Kadar standard terpakai sehingga 272.000 token input, kira-kira 26% daripadanya; apa-apa di atas itu dicaj 2x input dan 1,5x output, dan keseluruhan permintaan dikira semula sebaik garis itu dilepasi.

Sumber: halaman model GPT-6 Luna OpenAI, klausa harga konteks panjang, September 2026

Cache gesaan

Bila cache berbaloi

Cache ialah pertaruhan: anda membayar 1,25 kali kadar input sekali untuk menulis awalan, kemudian satu persepuluhnya pada setiap bacaan selepas itu. Pada kadar Luna, pertaruhan itu berbaloi pada panggilan kedua.

Penulisan berharga suku lebih

Permintaan pertama yang menulis awalan dicaj $0,125 setiap juta token dan bukan $0,10 — 25% lebih daripada menghantar teks yang sama tanpa cache.

Bacaan berharga satu persepuluh

Setiap permintaan kemudian yang mengenai cache dicaj $0,01 setiap juta, menjimatkan $0,09 berbanding kadar tanpa cache setiap kali.

Pulang modal pada panggilan kedua

Satu penulisan campur satu bacaan ialah $0,135 setiap juta, berbanding $0,20 untuk dua permintaan tanpa cache. Menjelang ulangan keseratus, laluan cache berharga kira-kira 11% daripada menghantar awalan yang sama dari awal.

Kos terkumpul mengulang awalan yang sama, dengan cache berbanding tanpa cache

Kos terkumpul mengulang awalan yang sama, dengan cache berbanding tanpa cache

Kos setiap juta token bagi awalan yang diulang sepanjang 100 permintaan. Menghantarnya baru setiap kali berharga $10,00; menyimpannya dalam cache berharga $1,115. Kedua-dua garis bersilang antara permintaan pertama dan kedua.

Sumber: dikira daripada kadar penulisan cache dan input cache yang diterbitkan OpenAI untuk GPT-6 Luna, September 2026

Tahap penaakulan

Tuas lain pada bil

Luna menerima keseluruhan skala tahap penaakulan enam langkah OpenAI, dan tetapan itu menentukan berapa token penaakulan yang dibelanjakan sesuatu panggilan. Medium ialah tetapan lalai.

none

panggilan fungsi

low

 

medium

lalai

high

 

xhigh

 

max

 

Enam tetapan, satu lalai

Luna menerima none, low, medium, high, xhigh dan max. Token penaakulan dicaj sebagai output, jadi tetapan ini ialah tuas kos dan juga tuas kualiti: semakin tinggi tahapnya, semakin banyak model berbelanja sebelum ia menjawab.

Panggilan alat perlukan none pada Chat Completions

Pada Chat Completions API, permintaan yang memanggil alat hanya diproses apabila tahap penaakulan ialah none. Untuk alat terbina dalam dan panggilan fungsi, OpenAI merujuk kepada Responses API, tempat skala tahap itu tersedia bersama alat. Elok diperiksa endpoint mana yang digunakan sesuatu integrasi sebelum menetapkan tuas ini.

Kedudukan Luna dalam keluarga GPT-6

Tiga peringkat, satu tugas masing-masing. Yang memudahkan keputusan penghalaan ialah satu per dua puluh kadar Sol.

Model

Input

Output

Untuk apa

GPT-6 Luna

$0,10

$0,50

Kerja volum tinggi dengan skop ketat: meringkaskan, mengekstrak, mengelaskan, menghalakan dan soalan mudah.

GPT-6 Sol

$2

$10

Kerja kompleks yang berulang: menulis dan menyemak kod, menyahpepijat dan analisis data.

GPT-6 Astra

$10

$50

Penaakulan sekali jalan yang paling sukar, penggunaan komputer, dan kerja saintifik atau matematik.

Prestasi

Apa yang OpenAI dakwa, dan apa yang ia ukur

OpenAI membuat dua jenis dakwaan tentang Luna: apa yang ia lakukan untuk wang tersebut, dan apa yang ia berhenti lakukan. Kedua-duanya angka vendor, dan kedua-duanya ditandakan sedemikian.

Kerja setiap dolar

Dakwaan utama OpenAI untuk Luna dinormalkan kepada kos dan bukan skor mentah: pada tahap penaakulan maksimum, ia melebihi GPT-5.6 Sol pada tahap medium dengan kos tugasan kira-kira satu persepuluhnya. Liputan pelancaran juga melaporkan 66,6% pada DeepSWE v1.1, 5,4 mata di atas GPT-5.6 Luna pada tahap tinggi dengan kos setiap tugasan 58% lebih rendah. Luna menerbitkan angka pada jauh lebih sedikit penanda aras daripada Sol, jadi halaman ini memuatkan dakwaan itu dan bukan jadual penanda aras.

Dakwaan mengelirukan tentang kerja pengekodan

OpenAI melaporkan bahawa Luna membawa kerja penjajaran Astra turun ke peringkat murah, termasuk kadar lebih rendah bagi dakwaan mengelirukan tentang kerja pengekodannya sendiri. Angka yang dipersetujui beberapa tulisan bebas ialah kadar penipuan pengekodan: 2,8%, daripada 9,5% pada GPT-5.6 Luna.

Penilaian

GPT-5.6 Luna

GPT-6 Luna

Kadar penipuan pengekodan (lebih rendah lebih baik)

9,5%

2,8%

Penilaian penjajaran OpenAI sendiri, dijalankan pada senario yang sengaja sukar dan kebanyakannya berisiko rendah tanpa perlindungan produksi. OpenAI menyatakan penilaian ini tidak mengukur kadar kegagalan dalam penggunaan biasa, jadi ini bukan kadar produksi. Angka pelancaran kedua yang dilaporkan media secara tidak konsisten tidak dimuatkan di halaman ini dan tidak juga dipuratakan.

Apa yang patut dijalankan pada Luna

Kerja yang menjadi sebab OpenAI membina peringkat ini, tempat kos setiap panggilan menetapkan siling pada apa yang berbaloi dibina.

Meringkaskan secara pukal

Dokumen, urutan dan transkrip dipadatkan menjadi satu perenggan, tempat harga setiap token menentukan sama ada kerja itu berjalan langsung.

Pengekstrakan

Menarik medan berstruktur keluar daripada teks tidak berstruktur — invois, senarai, borang — ke bentuk yang boleh digunakan saluran paip.

Pengelasan dan pelabelan

Menyusun tiket, melabel kandungan dan menggunakan kategori merentas korpus, satu panggilan murah pada satu masa.

Penghalaan

Menentukan apa sesuatu permintaan itu dan ke mana ia patut pergi — keputusan kecil yang tidak sepatutnya memakan satu panggilan model perdana.

Soalan pantas

Carian fakta pendek yang dijawab sesuatu produk terus di tempatnya, tempat kependaman dan harga lebih penting daripada kedalaman.

Kerja Batch dan Flex

OpenAI mengenakan Batch dan Flex pada separuh kadar standard, menjadikan input Luna $0,05 setiap juta untuk apa-apa yang boleh menunggu.

Di mana GPT-6 Luna berjalan

Luna dilancarkan merentas setiap permukaan OpenAI kecuali sembang utamanya, serta platform yang menyenaraikannya pada hari yang sama. Di Felo, ia berjalan dengan ID model gpt-6-luna.

Felo AI Search

Aktif sebagai gpt-6-luna, bersama seluruh keluarga GPT-6 yang lain.

OpenAI API

Chat Completions, Responses dan Batch, sebagai gpt-6-luna.

ChatGPT Work dan Codex

Plus, Pro, Business, Enterprise dan Edu, dengan pengaktifan oleh pentadbir pada Enterprise.

Free dan Go

Boleh dicapai dalam aplikasi desktop, bukan dalam sembang pelayar.

GitHub Copilot

Pelan Pro, Pro+, Max, Business dan Enterprise.

Amazon Bedrock dan OpenRouter

Kedua-duanya menyenaraikan Luna pada 22 September 2026, hari ia dilancarkan.

Apa yang tidak disokong Luna

Elok diperiksa sebelum membina di atasnya. Halaman model OpenAI menyenaraikan perkara ini sebagai tidak disokong pada GPT-6 Luna.

  • API Realtime dan Live
  • Assistants API
  • Penalaan halus
  • Embeddings
  • Penjanaan dan penyuntingan imej
  • Audio, video dan moderasi

Spesifikasi

Apa yang OpenAI telah terbitkan untuk GPT-6 Luna.

Harga

GPT-6 Luna: $0,10 / $0,50 setiap juta token, dengan input cache $0,01 dan penulisan cache $0,125.

Kadar standard. Batch dan Flex dicaj separuh harga, Fast mode dua kali ganda, dan permintaan melebihi 272.000 token input membayar 2x input dan 1,5x output untuk keseluruhan permintaan.

Tetingkap konteks

1.050.000 token, dengan input maksimum 922.000 dan output maksimum 128.000.

Tetingkap yang sama dengan GPT-6 Sol dan GPT-6 Astra, tetapi kadar standard hanya merangkumi 272.000 token input pertama.

Tarikh pengetahuan

18 Mei 2026, tarikh pengetahuan terbaru antara ketiga-tiga model GPT-6.

Modaliti

Teks dan imej masuk, teks keluar.

Tahap penaakulan

None, low, medium, high, xhigh dan max, dengan medium sebagai lalai. Panggilan fungsi pada Chat Completions memerlukan none.

Harga Batch dan serantau

Batch dan Flex dicaj 50% daripada standard. Pemprosesan serantau menambah 10%, dan kediaman data EU memerlukan pemprosesan Standard.

Soalan lazim

GPT-6 Luna ialah model GPT-6 termurah OpenAI, dilancarkan pada 22 September 2026 bersama GPT-6 Sol dan diletakkan di bawah Sol serta perdana Astra. OpenAI menggambarkannya sebagai modelnya yang paling cekap, dibina untuk tugasan volum tinggi dengan sasaran yang jelas: meringkaskan dokumen, mengekstrak maklumat, mengelaskan dan menjawab soalan mudah. Harganya $0,10 setiap juta token input dan $0,50 setiap juta token output.

Cuba GPT-6 Luna di Felo

Model GPT-6 termurah OpenAI: $0,10 input dan $0,50 output setiap juta token, bacaan cache $0,01, dan tetingkap 1.050.000 token.

Tersedia di Felo AI Search dan Felo API