GPT-6 LunaModel volum tinggi OpenAI pada $0,10
GPT-6 Luna ialah peringkat termurah dalam generasi GPT-6 OpenAI, dilancarkan pada 22 September 2026 bersama GPT-6 Sol. OpenAI meletakkannya untuk kerja volum tinggi dengan sasaran yang jelas: meringkaskan, mengelaskan, mengekstrak dan melakukan penghalaan. Pada $0,10 setiap juta token input, harganya satu per dua puluh GPT-6 Sol dan separuh harga input GPT-5.6 Luna. Ia berjalan di Felo AI Search dan Felo API.
Aktif di OpenAI API sebagai gpt-6-luna sejak 22 September 2026, pada $0,10 / $0,50 setiap juta token — separuh harga input GPT-5.6 Luna.
Dilancarkan 22 September 2026 · Kini tersedia di Felo AI Search dan Felo API
Kad kadar
GPT-6 Luna secara ringkas
- ID model
- gpt-6-luna
- Dilancarkan
- 22 September 2026
- Input
- $0,10 setiap juta
- Input cache
- $0,01 setiap juta
- Output
- $0,50 setiap juta
- Tetingkap konteks
- 1.050.000 token
$0,10 / $0,50
Harga input
Setiap juta token, kadar standard.
$0,01
Input cache
Satu persepuluh kadar input, setiap juta token.
1,05M
Tetingkap konteks
Maksimum 922.000 input, 128.000 output.
gpt-6-luna
ID model API
Rentetan yang dihantar dalam medan model.
Berapa kos satu juta token
Hujah Luna ialah aritmetik, bukan kata adjektif. Ini empat kadar yang diterbitkan OpenAI, dan hasilnya pada beban kerja yang jauh lebih banyak membaca daripada menulis.
Kad kadar
Kadar standard setiap juta token, seperti yang diterbitkan.
- Input
- $0,10
- Input cache
- $0,01
- Penulisan cache
- $0,125
- Output
- $0,50
Input cache dicaj satu persepuluh kadar input. Penulisan cache berharga 1,25 kali bacaan tanpa cache, dan inilah yang menentukan kiraan pulang modal di bawah.
Kos pada beban kerja bercampur
Kebanyakan gesaan jauh lebih banyak membaca daripada menulis, jadi kadar input yang menonjol melebih-lebihkan kos sesuatu beban kerja. Lajur ini menganggap 20 token input bagi setiap token output.
Model
Setiap 1 juta bercampur
berbanding Luna
GPT-6 Luna
$0,12
1x
GPT-5.6 Luna
$0,25
2,1x
GPT-6 Sol
$2,38
20x
GPT-6 Astra
$11,90
100x
Dikira di halaman ini daripada kadar terbitan setiap model pada nisbah input kepada output 20:1; tiada vendor menerbitkan lajur ini. Nisbah lain akan mengalihkan setiap angka — pada 1:1 kadar bercampur Luna ialah $0,30 setiap juta, dan pada 100:1 lebih kurang $0,10.

Kos setiap juta token pada campuran 20:1, berbanding GPT-6 Luna
Setiap bar ialah kos satu juta token bercampur, dibahagi angka Luna sendiri. GPT-5.6 Luna ialah 2,1 kali Luna, GPT-6 Sol 20 kali, dan GPT-6 Astra 100 kali. Dikira daripada kadar terbitan OpenAI; bar bermula dari sifar.
Sumber: dikira daripada harga OpenAI API untuk keluarga GPT-6, September 2026

Harga setiap juta token, keluarga GPT-6 dan GPT-5.6 Luna
Kadar input dan output setiap juta token. GPT-6 Luna $0,10 input dan $0,50 output; GPT-5.6 Luna $0,20 dan $1,20; GPT-6 Sol $2 dan $10; GPT-6 Astra $10 dan $50. Bar bermula dari sifar.
Sumber: harga OpenAI API, September 2026
Batas harga 272.000 token
Permintaan yang melebihi 272.000 token input dicaj pada kadar konteks panjang untuk keseluruhan permintaan, bukan hanya token yang melepasi garis itu. Ambang itu terletak pada 26% daripada tetingkap yang diiklankan Luna.
Kadar
Standard
Melebihi 272.000
Perubahan
Input
$0,10
$0,20
2x
Input cache
$0,01
$0,02
2x
Output
$0,50
$0,75
1,5x
Mengapa ini jurang, bukan cerun
Pada 272.000 token input, satu permintaan dicaj $0,0272. Tambah satu token lagi dan keseluruhan permintaan dikira semula: 272.001 token pada $0,20 setiap juta ialah $0,0544, jadi satu token tambahan menambah $0,0272 pada bil. 272.000 token yang sama, dipecahkan kepada dua panggilan yang masing-masing kekal di bawah ambang, berharga $0,0272.
Apa yang perlu dilakukan
Pastikan input satu permintaan kekal di bawah 272.000 token dan kadar standard terpakai. Retrieval yang memulangkan 200.000 token, atau proses pemotongan yang membahagi dokumen panjang, kekal dalam peringkat murah; satu panggilan yang membawa keseluruhan tetingkap tidak. Peringkat murah ini merangkumi kira-kira suku pertama konteks yang diiklankan.

Di mana kadar standard berakhir dalam tetingkap konteks GPT-6 Luna
Tetingkapnya 1.050.000 token. Kadar standard terpakai sehingga 272.000 token input, kira-kira 26% daripadanya; apa-apa di atas itu dicaj 2x input dan 1,5x output, dan keseluruhan permintaan dikira semula sebaik garis itu dilepasi.
Sumber: halaman model GPT-6 Luna OpenAI, klausa harga konteks panjang, September 2026
Bila cache berbaloi
Cache ialah pertaruhan: anda membayar 1,25 kali kadar input sekali untuk menulis awalan, kemudian satu persepuluhnya pada setiap bacaan selepas itu. Pada kadar Luna, pertaruhan itu berbaloi pada panggilan kedua.
Penulisan berharga suku lebih
Permintaan pertama yang menulis awalan dicaj $0,125 setiap juta token dan bukan $0,10 — 25% lebih daripada menghantar teks yang sama tanpa cache.
Bacaan berharga satu persepuluh
Setiap permintaan kemudian yang mengenai cache dicaj $0,01 setiap juta, menjimatkan $0,09 berbanding kadar tanpa cache setiap kali.
Pulang modal pada panggilan kedua
Satu penulisan campur satu bacaan ialah $0,135 setiap juta, berbanding $0,20 untuk dua permintaan tanpa cache. Menjelang ulangan keseratus, laluan cache berharga kira-kira 11% daripada menghantar awalan yang sama dari awal.

Kos terkumpul mengulang awalan yang sama, dengan cache berbanding tanpa cache
Kos setiap juta token bagi awalan yang diulang sepanjang 100 permintaan. Menghantarnya baru setiap kali berharga $10,00; menyimpannya dalam cache berharga $1,115. Kedua-dua garis bersilang antara permintaan pertama dan kedua.
Sumber: dikira daripada kadar penulisan cache dan input cache yang diterbitkan OpenAI untuk GPT-6 Luna, September 2026
Tuas lain pada bil
Luna menerima keseluruhan skala tahap penaakulan enam langkah OpenAI, dan tetapan itu menentukan berapa token penaakulan yang dibelanjakan sesuatu panggilan. Medium ialah tetapan lalai.
none
panggilan fungsi
low
medium
lalai
high
xhigh
max
Enam tetapan, satu lalai
Luna menerima none, low, medium, high, xhigh dan max. Token penaakulan dicaj sebagai output, jadi tetapan ini ialah tuas kos dan juga tuas kualiti: semakin tinggi tahapnya, semakin banyak model berbelanja sebelum ia menjawab.
Panggilan alat perlukan none pada Chat Completions
Pada Chat Completions API, permintaan yang memanggil alat hanya diproses apabila tahap penaakulan ialah none. Untuk alat terbina dalam dan panggilan fungsi, OpenAI merujuk kepada Responses API, tempat skala tahap itu tersedia bersama alat. Elok diperiksa endpoint mana yang digunakan sesuatu integrasi sebelum menetapkan tuas ini.
Kedudukan Luna dalam keluarga GPT-6
Tiga peringkat, satu tugas masing-masing. Yang memudahkan keputusan penghalaan ialah satu per dua puluh kadar Sol.
Model
Input
Output
Untuk apa
GPT-6 Luna
$0,10
$0,50
Kerja volum tinggi dengan skop ketat: meringkaskan, mengekstrak, mengelaskan, menghalakan dan soalan mudah.
GPT-6 Sol
$2
$10
Kerja kompleks yang berulang: menulis dan menyemak kod, menyahpepijat dan analisis data.
GPT-6 Astra
$10
$50
Penaakulan sekali jalan yang paling sukar, penggunaan komputer, dan kerja saintifik atau matematik.
Apa yang OpenAI dakwa, dan apa yang ia ukur
OpenAI membuat dua jenis dakwaan tentang Luna: apa yang ia lakukan untuk wang tersebut, dan apa yang ia berhenti lakukan. Kedua-duanya angka vendor, dan kedua-duanya ditandakan sedemikian.
Kerja setiap dolar
Dakwaan utama OpenAI untuk Luna dinormalkan kepada kos dan bukan skor mentah: pada tahap penaakulan maksimum, ia melebihi GPT-5.6 Sol pada tahap medium dengan kos tugasan kira-kira satu persepuluhnya. Liputan pelancaran juga melaporkan 66,6% pada DeepSWE v1.1, 5,4 mata di atas GPT-5.6 Luna pada tahap tinggi dengan kos setiap tugasan 58% lebih rendah. Luna menerbitkan angka pada jauh lebih sedikit penanda aras daripada Sol, jadi halaman ini memuatkan dakwaan itu dan bukan jadual penanda aras.
Dakwaan mengelirukan tentang kerja pengekodan
OpenAI melaporkan bahawa Luna membawa kerja penjajaran Astra turun ke peringkat murah, termasuk kadar lebih rendah bagi dakwaan mengelirukan tentang kerja pengekodannya sendiri. Angka yang dipersetujui beberapa tulisan bebas ialah kadar penipuan pengekodan: 2,8%, daripada 9,5% pada GPT-5.6 Luna.
Penilaian
GPT-5.6 Luna
GPT-6 Luna
Kadar penipuan pengekodan (lebih rendah lebih baik)
9,5%
2,8%
Penilaian penjajaran OpenAI sendiri, dijalankan pada senario yang sengaja sukar dan kebanyakannya berisiko rendah tanpa perlindungan produksi. OpenAI menyatakan penilaian ini tidak mengukur kadar kegagalan dalam penggunaan biasa, jadi ini bukan kadar produksi. Angka pelancaran kedua yang dilaporkan media secara tidak konsisten tidak dimuatkan di halaman ini dan tidak juga dipuratakan.
Apa yang patut dijalankan pada Luna
Kerja yang menjadi sebab OpenAI membina peringkat ini, tempat kos setiap panggilan menetapkan siling pada apa yang berbaloi dibina.
Meringkaskan secara pukal
Dokumen, urutan dan transkrip dipadatkan menjadi satu perenggan, tempat harga setiap token menentukan sama ada kerja itu berjalan langsung.
Pengekstrakan
Menarik medan berstruktur keluar daripada teks tidak berstruktur — invois, senarai, borang — ke bentuk yang boleh digunakan saluran paip.
Pengelasan dan pelabelan
Menyusun tiket, melabel kandungan dan menggunakan kategori merentas korpus, satu panggilan murah pada satu masa.
Penghalaan
Menentukan apa sesuatu permintaan itu dan ke mana ia patut pergi — keputusan kecil yang tidak sepatutnya memakan satu panggilan model perdana.
Soalan pantas
Carian fakta pendek yang dijawab sesuatu produk terus di tempatnya, tempat kependaman dan harga lebih penting daripada kedalaman.
Kerja Batch dan Flex
OpenAI mengenakan Batch dan Flex pada separuh kadar standard, menjadikan input Luna $0,05 setiap juta untuk apa-apa yang boleh menunggu.
Di mana GPT-6 Luna berjalan
Luna dilancarkan merentas setiap permukaan OpenAI kecuali sembang utamanya, serta platform yang menyenaraikannya pada hari yang sama. Di Felo, ia berjalan dengan ID model gpt-6-luna.
Felo AI Search
Aktif sebagai gpt-6-luna, bersama seluruh keluarga GPT-6 yang lain.
OpenAI API
Chat Completions, Responses dan Batch, sebagai gpt-6-luna.
ChatGPT Work dan Codex
Plus, Pro, Business, Enterprise dan Edu, dengan pengaktifan oleh pentadbir pada Enterprise.
Free dan Go
Boleh dicapai dalam aplikasi desktop, bukan dalam sembang pelayar.
GitHub Copilot
Pelan Pro, Pro+, Max, Business dan Enterprise.
Amazon Bedrock dan OpenRouter
Kedua-duanya menyenaraikan Luna pada 22 September 2026, hari ia dilancarkan.
Apa yang tidak disokong Luna
Elok diperiksa sebelum membina di atasnya. Halaman model OpenAI menyenaraikan perkara ini sebagai tidak disokong pada GPT-6 Luna.
- API Realtime dan Live
- Assistants API
- Penalaan halus
- Embeddings
- Penjanaan dan penyuntingan imej
- Audio, video dan moderasi
Spesifikasi
Apa yang OpenAI telah terbitkan untuk GPT-6 Luna.
Harga
GPT-6 Luna: $0,10 / $0,50 setiap juta token, dengan input cache $0,01 dan penulisan cache $0,125.
Kadar standard. Batch dan Flex dicaj separuh harga, Fast mode dua kali ganda, dan permintaan melebihi 272.000 token input membayar 2x input dan 1,5x output untuk keseluruhan permintaan.
Tetingkap konteks
1.050.000 token, dengan input maksimum 922.000 dan output maksimum 128.000.
Tetingkap yang sama dengan GPT-6 Sol dan GPT-6 Astra, tetapi kadar standard hanya merangkumi 272.000 token input pertama.
Tarikh pengetahuan
18 Mei 2026, tarikh pengetahuan terbaru antara ketiga-tiga model GPT-6.
Modaliti
Teks dan imej masuk, teks keluar.
Tahap penaakulan
None, low, medium, high, xhigh dan max, dengan medium sebagai lalai. Panggilan fungsi pada Chat Completions memerlukan none.
Harga Batch dan serantau
Batch dan Flex dicaj 50% daripada standard. Pemprosesan serantau menambah 10%, dan kediaman data EU memerlukan pemprosesan Standard.
Soalan lazim
GPT-6 Luna ialah model GPT-6 termurah OpenAI, dilancarkan pada 22 September 2026 bersama GPT-6 Sol dan diletakkan di bawah Sol serta perdana Astra. OpenAI menggambarkannya sebagai modelnya yang paling cekap, dibina untuk tugasan volum tinggi dengan sasaran yang jelas: meringkaskan dokumen, mengekstrak maklumat, mengelaskan dan menjawab soalan mudah. Harganya $0,10 setiap juta token input dan $0,50 setiap juta token output.
Cuba GPT-6 Luna di Felo
Model GPT-6 termurah OpenAI: $0,10 input dan $0,50 output setiap juta token, bacaan cache $0,01, dan tetingkap 1.050.000 token.
Tersedia di Felo AI Search dan Felo API



