GPT-6 LunaModel bervolume tinggi OpenAI seharga $0,10
GPT-6 Luna adalah tingkat termurah dari generasi GPT-6 OpenAI, dirilis 22 September 2026 bersama GPT-6 Sol. OpenAI memosisikannya untuk pekerjaan bervolume tinggi dengan sasaran yang jelas: meringkas, mengklasifikasi, mengekstrak, dan merutekan. Pada $0,10 per juta token input, harganya satu per dua puluh GPT-6 Sol dan separuh harga input GPT-5.6 Luna. Model ini berjalan di Felo AI Search dan Felo API.
Aktif di OpenAI API sebagai gpt-6-luna sejak 22 September 2026, pada $0,10 / $0,50 per juta token — separuh harga input GPT-5.6 Luna.
Dirilis 22 September 2026 · Kini tersedia di Felo AI Search dan Felo API
Kartu tarif
GPT-6 Luna sekilas
- ID model
- gpt-6-luna
- Dirilis
- 22 September 2026
- Input
- $0,10 per juta
- Input cache
- $0,01 per juta
- Output
- $0,50 per juta
- Jendela konteks
- 1.050.000 token
$0,10 / $0,50
Harga input
Per juta token, tarif standar.
$0,01
Input cache
Sepersepuluh dari tarif input, per juta token.
1,05M
Jendela konteks
Maksimum 922.000 input, 128.000 output.
gpt-6-luna
ID model API
String yang dikirim di kolom model.
Berapa biaya satu juta token
Argumen Luna adalah aritmetika, bukan kata sifat. Berikut empat tarif yang diterbitkan OpenAI, dan hasilnya pada beban kerja yang jauh lebih banyak membaca daripada menulis.
Kartu tarif
Tarif standar per juta token, sesuai yang diterbitkan.
- Input
- $0,10
- Input cache
- $0,01
- Penulisan cache
- $0,125
- Output
- $0,50
Input cache ditagih sepersepuluh dari tarif input. Penulisan cache berharga 1,25 kali pembacaan tanpa cache, dan itulah yang menentukan hasil hitungan balik modal di bawah.
Biaya pada beban kerja campuran
Sebagian besar prompt jauh lebih banyak membaca daripada menulis, sehingga tarif input yang menonjol melebih-lebihkan biaya sebuah beban kerja. Kolom ini mengasumsikan 20 token input untuk setiap token output.
Model
Per 1 juta (campuran)
vs. Luna
GPT-6 Luna
$0,12
1x
GPT-5.6 Luna
$0,25
2,1x
GPT-6 Sol
$2,38
20x
GPT-6 Astra
$11,90
100x
Dihitung di halaman ini dari tarif terbitan tiap model pada rasio input terhadap output 20:1; tidak ada vendor yang menerbitkan kolom ini. Rasio lain akan menggeser semua angka — pada 1:1 tarif campuran Luna adalah $0,30 per juta, dan pada 100:1 sekitar $0,10.

Biaya per juta token pada campuran 20:1, relatif terhadap GPT-6 Luna
Setiap batang adalah biaya satu juta token campuran, dibagi angka Luna sendiri. GPT-5.6 Luna adalah 2,1 kali Luna, GPT-6 Sol 20 kali, dan GPT-6 Astra 100 kali. Dihitung dari tarif terbitan OpenAI; batang dimulai dari nol.
Sumber: dihitung dari harga OpenAI API untuk keluarga GPT-6, September 2026

Harga per juta token, keluarga GPT-6 dan GPT-5.6 Luna
Tarif input dan output per juta token. GPT-6 Luna $0,10 input dan $0,50 output; GPT-5.6 Luna $0,20 dan $1,20; GPT-6 Sol $2 dan $10; GPT-6 Astra $10 dan $50. Batang dimulai dari nol.
Sumber: harga OpenAI API, September 2026
Batas harga 272.000 token
Permintaan yang melewati 272.000 token input ditagih dengan tarif konteks panjang untuk seluruh permintaan, bukan hanya untuk token yang melewati batas. Ambang itu jatuh pada 26% dari jendela yang diiklankan Luna.
Tarif
Standar
Di atas 272.000
Perubahan
Input
$0,10
$0,20
2x
Input cache
$0,01
$0,02
2x
Output
$0,50
$0,75
1,5x
Mengapa ini jurang, bukan lereng
Pada 272.000 token input, satu permintaan ditagih $0,0272. Tambahkan satu token lagi dan seluruh permintaan dihitung ulang: 272.001 token pada $0,20 per juta menjadi $0,0544, jadi satu token tambahan menambah $0,0272 pada tagihan. 272.000 token yang sama, dipecah menjadi dua panggilan yang masing-masing tetap di bawah ambang, berbiaya $0,0272.
Apa yang perlu dilakukan
Jaga input satu permintaan tetap di bawah 272.000 token dan tarif standar berlaku. Retrieval yang mengembalikan 200.000 token, atau tahap pemotongan yang membagi dokumen panjang, tetap berada di tingkat murah; satu panggilan yang membawa seluruh jendela tidak. Tingkat murah ini mencakup kira-kira seperempat pertama dari konteks yang diiklankan.

Di mana tarif standar berakhir di jendela konteks GPT-6 Luna
Jendelanya 1.050.000 token. Tarif standar berlaku sampai 272.000 token input, sekitar 26% darinya; di atas itu ditagih 2x input dan 1,5x output, dan seluruh permintaan dihitung ulang begitu garis itu dilewati.
Sumber: halaman model GPT-6 Luna OpenAI, klausul harga konteks panjang, September 2026
Kapan cache balik modal
Cache adalah taruhan: Anda membayar 1,25 kali tarif input sekali untuk menulis prefiks, lalu sepersepuluhnya pada setiap pembacaan setelahnya. Dengan tarif Luna, taruhan itu balik modal pada panggilan kedua.
Penulisan berbiaya seperempat lebih
Permintaan pertama yang menulis prefiks ditagih $0,125 per juta token, bukan $0,10 — 25% lebih banyak daripada mengirim teks yang sama tanpa cache.
Pembacaan berbiaya sepersepuluh
Setiap permintaan berikutnya yang mengenai cache ditagih $0,01 per juta, menghemat $0,09 dibandingkan tarif tanpa cache setiap kali.
Balik modal pada panggilan kedua
Satu penulisan ditambah satu pembacaan adalah $0,135 per juta, dibandingkan $0,20 untuk dua permintaan tanpa cache. Pada pengulangan ke-100, jalur cache berbiaya sekitar 11% dari mengirim prefiks yang sama dari awal.

Biaya kumulatif mengulang prefiks yang sama, dengan cache dan tanpa cache
Biaya per juta token untuk prefiks yang diulang sebanyak 100 permintaan. Mengirimnya baru setiap kali berbiaya $10,00; menyimpannya di cache berbiaya $1,115. Kedua garis bersilangan antara permintaan pertama dan kedua.
Sumber: dihitung dari tarif penulisan cache dan input cache yang diterbitkan OpenAI untuk GPT-6 Luna, September 2026
Tuas lain pada tagihan
Luna menerima seluruh skala tingkat penalaran enam langkah milik OpenAI, dan pengaturannya menentukan berapa token penalaran yang dihabiskan sebuah panggilan. Medium adalah bawaannya.
none
pemanggilan fungsi
low
medium
bawaan
high
xhigh
max
Enam pengaturan, satu bawaan
Luna menerima none, low, medium, high, xhigh, dan max. Token penalaran ditagih sebagai output, jadi pengaturan ini adalah tuas biaya sekaligus tuas kualitas: makin tinggi tingkatnya, makin banyak yang dihabiskan model sebelum menjawab.
Pemanggilan alat butuh none di Chat Completions
Di Chat Completions API, permintaan yang memanggil alat hanya ditangani bila tingkat penalaran adalah none. Untuk alat bawaan dan pemanggilan fungsi, OpenAI mengarahkan ke Responses API, tempat skala tingkat penalaran tersedia berdampingan dengan alat. Sebaiknya periksa endpoint mana yang dipakai sebuah integrasi sebelum menyetel tuas ini.
Posisi Luna dalam keluarga GPT-6
Tiga tingkat, satu tugas masing-masing. Yang membuat keputusan perutean jadi mudah adalah satu per dua puluh tarif Sol.
Model
Input
Output
Untuk apa
GPT-6 Luna
$0,10
$0,50
Pekerjaan bervolume tinggi dengan batas jelas: meringkas, mengekstrak, mengklasifikasi, merutekan, dan pertanyaan lugas.
GPT-6 Sol
$2
$10
Pekerjaan kompleks yang berulang: menulis dan meninjau kode, men-debug, dan analisis data.
GPT-6 Astra
$10
$50
Penalaran sekali jalan tersulit, penggunaan komputer, dan pekerjaan ilmiah atau matematis.
Apa yang diklaim OpenAI, dan apa yang diukurnya
OpenAI membuat dua jenis klaim tentang Luna: apa yang bisa dilakukannya untuk uang sebesar itu, dan apa yang tidak lagi dilakukannya. Keduanya angka vendor, dan keduanya ditandai demikian.
Pekerjaan per dolar
Klaim utama OpenAI untuk Luna dinormalkan terhadap biaya, bukan skor mentah: pada tingkat penalaran maksimum, model ini melampaui GPT-5.6 Sol pada tingkat medium dengan biaya tugas sekitar sepersepuluhnya. Liputan peluncuran juga melaporkan 66,6% pada DeepSWE v1.1, 5,4 poin di atas GPT-5.6 Luna pada tingkat tinggi dengan biaya per tugas 58% lebih rendah. Luna menerbitkan angka di jauh lebih sedikit benchmark daripada Sol, jadi halaman ini memuat klaimnya alih-alih tabel benchmark.
Klaim menyesatkan soal pekerjaan coding
OpenAI melaporkan bahwa Luna membawa pekerjaan alignment Astra turun ke tingkat murah, termasuk laju klaim menyesatkan yang lebih rendah soal pekerjaan coding-nya sendiri. Angka yang disepakati beberapa tulisan independen adalah laju penipuan coding: 2,8%, dari 9,5% di GPT-5.6 Luna.
Evaluasi
GPT-5.6 Luna
GPT-6 Luna
Laju penipuan coding (lebih rendah lebih baik)
9,5%
2,8%
Evaluasi alignment OpenAI sendiri, dijalankan pada skenario yang sengaja dibuat sulit dan sebagian besar berisiko rendah, tanpa pengaman produksi. OpenAI menyatakan evaluasi ini tidak mengukur laju kegagalan pada pemakaian biasa, jadi ini bukan angka produksi. Angka peluncuran kedua yang dilaporkan media secara tidak konsisten tidak dimuat di halaman ini alih-alih dirata-ratakan.
Apa yang dijalankan di Luna
Pekerjaan yang menjadi alasan OpenAI membangun tingkat ini, di mana biaya per panggilan menentukan batas atas apa yang layak dibangun.
Meringkas dalam jumlah besar
Dokumen, utas, dan transkrip dipadatkan menjadi satu paragraf, ketika harga per token menentukan apakah pekerjaan itu jalan atau tidak.
Ekstraksi
Menarik kolom terstruktur keluar dari teks tak terstruktur — faktur, daftar, formulir — ke bentuk yang bisa dikonsumsi pipeline.
Klasifikasi dan pelabelan
Menyortir tiket, melabeli konten, dan menerapkan kategori di seluruh korpus, satu panggilan murah setiap kali.
Perutean
Menentukan sebuah permintaan itu sebenarnya apa dan harus diarahkan ke mana — keputusan kecil yang seharusnya tidak memakan satu panggilan model andalan.
Pertanyaan singkat
Pencarian fakta pendek yang dijawab langsung oleh sebuah produk, ketika latensi dan harga lebih penting daripada kedalaman.
Pekerjaan Batch dan Flex
OpenAI menagih Batch dan Flex separuh tarif standar, sehingga input Luna menjadi $0,05 per juta untuk apa pun yang bisa menunggu.
Di mana GPT-6 Luna berjalan
Luna dirilis di seluruh permukaan OpenAI kecuali obrolan utamanya, plus platform yang mencantumkannya di hari yang sama. Di Felo, model ini berjalan dengan ID model gpt-6-luna.
Felo AI Search
Aktif sebagai gpt-6-luna, bersama sisa keluarga GPT-6.
OpenAI API
Chat Completions, Responses, dan Batch, sebagai gpt-6-luna.
ChatGPT Work dan Codex
Plus, Pro, Business, Enterprise, dan Edu, dengan pengaktifan oleh admin di Enterprise.
Free dan Go
Bisa diakses di aplikasi desktop, tetapi tidak di obrolan peramban.
GitHub Copilot
Paket Pro, Pro+, Max, Business, dan Enterprise.
Amazon Bedrock dan OpenRouter
Keduanya mencantumkan Luna pada 22 September 2026, hari peluncurannya.
Yang tidak didukung Luna
Perlu diperiksa sebelum membangun di atasnya. Halaman model OpenAI mencantumkan hal-hal ini sebagai tidak didukung di GPT-6 Luna.
- API Realtime dan Live
- Assistants API
- Fine-tuning
- Embeddings
- Pembuatan dan penyuntingan gambar
- Audio, video, dan moderasi
Spesifikasi
Apa yang sudah diterbitkan OpenAI untuk GPT-6 Luna.
Harga
GPT-6 Luna: $0,10 / $0,50 per juta token, dengan input cache $0,01 dan penulisan cache $0,125.
Tarif standar. Batch dan Flex ditagih separuh harga, Fast mode dua kali lipat, dan permintaan di atas 272.000 token input membayar 2x input dan 1,5x output untuk seluruh permintaan.
Jendela konteks
1.050.000 token, dengan input maksimum 922.000 dan output maksimum 128.000.
Jendela yang sama dengan GPT-6 Sol dan GPT-6 Astra, tetapi tarif standar hanya mencakup 272.000 token input pertama.
Tanggal pengetahuan
18 Mei 2026, tanggal pengetahuan terbaru di antara ketiga model GPT-6.
Modalitas
Teks dan gambar masuk, teks keluar.
Tingkat penalaran
None, low, medium, high, xhigh, dan max, dengan medium sebagai bawaan. Pemanggilan fungsi di Chat Completions memerlukan none.
Harga Batch dan regional
Batch dan Flex ditagih 50% dari standar. Pemrosesan regional menambah 10%, dan residensi data EU mewajibkan pemrosesan Standard.
Pertanyaan yang sering diajukan
GPT-6 Luna adalah model GPT-6 termurah OpenAI, dirilis 22 September 2026 bersama GPT-6 Sol dan diposisikan di bawah Sol serta model andalan Astra. OpenAI menyebutnya modelnya yang paling efisien, dibangun untuk tugas bervolume tinggi dengan sasaran yang jelas: meringkas dokumen, mengekstrak informasi, mengklasifikasi, dan menjawab pertanyaan lugas. Harganya $0,10 per juta token input dan $0,50 per juta token output.
Coba GPT-6 Luna di Felo
Model GPT-6 termurah OpenAI: $0,10 input dan $0,50 output per juta token, pembacaan cache $0,01, dan jendela 1.050.000 token.
Tersedia di Felo AI Search dan Felo API



