Dirilis 22 September 2026

GPT-6 LunaModel bervolume tinggi OpenAI seharga $0,10

GPT-6 Luna adalah tingkat termurah dari generasi GPT-6 OpenAI, dirilis 22 September 2026 bersama GPT-6 Sol. OpenAI memosisikannya untuk pekerjaan bervolume tinggi dengan sasaran yang jelas: meringkas, mengklasifikasi, mengekstrak, dan merutekan. Pada $0,10 per juta token input, harganya satu per dua puluh GPT-6 Sol dan separuh harga input GPT-5.6 Luna. Model ini berjalan di Felo AI Search dan Felo API.

Aktif di OpenAI API sebagai gpt-6-luna sejak 22 September 2026, pada $0,10 / $0,50 per juta token — separuh harga input GPT-5.6 Luna.

Dirilis 22 September 2026 · Kini tersedia di Felo AI Search dan Felo API

Kartu tarif

GPT-6 Luna sekilas

ID model
gpt-6-luna
Dirilis
22 September 2026
Input
$0,10 per juta
Input cache
$0,01 per juta
Output
$0,50 per juta
Jendela konteks
1.050.000 token
Tarif yang tercantum adalah harga API standar OpenAI per juta token. Bagian biaya di bawah ini menghitung sendiri dari keempat angka tersebut, dan menandai angka mana yang dihitung sendiri alih-alih dikutip.

$0,10 / $0,50

Harga input

Per juta token, tarif standar.

$0,01

Input cache

Sepersepuluh dari tarif input, per juta token.

1,05M

Jendela konteks

Maksimum 922.000 input, 128.000 output.

gpt-6-luna

ID model API

String yang dikirim di kolom model.

Ekonomi unit

Berapa biaya satu juta token

Argumen Luna adalah aritmetika, bukan kata sifat. Berikut empat tarif yang diterbitkan OpenAI, dan hasilnya pada beban kerja yang jauh lebih banyak membaca daripada menulis.

Kartu tarif

Tarif standar per juta token, sesuai yang diterbitkan.

Input
$0,10
Input cache
$0,01
Penulisan cache
$0,125
Output
$0,50

Input cache ditagih sepersepuluh dari tarif input. Penulisan cache berharga 1,25 kali pembacaan tanpa cache, dan itulah yang menentukan hasil hitungan balik modal di bawah.

Biaya pada beban kerja campuran

Sebagian besar prompt jauh lebih banyak membaca daripada menulis, sehingga tarif input yang menonjol melebih-lebihkan biaya sebuah beban kerja. Kolom ini mengasumsikan 20 token input untuk setiap token output.

Model

Per 1 juta (campuran)

vs. Luna

GPT-6 Luna

$0,12

1x

GPT-5.6 Luna

$0,25

2,1x

GPT-6 Sol

$2,38

20x

GPT-6 Astra

$11,90

100x

Dihitung di halaman ini dari tarif terbitan tiap model pada rasio input terhadap output 20:1; tidak ada vendor yang menerbitkan kolom ini. Rasio lain akan menggeser semua angka — pada 1:1 tarif campuran Luna adalah $0,30 per juta, dan pada 100:1 sekitar $0,10.

Biaya per juta token pada campuran 20:1, relatif terhadap GPT-6 Luna

Biaya per juta token pada campuran 20:1, relatif terhadap GPT-6 Luna

Setiap batang adalah biaya satu juta token campuran, dibagi angka Luna sendiri. GPT-5.6 Luna adalah 2,1 kali Luna, GPT-6 Sol 20 kali, dan GPT-6 Astra 100 kali. Dihitung dari tarif terbitan OpenAI; batang dimulai dari nol.

Sumber: dihitung dari harga OpenAI API untuk keluarga GPT-6, September 2026

Harga per juta token, keluarga GPT-6 dan GPT-5.6 Luna

Harga per juta token, keluarga GPT-6 dan GPT-5.6 Luna

Tarif input dan output per juta token. GPT-6 Luna $0,10 input dan $0,50 output; GPT-5.6 Luna $0,20 dan $1,20; GPT-6 Sol $2 dan $10; GPT-6 Astra $10 dan $50. Batang dimulai dari nol.

Sumber: harga OpenAI API, September 2026

Konteks panjang

Batas harga 272.000 token

Permintaan yang melewati 272.000 token input ditagih dengan tarif konteks panjang untuk seluruh permintaan, bukan hanya untuk token yang melewati batas. Ambang itu jatuh pada 26% dari jendela yang diiklankan Luna.

Tarif

Standar

Di atas 272.000

Perubahan

Input

$0,10

$0,20

2x

Input cache

$0,01

$0,02

2x

Output

$0,50

$0,75

1,5x

Mengapa ini jurang, bukan lereng

Pada 272.000 token input, satu permintaan ditagih $0,0272. Tambahkan satu token lagi dan seluruh permintaan dihitung ulang: 272.001 token pada $0,20 per juta menjadi $0,0544, jadi satu token tambahan menambah $0,0272 pada tagihan. 272.000 token yang sama, dipecah menjadi dua panggilan yang masing-masing tetap di bawah ambang, berbiaya $0,0272.

Apa yang perlu dilakukan

Jaga input satu permintaan tetap di bawah 272.000 token dan tarif standar berlaku. Retrieval yang mengembalikan 200.000 token, atau tahap pemotongan yang membagi dokumen panjang, tetap berada di tingkat murah; satu panggilan yang membawa seluruh jendela tidak. Tingkat murah ini mencakup kira-kira seperempat pertama dari konteks yang diiklankan.

Di mana tarif standar berakhir di jendela konteks GPT-6 Luna

Di mana tarif standar berakhir di jendela konteks GPT-6 Luna

Jendelanya 1.050.000 token. Tarif standar berlaku sampai 272.000 token input, sekitar 26% darinya; di atas itu ditagih 2x input dan 1,5x output, dan seluruh permintaan dihitung ulang begitu garis itu dilewati.

Sumber: halaman model GPT-6 Luna OpenAI, klausul harga konteks panjang, September 2026

Cache prompt

Kapan cache balik modal

Cache adalah taruhan: Anda membayar 1,25 kali tarif input sekali untuk menulis prefiks, lalu sepersepuluhnya pada setiap pembacaan setelahnya. Dengan tarif Luna, taruhan itu balik modal pada panggilan kedua.

Penulisan berbiaya seperempat lebih

Permintaan pertama yang menulis prefiks ditagih $0,125 per juta token, bukan $0,10 — 25% lebih banyak daripada mengirim teks yang sama tanpa cache.

Pembacaan berbiaya sepersepuluh

Setiap permintaan berikutnya yang mengenai cache ditagih $0,01 per juta, menghemat $0,09 dibandingkan tarif tanpa cache setiap kali.

Balik modal pada panggilan kedua

Satu penulisan ditambah satu pembacaan adalah $0,135 per juta, dibandingkan $0,20 untuk dua permintaan tanpa cache. Pada pengulangan ke-100, jalur cache berbiaya sekitar 11% dari mengirim prefiks yang sama dari awal.

Biaya kumulatif mengulang prefiks yang sama, dengan cache dan tanpa cache

Biaya kumulatif mengulang prefiks yang sama, dengan cache dan tanpa cache

Biaya per juta token untuk prefiks yang diulang sebanyak 100 permintaan. Mengirimnya baru setiap kali berbiaya $10,00; menyimpannya di cache berbiaya $1,115. Kedua garis bersilangan antara permintaan pertama dan kedua.

Sumber: dihitung dari tarif penulisan cache dan input cache yang diterbitkan OpenAI untuk GPT-6 Luna, September 2026

Tingkat penalaran

Tuas lain pada tagihan

Luna menerima seluruh skala tingkat penalaran enam langkah milik OpenAI, dan pengaturannya menentukan berapa token penalaran yang dihabiskan sebuah panggilan. Medium adalah bawaannya.

none

pemanggilan fungsi

low

 

medium

bawaan

high

 

xhigh

 

max

 

Enam pengaturan, satu bawaan

Luna menerima none, low, medium, high, xhigh, dan max. Token penalaran ditagih sebagai output, jadi pengaturan ini adalah tuas biaya sekaligus tuas kualitas: makin tinggi tingkatnya, makin banyak yang dihabiskan model sebelum menjawab.

Pemanggilan alat butuh none di Chat Completions

Di Chat Completions API, permintaan yang memanggil alat hanya ditangani bila tingkat penalaran adalah none. Untuk alat bawaan dan pemanggilan fungsi, OpenAI mengarahkan ke Responses API, tempat skala tingkat penalaran tersedia berdampingan dengan alat. Sebaiknya periksa endpoint mana yang dipakai sebuah integrasi sebelum menyetel tuas ini.

Posisi Luna dalam keluarga GPT-6

Tiga tingkat, satu tugas masing-masing. Yang membuat keputusan perutean jadi mudah adalah satu per dua puluh tarif Sol.

Model

Input

Output

Untuk apa

GPT-6 Luna

$0,10

$0,50

Pekerjaan bervolume tinggi dengan batas jelas: meringkas, mengekstrak, mengklasifikasi, merutekan, dan pertanyaan lugas.

GPT-6 Sol

$2

$10

Pekerjaan kompleks yang berulang: menulis dan meninjau kode, men-debug, dan analisis data.

GPT-6 Astra

$10

$50

Penalaran sekali jalan tersulit, penggunaan komputer, dan pekerjaan ilmiah atau matematis.

Performa

Apa yang diklaim OpenAI, dan apa yang diukurnya

OpenAI membuat dua jenis klaim tentang Luna: apa yang bisa dilakukannya untuk uang sebesar itu, dan apa yang tidak lagi dilakukannya. Keduanya angka vendor, dan keduanya ditandai demikian.

Pekerjaan per dolar

Klaim utama OpenAI untuk Luna dinormalkan terhadap biaya, bukan skor mentah: pada tingkat penalaran maksimum, model ini melampaui GPT-5.6 Sol pada tingkat medium dengan biaya tugas sekitar sepersepuluhnya. Liputan peluncuran juga melaporkan 66,6% pada DeepSWE v1.1, 5,4 poin di atas GPT-5.6 Luna pada tingkat tinggi dengan biaya per tugas 58% lebih rendah. Luna menerbitkan angka di jauh lebih sedikit benchmark daripada Sol, jadi halaman ini memuat klaimnya alih-alih tabel benchmark.

Klaim menyesatkan soal pekerjaan coding

OpenAI melaporkan bahwa Luna membawa pekerjaan alignment Astra turun ke tingkat murah, termasuk laju klaim menyesatkan yang lebih rendah soal pekerjaan coding-nya sendiri. Angka yang disepakati beberapa tulisan independen adalah laju penipuan coding: 2,8%, dari 9,5% di GPT-5.6 Luna.

Evaluasi

GPT-5.6 Luna

GPT-6 Luna

Laju penipuan coding (lebih rendah lebih baik)

9,5%

2,8%

Evaluasi alignment OpenAI sendiri, dijalankan pada skenario yang sengaja dibuat sulit dan sebagian besar berisiko rendah, tanpa pengaman produksi. OpenAI menyatakan evaluasi ini tidak mengukur laju kegagalan pada pemakaian biasa, jadi ini bukan angka produksi. Angka peluncuran kedua yang dilaporkan media secara tidak konsisten tidak dimuat di halaman ini alih-alih dirata-ratakan.

Apa yang dijalankan di Luna

Pekerjaan yang menjadi alasan OpenAI membangun tingkat ini, di mana biaya per panggilan menentukan batas atas apa yang layak dibangun.

Meringkas dalam jumlah besar

Dokumen, utas, dan transkrip dipadatkan menjadi satu paragraf, ketika harga per token menentukan apakah pekerjaan itu jalan atau tidak.

Ekstraksi

Menarik kolom terstruktur keluar dari teks tak terstruktur — faktur, daftar, formulir — ke bentuk yang bisa dikonsumsi pipeline.

Klasifikasi dan pelabelan

Menyortir tiket, melabeli konten, dan menerapkan kategori di seluruh korpus, satu panggilan murah setiap kali.

Perutean

Menentukan sebuah permintaan itu sebenarnya apa dan harus diarahkan ke mana — keputusan kecil yang seharusnya tidak memakan satu panggilan model andalan.

Pertanyaan singkat

Pencarian fakta pendek yang dijawab langsung oleh sebuah produk, ketika latensi dan harga lebih penting daripada kedalaman.

Pekerjaan Batch dan Flex

OpenAI menagih Batch dan Flex separuh tarif standar, sehingga input Luna menjadi $0,05 per juta untuk apa pun yang bisa menunggu.

Di mana GPT-6 Luna berjalan

Luna dirilis di seluruh permukaan OpenAI kecuali obrolan utamanya, plus platform yang mencantumkannya di hari yang sama. Di Felo, model ini berjalan dengan ID model gpt-6-luna.

Felo AI Search

Aktif sebagai gpt-6-luna, bersama sisa keluarga GPT-6.

OpenAI API

Chat Completions, Responses, dan Batch, sebagai gpt-6-luna.

ChatGPT Work dan Codex

Plus, Pro, Business, Enterprise, dan Edu, dengan pengaktifan oleh admin di Enterprise.

Free dan Go

Bisa diakses di aplikasi desktop, tetapi tidak di obrolan peramban.

GitHub Copilot

Paket Pro, Pro+, Max, Business, dan Enterprise.

Amazon Bedrock dan OpenRouter

Keduanya mencantumkan Luna pada 22 September 2026, hari peluncurannya.

Yang tidak didukung Luna

Perlu diperiksa sebelum membangun di atasnya. Halaman model OpenAI mencantumkan hal-hal ini sebagai tidak didukung di GPT-6 Luna.

  • API Realtime dan Live
  • Assistants API
  • Fine-tuning
  • Embeddings
  • Pembuatan dan penyuntingan gambar
  • Audio, video, dan moderasi

Spesifikasi

Apa yang sudah diterbitkan OpenAI untuk GPT-6 Luna.

Harga

GPT-6 Luna: $0,10 / $0,50 per juta token, dengan input cache $0,01 dan penulisan cache $0,125.

Tarif standar. Batch dan Flex ditagih separuh harga, Fast mode dua kali lipat, dan permintaan di atas 272.000 token input membayar 2x input dan 1,5x output untuk seluruh permintaan.

Jendela konteks

1.050.000 token, dengan input maksimum 922.000 dan output maksimum 128.000.

Jendela yang sama dengan GPT-6 Sol dan GPT-6 Astra, tetapi tarif standar hanya mencakup 272.000 token input pertama.

Tanggal pengetahuan

18 Mei 2026, tanggal pengetahuan terbaru di antara ketiga model GPT-6.

Modalitas

Teks dan gambar masuk, teks keluar.

Tingkat penalaran

None, low, medium, high, xhigh, dan max, dengan medium sebagai bawaan. Pemanggilan fungsi di Chat Completions memerlukan none.

Harga Batch dan regional

Batch dan Flex ditagih 50% dari standar. Pemrosesan regional menambah 10%, dan residensi data EU mewajibkan pemrosesan Standard.

Pertanyaan yang sering diajukan

GPT-6 Luna adalah model GPT-6 termurah OpenAI, dirilis 22 September 2026 bersama GPT-6 Sol dan diposisikan di bawah Sol serta model andalan Astra. OpenAI menyebutnya modelnya yang paling efisien, dibangun untuk tugas bervolume tinggi dengan sasaran yang jelas: meringkas dokumen, mengekstrak informasi, mengklasifikasi, dan menjawab pertanyaan lugas. Harganya $0,10 per juta token input dan $0,50 per juta token output.

Coba GPT-6 Luna di Felo

Model GPT-6 termurah OpenAI: $0,10 input dan $0,50 output per juta token, pembacaan cache $0,01, dan jendela 1.050.000 token.

Tersedia di Felo AI Search dan Felo API