שוחרר ב-22 בספטמבר 2026

GPT-6 Lunaהמודל הזול של OpenAI ב-$0.10

GPT-6 Luna הוא הדרגה הזולה ביותר בדור ה-GPT-6 של OpenAI, ששוחרר ב-22 בספטמבר 2026 יחד עם GPT-6 Sol. OpenAI ממקמת אותו לעבודה בנפחים גבוהים עם מטרה מוגדרת: סיכום, סיווג, חילוץ וניתוב. במחיר $0.10 למיליון טוקני קלט הוא עולה אחד מעשרים מהתעריף של GPT-6 Sol ומחצית ממחיר הקלט של GPT-5.6 Luna. הוא פועל ב-Felo AI Search וב-Felo API.

פעיל ב-OpenAI API תחת gpt-6-luna מאז 22 בספטמבר 2026, ב-$0.10 / $0.50 למיליון טוקנים — מחצית ממחיר הקלט של GPT-5.6 Luna.

שוחרר ב-22 בספטמבר 2026 · זמין כעת ב-Felo AI Search וב-Felo API

כרטיס תעריפים

GPT-6 Luna במבט חטוף

מזהה המודל
gpt-6-luna
שחרור
22 בספטמבר 2026
קלט
$0.10 למיליון
קלט במטמון
$0.01 למיליון
פלט
$0.50 למיליון
חלון הקשר
1,050,000 טוקנים
התעריפים הם מחירי ה-API הסטנדרטיים שפרסמה OpenAI למיליון טוקנים. חלקי העלות בהמשך עורכים את החשבון מהארבעה האלה, ומסמנים מה מחושב כאן ומה מצוטט.

$0.10 / $0.50

מחיר קלט

למיליון טוקנים, תעריף סטנדרטי.

$0.01

קלט במטמון

עשירית מתעריף הקלט, למיליון טוקנים.

1.05M

חלון הקשר

עד 922,000 קלט ו-128,000 פלט.

gpt-6-luna

מזהה המודל ב-API

המחרוזת שנשלחת בשדה model.

כלכלת יחידה

כמה עולה מיליון טוקנים

הטיעון של Luna הוא חשבון, לא תארים. אלה ארבעת התעריפים שפרסמה OpenAI, וזה מה שהם מסתכמים לעומס עבודה שקורא הרבה יותר ממה שהוא כותב.

כרטיס התעריפים

תעריפים סטנדרטיים למיליון טוקנים, כפי שפורסמו.

קלט
$0.10
קלט במטמון
$0.01
כתיבה למטמון
$0.125
פלט
$0.50

קלט במטמון מחויב בעשירית מתעריף הקלט. כתיבה למטמון עולה פי 1.25 מקריאה בלי מטמון, וזה מה שחישוב ההחזר בהמשך תלוי בו.

עלות על עומס עבודה מעורב

רוב הפרומפטים קוראים הרבה יותר ממה שהם כותבים, ולכן תעריף הקלט הכותרתי מגזים בעלות של עומס עבודה. העמודה הזאת מניחה 20 טוקני קלט על כל טוקן פלט.

מודל

למיליון מעורב

מול Luna

GPT-6 Luna

$0.12

1x

GPT-5.6 Luna

$0.25

2.1x

GPT-6 Sol

$2.38

20x

GPT-6 Astra

$11.90

100x

מחושב כאן מהתעריפים שפרסמה כל חברה ביחס של 20:1 בין קלט לפלט; אף ספק לא מפרסם את העמודה הזאת. יחס אחר מזיז כל נתון — ב-1:1 התעריף המעורב של Luna הוא $0.30 למיליון, וב-100:1 הוא כ-$0.10.

עלות למיליון טוקנים בתמהיל 20:1, ביחס ל-GPT-6 Luna

עלות למיליון טוקנים בתמהיל 20:1, ביחס ל-GPT-6 Luna

כל עמודה היא עלות מיליון טוקנים מעורבים חלקי הנתון של Luna עצמו. GPT-5.6 Luna הוא פי 2.1 מ-Luna, GPT-6 Sol פי 20, ו-GPT-6 Astra פי 100. מחושב מהתעריפים שפרסמה OpenAI; העמודות מתחילות מאפס.

מקור: מחושב מתמחור ה-API של OpenAI למשפחת GPT-6, ספטמבר 2026

מחיר למיליון טוקנים: משפחת GPT-6 ו-GPT-5.6 Luna

מחיר למיליון טוקנים: משפחת GPT-6 ו-GPT-5.6 Luna

תעריפי קלט ופלט למיליון טוקנים. GPT-6 Luna ב-$0.10 קלט ו-$0.50 פלט; GPT-5.6 Luna ב-$0.20 ו-$1.20; GPT-6 Sol ב-$2 ו-$10; GPT-6 Astra ב-$10 ו-$50. העמודות מתחילות מאפס.

מקור: תמחור ה-API של OpenAI, ספטמבר 2026

הקשר ארוך

צוק המחיר ב-272,000 טוקנים

בקשה מעל 272,000 טוקני קלט מחויבת בתעריפי הקשר ארוך על כל הבקשה, לא רק על הטוקנים שמעבר לקו. הסף הזה נופל על 26% מהחלון המוצהר של Luna.

תעריף

סטנדרטי

מעל 272,000

שינוי

קלט

$0.10

$0.20

2x

קלט במטמון

$0.01

$0.02

2x

פלט

$0.50

$0.75

1.5x

למה זה צוק ולא מדרון

ב-272,000 טוקני קלט בקשה מחויבת ב-$0.0272. הוסיפו טוקן אחד והבקשה כולה מתומחרת מחדש: 272,001 טוקנים ב-$0.20 למיליון הם $0.0544, כך שטוקן עודף אחד מוסיף $0.0272 לחשבון. אותם 272,000 טוקנים, כשהם מפוצלים לשתי קריאות שכל אחת נשארת מתחת לסף, עולים $0.0272.

מה עושים עם זה

השאירו את הקלט של בקשה בודדת מתחת ל-272,000 טוקנים והתעריף הסטנדרטי חל. שליפה שמחזירה 200,000 טוקנים, או מעבר חלוקה שמפצל מסמך ארוך, נשארים בדרגה הזולה; קריאה אחת שנושאת את החלון כולו לא. הדרגה הזולה מכסה בערך את הרבע הראשון של ההקשר המוצהר.

איפה נגמר התעריף הסטנדרטי בחלון ההקשר של GPT-6 Luna

איפה נגמר התעריף הסטנדרטי בחלון ההקשר של GPT-6 Luna

החלון הוא 1,050,000 טוקנים. התעריף הסטנדרטי חל עד 272,000 טוקני קלט, כ-26% ממנו; כל מה שמעל מחויב בפי 2 בקלט ובפי 1.5 בפלט, והבקשה כולה מתומחרת מחדש כשחוצים את הקו.

מקור: דף המודל GPT-6 Luna של OpenAI, סעיף תמחור הקשר ארוך, ספטמבר 2026

מטמון פרומפטים

מתי המטמון מחזיר את עצמו

מטמון הוא הימור: משלמים פי 1.25 מתעריף הקלט פעם אחת כדי לכתוב קידומת, ואחר כך עשירית ממנו על כל קריאה. בתעריפים של Luna ההימור משתלם בקריאה השנייה.

כתיבה עולה רבע יותר

הבקשה הראשונה שכותבת קידומת מחויבת ב-$0.125 למיליון טוקנים ולא ב-$0.10 — 25% יותר משליחת אותו טקסט בלי מטמון.

קריאה עולה עשירית

כל בקשה מאוחרת שפוגעת במטמון מחויבת ב-$0.01 למיליון, וחוסכת $0.09 מול התעריף בלי מטמון בכל פעם.

נקודת האיזון בקריאה השנייה

כתיבה אחת ועוד קריאה אחת הן $0.135 למיליון, מול $0.20 לשתי בקשות בלי מטמון. בחזרה המאה, המסלול עם המטמון עולה כ-11% משליחת אותה קידומת מחדש.

עלות מצטברת של חזרה על אותה קידומת, עם מטמון ובלעדיו

עלות מצטברת של חזרה על אותה קידומת, עם מטמון ובלעדיו

עלות למיליון טוקנים של קידומת חוזרת לאורך 100 בקשות. שליחה מחדש בכל פעם עולה $10.00; שמירה במטמון עולה $1.115. שני הקווים נחתכים בין הבקשה הראשונה לשנייה.

מקור: מחושב מתעריפי כתיבה למטמון וקלט במטמון שפרסמה OpenAI ל-GPT-6 Luna, ספטמבר 2026

מאמץ החשיבה

הידית השנייה על החשבון

Luna מקבל את כל שש הדרגות של סולם מאמץ החשיבה של OpenAI, וההגדרה קובעת כמה טוקני חשיבה קריאה מוציאה. ברירת המחדל היא medium.

none

קריאה לפונקציות

low

 

medium

ברירת מחדל

high

 

xhigh

 

max

 

שש הגדרות, ברירת מחדל אחת

Luna מקבל none, low, medium, high, xhigh ו-max. טוקני חשיבה מחויבים כפלט, כך שההגדרה היא חוגת עלות לא פחות משהיא חוגת איכות: ככל שהמאמץ גבוה יותר, כך המודל מוציא יותר לפני שהוא עונה.

קריאות לכלים דורשות none ב-Chat Completions

ב-Chat Completions API בקשה שקוראת לכלי מטופלת רק כשמאמץ החשיבה הוא none. לכלים מובנים ולקריאה לפונקציות מפנה OpenAI ל-Responses API במקום, שם סולם המאמץ זמין לצד כלים. כדאי לבדוק באיזו נקודת קצה משתמש כל אינטגרציה לפני שמסובבים את החוגה.

איפה Luna יושב במשפחת GPT-6

שלוש דרגות, תפקיד אחד לכל אחת. אחד מעשרים מהתעריף של Sol הוא מה שהופך את החלטת הניתוב לקלה.

מודל

קלט

פלט

מה מנתבים לכאן

GPT-6 Luna

$0.10

$0.50

עבודה בנפח גבוה ובהגדרה הדוקה: סיכום, חילוץ, סיווג, ניתוב ושאלות ישירות.

GPT-6 Sol

$2

$10

עבודה מורכבת חוזרת: כתיבה וסקירה של קוד, דיבוג וניתוח נתונים.

GPT-6 Astra

$10

$50

החשיבה הבודדת הקשה ביותר, שימוש במחשב, ועבודה מדעית או מתמטית.

ביצועים

מה OpenAI טוענת ומה היא מדדה

ל-OpenAI שני סוגי טענות לגבי Luna: מה הוא עושה תמורת הכסף, ומה הוא הפסיק לעשות. שתיהן נתונים של הספק, ושתיהן מסומנות ככאלה.

עבודה לדולר

הטענה הכותרתית של OpenAI לגבי Luna אינה ציון גולמי אלא השוואה מנורמלת בעלות: במאמץ המרבי הוא עוקף את GPT-5.6 Sol במאמץ הבינוני בעלות משימה של כעשירית. סיקור ההשקה מדווח גם על 66.6% ב-DeepSWE v1.1, 5.4 נקודות מעל GPT-5.6 Luna במאמץ גבוה ובעלות נמוכה ב-58% לכל משימה. Luna פרסמה נתונים על הרבה פחות בנצ'מרקים מ-Sol, ולכן העמוד הזה מביא את הטענות ולא טבלת בנצ'מרקים.

טענות מטעות על עבודת קוד

OpenAI מדווחת ש-Luna מוריד את עבודת היישור של Astra לדרגה הזולה, כולל שיעורים נמוכים יותר של טענות מטעות על עבודת הקוד שלו עצמו. הנתון שכמה כתבות עצמאיות מסכימות עליו הוא שיעור ההונאה בקוד: 2.8%, לעומת 9.5% ב-GPT-5.6 Luna.

הערכה

GPT-5.6 Luna

GPT-6 Luna

שיעור הונאה בקוד (נמוך עדיף)

9.5%

2.8%

הערכות היישור של OpenAI עצמה, שהורצו בתרחישים קשים במכוון וברובם בסיכון נמוך, בלי הגנות ייצור. OpenAI מציינת שהן לא מודדות שיעורי כשל בשימוש רגיל, ולכן זה אינו שיעור ייצורי. נתון השקה שני שהתקשורת דיווחה עליו באופן לא עקבי מושמט מהעמוד הזה ולא מוצג כממוצע.

מה מריצים על Luna

העבודות שלשמן בנתה OpenAI את הדרגה הזאת, ואיפה עלות לקריאה קובעת את התקרה של מה ששווה לבנות.

סיכום בנפח

מסמכים, שרשורים ותמלולים שנדחסים לפסקה, שבו מחיר הטוקן קובע אם העבודה תורצה בכלל.

חילוץ

שליפת שדות מובנים מתוך טקסט לא מובנה — חשבוניות, מודעות, טפסים — לצורה שצינור יכול לצרוך.

סיווג ותיוג

מיון פניות, תיוג תוכן והחלת קטגוריות על פני קורפוס, בקריאה זולה אחת בכל פעם.

ניתוב

להחליט מהי בקשה ולאן היא צריכה ללכת; זו החלטה קטנה שלא צריכה לעלות קריאה לדגל.

שאלות קצרות

חיפושי העובדות הקצרים שמוצר עונה עליהם בתוך השיחה, שבהם השהיה ומחיר חשובים יותר מעומק.

עבודת Batch ו-Flex

OpenAI מחייבת את Batch ואת Flex בחצי מהתעריף הסטנדרטי, מה שמעמיד את הקלט של Luna על $0.05 למיליון לכל דבר שיכול להמתין.

איפה GPT-6 Luna פועל

Luna שוחרר בכל משטחי OpenAI מלבד הצ'אט המרכזי, ובנוסף בפלטפורמות שרשמו אותו באותו יום. ב-Felo הוא פועל תחת מזהה המודל gpt-6-luna.

Felo AI Search

פעיל כ-gpt-6-luna, לצד שאר משפחת GPT-6.

OpenAI API

Chat Completions, Responses ו-Batch, כ-gpt-6-luna.

ChatGPT Work ו-Codex

Plus, Pro, Business, Enterprise ו-Edu, עם הפעלה בידי מנהל ב-Enterprise.

Free ו-Go

נגיש באפליקציית שולחן העבודה, לא בצ'אט בדפדפן.

GitHub Copilot

מסלולי Pro, Pro+, Max, Business ו-Enterprise.

Amazon Bedrock ו-OpenRouter

שניהם רשמו את Luna ב-22 בספטמבר 2026, ביום שבו יצא.

מה Luna לא תומך בו

כדאי לבדוק לפני שבונים עליו. דף המודל של OpenAI מפרט את אלה כלא נתמכים ב-GPT-6 Luna.

  • Realtime ו-Live API
  • Assistants API
  • כיוונון עדין
  • Embeddings
  • יצירת תמונות ועריכתן
  • אודיו, וידאו וסינון תוכן

מפרט

מה ש-OpenAI פרסמה עבור GPT-6 Luna.

תמחור

GPT-6 Luna: $0.10 / $0.50 למיליון טוקנים, עם קלט במטמון ב-$0.01 וכתיבה למטמון ב-$0.125.

תעריפים סטנדרטיים. Batch ו-Flex מחויבים בחצי מחיר, Fast mode בכפול, ובקשות מעל 272,000 טוקני קלט משלמות פי 2 בקלט ופי 1.5 בפלט על כל הבקשה.

חלון הקשר

1,050,000 טוקנים, עם מקסימום 922,000 קלט ו-128,000 פלט.

אותו חלון כמו GPT-6 Sol ו-GPT-6 Astra, אבל התעריף הסטנדרטי מכסה רק את 272,000 טוקני הקלט הראשונים.

תאריך ידע

18 במאי 2026, תאריך הידע העדכני מבין שלושת מודלי GPT-6.

מודאליות

טקסט ותמונות בקלט, טקסט בפלט.

מאמץ החשיבה

None, low, medium, high, xhigh ו-max, כשהברירת מחדל היא medium. קריאה לפונקציות ב-Chat Completions דורשת none.

Batch ותמחור אזורי

Batch ו-Flex מחויבים ב-50% מהסטנדרטי. עיבוד אזורי מוסיף 10%, ותושבות נתונים ב-EU דורשת עיבוד Standard.

שאלות נפוצות

GPT-6 Luna הוא מודל ה-GPT-6 הזול ביותר של OpenAI, ששוחרר ב-22 בספטמבר 2026 יחד עם GPT-6 Sol וממוקם מתחת ל-Sol ולדגל Astra. OpenAI מתארת אותו כמודל היעיל ביותר שלה, שנבנה למשימות בנפח גבוה עם מטרה ברורה: סיכום מסמכים, חילוץ מידע, סיווג ומענה על שאלות ישירות. הוא עולה $0.10 למיליון טוקני קלט ו-$0.50 למיליון טוקני פלט.

נסו את GPT-6 Luna ב-Felo

המודל הזול ביותר של OpenAI בדור GPT-6: $0.10 קלט ו-$0.50 פלט למיליון טוקנים, קריאה מהמטמון ב-$0.01, וחלון של 1,050,000 טוקנים.

זמין ב-Felo AI Search וב-Felo API