Anthropic השיקה את Opus 5.5 ב-22 בספטמבר 2026

Claude Opus 5.5יותר עבודה, פחות טוקנים

המודל הראשון במשפחת Claude 5.5. הוא מגיע לרמה של Claude Fable 5.1 ברוב העבודות, עולה ב-40% פחות להרצה מ-Opus 5, ומייצר פלט מהיר ביותר מ-30%.

22 בספט׳
השקה ב-2026
המודל הראשון במשפחת Claude 5.5
4 $ / 20 $
API קלט / פלט
לכל מיליון טוקנים, לעומת 5 $ / 25 $ ב-Opus 5
medium
effort ברירת מחדל
דרגה אחת מתחת ל-Opus 5, שמתחיל ב-high
מיליון / 128 אלף
הקשר / פלט מרבי
אותו חלון כמו Opus 5, ידע עד יוני 2026

זמין כעת בחיפוש של Felo

הכניסו את כל ערימת המסמכים, ואז שאלו.

Claude Opus 5.5 זמין בחיפוש של Felo למשימות עם קלט ארוך: הצלבת מספרים בין קבצים, מעקב אחר טענה עד למקור, והחזרת תשובה שאפשר להעביר הלאה כמו שהיא.

נסו את Opus 5.5 בחיפוש של Felo

01

להחזיק את כל ההקשר

חלון הקשר של מיליון טוקנים וידע עד יוני 2026. שרשור ארוך, מאגר קוד שלם או ערכת מסמכים נשארים במשימה אחת.

02

לבדוק את המספר, לא רק את המסקנה

בבדיקה פנימית של Anthropic, 16 מתוך 18 דוחות עברו את רף האיכות. מספר אחד או ציטוט אחד שהומצאו היו מכשילים את כל הבדיקה.

03

לומר מה נעשה ומה חסר

Anthropic עיצבה מחדש את אופן התקשורת של המודל: המידע החשוב ביותר מגיע ראשון, והדוח אומר בפירוש מה הושלם, מה נמצא ומה עוד פתוח.

מדריך קצר

לעבור ל-Claude Opus 5.5 ב-Felo

‏Claude Opus 5.5 מופיע בבורר המודלים לצד שאר המודלים המובילים בחשבון שלכם.

פתחו את בורר המודלים, בחרו ב-Claude Opus 5.5, והתחילו את המשימה באותו מרחב עבודה.

מה שונה ב-Opus 5.5

הירידת בעלות היא עצמה התכונה.

Anthropic שמה את הדגש על יעילות ולא על ציון בנצ׳מרק גבוה יותר: פחות טוקנים לכל משימה, מחיר נמוך יותר לטוקן, ועלות נמוכה ב-40% בעומסי עבודה אופייניים. זה מה שהופך עבודת סוכן ארוכה למשתלמת.

01

לסיים את העבודה המסועפת

Anthropic מדווחת שבודק מוקדם בחן ותיקן בסיס קוד של 200,000 שורות בפחות משלוש שעות, בעוד Opus 5 נדרש ליותר מ-20 שעות והשתמש בפי 2.5 טוקנים.

02

לתפוס את הבאג לפני המיזוג

Deloitte דיווחה שגם בדרגת effort הנמוכה ביותר Opus 5.5 תפס 72% מהבאגים הידועים בסקירת קוד, לעומת 56% ב-Opus 5 ב-high, ועם פחות התראות שווא.

03

להשאיר דוח שאפשר להשתמש בו

הטקסטים קצרים יותר ומאורגנים טוב יותר. Box דיווחה שתשובות היו פחות מלל ב-40% בלי לאבד דיוק, ובשליש מהטוקנים של Opus 5.

בחירת מודל

לשקול את עלות הטוקן מול עלות הטעות.

המחירים שלמטה הם תעריפי API ציבוריים רשמיים לכל מיליון טוקנים, ולא מחירי מנוי או שימוש של Felo. שורת ה-effort חשובה כמו שורת המחיר: אותו פרומפט יכול לעלות אחרת לגמרי לפי נקודת הפתיחה של כל מודל.

גורם החלטה
Claude Opus 5.5
Claude Fable 5.1
Claude Opus 5
GPT-6 Astra
מחיר API / מיליון טוקנים
4 $ קלט / 20 $ פלט
10 $ קלט / 50 $ פלט
5 $ קלט / 25 $ פלט
10 $ קלט / 50 $ פלט
קריאה מהמטמון / מיליון טוקנים
0.20 $, כלומר פי 0.05 ממחיר הקלט
0.25 $, כלומר פי 0.025 ממחיר הקלט
0.50 $, המכפיל התקני 0.1
משתנה לפי הספק ושכבת המטמון
effort ברירת מחדל
medium. חשיבה אדפטיבית פועלת תמיד ואי אפשר לכבות אותה.
high. חשיבה אדפטיבית פועלת תמיד.
high. אפשר לכבות חשיבה ב-high ומטה.
נקבע על ידי הקורא בכל בקשה
היכן זה משתלם
כתיבת קוד סוכנית ארוכה, סקירת קוד ועבודת ידע במחיר בינוני.
ההיסק המורכב ביותר והרצות הסוכן הארוכות ביותר, כשגם effort גבוה יותר לא מספיק ב-Opus 5.5.
בסיס ה-Opus הקודם. השוו זמינות ושהיה בפועל על התעבורה שלכם.
דרגת הדגל של OpenAI, בקצה העליון של טווח המחירים.

תעריפי ה-API הציבוריים וברירות המחדל נבדקו ב-23 בספטמבר 2026 מול הודעת Claude Opus 5.5 של Anthropic, עמודי המודלים ב-Claude Platform והעמוד של GPT-6 Astra ב-OpenAI. מחיר הטוקן הוא רק חלק מהעלות הכוללת של משימה. הצהרת היעילות של Anthropic היא ירידה של 40% בעומסים אופייניים, והיא משלבת מחיר נמוך יותר לטוקן עם פחות טוקנים לכל משימה.

התוצאות שפרסמה Anthropic

היכן Opus 5.5 מוביל, והיכן לא.

Anthropic פרסמה את המספרים שלה לצד Fable 5.1, Opus 5, GPT-6 Astra ו-GPT-5.6 Sol. שניים מארבעת הגרפים שלמטה מציגים דיוק מול עלות לכל משימה ולא דיוק בלבד, כי זו בדיוק ההשוואה ש-Anthropic עורכת.

טבלת ההשוואה של Claude Opus 5.5 שפרסמה Anthropic מול Fable 5.1, Opus 5, GPT-6 Astra ו-GPT-5.6 Sol

ההשוואה המלאה שפורסמה

כתיבת קוד סוכנית, עבודת ידע, תהליכים עסקיים, היסק בין-תחומי, מחקר מדעי, שימוש במחשב וקריאת גרפים, בכל חמשת המודלים שנמדדו.

גרפי כתיבת קוד סוכנית של Claude Opus 5.5 שפרסמה Anthropic

כתיבת קוד סוכנית

‏Terminal-Bench 4.0, FrontierCode v1.1 ו-CursorBench 4.0, כשברקע עלות לכל משימה.

גרפי עבודת ידע של Claude Opus 5.5 שפרסמה Anthropic

עבודת ידע

‏GDPval-AA v2.1 על פני 44 מקצועות, AutomationBench, ובנצ׳מרק איסוף הנתונים WANDR של Perplexity.

גרפי שימוש במחשב והיסק של Claude Opus 5.5 שפרסמה Anthropic

שימוש במחשב והיסק

‏OSWorld 2.0, Humanity's Last Exam ו-Chartography, כשהאחרון מודד את הדיוק בקריאת ערכים מגרף.

גרפי דיוק מול עלות לכל משימה של Claude Opus 5.5 שפרסמה Anthropic

דיוק מול עלות לכל משימה

הטענה המרכזית של Anthropic אינה ציון גבוה יותר בכל מחיר, אלא אותו ציון או טוב יותר בשבריר מהעלות לכל ניסיון.

מספרים שפורסמו על ידי הספק. אלא אם צוין אחרת, Anthropic הריצה את Opus 5.5 עם חשיבה אדפטיבית ב-max effort והעריכה אותו כשאמצעי ההגנה לייצור פעילים. כשאמצעים אלה התערבו, משימות סייבר הושלמו על ידי Opus 4.8 ומשימות ביולוגיה על ידי Opus 5, מה שככל הנראה מפחית את המספרים שפורסמו ל-Opus 5.5 בבנצ׳מרקים האלה. המספרים של GPT-6 Astra ו-GPT-5.6 Sol הם כפי ש-OpenAI דיווחה. פערי בנצ׳מרק בין ספקים הם אינדיקציה חלשה להבדלים אמיתיים, וכך Anthropic עצמה אומרת על המספרים האלה.

אם אתם כבר מריצים Opus 5

ארבעה שינויים ששוברים קוד קיים.

Anthropic מפרטת ארבעה שינויים לא תואמים לאינטגרציות שכבר פועלות על Claude Opus 5, ובנוסף שינוי חמישי שמשנה את מבנה התשובה בלי להכשיל בקשות. כדאי לקרוא אותם לפני החלפת מזהה המודל, כי שלושה מהם מחזירים שגיאת 400 במקום להידרדר בשקט.

01

אי אפשר יותר לכבות חשיבה

ב-Opus 5 אפשר היה לכבות חשיבה ב-high ומטה. ב-Opus 5.5 היא תמיד פעילה, וגם צורת הכיבוי וגם תקציב טוקנים ידני מחזירים שגיאת 400. effort הוא כעת הבקרה היחידה, וברירת המחדל עברה מ-high ל-medium.

thinking: {"type": "disabled"} -> 400 invalid_request_error

02

שימוש כפוי בכלים נדחה

הגדרת tool_choice ל-"any" או לכלי בשם מפורש מחזירה שגיאת 400, כולל בנקודת ספירת הטוקנים. השתמשו ב-auto יחד עם שימוש קפדני בכלים או פלט מובנה, וציינו בפרומפט מתי הכלי רלוונטי.

tool_choice: {"type": "tool", "name": "..."} -> 400 invalid_request_error

03

בלוקי חשיבה קשורים למודל

כל בלוק חשיבה מתעד איזה מודל יצר אותו. Opus 5.5 קורא בלוקים מ-Opus 5 וממודלים קודמים של Opus, Sonnet ו-Haiku, אבל לא מ-Fable או Mythos. אם נתב מעביר את השיחה למודל אחר, הסבבים הבאים רצים בלי ההיסק הקודם.

Opus 5.5 -> Fable 5.1 / Mythos 5.1 שומרים על החשיבה; מודלים אחרים מפילים אותה

04

כלי השימוש במחשב הישן נעלם

ב-Claude API וב-Google Cloud הכלי computer_20251124 מחזיר שגיאת 400. הצהירו במקומו על ערכת computer_toolset_20260801, הסירו את כותרת ה-beta, והתאימו את לולאת הסוכן לבלוקי member tool_use. ב-Amazon Bedrock הכלי הישן עדיין עובד.

computer_20251124 -> computer_toolset_20260801

effort הוא כעת הבקרה היחידה על החשיבה

מאחר שאי אפשר לכבות חשיבה, מה שמכווננים הוא effort. Opus 5.5 תומך בכל חמש הדרגות ומתחיל ב-medium, דרגה אחת מתחת ל-Opus 5. ההמלצה של Anthropic היא להריץ סריקה מחודשת על ההערכות שלכם ולא להעביר הגדרה קיימת, ולהקצות max_tokens נדיב בדרגות הגבוהות, כי טוקני חשיבה נספרים במכסה הזו גם כשטקסט החשיבה לא מוחזר.

דרגה
ברירת מחדל
השימוש המומלץ על ידי Anthropic
low
לא
הדרגה החסכונית ביותר, עם ירידה מסוימת ביכולת. Anthropic ממליצה עליה למשימות פשוטות ולסוכנים משניים.
medium
כן
ברירת המחדל ב-Opus 5.5. לפי Anthropic הוא משתווה ל-Opus 5 ב-high או עולה עליו בהערכות כתיבת קוד ועבודת ידע.
high
לא
ברירת המחדל ברוב מודלי Claude האחרים. היסק מורכב ובעיות כתיבת קוד קשות.
xhigh
לא
עבודת סוכן וכתיבת קוד ארוכת טווח מעל 30 דקות, עם תקציבי טוקנים בסדרי גודל של מיליונים.
max
לא
ההיסק העמוק ביותר הזמין, בלי הגבלה על הוצאת טוקנים. שמרו אותו לעבודות שבהן מדדתם שיפור באיכות.

effort הוא אות התנהגותי ולא תקציב טוקנים נוקשה: בדרגה נמוכה המודל עדיין חושב על בעיות קשות באמת, רק פחות מאשר בדרגה גבוהה. Anthropic מציינת גם שב-Opus 5.5 יש נטייה לחשוב יותר בכל סבב מאשר ב-Opus 5 באותה דרגה, בעיקר ב-xhigh וב-max, כך שהגדרה שהועברה מ-Opus 5 תייצר סבבים ארוכים ויקרים יותר.

היכן זה מתאים

עבודה ארוכה מכדי לשבת עליה.

Opus 5.5 משתלם כשמשימה נמשכת שעות, משתרעת על יותר קבצים ממה שאדם אחד יכול להחזיק, או מפיקה משהו שמישהו אחר צריך לבדוק. אלה המקרים ש-Anthropic והבודקים המוקדמים שלה מתארים, לא פרומפטים כלליים של צ׳אט.

מיגרציות וסקירות ברמת המאגר

להעביר שינוי דרך מאגר גדול עד שהבדיקות עוברות, במקום לעצור בתיקון הראשון שנראה סביר. Anthropic מדווחת על מיגרציה של 680,000 שורות שהושלמה בפחות מיום על ידי בודק אחד.

סקירת קוד שמוצאת את הבאג האמיתי

‏Column, אחת הבודקות ש-Anthropic מצטטת, דיווחה שמצאה באג בכך שבדקה תיעוד חיצוני לאינטגרציה של צד שלישי שתוכננה לא נכון כמה קומיטים קודם.

ניתוח פיננסי ומסמכים

לבנות את המודל ואז את הסיכום של עמוד אחד, תוך שמירה על ההסתייגויות. Anthropic מדווחת על ניתוח מיזוג שהושלם ב-63 דקות לעומת 93 ב-Opus 5, בחצי מהעלות.

צוותי סוכנים ארוכי טווח

המודל מאציל לסוכנים משניים ומתאים את הקצב לתקציב זמן. ההמלצה של Anthropic היא לספק לארכיטקטורה מרובת סוכנים אות של זמן שחלף, כדי שתעבוד במקביל ולא בטור.

נסו אותו על משימה ארוכה

01

הביאו את ההקשר האמיתי

הוסיפו את המאגר, המסמכים והדרישות שתשובה שימושית חייבת להתחשב בהם. חלון מיליון הטוקנים קיים בדיוק בשביל זה.

02

נסחו את תנאי הסיום

אמרו מה צריך להיות נכון כדי שהעבודה תיחשב גמורה. ההמלצה של Anthropic להרצות ללא השגחה היא להחזיק את חלקי המשימה ברשימה שהמודל מעדכן.

03

השוו את התוצר המוגמר

הריצו את אותה משימה על Opus 5.5, Opus 5 ו-Fable 5.1 ב-Felo. השוו גם בדיקות, הסתייגויות וצריכת טוקנים, לא רק את התשובה.

בחרו ב-Claude Opus 5.5 כשהוא יופיע בבורר המודלים בחשבון שלכם.

נסו את Opus 5.5 ב-Felo

שאלות נפוצות על Claude Opus 5.5

‏Claude Opus 5.5 הוא המודל של Anthropic לכתיבת קוד סוכנית ארוכה ולעבודת ידע, שיצא ב-22 בספטמבר 2026 כמודל הראשון במשפחת Claude 5.5. לפי Anthropic הוא מגיע לרמה של Claude Fable 5.1 ברוב העבודות, בעוד עלות ההרצה נמוכה ב-40% מזו של Claude Opus 5.

הריצו את המשימה הארוכה במחיר נמוך יותר.

הציבו את Claude Opus 5.5 לצד שאר המודלים המובילים ב-Felo, ואז נסו אותו על העבודה שאתם דוחים כי היא נמשכת שעות.

נסו את Opus 5.5 ב-Felo

התחילו בחיפוש של Felo AI ובחרו את המודל במקום שבו הוא זמין.