
Claude Haiku 5.5 לעומת DeepSeek V4 Flash: Anthropic זה עתה שברה את רצפת המחיר
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
במשך שנתיים הייתה לשכבה הזולה של השוק צורה שכולם הכירו: המעבדות האמריקאיות גבו יותר והמעבדות הסיניות גבו פחות, ובחרת את הצד שלך בהתאם. Claude Haiku 5.5שבר את זה ב-7 באוקטובר 2026, כשהושק במחיר של $0.10 למיליון טוקני קלט ו-$0.50 למיליון טוקני פלט — מחיר שנמוך מהתעריף המפורסם של DeepSeek V4 Flash, המודל שהיווה נקודת ייחוס לזול מאז הקיץ.
זהו ניצחון צר יותר ממה שזה נשמע, והסיבות לכך שוות יותר מהכותרת. התעריף של Anthropic תקף רק עבור פרומפטים של עד 100,000 טוקנים. מעל זה הוא הופך ל-$0.50 ול-$2.50, שזה פי כמה ממחירו של DeepSeek. ולכרטיס של DeepSeek עצמו יש צורה שאף אחד לא מעתיק: המחיר מוכפל במהלך שני חלונות זמן בימי חול. שני ספקים, שתי תפיסות שונות לחלוטין של מה זה "זול".
מה שכל ספק למעשה מפרסם
לכל מיליון טוקנים, בדולרים אמריקאיים. הנתונים של Anthropic הם מתיעוד התמחור של Anthropic; הנתונים של DeepSeek הם מתוך עמוד Models & Pricing של DeepSeek עצמו, שהוא הכרטיס הסמכותי של המודל.

• קלט — Claude Haiku 5.5 $0.10 עד 100,000 טוקנים, $0.50 מעל זה. DeepSeek V4 Flash $0.15 מחוץ לשעות השיא, $0.30 בחלונות השיא.
• פלט — Claude Haiku 5.5 $0.50 עד 100,000 טוקנים, $2.50 מעל זה. DeepSeek V4 Flash $0.60 בשעות שפל, $1.20 בשעות שיא.
• קלט במטמון — Claude Haiku 5.5 $0.01 עד 100,000 טוקנים ו-$0.05 מעל לכך. DeepSeek V4 Flash $0.003 בשעות שפל ו-$0.006 בשעות שיא, שזה זול ביותר מפי שלושה.
• חלונות שיא — ל-Anthropic אין כאלה; התעריף משתנה בהתאם לאורך הפרומפט ולא לפי שום דבר אחר. DeepSeek מכפילה את התעריף בין 01:00 ל-04:00 ושוב בין 06:00 ל-10:00 UTC, בימי שני עד שישי, למעט חגים ציבוריים בסין.
• הקשר ופלט — 1M טוקנים ו-128,000 פלט מקסימלי עבור Claude Haiku 5.5; 1M טוקנים ו-384,000 פלט מקסימלי עבור DeepSeek V4 Flash.
• מודאליות — Claude Haiku 5.5 תומך בטקסט ובתמונות, בעוד DeepSeek V4 Flash הוא טקסט בלבד, והיכולת החזותית נמצאת במודל האח ולא בזה.
• ציון בלתי תלוי — Artificial Analysis Intelligence Index v4.3.2 מציב את Claude Haiku 5.5 (Max) בציון 43.40, במקום השני מתוך 182 מודלים, ואת DeepSeek V4 Flash 0731 (Max) בציון 34.33, במקום העשירי מתוך 117.
• מהירות — אותו מקור מודד 241.9 אסימוני פלט לשנייה עבור Claude Haiku 5.5 ו-222.0 עבור DeepSeek V4 Flash, השני הכי מהיר בלוח שלו.
הקרוסאובר הוא כל הסיפור
יישרו את שני הכרטיסים בבקשה אחת וההשוואה תתהפך פעמיים.
מתחת ל-100,000 טוקנים, Anthropic זולה יותר גם בשני המונים וגם בתג המחיר שקובע: $0.10 לעומת $0.15 בקלט, $0.50 לעומת $0.60 בפלט. זו הפעם הראשונה שמודל קטן של Anthropic מגיע מתחת לתעריף של DeepSeek Flash במונחים זהים, וזו העובדה שפוסט ההשקה פותח בה.
מעל 100,000 טוקנים, המגמה מתהפכת בחדות. הקלט של Anthropic במחיר $0.50 הוא יותר מפי שלושה מהתעריף של DeepSeek מחוץ לשעות השיא, והפלט במחיר $2.50 הוא יותר מפי ארבעה ממנו. פייפליין לאחזור או למסמכים ארוכים שמרכיב באופן שגרתי פרומפטים בני 150,000 טוקנים אינו לקוח של Claude Haiku 5.5 בכלל; הוא לקוח של המודל שבו הוא כבר משתמש.
ובשני חלונות ימי החול של DeepSeek, ההשוואה השנייה מצטמצמת מהכיוון השני, מכיוון שהתעריף של DeepSeek עצמו מוכפל בעוד שזה של Anthropic לא זז. שום מבנה של ספק אינו עדיף באופן מופשט. אחד מתמחר לפי כמות שאתה שולח, האחר מתמחר לפי מתי שאתה שולח את זה, ורק אחד מאלה נמצא בשליטתך בזמן הבקשה.
כמה עולה משימה שהושלמה, שזה המספר ההוגן היחיד
תעריפי המחירון הם לפי טוקן, ושני המודלים אינם מפיקים את אותו מספר טוקנים עבור אותה עבודה. כאן האריתמטיקה של ההשקה נעשית לא נוחה עבור Anthropic.
Artificial Analysis מציבה את Claude Haiku 5.5 (Max) בעלות של $0.21 לכל משימת Intelligence Index ואת DeepSeek V4 Flash 0731 (Max) בעלות של $0.22 לכל משימה. עשירית מתעריף הקלט, חלון רחב יותר ופער של 26 נקודות ב-Intelligence Index — 43.40 מול 34.33 — והעלות הנמדדת של השלמת משימה אחת נמצאת במרווח של סנט מהמודל שהיה אמור להיות זול ממנו.
הסיבה נמצאת באותו עמוד. בעת הערכת ה-Index, Claude Haiku 5.5 יצר 440 מיליון טוקנים של פלט מול חציון של 100 מיליון, והמעריך מכנה אותו מאוד מפורט. DeepSeek V4 Flash יצר 240 מיליון מול חציון של 140 מיליון וגם הוא מכונה מאוד מפורט. שני המודלים חושבים באריכות, שניהם מחייבים על החשיבה כפלט, והפלט הוא המונה שקובע את החשבון. הקיצוץ של תשעים אחוז בקלט הוא אמיתי, והוא מחויב על החצי הקטן יותר של החשבונית.
יש אפקט שני, שקט יותר. התיעוד של Anthropic עצמו אומר ש-Claude Haiku 5.5 משתמש בטוקנייזר החדש יותר שמשותף עם Claude 4.7 ואילך, כך שאותו טקסט נספר כבערך 30% יותר טוקנים מאשר ב-Claude Haiku 4.5. התעריף ירד פי עשרה; מספר הטוקנים לא ירד כלל, ובאותו טקסט הוא עלה.

גם המודל שמאחורי השם DeepSeek השתנה
כל מי שמשווה בין השניים האלה על סמך טבלת השוואה בת חודשים צריך לדעת את זה לפני שהוא עושה זאת.
עמוד התמחור של DeepSeek מציג כעת את deepseek-flash כשם המודל, בגיבוי DeepSeek-V4.1-Flash, ומציין שה-ID הישן deepseek-v4-flash עדיין מתקבל, אך ש"המודלים המתאימים הוצאו משירות" — בקשות תחת השם הישן מטופלות על ידי המודל החדש יותר ומחויבות במחיר Flash. במילים אחרות, ה-ID שמר על שמו, על מחירו ועל מקומו במערך, והמשקלים שמתחתיו הוחלפו.
זו אינה ביקורת; זו אזהרה לגבי מה שטבלת בנצ'מרק מתוארכת לו. הערך של Artificial Analysis שהמאמר הזה מצטט הוא עבור מהדורת 0731 של DeepSeek V4 Flash בתצורת Max שלו, שזה המודל שהלוח מדד, וזה לא בהכרח מהווה הצהרה על כל מה שמזוהה עם המזהה הזה היום. לעומת זאת, Claude Haiku 5.5 של Anthropic הוא מזהה קבוע ללא סיומת תאריך וללא כינוי, והמיקום שלו באינדקס מתוארך לשבוע ההשקה שלו.
שני מודלים, נקודת קצה אחת
הסיבה לכך שקל להכריע בהשוואה הזו בעצמך ולא על סמך דף מפרט היא שאפשר לקרוא לשני הצדדים מאותו מקום — למעט חריג אחד שראוי לציין.
DeepSeek V4 Flash נמצא היום בקטלוג של OrcaRouter, ומעבר אוטומטי לגיבוי יושב מתחתיו, כך שהזרוע של DeepSeek בהשוואה הזו ניתנת להפעלה מאיתנו הבוקר ולא רק לקרוא עליה. אזהרה אחת שראויה להיאמר במקום להשאיר לכם לגלות אותה: התעריף הרשום שלנו למודל הזה הוא $0.22 לקלט ו-$0.66 לפלט למיליון טוקנים, והוא גבוה מכרטיס שעות השפל של DeepSeek ונמוך מזה של שעות השיא. התייחסו לעמוד של DeepSeek, ולא לשלנו, כאל הסמכות לגבי מבנה שעות השיא ושעות השפל, ולשלנו כאל מספר משולב יחיד שממנו מתחילים הרצה במדידה. Claude Sonnet 5.5 ו-Claude Opus 5.5 נמצאים גם הם בקטלוג. אז A/B בין זרוע DeepSeek Flash לזרוע Claude הוא מפתח אחד ו-SDK אחד, וה-DSL של הניתוב ירכיב אותם לקריאה אחת אם לוגיקת ההסלמה שייכת לנתיב ולא לאפליקציה.
Claude Haiku 5.5 עדיין לא בקטלוג. זו לא הסתייגות — פירוש הדבר הוא שהצד של Anthropic בהשוואה הזו צריך כרגע להיות נגיש ישירות אצל Anthropic, ואילו הצד של DeepSeek לא. אם אתם רוצים את הדרגה הזולה של סדרת DeepSeek על אותו מפתח כמו שאר הסטאק שלכם היום, החלק הזה כבר פעיל.

איזה אחד לבחור?
אם הקריאות שלך קצרות — סיווג, חילוץ, ניתוב, סיכום, תורות של סוכני משנה — והן נכנסות מתחת ל-100,000 טוקנים, Claude Haiku 5.5 הוא כעת המודל הזול יותר בשני המדדים והחזק יותר בלוח העצמאי, והשיקול פשוט. הוא גם היחיד מבין השניים שמקבל תמונה.
אם הקריאות שלך ארוכות, אם אתה שולח מחדש קידומת משותפת גדולה, או אם אתה יכול לתזמן, החישוב מצביע לכיוון ההפוך, ובפער ניכר: הקלט השמור במטמון של DeepSeek במחיר $0.003 בשעות שפל נמוך בסדר גודל מ-$0.01 של Anthropic, תקרת הפלט שלו גבוהה פי שלושה, וההנחה שלו בשעות שפל היא בעיית תזמון ולא מגבלה של המוצר.
מה שההשקה למעשה קבעה הוא צר יותר מ"Anthropic היא זולה עכשיו". היא קבעה שהמעבדות האמריקאיות יתמחרו מתחת לסיניות במקרה של פרומפט קצר, ושמקרה הפרומפט הקצר הוא זה שבו נמצאת רוב תעבורת הייצור. כל מה שמעבר ל-100,000 טוקנים הוא עדיין השוק של המודל האחר.
