כרטיס Hero שנוצר שכותרתו 'Claude Haiku 5.5 vs PPLX 27B', עם קיקר '$0.00 לטוקן זה לא בחינם' וצ'יפים שמציגים ללא חומרה מול כ-$4,500, 1M מול הקשר של 262K, וענן מול על-מכשיר.
Guides & Insights

Claude Haiku 5.5 מול PPLX 27B: $0.00 לטוקן זה לא אותו דבר כמו חינם

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

PPLX 27B לא עולה דבר לכל טוקן. הוא פועל מקומית, על חומרה שבבעלותך, וברגע שהחומרה נקנתה, העלות השולית של הטוקן הבא היא באמת אפס. Claude Haiku 5.5 עולה 0.10 דולר למיליון טוקני קלט ו-0.50 דולר למיליון טוקני פלט — מספר קטן דיו כדי שיהיה כדאי לבצע את החיסור כראוי ולא להסתפק במסקנה המובנת מאליה. מכונה שמסוגלת להריץ היטב את PPLX 27B היא בקירוב DGX Spark ב-4,500 דולר או מחשב שולחני עם כרטיס RTX בנפח 24GB ומעלה, ו-4,500 דולר של טוקני פלט מ-Claude Haiku 5.5 הם בערך תשעה מיליארד מהם. לכן השאלה שההשוואה הזו באמת שואלת אינה מי זול יותר. היא כמה טוקנים אתה מצפה לשרוף, והאם התשובה לכך משתנה מפני שהטוקנים יושבים על השולחן שלך.

Claude Haiku 5.5 הוא המודל הקטן של הספק, שיצא ב-7 באוקטובר 2026. PPLX 27B הוכרז על ידי Perplexity ב-25 באוגוסט 2026 לצד Portable Computer, שנבנה עם NVIDIA, והוא גרסה שעברה אימון-המשך של Qwen 3.8 27B בעל המשקולות הפתוחות, שכווננה עבור מסגרת ההרצה של Perplexity עצמה. אף אחד מהם אינו תחליף ישיר לשני, ואף אחד מהם אינו נמצא בקטלוג של OrcaRouter.

שני המודלים, ומדוע אחד מהם חי על השולחן שלך

Claude Haiku 5.5 — מזהה claude-haiku-5-5, טקסט ותמונה בקלט, טקסט בפלט, חלון הקשר של מיליון טוקנים, פלט מרבי של 128,000 טוקנים עם מסלול בטא של 300,000 טוקנים ב-Batch API, תאריך חיתוך אימון של יוני 2026, והתחייבות שלא להוציאו מכלל שימוש לפני 7 באוקטובר 2027. רמת המאמץ נעה מ-Low עד Max, כאשר Medium היא ברירת המחדל, חשיבה אדפטיבית פועלת כברירת מחדל, קריאות מהמטמון עולות $0.01 למיליון טוקנים ו-Batch מפחית את התעריף בחצי. זהו מוצר מתארח: אתם שולחים טוקנים, אתם מקבלים טוקנים, ואף פעם לא רואים GPU.

PPLX 27B — מודל צפוף בעל 27 מיליארד פרמטרים, שנגזר מ-Qwen 3.8 27B ועבר אימון-המשך עבור רתמת הסוכנים של Perplexity עצמה. הוא פועל בתוך Portable Computer על DGX Spark או על מחשב Linux עם כרטיס NVIDIA RTX בנפח 24GB ומעלה, והוא אינו יוצא מהמחשב הזה. מצב היברידי שנוסף ב-1 בספטמבר 2026 משלב אותו עם מודל ענן לעבודות כבדות יותר מאחורי Privacy Gate מקומי במכשיר; תמיכת Linux ב-RTX הגיעה ב-3 בספטמבר; תמיכת Windows בכרטיסי RTX בנפח 24GB ומעלה הגיעה ב-14 בספטמבר, יחד עם MCP מקומי ומשימות מתוזמנות. המשקולות שעברו אימון-המשך הן קנייניות ונמצאות מאחורי מנוי Perplexity Pro או Max.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs PPLX 27B — the scoreboard'. Claude Haiku 5.5 reads marginal price $0.10 / $0.50 per million tokens, no upfront hardware, 1M-token context, 128K max output, AA Index 43, vendor-cloud data path; PPLX 27B reads marginal price $0.00 per token, about $4,500 upfront hardware, about 262K tokens of context, max output not published, no published independent score, on-device-only data path. A footer notes the Claude figures are per Artificial Analysis and the PPLX 27B figures are vendor-reported.

• המידות, כל אחת בשורה אחת

• עלות שולית לכל טוקן — Claude Haiku 5.5:‏ $0.10 למיליון בקלט ו-$0.50 בפלט עד 100K טוקנים של פרומפט, ואז $0.50 ו-$2.50; PPLX 27B: כלום, ברגע שהחומרה כבר שולמה.

• עלות התחלה — אין צורך בשום דבר מעבר למפתח API עבור Claude Haiku 5.5; כ-4,500 דולר עבור DGX Spark, או מחשב שולחני עם כרטיס NVIDIA RTX של 24GB או יותר, עבור PPLX 27B.

• חלון הקשר — 1,000,000 טוקנים עבור Claude Haiku 5.5 לעומת כ-262,144 בירושה מ-Qwen 3.8 27B.

• פלט מרבי — 128,000 טוקנים עבור Claude Haiku 5.5, עם כותרת בטא של 300,000 טוקנים ב-Batch; לא פורסם עבור PPLX 27B.

• לאן הנתונים הולכים — הענן של Anthropic לעומת המכונה שלך, כאשר ה-Privacy Gate של המצב ההיברידי מחליט מה יוצא ממנה.

• ציון עצמאי — מדד האינטליגנציה של Artificial Analysis: 43 עבור Claude Haiku 5.5, בתצורת Max 43.40, במקום השני מתוך 182; לא פורסם דבר עבור PPLX 27B, ש-Artificial Analysis אינה עוקבת אחריו.

• מהירות פלט — 243.4 טוקנים לשנייה עבור Claude Haiku 5.5; תלוי ב-GPU שלך עבור PPLX 27B, ואינו ניתן להשוואה ללא נתון מפורסם.

• מודאליות קלט — טקסט ותמונות לעומת טקסט, בירושה מבסיס רב-מודלי.

• משקלים — קנייניים בשני המקרים, אך מסיבות שונות: לא שוחררו משקלים לעומת post-train מוגבל שדורש מנוי להשגה.

החומרה היא המחיר, והמחיר הוא מבחן היושר

"חינם" היא המילה הלא נכונה עבור הסקה מקומית, והיצרנים יודעים זאת — ולכן המספר שמצוטט הוא תמיד עלות שולית. ההשוואה הנכונה היא נקודת איזון: מכונה ב-4,500 דולר, בתעריף של 0.50 דולר למיליון טוקני פלט של Claude Haiku 5.5, שקולה לתשעה מיליארד טוקני פלט עד שהחומרה מחזירה את עלותה. צוות שמייצר מאה מיליון טוקני פלט בחודש מגיע לנקודה הזו בתוך כשבע וחצי שנים, ועד אז ה-GPU כבר מיושן. צוות שמייצר חמישה מיליארד בחודש מגיע לשם בתוך פחות מחודשיים.

שתי התשובות נכונות, והן נכונות עבור חברות שונות. זו כל הסיבה שההשוואה הזו לא יכולה להיות מוכרעת על סמך דף מפרט, וזו גם הסיבה שהחישוב שלמעלה מתעלם מכל מה שהופך הסקה מקומית ליקרה בפועל: החשמל, מקום המתלה, האדם שאחראי על עדכוני הדרייברים, והעובדה שמכונה על שולחן היא נקודת כשל יחידה אלא אם קניתם שניים. תוסיפו את אלה ונקודת האיזון נעה עוד יותר רחוק.

מה שהסקה מקומית קונה תמורת הכסף הזה הוא בכלל לא עלות. זה הערובה שפרומפט לעולם לא יוצא מהבניין, וזה שווה יותר מכל תעריף לפי טוקן לצוות משפטי, רפואי או כזה שמשיק לביטחון, ואף הנחה ש-Anthropic מציעה אינה מהווה תחליף לכך. לעומת זאת, חלון ההקשר של 1M טוקנים ותקרת הפלט של 128,000 טוקנים של Claude Haiku 5.5 הם דברים שאי אפשר לקנות בשום מחיר בכרטיס של 24GB, ומכונה ב-$4,500 לא משנה את זה.

מה ה-85.4% בעצם מודד

המספר שפרסמה Perplexity עבור PPLX 27B הוא 85.4% ב-Local Knowledge Work Bench שלה, בעל 53 משימות, לעומת 82.6% לאותו מערך בדיקות שרץ על ה-base של Qwen 3.8 27B ללא כיוונון, 77.6% עבור Pi ו-74.0% עבור Hermes. שלושה דברים בנוגע לכך ראויים להיאמר בפשטות, משום שסיקור ההשקה בדרך כלל לא אמר אותם.

זה מדווח על ידי הספק ולא שוחזר באופן עצמאי. זהו השוואה בהרנס של הספק עצמו, שהוא המבחן ההוגן ביותר האפשרי עבור מודל שעבר אימון־פוסט על אותו הרנס — השיפור לעומת מודל הבסיס הוא בחלקו שיפור בהתאמה למבחן. והוא מודד עבודת ידע מקומית באופן ספציפי: שליפה, תמצות, טיפול במסמכים, המשימות שעבורן נבנה Portable Computer. זה אינו ציון יכולת כללית ואין לקרוא אותו ככזה.

מודל הבסיס הוא עניין אחר. Qwen 3.8 27B הוא צפוף, ברישיון Apache-2.0, מולטימודלי, ושוחרר ב-14 באוגוסט 2026 עם חלון הקשר מקורי של 262,144 טוקנים, ו-Artificial Analysis מדרגת את תצורת ההסקה שלו במדד Intelligence Index 44 — נקודה אחת מעל 43.40 של Claude Haiku 5.5, במחיר שונה. PPLX 27B הוא אותו מודל בתוספת אימון ההמשך (post-training) של Perplexity, כך שהפרשנות הכנה היא שהמשקלים הבסיסיים נמצאים בטווח היכולות של Claude Haiku 5.5, והכוונון הסיט אותם לעבר עומס העבודה של ספק אחד. איזה משני הדברים האלה אתה קונה היא השאלה שה-85.4% נועד שלא להשיב עליה.

איפה Claude Haiku 5.5 מנצח בלי צורך בבנצ'מרק

הקשר ארוך, ראשית: 1M טוקנים לעומת כ-262K, ו-128,000 טוקנים של פלט מקסימלי לעומת נתון שלא פורסם. קלט תמונות, שנית, אשר שושלת Qwen 3.8 כוללת, אך ההרנס של Perplexity אינו מפרסם. בקרת מאמץ, שלישית, והיא זו שמזלזלים בה — הגדרת Low קיימת במיוחד כדי שתוכל להפסיק לשלם עבור טוקני חשיבה בקריאות שלא זקוקות להם, וזהו מנוף עלויות שאף מודל מקומי לא מציע כי אין חשבון להוריד.

ולזמינות, רביעית. Claude Haiku 5.5 הוא מחרוזת מודל ב-API, והמספרים הבלתי-תלויים קיימים: Intelligence Index 43 בסך הכול ו-43.40 במאמץ Max, שני מתוך 182, במחיר $0.21 לכל משימת אינדקס ו-243.4 אסימוני פלט בשנייה עם כ-0.3 שניות עד לאסימון הראשון. כשאתה מחליט אם עומס עבודה מוכן לעבור, ציון שפורסם שלא חישבת בעצמך שווה יותר ממספר מהיר יותר שחישבת.

A capture of Anthropic's Claude Platform models documentation showing the current Claude lineup — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 — with each model's context window, maximum output and per-million input and output pricing.

איפה PPLX 27B מנצח בלי צורך בבנצ'מרק

פרטיות היא הראשונה והחשובה ביותר: האסימונים לעולם לא עוזבים את המכונה, דבר שאף מודל מתארח לא יכול להשתוות אליו. עלות בהיקף היא השנייה, והיא ממשית לאחר כמה מיליארדי אסימוני פלט בחודש. פעולה לא מקוונת היא השלישית — מחשב נייד במרתף ללא חיבור עדיין עונה, ואילו Claude Haiku 5.5 לא. והמצב ההיברידי שנוסף ב-1 בספטמבר הוא העיצוב המעניין ביותר במוצר: מודל מקומי שעושה את העבודה השגרתית עם מודל בענן מאחורי שער על-המכשיר עבור הקריאות הקשות הוא בדיוק הדרך לקבל גם פרטיות וגם יכולת, וזו הארכיטקטורה שרוב הצוותים צריכים להעתיק, לא משנה מאיזה ספק הם קונים אותה.

מה ש-PPLX 27B לא מציע הוא תשובה ניידת. הוא קשור ל-Portable Computer, הוא דורש מנוי כדי להשיג את המשקולות, והמשקולות הן נגזרת של המודל של מישהו אחר — כך שהרישיון שאתה מחזיק בו בפועל הוא של Perplexity, ולא Apache-2.0. אם המטרה היא מודל שאפשר לעשות לו fork ולהפיץ, Qwen 3.8 27B הבסיסי הוא זה עם הרישיון המתירני, אבל זה מודל שונה מזה שהמאמר הזה עוסק בו.

A capture of the OrcaRouter model page for qwen/qwen3.8-27b showing the Qwen3.8-27B listing with its Vision, Tools, JSON and Reasoning badges, its per-million pricing and the description noting it is released under Apache-2.0 and self-hosted on OrcaRouter's own infrastructure.

הרצת אחד מהם ממקש אחד, ואיפה זה נעצר

PPLX 27B אינו מגיע דרך API כלל: הוא פועל בתוך Portable Computer על החומרה שלך, והמצב ההיברידי מגיע למודל ענן לפי בחירתה של Perplexity בצד השני של שער הפרטיות. Claude Haiku 5.5 זמין דרך ה-API של Anthropic עצמה, ומשם — בכל מקום שבו המודלים של Anthropic נמכרים מחדש. אף אחד מהם אינו בקטלוג של OrcaRouter, ולא נרמוז אחרת — מה שאנחנו מנתבים משתי המשפחות האלה הוא anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 וanthropic/claude-fable-5.1, ובנפרד בסיס Qwen 3.8 27B שממנו PPLX 27B עבר אימון-המשך, אשר נמצא בקטלוג בכתובת qwen/qwen3.8-27b ומתארח באופן עצמאי בתשתית שלנו.

הנקודה האחרונה היא המעשית. אם הסיבה שהסתכלת על PPLX 27B הייתה משקולות Qwen 3.8 27B שמתחתיו ולא ההרצה המקומית, אפשר לקבל את מודל הבסיס דרך API אחד ליותר מ-200 מודלים, מפתח אחד וחיוב אחד, כשמחיר המחירון של הספק מועבר הלאה בתוספת של 0% ומעבר אוטומטי בין ספקים מתחת. אם מה שאתה באמת צריך הוא שהפרומפט לעולם לא יעזוב את המכונה, שום gateway אינו הפתרון ו-Portable Computer הוא כן.

ההחלטה, בלי להעמיד פנים שהמספרים מכריעים אותה

אם הפרומפטים שלך לא יכולים לצאת מהתשתית שלך, PPLX 27B הוא היחיד מבין השניים שקיים עבורך, וה-$4,500 אינו השוואת עלויות — זה המחיר של אילוץ שאינך יכול להתמקח עליו. אם אתה שורף יותר מכמה מיליארד טוקני פלט בחודש, המסלול המקומי מחזיר את ההשקעה בתוך רבעון ואז ממשיך להשתלם.

אם אף אחד מאלה אינו נכון, Claude Haiku 5.5 הוא הקנייה הטובה יותר בכמעט כל נפח: בלי חומרה, בלי תפעול, חלון של 1M טוקנים, תקרת פלט של 128,000 טוקנים, קלט תמונות, חוגת מאמץ שמנמיכה את העלות לפי דרישה, ציון עצמאי מפורסם של 43, ומחיר של $0.10 ו-$0.50 למיליון, שמעמיד את נקודת האיזון מול תחנת עבודה במרחק של כתשעה מיליארד טוקנים. הנתון של $0.00 לטוקן נכון. זה פשוט לא כל החיסור.

אם הסיבה שהסתכלת על PPLX 27B הייתה משקולות ה-Qwen 3.8 27B שמתחתיו ולא ההרצה המקומית, אפשר לקבל את מודל הבסיס דרך API אחד ליותר מ-200 מודלים, מפתח אחד וחשבון אחד , כשמחיר המחירון של הספק מועבר הלאה בתוספת של 0% ומעבר אוטומטי בין ספקים ברקע.