
Octen Search מתברגת במקום השלישי במדד Artificial Analysis Search Index: המהירה ביותר לכל משימה, והזולה ביותר מבין המובילים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
Octen Search קיבל ציון 77 בהופעתו הראשונה ב-Artificial Analysis Search Index, מספיק למקום השלישי בלוח — והוא הגיע לשם תוך 17.2 שניות למשימה, מהר יותר מכל דבר אחר ש-Artificial Analysis בחנה. המוצר עצמו אינו חדש: Octen Search זמין מסחרית מאז 22 באפריל 2026, כאשר חברת האם שלו APITECH AI הודיעה על סבב סיד בסך 10 מיליון דולר בהובלת Square Peg. מה שהשתנה הוא שנכון לנתונים של Artificial Analysis מ-8 בספטמבר, סוף סוף יש מספר של צד שלישי שמצורף אליו, והמספר טוב יותר ממה שהבדיקה המעשית העצמאית המוקדמת ביותר של Octen Search הייתה צופה.
מה בעצם מודדת Artificial Analysis
אינדקס החיפוש עלה לאוויר ב-18 באוגוסט 2026, והעיצוב שלו נקי באופן יוצא דופן עבור טבלת דירוג. כל ספק פועל בתוך אותה תשתית סוכנים — Stirrup, הסוכן בקוד פתוח של Artificial Analysis — מונחה על ידי אותו מודל, GPT-5.6 Luna ברמת חשיבה בינונית, ומקבל ציון מאותו מעריך. הסוכן מקבל שני כלים, web_search וweb_fetch, עד 25 תורות למשימה ולכל היותר עשרה תוצאות לחיפוש, כאשר מקורות זיהום ידועים מסוננים החוצה. הרצה ששורפת את כל 25 התורות בלי לקרוא ל-finish מקבלת ציון אפס, כך שהשארת הסוכן בלי יכולת לסגור משימה נענשת באותה חומרה כמו אי-אחזור של דבר.
המשתנה היחיד הוא ספק החיפוש. זהו המאפיין שחסר ברוב השוואות החיפוש, והוא מה שמאפשר לקרוא את המיקום של Octen Search כהצהרה על אחזור ולא על איזה ספק צירף את מודל התשובות החזק ביותר.
ציונים הם הממוצע שווה-המשקל של שלוש הערכות בסקאלה של 0–100. DeepSearchQA F1 פועל על חלוקה של 900 משימות של שאלות מחקר רחבות ומדרג את התשובה כרשימה של פריטים. דיוק BrowseComp משתמש בתת-קבוצה קשה של 200 דגימות של עובדות רב-שלביות שבהן התשובה היא ערך יחיד שניתן לאימות. דיוק AA-Omniscience משתמש ב-600 שאלות ידע כללי שהוחזקו בנפרד וקיים בעיקר כדי לבודד כמה החיפוש מוסיף מעבר למה שהמודל כבר ידע. מכיוון שהמדד הוא ממוצע פשוט, רכיב רך בודד גורר את המספר הכותרתי למטה, ופרופיל הרכיבים לעתים קרובות שימושי יותר מהדירוג. הרצת אותו סוכן ללא כלי חיפוש כלל מקבלת ציון 33, כך שכמעט כל מה שספק מרוויח הוא שיפור מעל הפרמטרים של המודל עצמו.
Artificial Analysis אומרת שהיא בדקה 20 מוצרי חיפוש של 10 ספקים; התרשימים המוגדרים כברירת מחדל מציגים 12 מהם.
היכן נחתה Octen Search
החלק העליון של הטבלה מ-8 בספטמבר, עם עלויות לכל משימה המחושבות על ידי חיבור עמודות החיפוש ועמודות אסימוני המודל ש-Artificial Analysis מפרסמת לכל 1,000 משימות — לוח הדירוג עצמו אינו מציג נתון משולב אחד:
• חיפוש Perplexity (בינוני) — מדד 80, 28.8 שניות למשימה, כ-0.091$ למשימה
• Perplexity Search (גבוה) — אינדקס 79, 29.7 שנ׳, כ-$0.091
• Octen Search (הדגשות) — אינדקס 77, 17.2s, בערך $0.058
• Perplexity Search (נמוך) — אינדקס 77, 37.4 שנ׳, כ-0.105 $
• חיפוש מקבילי (מתקדם) — אינדקס 75, 42.9 שניות, בערך $0.084
• Brave Search (הקשר LLM) — אינדקס 75, 24.4 שניות, בערך $0.130
• חיפוש You.com (הדגשות) — אינדקס 74, 20.7 שניות, כ-$0.117
• Exa Search (אוטומטי) — אינדקס 74, 33.3s, בערך $0.127
ציוני הרכיבים הם המקום שבו המיקום הופך למעניין יותר מהדירוג. Octen Search מקבל 80 ב-DeepSearchQA, 86 ב-BrowseComp ו-66 ב-AA-Omniscience. Parallel Search (advanced), הספק שהוביל את המדד בעת ההשקה, מקבל 81, 77 ו-67. אז Octen Search מנצח את Parallel Search בתשע נקודות בבנצ'מרק איתור עובדות רב-שלבי ומשתווה לו במחקר רחב, בעוד שהוא מפגר אחר הגדרות Perplexity Search בשיפור הידע הכללי — 66 לעומת 72 עבור Perplexity Search (medium). במילים פשוטות, Octen Search טוב מאוד בלאתר דברים שקשה באמת למצוא, ומציע פחות תוספת בשאלות שהמודל כבר יודע למחצה.
פרט קטן אחד שכדאי לציין לכל מי שמצטט את זה: ההודעה של Artificial Analysis עצמה על התוצאה הציבה את Octen Search על 16.9 שניות למשימה, בעוד שהטבלה החיה מציגה 17.2 בנתוני 8 בספטמבר. זו סטיית הרצה חוזרת, לא סתירה, אך זו הסיבה לצטט את הטבלה ולא את הפוסט ברשת החברתית.

המהירות היא הכותרת; חלוקת העלויות היא הסיפור
17.2 שניות למשימה הופכות את Octen Search לרשומה המהירה ביותר במדד. Perplexity Search (medium) זקוק ל-28.8 שניות, Parallel Search (advanced) ל-42.9, ו-Firecrawl Search ל-63.2. Artificial Analysis גם מדווחת ש-Octen Search הוא המהיר ביותר לכל שאילתה בודדת, עם ממוצע של 0.21 שניות לחיפוש — זמן הקריאה המהיר ביותר שנמדד, ללא תלות במספר הקריאות שמשימה דורשת.
המספר ששווה לבהות בו, עם זאת, הוא פירוט העלויות. לכל 1,000 משימות, Artificial Analysis מציב את Octen Search על $9.07 של הוצאות חיפוש ו-$49.15 של הוצאות טוקנים של מודל. הטוקנים עולים בערך פי 5.4 מהחיפושים. זו אינה מוזרות של Octen Search — זו הנקודה המבנית שהאינדקס הזה ממשיך להעלות. ספק חיפוש לא מחייב אותך רק על אחזור; הוא קובע כמה סבבים הסוכן יבצע, וכל סבב נוסף הוא טוקנים של מודל בתעריף של המודל.
Artificial Analysis העלתה את אותה הטענה עם Parallel בעת ההשקה: מצב מתקדם עלה יותר לכל חיפוש מאשר מצב בסיסי ($0.048 לעומת $0.045), אך פחות לכל משימה ($0.084 לעומת $0.11), משום שתוצאות טובות יותר קיצצו את השימוש בטוקנים מכ-339,000 ל-169,000 לכל משימה. קריאות זולות יותר ומשימות זולות יותר הם דברים שונים, ורק אחד מהם מופיע בחשבונית שלך.
בהשוואה לשאר הלוח, העלות של Octen Search, כ-0.058 דולר למשימה, היא הנמוכה מכל דבר שציון 75 ומעלה. TinyFish Search זול יותר, כ-0.035 דולר, אך הוא מקבל ציון 71 ולוקח לו 60.4 שניות להשלים משימה.
מה שהתוצאה מכריעה, ומה שהיא אינה מכריעה
המספרים של Octen עצמה תמיד היו אגרסיביים, והם נותרו מדווחים על ידי הספק. החברה טוענת להשהיה של 62 מ״ש ב-P50 ושל 68 מ״ש ב-P90 בבנצ׳מרק SealQA Hard, לתפוקה של למעלה ממיליון שאילתות בשנייה לכל חשבון, לתוכן חדש שנכנס לאינדקס בתוך חמש דקות, ולדירוג עולמי במקום השלישי ב-DeepResearch Bench עם ציון כולל של 55.58. אף אחד מאלה לא שוחזר באופן עצמאי, וכמה מהם אינם ניתנים להשוואה ישירה לשום דבר אחר שפורסם.
קיימים כעת שני מבחנים עצמאיים, והם מצביעים לכיוונים שונים. Artificial Analysis, כאשר המודל ומערך הבדיקה מוחזקים קבועים, מציב את Octen Search במקום השלישי באיכות ובראשון במהירות. מבחן עצמאי נפרד שפורסם באוגוסט 2026 מדד את Octen Search ב-359 ms P50 וב-941 ms P95 — פי כמה מהשהיה המוצהרת של הספק — וכן nDCG@10 של 0.495, ממש מתחת לקו 0.5 ומאחורי Parallel, Brave, Kagi, Perplexity, Context, Tavily ו-Exa במדד הזה. צוות Octen אמר לאותו סוקר שהמבחן של עצמו בודק בעיקר השהיה ולא איכות תוצאות, וזו הבהרה הוגנת וגם הודאה שאיכות התוצאות לא הייתה הדבר שנטען.
שתי התוצאות יכולות להיות נכונות, מכיוון שהן שואלות שאלות שונות. המבחן המוקדם יותר דירג אם עשר התוצאות המובילות נראו רלוונטיות לפי יוריסטיקות מטא-נתונים על מערך השאילתות שלו; Artificial Analysis מדרג אם סוכן, עם מודל אמיתי שמניע אותו, מסיים משימה בצורה נכונה. מה שהמיקום באינדקס קובע באופן מוצק הוא צר יותר מ"ה-API הטוב ביותר לחיפוש" ושימושי יותר מטענה של ספק: בהשלמת משימות סוכניות, כאשר המודל קבוע, Octen Search תחרותי עם הספקים החזקים ביותר ומהיר מכולם.
כמה עולה בעצם להריץ את Octen Search
התמחור המפורסם של Octen, שאותו עדכנה החברה לאחרונה ב-7 בספטמבר 2026:
• קריאות Search API — $1 לכל 1,000 קריאות, הנחה של 80% ממחיר המחירון של $5, שחלה אוטומטית מאז 16 ביולי 2026
• מגבלות תוצאות — 10 התוצאות הראשונות בתוך חיפוש הן בחינם; חיוב עבור תוספות הוא $0.50 לכל 1,000 תוצאות
• נקודות קצה אחרות — חיפוש תמונות וחיפוש וידאו ב-5$ לכל 1,000 קריאות; Extract ב-1$ לכל 1,000 כתובות URL שעובדו בהצלחה
• הטמעות — octen-embedding-8b במחיר $0.07 ו-octen-embedding-0.6b במחיר $0.01 למיליון טוקנים
• תוכניות תפוקה — מסלול חינמי עד 10 QPS; Base עד 20 QPS ללא תשלום ברגע שיש קרדיט בחשבון; Builder עד 50 QPS ב-2,099$ לחודש; Pro עד 200 QPS ב-13,999$ לחודש; Max עד 500 QPS ב-33,999$ לחודש
• הרשמה — $5 ביתרת חינם
מדרגות התפוקה הן החלק שבשקט שובר את חשבון העלויות. הנתון הזה של $0.058 למשימה הוא חישוב טהור לפי קריאה. אם עומס העבודה שלך דורש 200 שאילתות מקבילות בשנייה, אתה משלם $13,999 בחודש לפני שהחיפוש הראשון מתבצע, והנתון למשימה מפסיק להיות המספר המעניין.
ישנם גם פערים שסומנו כאשר Octen הושקה: תנאי אי-שמירת נתונים, הסמכות תאימות וזמינות אזורית אינם מפורסמים באותה רמת פירוט כמו אצל ספקים מבוססים. אם אתם משחררים מוצר לסביבה מוסדרת, זה חשוב הרבה יותר מפער של שלוש נקודות במדד.


אם זה שלישי, למה שמישהו עדיין יבחר ב-Perplexity Search?
הפער של שלוש נקודות אל מול Perplexity Search (medium) קטן מכפי שהוא נראה, וכך גם הדבר בנוגע למעבר מוחלט. Perplexity Search מנצח ב-AA-Omniscience ב-72 מול 66, והוא מחזיר תשובה מסונתזת ומצוטטת בקריאה אחת, מה שכמה פייפליינים רוצים והאינדקס הזה — הבנוי סביב סוכן הקורא לכלים — אינו מתגמל. היתרונות של Octen Search הם מהירות ומחיר: מהיר פי כ-1.7 לכל משימה וזול בכ-36% לכל משימה מ-Perplexity Search (medium) לפי נתונים אלה.
הסיכום המעשי: אם הסוכן שלך מוגבל בהשהיה, או שהחיוב שלך נשלט על ידי אחזור בהיקף גבוה, Octen Search הוא כעת ברירת מחדל ניתנת להגנה ולא הימור. אם הצינור שלך תלוי בתשובה מסונתזת, או בעמדת הציות של ספק מבוסס, האינדקס לא נותן לך סיבה לעבור.
לאן זה משאיר את סטאק הסוכנים שלך
The Search Index מודד שכבה שרוב הצוותים מתייחסים אליה כאל צנרת, והוא מעביר מסר שמגיע מעבר לחיפוש. בשורה של Octen Search עצמה, הטוקנים של המודל עולים פי 5.4 מחשבון האחזור. יהיה אשר יהיה מה שתבחר לאחזור, צד המודל הוא המקום שאליו הולך הכסף, והוא הצד שהכי פחות תרצה לשלב מחדש בכל פעם שאתה בוחן ספק חיפוש חדש.
זהו הטיעון בעד השארת נתיב המודל מאחורי נקודת קצה אחת. OrcaRouter מגיש 200+ מודלים מאחורי API אחד ב-0% תוספת מחיר — מחיר המחירון של הספק מועבר כפי שהוא, כך שהורדת מחיר מצד ספק מגיעה אליכם באותו יום — עם מעבר אוטומטי בין ספקים ו-DSL לניתוב להרכבת כמה מודלים לקריאה אחת. השאירו את נתיב המודל קבוע, החליפו את שכבת האחזור שמאחוריו, ואם הספק החדש יתברר כחלש יותר בתעבורה שלכם מאשר ב-DeepSearchQA, החלפתם תלות אחת במקום שתיים. אפשר לראות את הקטלוג ב-קטלוג המודלים של OrcaRouter.
ליתר בהירות לגבי מה שאנחנו מספקים ומה שאנחנו לא מספקים: Octen Search לא נמצא בקטלוג של OrcaRouter ואנחנו לא משמשים לו כפרוקסי — הקריאה הזו נשלחת ישירות ל-Octen. מה שאנחנו מנתבים הוא המודל שנמצא בקצה השני שלה.
מה לצפות בהמשך
שלושה דברים היו מזיזים את הסיפור הזה. Artificial Analysis מריצה מחדש את המדד כשספקים משחררים שינויים, כך שנקודת נתונים שנייה על 77 או בסמוך לכך תהפוך הופעת בכורה למסלול, ואילו ירידה תצביע על כך שהרכב השאילתות החמיא למיקום הראשון. Octen לא פרסמה את המספרים שלה לכל מדד בנפרד עבור DeepSearchQA, BrowseComp ו-AA-Omniscience, וזהו מקור האמינות הזול ביותר העומד לרשותה. ותעריף של 1 דולר ל-1,000 קריאות תקף מאז 16 ביולי; אם המבצע הזה יפוג ויחזור למחיר המחירון של 5 דולר, שורת החיפוש בעלות של Octen Search תגדל בערך פי חמישה, והטיעון המחירי ייחלש במידה ניכרת.
לכל מי שבונה סוכן ברבעון הזה, המהלך קטן. המדד הוא אות לאיכות-לעומת-עלות, לא מבחן תאימות. הריצו את התפלגות השאילתות שלכם מול Octen Search לפני שאתם מעבירים נתיב אחזור בפרודקשן, והתייחסו ל-77 כסיבה לבנצ'מרק ולא כסיבה להגר.
