GPT-4o mini Search Preview הוא מודל מיוחד לחיפוש באינטרנט ב-Chat Completions. הוא מאומן להבין ולבצע שאילתות חיפוש באינטרנט.
GPT-4o-mini Search Preview הוא וריאנט של המודל GPT-4o-mini של OpenAI הכולל יכולות חיפוש אינטרנט מובנות. הוא מתוכנן לספק תשובות שמשלבות מידע בזמן אמת מהאינטרנט, מה שהופך אותו למתאים לשאילתות שתלויות…
המודל משלב הבנה ויצירה לשונית כללית עם חיפוש אינטרנט חי. הוא יכול לענות על שאלות על אירועים אחרונים, לשלוף נתונים מאתרים ספציפיים ולסנתז מידע ממקורות מקוונים מרובים. הוא שומר על היכולות האופייניות של GPT-4o-mini: סיכום טקסט, תרגום, יצירת קוד, חשיבה לוגית וכתיבה יצירתית. תצוגת החיפוש מוסיפה את היכולת לגשת לחדשות עדכניות, מחירי מניות, מזג אוויר, פרטי מוצרים ונתונים רגישים לזמן אחרים. עם זאת, כיוון שהמודל מכוון למהירות ויעילות, עומק החשיבה שלו עשוי להיות נמוך מזה של מודל GPT-4o המלא.
המודל מצטיין בתרחישים שבהם התשובות תלויות במידע משתנה או עדכני. דוגמאות כוללות נציגי שירות לקוחות חיים שצריכים לבדוק סטטוס הזמנה או מדיניות החזרות, כלי תוכן שמייצרים סיכומים של נושאים טרנדיים, ועוזרי מחקר שמרכיבים עובדות ממספר מקורות מקוונים. הוא גם שימושי לאימות טענות מול נתונים עדכניים, כמו בדיקת ההכרזה האחרונה של חברה או תוצאת ספורט. בשל העלות הנמוכה יחסית וזמני התגובה המהירים שלו, הוא מתאים ליישומים עם נפחי בקשות גבוהים שבהם עיגון לנתוני רשת (web grounding) הוא תכונה מרכזית.
אם היישום שלך לא דורש חיפוש באינטרנט או מידע עדכני, שקול להשתמש ב-GPT-4o-mini הבסיסי ללא תצוגה מקדימה של חיפוש. המודל הבסיסי זול אף יותר (אותו תמחור לפי טוקן, אך ללא תקורה של אחזור חיפוש) ועשוי להיות מהיר יותר עבור משימות שיחה טהורות. עבור שאילתות פשוטות מאוד שאינן זקוקות לידע עולמי רחב, מודלים קטנים יותר כמו GPT-4o-mini (בסיסי) או אפילו מודלים ישנים יותר כמו GPT-3.5 Turbo עשויים להספיק. הערך האם תכונת התצוגה המקדימה של חיפוש מצדיקה את העלות עבור מקרה השימוש הספציפי שלך.
תצוגה מקדימה של חיפוש מופעלת אוטומטית על ידי המודל כאשר הוא קובע שהשאילתה זקוקה למידע חיצוני. אינך צריך להגדיר ממשקי API לחיפוש או להעביר תוצאות חיפוש ידנית. עם זאת, תוכל להשפיע על התנהגות המודל על ידי הנחיה מפורשת להשתמש בחיפוש אינטרנטי, או על ידי ציון מקורות. המודל מכבד את מסנני הבטיחות והתוכן הסטנדרטיים המופעלים על ידי OpenAI. שים לב שחיפוש אינטרנטי עלול לגרום לעיכוב בהשוואה למודל הבסיסי, מאחר שהמודל ממתין לתוצאות החיפוש לפני יצירת התשובה הסופית.
ציוני אמות מידה ספציפיים עבור GPT-4o-mini Search Preview לא פורסמו בפומבי כווריאציה נפרדת. עם זאת, בהתבסס על GPT-4o-mini הבסיסי, מודל זה צפוי להשיג ביצועים טובים באמות מידה סטנדרטיות לעיבוד שפה טבעית כמו MMLU, HellaSwag ו- GSM8K, אך ככל הנראה בדיוק נמוך יותר מאשר GPT-4o המלא. תכונת התצוגה המקדימה של החיפוש עשויה לשפר ביצועים במשימות הדורשות ידע עדכני (כגון טריוויה על אירועים אחרונים), אך אינה משנה את יכולות ההיגיון הבסיסיות של המודל. באשר לדיוק העובדתי, המודל מסתמך על האיכות והעדכניות של מקורות האינטרנט שהוא מאחזר.
GPT-4o-mini Search Preview מיועד לזמן השהיה נמוך בהשוואה ל-GPT-4o. GPT-4o-mini הבסיסי ידוע בזמן הסקה מהיר, וה-Search Preview מוסיף זמן נוסף לשליפת תוצאות מהאינטרנט. זמן התגובה הכולל תלוי בגורמים כמו השהיית רשת, מספר תוצאות החיפוש שנשלפו, ואורך ההקשר. בשימוש טיפוסי, התגובות נוצרות תוך מספר שניות. עבור יישומים הדורשים זמן השהיה מינימלי מוחלט, GPT-4o-mini הבסיסי (ללא חיפוש) יהיה מהיר יותר. ה-API של OrcaRouter תומך ב-streaming כדי להתחיל להציג טוקנים תוך כדי יצירתם.
יתרונות: המודל מספק מידע עדכני ללא צורך באינטגרציה נפרדת של חיפוש, בעל חלון הקשר גדול (128k טוקנים), וחסכוני לשימוש בהיקפים גדולים. מגבלות: הוא מקבל טקסט בלבד; לעיתים עשוי לאחזר תוכן אינטרנטי חלקי או לא רלוונטי; יכולת ההסקה שלו פחות עמוקה מ-GPT-4o; ותצוגה מקדימה של חיפוש עלולה להגדיל את זמן ההשהיה. בנוסף, המודל לא תמיד מציין מקורות במפורש, ולכן משתמשים צריכים לוודא מידע קריטי. הוא אינו מיועד למשימות כמו הבנה רב-מודאלית, מתמטיקה מתקדמת, או חשיבה שרשרתית מורכבת שבהן GPT-4o מבצע טוב יותר.
OrcaRouter מחייב את GPT-4o-mini Search Preview בתעריף הספק ללא תוספת מחיר: $0.15 למיליון טוקני קלט ו-$0.60 למיליון טוקני פלט. משמעות הדבר שאתה משלם בדיוק את מה ש-OpenAI גובה, ללא עמלות נוספות. התמחור הוא לפי טוקן, כאשר טוקני הקשר נספרים כקלט וטוקנים שנוצרו כפלט. המודל משתמש בסכמת הטוקניזציה הסטנדרטית של OpenAI. אין חיובים נוספים עבור תכונת התצוגה המקדימה של החיפוש עצמה; העלות זהה לעלות הבסיסית של GPT-4o-mini, למרות האחזור הנוסף מהאינטרנט.
בהשוואה ל-GPT-4o (שעולה $2.50 למיליון טוקנים בקלט ו-$10 למיליון טוקנים בפלט), GPT-4o-mini Search Preview זול משמעותית—בערך פי 16 פחות עבור קלט ופי 16.6 פחות עבור פלט. זה הופך אותה למועמדת חזקה ליישומים שבהם העלות לשאילתה חשובה, במיוחד כאשר יש צורך בחיפוש אינטרנט. עם זאת, ה-GPT-4o-mini הבסיסי (ללא Search Preview) עולה אותו דבר לטוקן אך חסר חיפוש. אם אין צורך בחיפוש, ניתן לחסוך במעט השהיה הנוספת, אך העלות לטוקן זהה.
OrcaRouter עשוי לתמוך בשמירה במטמון של תוצאות חיפוש או תגובות מודל, בהתאם לתצורה. אם מופעל, שאילתות חוזרות לאותו מידע עשויות להיות מסופקות מהמטמון, מה שמפחית את זמן ההשהיה ואת השימוש בטוקנים. עם זאת, מדיניות השמירה במטמון משתנה. למידע העדכני ביותר, המודל מבצע בדרך כלל חיפוש אינטרנט חדש בכל בקשה. כדי למזער עלויות, שקול להשתמש ב-base GPT-4o-mini אם השאילתות שלך אינן דורשות נתוני אינטרנט. תמיד עקוב אחר השימוש בטוקנים שלך דרך לוח המחוונים של OrcaRouter כדי להבין את ההוצאות שלך.
OrcaRouter מעביר את התמחור המדויק של OpenAI ללא הוספת מרווח. החיוב מתבסס על מספרי הטוקנים כפי שדווחו על ידי הספק. אין דמי התקנה, מינימום חודשי או חיובים נוספים עבור שער ה-API. אתה משלם רק על הטוקנים שבהם אתה משתמש לפי התעריפים המצוינים. עבור GPT-4o-mini Search Preview, המשמעות היא $0.15 למיליון טוקני קלט ו-$0.60 למיליון טוקני פלט. ודא שהחשבון שלך מוגדר עם OrcaRouter כדי לגשת למודל בתעריפים אלו.
כדי להשתמש במודל, שלח בקשת POST אל https://api.orcarouter.ai/v1/chat/completions עם השדה model מוגדר כ-"openai/gpt-4o-mini-search-preview". נקודת קצה זו תואמת ל-OpenAI, כך שתוכל להשתמש בכל SDK או לקוח של OpenAI על ידי שינוי כתובת ה-URL הבסיסית ומפתח ה-API. דוגמת curl: curl https://api.orcarouter.ai/v1/chat/completions \ -H "Authorization: Bearer YOUR_ORCAROUTER_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "openai/gpt-4o-mini-search-preview", "messages": [{"role": "user", "content": "What is the current weather in London?"}] }' תצוגת החיפוש תופעל אוטומטית.
ה-API תומך בכל פרמטרי השלמת הצ'אט הסטנדרטיים של OpenAI: temperature (0-2, ברירת מחדל 1), top_p, n, stream, stop, max_tokens (עד 16384), presence_penalty, frequency_penalty ו-logit_bias. המודל מכבד פרמטרים אלו. עבור תצוגה מקדימה של חיפוש, אין צורך בפרמטרים נוספים; המודל מחליט מתי לחפש. עם זאת, ניתן להנחות אותו לבקש במפורש חיפוש באינטרנט (לדוגמה, "חפש באינטרנט חדשות אחרונות על...") כדי לעודד אחזור. שים לב שהמודל עשוי עדיין לבחור לא לחפש אם הוא רואה בידע הפנימי שלו כמספק.
אם אתם כבר משתמשים ב-API של OpenAI, המעבר ל-OrcaRouter הוא פשוט: שנו את כתובת הבסיס מ-https://api.openai.com/v1 ל-https://api.orcarouter.ai/v1, והחליפו את מפתח ה-API שלכם במפתח מ-OrcaRouter. מזהה המודל הופך ל-"openai/gpt-4o-mini-search-preview". כל שאר גופי הבקשה ותבניות התגובה נשארים זהים. ניתן להשתמש בכל ספריית לקוח של OpenAI (Python, Node.js, וכו') ללא שינוי. OrcaRouter תומך גם בסטרימינג, קריאות פונקציות, ותכונות מתקדמות אחרות התואמות ל-API של OpenAI.
כדי להזרים תגובות, הגדר "stream": true בבקשה שלך. OrcaRouter מחזירה נתונים כאירועי שרת (server-sent events), זהים לפורמט ההזרמה של OpenAI. כל אירוע מכיל דלתא (delta) של התגובה. הזרמה שימושית במיוחד עבור יישומים פונים למשתמש, כדי להציג טוקנים בזמן שהם נוצרים. עבור שאילתות תצוגה מקדימה של חיפוש, המודל עשוי תחילה לציין שהוא מחפש לפני פלט התשובה הסופית. הזרם יכלול טוקני ביניים אלה. ודא שהלקוח שלך יכול לטפל בעדכונים חלקיים בצורה חלקה.
GPT-4o-mini Search Preview הוא דגם קטן יותר, מהיר יותר וזול יותר של GPT-4o עם יכולות חיפוש באינטרנט נוספות. בעוד של-GPT-4o יש יכולות חשיבה עליונות, מאגר ידע רחב יותר (עד נקודת החתך של האימון שלו), ותמיכה מולטי-מודאלית (תמונות, אודיו), המודל הזה הוא טקסט בלבד ומסתמך על חיפוש באינטרנט כדי להתגבר על הידע המוגבל שלו מאימון. למשימות הדורשות ניתוח מעמיק או מתמטיקה מורכבת, GPT-4o עדיף. ליישומים רגישים לעלות הזקוקים למידע עדכני, GPT-4o-mini Search Preview הוא אלטרנטיבה חזקה. המחיר זול בערך פי 16.
המודל הבסיסי GPT-4o-mini אינו כולל חיפוש באינטרנט; הוא מסתמך אך ורק על נתוני האימון שלו, שתאריך החתך שלהם הוא בסוף 2023. תצוגה מקדימה של GPT-4o-mini Search מוסיפה את היכולת לאחזר מידע עדכני מהאינטרנט. לשני המודלים אותו חלון הקשר (128k טוקנים), אותה תפוקה מקסימלית (16384), ואותו תמחור לכל טוקן. לגרסת התצוגה המקדימה של החיפוש עשוי להיות זמן השהיה מעט גבוה יותר בשל אחזור המידע מהאינטרנט. אם האפליקציה שלך אינה זקוקה לנתונים חיים, המודל הבסיסי זהה בתפקודו ועשוי להיות מהיר יותר. שני המודלים נגישים דרך OrcaRouter עם מזהי מודל שונים.
מודלים נוספים התומכים בחיפוש כוללים את Gemini עם יכולת חיפוש מבוססת Google, או מודלים המשתמשים באחזור מידע מהרשת באמצעות תוספים. GPT-4o-mini Search Preview מציע אינטגרציה מובנית ללא צורך בתוספים חיצוניים. הוא בדרך כלל זול יותר ממודלים גדולים יותר התומכים בחיפוש (כמו GPT-4 עם גלישה). עם זאת, הוא עשוי להיות פחות מקיף בתוצאות החיפוש בהשוואה לממשקי API ייעודיים לחיפוש. עבור ידע אינטרנטי ברמת דיוק גבוהה, שקול להשלים עם API עובדתי לחיפוש ולהזין את התוצאות למודל בסיסי. מודל זה מתאים לשאילתות פשוטות עד מורכבות בינוניות הנהנות מנתוני אינטרנט עדכניים.
בחר בדגם זה כשאתה זקוק ל: (1) עלות נמוכה לשאילתה, (2) חיפוש אינטרנט אוטומטי ללא אינטגרציה מותאמת אישית, (3) זמני תגובה מהירים, ו-(4) חלון הקשר גדול. בחר בגרסה מלאה של GPT-4o אם אתה זקוק לקלטים מולטי-מודליים או חשיבה מעמיקה יותר. בחר ב-GPT-4o-mini הבסיסי אם אינך זקוק לחיפוש אינטרנט ורוצה תגובות מהירות מעט יותר. בחר ב-API חיפוש ייעודי יחד עם דגם קטן אם אתה זקוק לשליטה מדויקת על מקורות ותוצאות החיפוש. דגם זה הוא הטוב ביותר כתחליף ישיר ל-GPT-3.5 או GPT-4o-mini ביישומים שירוויחו ממידע חי.
תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-mini-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| קלט / 1M טוקנים | $0.150 |
| פלט / 1M tokens | $0.600 |
| מטבע | USD |
הערכה מבוססת מחיר מחירון
הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.
GET /api/public/models/openai/gpt-4o-mini-search-previewפתיחה @misc{orcarouter_gpt_4o_mini_search_preview,
title = {GPT-4o-mini Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview}
}OpenAI. (2025). GPT-4o-mini Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview