Nano Banana Pro הוא המודל המתקדם ביותר של גוגל ליצירה ועריכת תמונות, שנבנה על Gemini 3 Pro. הוא מרחיב את ה-Nano Banana המקורי עם שיפור משמעותי בנימוק רב-מודאלי, ביסוס על העולם האמיתי, ו...
הדגם הזה הוא גרסת תצוגה מקדימה של גוגל לגרסה עתידית של Gemini 3 Pro המתמקדת בהבנת תמונה. הוא מקבל קלטי תמונה וטקסט ומייצר פלטי טקסט. השם "Nano Banana Pro" הוא שם קוד פנימי; מזהה הדגם עבור OrcaRouter…
המודל יכול לתאר תוכן תמונה בפירוט, לענות על שאלות על עצמים, סצנות, צבעים וטקסט הנראה בתמונה (למשל, קריאת שלטים או תוויות). הוא תומך במשימות חשיבה חזותית כגון השוואה בין שתי תמונות, זיהוי הבדלים, או הסקה מרמזים חזותיים. הוא יכול גם לנתח דיאגרמות ותרשימים, אם כי דיוקו על איורים מדעיים מורכבים עשוי להשתנות.
מקרי שימוש חזקים כוללים: 1) תיאור תמונות בזמן אמת לכלי נגישות; 2) חיפוש חזותי וסיווג מוצרים במסחר אלקטרוני; 3) עיבוד מסמכים (טפסים, קבלות, חשבוניות) עם טקסט בכתב יד או מודפס; 4) כלים חינוכיים המסבירים תרשימים או צילומים. המודל פועל בצורה הטובה ביותר עם תמונות ברורות ומוארות היטב והנחיות ספציפיות ומפורטות.
אם המשימה שלך אינה כוללת תמונות (למשל, יצירת טקסט טהור, תמצות, תרגום), מודל טקסט בלבד (כמו גרסאות רגילות של Gemini או Llama) יהיה חסכוני יותר. לסיווג תמונות פשוט שאינו דורש חשיבה בשפה טבעית, ייתכן שמודל ייעודי לעיבוד תמונה בעל זמן השהיה נמוך יותר יהיה עדיף. כמו כן, אם אתה זקוק לזמן השהיה נמוך יותר עבור בקשות בנפח גבוה, מודל רב‑מודאלי קטן יותר עשוי להיות מועדף.
כתצוגה מקדימה, תמיכה בקריאת פונקציות (function calling) אינה מאושרת עבור מודל זה. ה‑API של OrcaRouter תומך באותן הגדרות כלים כמו OpenAI, אך ייתכן שהמודל הבסיסי לא יבצע קריאות פונקציות בצורה אמינה. יש לבדוק היטב לפני הסתמכות על שימוש בכלים. פלט מובנה (מצב JSON) נתמך באמצעות הפורמט התואם ל‑OpenAI, אך איכות הפלט משתנה.
ציוני ביצועים (Benchmark) של Nano Banana Pro (Gemini 3 Pro Image Preview) לא פורסמו בפומבי. כמודל תצוגה מקדימה, ייתכן שהוא לא יוערך על פי אמות מידה סטנדרטיות כמו MMLU, VQAv2 או COCO Captions. מפתחים צריכים להפעיל הערכה משלהם על נתונים מייצגים כדי להעריך ביצועים. צפו לשיפורים בגרסה הסופית של Gemini 3 Pro.
השהייה תלויה בגודל התמונה, באורך הקלט ובעומס הנוכחי של OrcaRouter. עיבוד תמונה מוסיף תקורה בהשוואה למודלים מבוססי טקסט בלבד. בממוצע, בקשה עם תמונה אחת ברזולוציה בינונית ו-100 טוקנים טקסט עשויה לקחת מספר שניות לקבלת הטוקן הראשון ולאחר מכן להזרים את השאר. אין נתון מפורסם של טוקנים לשנייה עבור תצוגה מקדימה זו. השתמשו בתמונות קטנות יותר ובבקשות אצווה כדי להקטין את ההשהייה.
המודל מצטיין בזיהוי עצמים, אנשים וטקסט בתוך תמונות. הוא יכול להסיק על יחסים מרחביים ולענות על שאלות הדורשות שילוב של מידע חזותי וטקסטואלי. משוב מוקדם מצביע על ביצועים טובים בשאלות מבוססות תמונות ובהבנת מסמכים. חלון ההקשר הגדול שלו מאפשר שיחות מרובות תמונות.
כתצוגה מקדימה, המודל עשוי לייצר פלטים בלתי צפויים או להזות פרטים על גבי תמונות (למשל, לטעון על קיומם של עצמים שאינם נוכחים). הוא עלול להתקשה בתמונות ברזולוציה נמוכה, מטושטשות או מופשטות מאוד. הסקה חזותית מורכבת ורב‑שלבית (למשל, משוואות מתמטיות מכתב יד) עלולה להיות בלתי אמינה. המודל אינו תומך בקלט אודיו או וידאו. אין אפשרות לכוונון עדין עבור תצוגה מקדימה זו.
התמחור נקבע על ידי OrcaRouter על בסיס עלויות לאסימון (per‑token) עבור הספק google. אסימוני קלט הם בדרך כלל זולים יותר מאסימוני פלט. אסימוני תמונה צורכים הרבה יותר אסימוני קלט מאשר טקסט — כל תמונה מחולקת לאריחים ומעובדת. עיין בדף התמחור הרשמי של OrcaRouter לקבלת התעריפים העדכניים. אין שכבה חינמית למודל זה; אתה משלם לפי בקשה.
מכיוון שעיבוד תמונות הוא עתיר טוקנים, עלויות יכולות להצטבר במהירות אם תשלחו הרבה תמונות ברזולוציה גבוהה. כדי לנהל עלויות: הפחיתו את רזולוציית התמונה, הגבילו את מספר התמונות לבקשה, והשתמשו בטקסט הנחיה קצר. למשימות שבהן תמונות אינן חיוניות, שקלו מודל טקסט בלבד. OrcaRouter עשוי להציע שמירה במטמון עבור הטמעות תמונה חוזרות (בדקו בתיעוד לפרטים).
ייתכן ש-OrcaRouter מיישם מטמון (caching) עבור הטמעות תמונה בשימוש תדיר, אך התנהגות המטמון של מודל התצוגה המקדימה הזו אינה מתועדת. בדרך כלל, קלטי תמונה זהים באותה כתובת URL יכולים להישמר במטמון בצד הספק, מה שמפחית עלויות של אסימונים (tokens) בבקשות חוזרות. צור קשר עם תמיכת OrcaRouter לפרטים ספציפיים. המטמון תלוי במודל ואינו מובטח עבור מודלי תצוגה מקדימה.
צריכת טוקנים לתמונות פרופורציונלית למספר האריחים בגודל 256×256 הדרושים לכיסוי התמונה (לאחר שינוי גודל). תמונה בגודל 512×512 משתמשת ב‑4 אריחים (4 טוקני קלט לאריח? לא סופק—הנוסחה המדויקת תלויה במודל). OrcaRouter עשוי לספק ספירת טוקנים בשדה usage של תגובת ה‑API. נסה עם תמונות משלך כדי להעריך את העלות לבקשה.
השתמש בנקודת הקצה התואמת ל-OpenAI בכתובת https://api.orcarouter.ai/v1 עם מפתח ה-API שלך. הגדר את המודל ל-"google/gemini-3-pro-image-preview". עצב את הבקשה עם מערך messages המכיל גם טקסט וגם תמונות. התמונות מועברות כ-URL של base64 data או URL עם אובייקטים image_url. דוגמה: {"model":"google/gemini-3-pro-image-preview","messages":[{"role":"user","content":[{"type":"text","text":"Describe this image"},{"type":"image_url","image_url":{"url":"data:image/png;base64,..."}}]}]}. סטרימינג נתמך.
פרמטרים סטנדרטיים של OpenAI: temperature (0–2), top_p, max_tokens (עד חלון ההקשר בניכוי אסימוני ההנחיה), stop sequences, frequency_penalty, presence_penalty. המודל גם מקבל את הפרמטר "seed" לפלטים דטרמיניסטיים (לא מובטח). תמיכת הפרמטרים תלויה במודל; חלק מהפרמטרים עלולים להתעלם או להיות בעלי ערכי ברירת מחדל שונים. יש לבדוק עם התצורה הרצויה.
שנה את כתובת ה-base URL שלך מ-https://api.openai.com/v1 ל-https://api.orcarouter.ai/v1, עדכן את מפתח ה-API שלך למפתח OrcaRouter, ושנה את שם הדגם ל-"google/gemini-3-pro-image-preview". מבנה ההודעה (מערך תוכן עם text ו-image_url) זהה. אם אתה משתמש בספריות כמו openai Python, פשוט שנה את base_url ו-api_key. הערה: מגבלות הקצב שונות.
האימות מתבצע באמצעות מפתח API בכותרת הAuthorization (Bearer your_key). מגבלות הקצב הן לפי מפתח ותלויות בתוכנית שלך. הAPI מחזיר 429 כאשר חריגה מהמגבלה. אין אימות נפרד לספק המודל—OrcaRouter מנהל את הניתוב. לשימוש בייצור, השתמש במפתח ייעודי ועקוב אחר השימוש בלוח הבקרה של OrcaRouter.
שניהם רב-מודאליים (תמונה+טקסט כקלט, טקסט כפלט). GPT‑4V הוא מודל ייצור בוגר עם נתוני אמת מידה רחבים יותר. Nano Banana Pro הוא גרסת תצוגה מקדימה; היכולות האמיתיות שלו פחות ידועות. חלונות הקשר: GPT‑4V עד 128k לעומת 65k למודל זה. GPT‑4V תומך בתמונות ברזולוציה גבוהה יותר. עם זאת, מודל זה עשוי להציע עלויות נמוכות יותר וחוזקות חשיבה שונות. השוואות ישירות דורשות הערכה מותאמת למשימה.
OrcaRouter מציע מספר מודלים מולטי-מודאליים (למשל, Claude 3 Vision, Llama 3.2 Vision). תצוגה מקדימה זו של Google מספקת ארכיטקטורה ייחודית מבוססת Gemini שעשויה להצטיין במשימות מסוימות הממוקדות ב-Google (למשל, הבנת צילומי מסך של Google Docs). יש לה מחצית מחלון הקשר של חלק מהמתחרים. התמחור והשהייה משתנים; בדקו בטבלאות ההשוואה של OrcaRouter את התעריפים לפי מודל.
היתרון המרכזי הוא קלט תמונה מקורי ללא צורך במקודד חזותי נפרד. ניתן לשלב הקשר חזותי עם טקסט בהנחיה אחת. זה מקטין את מורכבות המערכת לעומת שרשרת של שני מודלים שונים. עם זאת, מודלים מבוססי טקסט בלבד זולים ומהירים יותר עבור משימות שאינן דורשות תמונות. בחר על פי האם המשימה דורשת הבנה חזותית.
Gemini 2 Pro הוא מודל ייצור (production) עם רקורד ארוך. תצוגה מקדימה זו מספקת הצצה לארכיטקטורה של Gemini 3 Pro ועשויה להיות בעלת חוזקות שונות (למשל, טיפול טוב יותר בסוגי תמונות מסוימים). עם זאת, זוהי תצוגה מקדימה—היציבות והתמיכה מוגבלות. לפריסות ייצור, Gemini 2 Pro (באמצעות OrcaRouter) בטוח יותר. השתמש בתצוגה מקדימה זו לבדיקות מוקדמות ומשוב.
https://api.orcarouter.aimax_tokensresponse_formatseedstopstructured_outputstemperaturetop_p| לבקשה | $0.2400 |
|---|---|
| מטבע | USD |
| עמלה קבועה לכל קריאת API (מודלי יצירת תמונה) | |
על מה מפתחים מדברים השבוע
GET /api/public/models/google/gemini-3-pro-image-previewפתיחה @misc{orcarouter_gemini_3_pro_image_preview,
title = {Nano Banana Pro (Gemini 3 Pro Image Preview) API},
author = {Google},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/google/gemini-3-pro-image-preview}
}Google. (2025). Nano Banana Pro (Gemini 3 Pro Image Preview) API. OrcaRouter. https://www.orcarouter.ai/models/google/gemini-3-pro-image-preview