כרטיס כותרת עם הכיתוב "Claude Opus 5.5: מה שלחיצה אחת באמת מרנדרת", עם כתובית משנה "סרטון הפרומו לא נוצר. הפייפליין שמאחוריו ניתן להתקין.", עם כותרת תחתונה "מחירים לפי Anthropic; נתוני מדד לפי Artificial Analysis."
Engineering & Research

Claude Opus 5.5 כתב סרטון השקת מוצר: מה "קליק אחד" באמת מרנדר

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

פוסט ב-X מתאריך 2026-09-24 אומר ש-Claude Opus 5 הפיק סרט פרומו למוצר בשם CodePilot, שנוצר בקליק אחד, ושהוא מרסק את GPT-6 Astra — המודל שהספק שחרר ב-4 בספטמבר. הפוסט הוא מאת 归藏 (op7418), מעצב מוצרים שמאגרי ה-skill שלו הפכו בשקט לערוץ הפצה בזכות עצמם, והפרט שחשוב יותר מהסרט הוא המשפט בסוף: תהליך העבודה נטמע כעת לתוך מאגר ציבורי בשם guizang-product-video-skill, שכל אחד יכול להתקין בתוך Claude Code או Codex. אז השאלה המועילה אינה אם הפרומו נראה טוב — המראה של דמו הוא טענה ממקור יחיד שאי אפשר להפריך לכאן או לכאן — אלא מה המאגר הזה באמת מספק, מה העלות של הרצתו, ומה הרישיון שלו מתיר לך לעשות עם הסרטון שהוא יוצר.

תשובה קצרה, וזה החלק שהריפוסטים משמיטים. Claude Opus 5.5 לא מפיק וידאו. הוא כותב תוכנית שמרנדרת וידאו, ואז ffmpeg מקודד את הפריימים שהמכונה שלך יצרה. התוצר היקר בצינור הזה הוא לא קובץ ה-MP4. זהו תהליך העבודה של פרומפט ואימות שעוטף אותו, שזה בדיוק הדבר שניתן להתקין כעת.

ההדגמה הפסיקה להיות הדגמה, וזו החדשות האמיתיות

Claude Opus 5.5 שוחרר ב-22 בספטמבר 2026 במחיר של 4 דולר למיליון טוקנים בקלט ו-20 דולר למיליון טוקנים בפלט, עם חלון הקשר של מיליון טוקנים ועד 128 אלף טוקני פלט. הוא בן שלושה ימים וזמין באופן כללי, ולכן זה אינו מאמר הדלפה: המודל אמיתי, מתומחר וניתן לניתוב, ואין השקה לשער לגביה. מה שחדש באות הוא האריזה.

למאגר שמאחורי ההדגמה יש צורה שאפשר לאמת. הוא הפך לציבורי ב-18 בספטמבר 2026, הקומיט האחרון שלו נכנס ב-22 בספטמבר — באותו יום שבו הושק Claude Opus 5.5 — ונכון לכתיבת שורות אלה יש בו 261 כוכבים ו-23 פורקים תחת רישיון AGPL-3.0, עם מסלול רישוי מסחרי נפרד. התאריכים האלה הם העיקר. פוסט הדגמה חד-פעמי שווה משיכת כתפיים; מאגר שמקבע את הטכניקה לשישה שלבים ממוספרים, שמונה מסמכי עזר וחמישה סקריפטים הוא משהו שקורא יכול להתקין אחר הצהריים. ההפצה חשובה יותר מהתוצר, כי התוצר ממילא נועד להיראות טוב, וזרימת העבודה היא מה שאפשר למעשה לשאול.

המסגור של המחבר עצמו כן לגבי השושלת. ה-README אומר שהמיומנות היא התהליך שהוא חידד בזמן יצירת הסרט CodePilot, שנכתב כדי שניתן יהיה להשתמש בו שוב במוצרים אחרים. גם סרטון ההיכרות אינו מופץ עם חבילת ההתקנה — ה-README משאיר הערת מציין מקום במקום שבו אמור להופיע הקישור לסרטון שהועלה, בעוד שהתמונות הדוממות שנשלפו ממנו נמצאות בנכסי ה-README של המאגר. זה דבר קטן, והוא מאלף: הדבר שמופץ הוא השיטה, לא הצילום.

מה שהמיומנות למעשה מפיקה, שלב אחר שלב

תהליך העבודה מורכב משישה שלבים, והצורה שלהם מספרת לך באיזה סוג של כלי מדובר:

• קודם כול ההיקף — המוצר, טווח הגרסאות, הקהל, הפלטפורמה, יחס הגובה-רוחב, השפה והסגנון מאושרים לפני שבונים משהו, וההיקף הנבחר נכתב לקובץ תוכנית כך שהסרט הנמסר לא מתיימר בשקט לכסות את כל המוצר.

• תוכן אמיתי במקום השני — הסוכן קורא את המאגר ואת הערות השחרור, בודק אילו תכונות נשלחו בפועל ולא רק הוכרזו, ומחבר רכיב מוצר אותנטי אחד לפני שמתרחש כל עיצוב.

• סטוריבורד וקופי בשלב השלישי — השינויים שראויים לספר הופכים לרשימת שוטים, הכיתובים נכתבים כמשפטים פשוטים, ופריימים מרכזיים מרונדרים לבדיקה לפני שהאנימציה מתחילה.

עיקרון רביעי — תנועה: ציר זמן מאסטר שניתן לדלג בו מניע את מצב הרכיבים, את הכניסות, את המעברים ואת צילומי הפרטים.

• סאונד חמישי — הפסקול מסונתז בקוד עבור הסרט המסוים הזה, אפקטי הקול מיושרים לפעולות שעל המסך, והמוזיקה מונמכת מתחת לרמזים חשובים.

• אימות בסוף — מסגור, גופנים, תמונות, לוגואים, סנכרון אודיו והקובץ הסופי נבדקים, והפרויקט מבחין בין מה שאומת על ידי מכונה לבין מה שעדיין דורש עיניים ואוזניים אנושיות.

מה שהמאגר מספק הוא מפורש באופן יוצא דופן, והגרסה המפורשת שימושית יותר מהסיכום. תיקיית references/ שלו מכילה שמונה מסמכים — קליטה, מאגר וסגנון, צינור רכיבים, סיפור וקופי, מקורות אודיו, אודיו ו-QA, מדריך התחלה ומקרה בוחן — ותיקיית scripts/ שלו מכילה חמישה: בדיקת סביבה, אתחול פרויקט, סינתזת אפקטי קול, מיקס אודיו ובדיקת מסירה שרצה על הסרט המוגמר. פרויקט ההתחלה הוא דוגמה חיה, ו-tests/ מכיל גם בדיקות רגרסיה של סקריפטים וגם בדיקות אינטגרציה של רכיבים. רשימת התלויות קונקרטית באותה מידה: Node 22 ואילך, Python 3.9 ואילך, FFmpeg ו-ffprobe, Playwright Chromium עבור צינור הרינדור בדפדפן, בתוספת מאגר המוצר שלך והתלויות שלו. שום דבר ברשימה הזו אינו שירות וידאו, שזו בחירת העיצוב שכל העניין נשען עליה.

Single-column scoreboard card titled "Claude Opus 5.5 - the scoreboard" listing Released: 22 September 2026; Price in / out: $4.00 / $20.00; Cached input: $0.20; Context: 1,000,000; AA Index, max effort: 58, rank 1 of 210; Output tokens per index task: 260M, rank 95 of 210; footer "Index figures per Artificial Analysis; price and context per Anthropic."

"לחיצה אחת" היא המילה של המחבר עצמו, וה-FAQ שלו עצמו סותר אותה

הסימן אומר 一键生成 — נוצר בלחיצה אחת. ה-FAQ של המאגר עונה ישירות על השאלה הקרובה ביותר לכך, והתשובה היא לא. לשאלה אם מסירת כתובת של מאגר מספיקה כדי לקבל סרט מוגמר, התשובה של ה-README עצמו היא שלפעמים עדיין צריך להוריד את המאגר, להשלים תלויות ולאמת מצבי דמו, וזהו תהליך שמאפשר ל-AI לסיים את העבודה צעד אחר צעד ולא ממיר בלחיצה אחת שמתעלם מסביבת הפרויקט שלך. המחבר מדייק לגבי הכלי שלו יותר משהפוסט על הכלי שלו מדייק.

יש בלם שני בזרימת העבודה עצמה. השלב הראשון מחייב החלטה שהסוכן נאסר עליו במפורש לקבל בשם המשתמש: איזה טווח גרסאות ואילו משטחי פלטפורמה הסרט מכסה. הנימוק של ה-README ראוי לציטוט בעיקרו — היסטוריית המאגר יכולה לומר לך אילו גרסאות קיימות, אבל לא אילו מהן אתה רוצה לפרסם — ויש להצהיר על משטחי פלטפורמה שאינם גמורים בעת המסירה, כדי שצופים לא יניחו שהסרט מכסה את כל המוצר. זהו צעד ממשל, לא צעד רינדור, והוא ההוכחה הברורה ביותר לכך ש"לחיצה אחת" מתארת את הנוחות של המחבר עצמו עם הכלי, ולא את משטח הקלט הממשי של הכלי.

יש גם צורה שהפייפליין מניח, וצורה שהוא אינו מניח. ה-README מציין במפורש את נקודת הפתיחה המוגדרת כברירת מחדל שלו: 45 עד 60 שניות, בפורמט רוחבי, בשפה הסינית. אפשר להתאים את משך הזמן ואת יחס הגובה-רוחב, אבל חיתוך אנכי אינו קרופ — יש לפרוס מחדש את המסגור ואת הטקסט, משום שהקומפוזיציה אינה משמרת את צדדיה. הפסקה הראשונה של היצירה הזו מצטטת את השפה של היצירה עצמה, ולכן כדאי לומר בפשטות שהסרט שעורר אותה הוא פרומו בשפה הסינית ובפורמט רוחבי; אם ההשקה שלך היא באנגלית או אנכית, הקצה תקציב לפריסה מחדש במקום להניח שהמעבר הראשון של הסקיל הוא התוצר שלך.

המקום שבו הטענה על "לחיצה אחת" מחזיקה מעמד הוא צר יותר ועדיין אמיתי: עבור ההדגמה שהוא כבר בנה, הסרט נוצר מהוראה אחת, מפני שההיקף, המוצר והשפה החזותית כבר היו סגורים. זו הקריאה הכנה. הפרומפט היה הודעה אחת; ההכנה לא.

כמה עולה רינדור, ולמה "מרסק את Astra" הוא הציר הלא נכון

ההשוואה בפוסט היא מול GPT-6 Astra, שיצא ב-4 בספטמבר 2026, במחיר של 10 ו-50 דולר למיליון טוקנים עד קלט של 272K טוקנים, כאשר בקשות עם הקשר ארוך מתומחרות מחדש ב-20 ו-75 דולר ומצב מהיר ב-20 ו-100 דולר. במדד העצמאי היחיד שבו נמדדים שני המודלים, השניים קרובים, והסדר תלוי במה שאתה נותן לו משקל.

• מדד האינטליגנציה — Claude Opus 5.5 משיג 58 במאמץ מרבי, ומדורג ראשון מבין 210 מודלים בעמוד של Artificial Analysis שנקרא ב-2026-09-25, לעומת 53 של GPT-6 Astra בהגדרה המקסימלית שלו, שמדורג שישי מבין 210.

• עלות לכל משימת Index — GPT-6 Astra הוא הזול מבין השניים, עם $3.26, לעומת $5.98 עבור Claude Opus 5.5. בציר הזה הפער נע דווקא בכיוון ההפוך.

• אסימוני פלט לכל משימת Index — Claude Opus 5.5 מוציא 260M ומגיע לדירוג מילוליות של 95 מתוך 210; GPT-6 Astra מוציא 60M ומדורג במקום ה-36. היתרון באיכות נקנה בחלקו באמצעות אסימונים.

הנתונים האלה מגיעים מ-Artificial Analysis והם התצורה המסומנת maximum effort עבור כל מודל, ולא הערכה של הספק עצמו. כשקוראים אותם יחד, הם אומרים משהו שימושי יותר מדירוג: Claude Opus 5.5 הוא המודל החזק יותר במדד המפורסם, ו-GPT-6 Astra זול באופן מהותי להרצת משימה עליו. טענה שאחד "מרסק" את האחר היא טענה על פלט של דמו בנקודת זמן אחת, ואף מדד לא תומך במילה הזאת באף כיוון.

יש שורת עלות שלישית שאף אחד מהאינדקסים לא לוכד, והיא זו שקובעת אם כדאי להתקין צינור פרומו. רינדור פריימים אינו קריאת מודל. רינדור של 3,760 פריימים בקצב של 24 פריימים לשנייה פועל על החומרה שלך דרך Chromium במצב headless, והעלות שלו היא זמן קיר וחשמל, לא טוקנים. חשבון ה-API מכסה את התכנון, את הקופי, את חיבור הרכיבים ואת קוד המקור של הרנדרר. הפיצול הזה הוא הסיבה לכך שהטכניקה משתלמת בכלל, ולכך שרשימת התלויות של ה-Skill ארוכה יותר מהפרומפט שלה.

Artificial Analysis model page for Claude Opus 5.5 in its Adaptive Reasoning, Max Effort, Default Fallback configuration, showing Intelligence rank 1 of 210, Speed 93 of 210, Cost 93 of 210, Verbosity 95 of 210, In $4.00 / Out $20.00, cost per Intelligence Index task $5.98, 260M output tokens per Index task, and 210 models in this class.

הרישיון הוא החלק שאיש לא קורא, והוא הקטע הישים ביותר.

כאן המאגר מקפיד במיוחד, וכאן קורא שמתכנן להשתמש בו באופן מסחרי צריך להאט. חלים שלושה משטרים נפרדים, והם אינם מתמזגים לאחד.

• הרישיון הראשי הוא AGPL-3.0. זרימת העבודה, התיעוד, הסקריפטים, פרויקט ההתחלה ונכסי האודיו המקוריים מכוסים על ידו. העתקה או הפצה שלהם מחייבת שמירה על זכויות היוצרים, הרישיון וההודעות, וסעיף האינטראקציה ברשת של AGPL-3.0 משמעו שגרסה שונתה המוצעת למשתמשים דרך רשת חייבת להציע לאותם משתמשים את קוד המקור המתאים.

• סגנון החזותי המוגדר כברירת מחדל אינו AGPL. הרכיבים והסגנונות שהותאמו מ-CodePilot וסופקו כסגנון הגיבוי נותרו תחת Business Source License 1.1 עם ה-Additional Use Grant ותאריך השינוי שלו. ה-README אומר במפורש שתיקייה זו לא קיבלה רישיון מחדש תחת MIT, ושפרויקט המשלב אותה אינו יכול להיות מתואר כ-AGPL בלבד או ככזה שאינו מוגבל לשימוש מסחרי.

• הסרטון שנוצר אינו הופך אוטומטית ל-AGPL. ה-README מציין שהפלט אינו הופך ליצירה ב-AGPL רק מפני שהכלי הזה הפיק אותו — אבל כל רכיב, נכס או קוד מוגן בתוך אותו פלט שומר על התנאים שלו. ההבחנה הזו היא כל העניין עבור צוות שיווק: הרישיון של הכלי והרישיון של הסרט הם שתי שאלות שונות.

המוזיקה היא החלק עם המקור הנקי ביותר והרישיון הברור ביותר. הפסקול המצורף מסונתז ב-Python מצורות גל, רעש, מעטפות ורצף תווים, באורך קבוע של 48 שניות ו-120 BPM, ללא דגימות חיצוניות וללא קריאה למודל גנרטיבי; קוד המקור נמצא במאגר כאסמכתא להתאמה ולא כפסקול קבוע, וברירת המחדל לסרט חדש היא פסקול שנכתב בקוד עבור התסריט החזותי של אותו סרט. אחד עשר אפקטי הקול נוצרים על ידי סקריפט במאגר ב-48 kHz, מונו, 16-bit PCM, עם משכים לכל קובץ וגיבובי SHA-256 המפורסמים במניפסט האודיו. שתי הקבוצות הן יצירה מקורית של מחבר המאגר, ולכן הן מכוסות על ידי AGPL-3.0 יחד עם זרימת העבודה, התיעוד, הסקריפטים ופרויקט ההתחלה.

הפער נוגע למה שהסרט המקורי השתמש בו, והמאגר מטפל בכך בדרך הנכונה. מקרה הבוחן גלוי לב שהצלילים של קליק, פופ, הקלדה והתראות בפרומו של CodePilot היו הקלטות ספרייה מאתר אפקטי קול, שזהות היוצר של כל קליפ ודפי הפרטים לא נשמרו, ושהוא לא ימציא מקורות עבורם. לכן ההקלטות האלה מוחרגות מחבילת ההתקנה ומוחלפות בסט הפרוצדורלי. ההשלכה המעשית היא שהאודיו שמקבלים מהקופסה הוא פשוט במכוון, והפניית המקורות אומרת לך לחפש תחילה בספרייה ולהיעזר בקבצים המובנים רק עבור הקטגוריות שאינך יכול למלא — עם תזכורת שהערת המקור המובנית אינה מכסה כל מה שתוריד כדי להחליף אותם.

מריצים את זה על שתי הרגליים שלנו

שני המודלים בהשוואה נמצאים ב-OrcaRouter, כך שאם השאלה היא לאיזה מהם לכוון צינור עיבוד, הניסוי אינו דורש שני חשבונות או כתיבה מחדש. Claude Opus 5.5 נמצא ב-OrcaRouter במחיר המחירון המפורסם של Anthropic, כשהוא מועבר הלאה ללא כל תוספת — אותם $4/$20 ו-$0.20 לקריאת מטמון שאנתרופיק מפרסמת — ו-GPT-6 Astra נמצא שם באותם תנאים, כך שאפשר להכריע את טענת ה"מוחץ אותו" על החומר של המוצר שלך ולא על ההדגמה של מישהו אחר. מפתח אחד מכסה API אחד ל-200+ מודלים, ו-מעבר אוטומטי לגיבוי פירושו שניסוי שמסתבר כלא מוצלח עולה לך ניסיון חוזר ולא נתיב ייצור. אם אתה רוצה את המודלים עצמם, שניהם נמצאים באותו קטלוג ובאותו חיוב.

OrcaRouter model page for anthropic/claude-opus-5.5 showing input text, image and file modality, vision, tools, JSON and reasoning support, public benchmarks by Anthropic dated 2026-09-22, pricing of $4.00 per 1M input tokens, $20.00 per 1M output tokens and $0.200 per 1M cache reads, and a performance panel with 7.39s p50 time to first token, 131 tokens per second and a 10.3% error rate.

על מה לעקוב, ומה להחליט עכשיו

שני דברים נותרו לא פתורים וכדאי לעקוב אחריהם במקום להניח הנחות. הראשון הוא האם זרימת העבודה ניתנת להכללה מעבר ל-React. ה-README מציין בכנות שקושי אינטגרציית הקומפוננטות משתנה מפריימוורק לפריימוורק, של-React יש דוגמאות עובדות, ושקומפוננטות שזקוקות לשרת, לסביבת ריצה נייטיבית או להקשר כבד עשויות להזדקק לשכבת התאמה. צוות Vue או Svelte צריך לצפות שיידרש לכתוב את השכבה הזו, ולא לרשת אותה.

הדבר השני הוא ההבטחה לניידות בין מודלים חלשים יותר. הפוסט טוען שהתבניות של המיומנות מאפשרות גם למודלים פחותים להפיק תוצאות סבירות, וזה בדיוק סוג הטענה שמאגר ציבורי יכול בסופו של דבר להכריע בה: אם השיטה נושאת את האיכות, התוצאות במודל זול יותר אמורות להחזיק מעמד; אם המודל נושא אותה, הן לא. איש עדיין לא פרסם את ההשוואה הזו, כולל המחבר.

מה שאתה יכול להחליט היום הוא צר יותר ושימושי יותר. אם יש לך מוצר עם רכיבים אמיתיים וגרסה ששווה להכריז עליה, הטכניקה שווה אחר צהריים, והציפייה הכנה שכדאי להביא היא זו: המודל כותב את הרנדרר, המכונה שלך צובעת את הפריימים, ffmpeg יוצר את הקובץ, והרישיון שאתה יורש תלוי באיזה משלושת המשטרים הסרט שלך באמת נוגע. תביא איתך את הציפייה הזו והמאגר יספק. תביא "קליק אחד" ותבלה את השעה הראשונה בלהחליט על מה הסרט, וזה החלק שהכלי צודק כשהוא מסרב להחליט בשבילך.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית