נושא01
אז מה בדיוק קרה?
ב-24 ביולי 2026 אנתרופיק שחררה את Claude Opus 5, הדגל החדש שלה - ולא שינתה תו אחד בתמחור. אותם 5 דולר למיליון טוקני קלט, אותם 25 דולר למיליון טוקני פלט, בדיוק כמו ב-Opus 4.8 הקודם. והבעיה הקטנה שזה יוצר למתחרים: זה בערך חצי מהמחיר שגובה Fable 5 על עבודה דומה.
וזה לא שדרוג שצריך לבקש. במנוי Claude Max, המודל כבר רץ אצלכם כברירת מחדל. במנוי Pro הוא הפך לאופציה החזקה ביותר שיש לכם. בלי הגדרות, בלי רשימת המתנה - פשוט מחליפים דור בלי לשים לב.
כשמתחרה מעלה מחיר ואתה משאיר אותו בדיוק על כנו - זו לא נדיבות. זו הודעה שהמרוץ כבר הוכרע.
נושא02
למה דווקא עכשיו?
התזמון לא מקרי. שבועיים לפני ההשקה, OpenAI שחררה מודל מתחרה. שמונה ימים לפני זה, חברה סינית פרסמה את מודל הקוד הפתוח הגדול ביותר שלה עד היום. וגוגל, שאמורה הייתה להשיק את הדור הבא שלה, פספסה את הדדליין בחודשיים. אנתרופיק בחרה לא להיכנס לזירה הזאת עם מודל יקר וחכם יותר - היא נכנסה עם מודל באותו מחיר בדיוק, שמנצח את המתחרה היקר בשורה ארוכה של מבחנים.
במבחן שבודק קידוד אוטונומי (FrontierBench) Opus 5 מגיע ל-44.4%, לעומת 33.7% של Fable 5. במבחן הפעלת מחשב עצמאית (OSWorld) הוא קפץ מ-55.7% אצל Opus 4.8 ל-70.6%. ובמבחן חשיבה מופשטת (ARC-AGI-3) הוא מגיע ל-30%, לעומת 7.8% בלבד אצל GPT-5.6 Sol, המודל המתחרה של OpenAI.
נושא03
מה זה 'מחוון מאמץ', ולמה זו בעצם המהפכה הקטנה כאן?
עד עכשיו קיבלתם דגם אחד עם רמת חשיבה קבועה. עכשיו, בכל בקשה, אתם בוחרים - נמוך, בינוני או גבוה. מייל שגרתי? תשאירו על נמוך, זה מהיר וזול. בעיה מסובכת שדורשת שהמודל יבדוק את עצמו, ינסה כמה גישות ויתקן טעויות באמצע הדרך? תעלו לגבוה.
זה כמו שיהיה לכם עובד אחד שיודע גם לענות מהר על שאלה פשוטה, וגם לשבת ולחשוב עמוק כשצריך - ואתם קובעים מתי איזה מצב פעיל, בלי לשלם על יועץ יקר בכל פעם שאתם רק צריכים תשובה מהירה.
נושא04
מה זה אומר בפועל?
בדוגמאות שאנתרופיק פרסמה, Opus 5 קיבל תמונות של רכיב מכני בלי גישה לקובץ המקורי - וכתב קוד ראיית מחשב משלו כדי לשחזר מהן מודל תלת-ממדי מדויק. במקרה אחר הוא תיקן באג בכלי ניהול חבילות קוד פתוח בצורה יסודית יותר מהתיקונים שהקהילה עצמה כתבה. זו לא עוזרת שעונה על שאלות - זו מערכת שבודקת את העבודה של עצמה וממשיכה גם כשהדרך הברורה חסומה.
לבעל עסק זה מתורגם למשהו מוחשי יותר: נותנים למודל מטרה, לא שאלה. 'תבדוק מה שלושת המתחרים שלי עושים ברשתות החודש, תבנה דף נחיתה מתחרה, תכתוב שלוש גרסאות מודעה ותציע תקציב יומי' - בדיוק סוג המשימה שבנצ'מארק חדש בשם AutomationBench נועד לבדוק, ו-Opus 5 קפץ בו מ-17% ל-26% לעומת הדור הקודם. במבחן מקביל של מחקר באינטרנט (BrowseComp) הוא מגיע ל-90.8% הצלחה.
נושא05
השורה התחתונה
אנתרופיק לא ניסתה למכור לכם מודל יקר יותר - היא הוכיחה שהיא יכולה לתת יותר באותו מחיר, וזה מוריד את הרף שצריך לעבור לפני שבודקים אם AI שווה את זה לעסק שלכם. השאלה האמיתית היא לא אם יש לכם גישה למודל הכי חזק - כי כנראה כבר יש, בלי שביקשתם. השאלה היא אם אתם יודעים איך להשתמש בו נכון, ממחוון המאמץ ועד הדרך לתת לו מטרה ולא רק שאלה. וזו בדיוק הנקודה שבה מתחילה הסדרה 'קלוד למתחילים מאפס' - לא ללמד אתכם על AI, אלא ללמד אתכם לעבוד איתו.
