
סיכום בינה מלאכותית — 14 באוגוסט 2026
DeepSeek V4-Pro זמין בגרסה כללית עם העלאת מחירים מפתיעה; Cerebras מאיצה את GPT-5.6 Sol פי 14; Anthropic מגדירה מצב אוטומטי כברירת מחדל ב-Claude Code; סין מבטלת את עסקת Manus.
By BINA Editorial
ארבע סיפורים שולטים בכותרות הבינה המלאכותית ב-14 באוגוסט: OpenAI ו-Cerebras משיגות האצה של פי 14 ב-inference של GPT-5.6 Sol; Anthropic מפעילה את המצב האוטומטי של Claude Code כברירת מחדל למשתמשים בתשלום; DeepSeek מעבירה את V4-Pro לזמינות כללית — ומלווה את ההכרזה בעלייה חדה במחירים שמפתיעה מפתחים; ורגולטורי סין מסיימים את ביטול הכפוי של רכישת Meta בשווי 2 מיליארד דולר של Manus, בעוד Tencent ממתינה בקלסים.
OpenAI ו-Cerebras מאיצות את GPT-5.6 Sol פי 14
OpenAI ו-Cerebras הכריזו ביום חמישי בבוקר על "Ultrafast Mode" עבור GPT-5.6 Sol, המגיע ל-750 טוקנים פלט לשנייה — כ-14 פעמים יותר מהמהירות הרגילה של כ-53 טוקנים לשנייה ב-Standard Mode. השותפות מנצלת את ארכיטקטורת ה-wafer-scale של Cerebras, שעוקפת את צוואר הבקבוק של רוחב פס הזיכרון שמאט אשכולות GPU קונבנציונליים בשלב ה-decoding של המודל.
ה-Ultrafast Mode נכנס לתצוגה מקדימה מוגבלת ללקוחות API היום. OpenAI מתארת את GPT-5.6 Sol כמודל החזק ביותר שלה לעבודות ממושכות בתחום המקצועי — כתבי בית דין, מודלים פיננסיים, דוחות הנדסיים — משימות שבהן מכפיל מהירות של פי 14 מתורגם ישירות למחזורי איטרציה מהירים יותר וסמן חביון נמוך יותר בצינורות ייצור.
הסדר המסחרי מגדיר את Cerebras, הנסחרת ב-NASDAQ תחת הסמל CBRS, כשותפת תשתית inference ולא כמתחרה ל-OpenAI. הוא ממשיך דפוס גלוי לאורך 2026: מעבדות הקצה מייעדות inference מתמחה לסטארטאפים של שבבים במקום לבנות או לרכוש את החומרה בעצמן.
אין שינוי בתמחור או באיכות הפלט לצד הרמה החדשה. OpenAI לא אמרה מתי ה-Ultrafast Mode יצא מהתצוגה המקדימה המוגבלת או יגיע לרמות enterprise ו-consumer.
Anthropic הופכת את המצב האוטומטי של Claude Code לברירת המחדל
החל מהיום, סשנים חדשים של Claude Code בתוכניות Pro, Max ו-Team פועלים במצב אוטומטי כברירת מחדל. במקום לעצור ולבקש אישור אנושי לפני כל עריכת קובץ, פקודת shell או קריאת רשת, Claude Code ממשיך אלא אם הסיווג המובנה שלו שופט פעולה כ"בלתי הפיכה, הרסנית, או כזו המכוונת מחוץ לסביבתך."
הרציונל למעבר מגיע ממחקר מבוקר של Anthropic עצמה: בודקים אנושיים זיהו פקודה מסוכנת שהושתלה במכוון ב-13.6% מהמקרים; הסיווג זיהה אותה ב-89% מהמקרים. על בסיס נתונים אלה, בקרה המפוקחת על ידי AI עולה על בדיקת ספוט אנושית לניטור פקודות שגרתי.
משתמשים שהגדירו קודם מצב הרשאות מותאם אישית שומרים עליו. מי שנעל העדפה אינו רואה שינוי. Anthropic גם הסירה את חיוב הטוקנים הנוסף עבור הסיווג בתוכניות בתשלום — עלות שהיססה בעבר חלק מהצוותים להפעיל את המצב האוטומטי.
משתמשי Enterprise, API ופלטפורמת ענן יכולים לצפות לאותה ברירת מחדל תוך 30 הימים הבאים. המהלך הוא האות הברור ביותר עד כה ש-Anthropic רואה בקידוד אגנטי המפוקח על ידי AI כאמין יותר מהתהליך של מבנה-אנושי-בלולאה-לכל-פקודה שהושק. האם קהילת המפתחים הרחבה תסכים יתברר עם הגיע המשוב מהשקת היום.
DeepSeek V4-Pro זמין בגרסה כללית — ומביא עלייה במחיר של עד פי 12
DeepSeek העבירה את V4-Pro מתצוגה מקדימה לזמינות כללית ביום רביעי, ומינתה את ה-build כ-DeepSeek-V4-Pro-0813. המודל היה בתצוגה מקדימה מוגבלת מאפריל; יום רביעי היה הפעם הראשונה שנפתח לגישת API בלתי מוגבלת. התזמון הוצל מיד על ידי הכרזת תמחור: מבנה חיוב חדש שעות שיא ושעות שפל נכנס לתוקף ב-16:00 UTC ב-16 באוגוסט.
במדדי ביצועים המתמקדים בקידוד אוטונומי ושימוש בכלים, V4-Pro קיבל ציון 87.9 ב-Terminal Bench 2.1, 62.7 ב-DeepSWE, ו-61.5 ב-NL2Repo — מספרים שמציבים אותו בתחום תחרותי עם מודלי מערב מרחיביים במשימות ספציפיות לסוכנים. חלון ההקשר מגיע ל-1 מיליון טוקנים, עם אורך פלט מקסימלי של 384,000 טוקנים. מצבי thinking ו-non-thinking שניהם נתמכים, וה-API חושף כעת שלושה רמות מאמץ — low, high, ו-max — עבור תקציב ההיגיון.
V4-Pro גם תואם לחלוטין לפורמט OpenAI Responses API, מה שאומר שמפתחים יכולים להפנות קוד לקוח קיים לנקודת הקצה של DeepSeek ללא שכתוב. יכולת פעולה הדדית מכוונת זו מורידה את עלות העברת העומסים — או חזרה, עכשיו שהמחיר השתנה.
שינוי המחיר הוא הפרט המרכזי. בשעות שיא (01:00–04:00 ו-06:00–10:00 UTC), כניסת cache-miss עולה ל-$1.32 למיליון טוקנים, לעומת $0.435. טוקני פלט קופצים ל-$3.96 למיליון בשעות שיא, לעומת $0.87. תעריפי שעות שפל עומדים על מחצית מרמת השיא. בהתאם למועד הפעלת העומסים, עליות עלות אפקטיביות נעות מכ-פי 1.9 על טוקני קלט ועד פי 12 על קריאות cache. DeepSeek מגדירה את השינוי כמנגנון עיצוב ביקוש שנועד להעביר תעבורה לתקופות פחות עמוסות, אך הכנסת השינוי באותו יום כמו שחרור ה-GA נותנת למפתחים רק 72 שעות להתאים לפני שהעלויות משתנות.
סין מבטלת את עסקת Manus של Meta — Tencent מתקרבת
סטארטאפ סוכני AI Manus הכריז ב-11 באוגוסט שהוא יחזור לפעול כחברה עצמאית לאחר שרגולטורים סיניים הורו ל-Meta לבטל את רכישתה. Meta השלימה את העסקה ב-29 בדצמבר 2025, בכ-2 מיליארד דולר. ועדת הפיתוח והרפורמה הלאומית של סין הוציאה את צו הנסיגה שלה באפריל 2026, בציון הפרות הקשורות לייצוא טכנולוגיה וכללי השקעות זרות.
להפרדה יש השלכות מיידיות ומעשיות למשתמשים. נתונים שנוצרו ב-29 בדצמבר 2025 ואילך — התאריך שבו בעלות Meta החלה — יימחקו בין ה-23 ל-24 באוגוסט בתחומי השיפוט הכפופים לצו הרגולטורי. למשתמשים מושפעים יש חלון גיבוי עד 7:59 בערב EDT ב-22 באוגוסט; גישת שחזור נפתחת מ-25 באוגוסט.
במהלך סקירת הפירוק, המייסדים-שותפים של Manus, המנכ"ל שיאו הונג ומדען הראשי ג'י ייצ'או, דווחו כי נאסר עליהם לצאת מסין בזמן שהרשויות בחנו את העסקה. Reuters ו-Financial Times דיווחו ביולי כי Tencent נמצאת במשא ומתן להיות בעל המניות הגדול ביותר של Manus — תוצאה שתחזיר את החברה לבעלות מקומית סינית מבלי לפתוח מחדש נתיב רכישה מערבי.
הביטול הכפוי הוא הדוגמה הישירה ביותר עד כה לרגולטורים סיניים שמבטלים באופן פעיל רכישת AI יוצאת שהושלמה. הוא קובע תקדים שיהיה גורם ב-due diligence לכל עסקה עתידית הכוללת חברת AI סינית ורוכש זר. עבור משתמשי Manus, שבנו תהליכי עבודה סביב עוזר הסוכן האוטונומי שלה, האפיזודה מעלה הן בעיית רצף נתונים בטווח הקצר והן שאלה פתוחה לגבי מפת הדרכים של המוצר תחת בעלות חדשה.