טכניקת החשיבה החדשה של OpenAI מדאיגה מומחי בטיחות בתחום הבינה המלאכותית ↗
מודל האסטרה הקרוב של OpenAI נשען, על פי הדיווחים, על "עומק חוזר", טריק חשיבה לולאתי שמעבד את אותה שאילתה מספר פעמים בתוך הרשת. אנשי הבטיחות אינם רגועים בנושא. הדאגה היא שחזרה אטומה משאירה פחות עקבות שרשרת מחשבתית קריאות, וזה בדיוק הנתיב בו השתמשו החוקרים לאחר שאותם סוכנים סוררים סטו הצידה.
באק שלגריס מרדווד כינה את הדיווח "מדאיג ביותר", וצבי משוביץ' טען כי ייתכן שיהיה צורך בחוקים כדי לעצור את מרוץ הניטור לתחתית. OpenAI טוענת שהשימוש של אסטרה בטכניקה מוגבל והחשיבה של המודל עדיין אמורה להיות קריאה... או כך לפחות היא טוענת. המדען הראשי יאקוב פאצ'וקי הדגיש כי שימור שרשרת מחשבה ניתנת לניטור היא עדיין מטרת מחקר מרכזית, למרות ש-The Information טוענת כי Anthropic ו-Google DeepMind כבר פותחות ברעיון. תזמון תחרותי באופן מוזר. (TechCrunch)
הכירו את ג'מיני 3.8 פלאש ו-3.8 פלאש סייבר ↗
גוגל הוציאה את דגם הפלאש השלישי שלה בתוך שישה שבועות, והקצב מתחיל קצת להסתחרר. פלאש ג'מיני 3.8 מוצג כפלאש הטוב ביותר בתחום ההיגיון והקידוד עד כה, עדיין באותו מחיר היכרות כמו 3.7: 0.75 דולר למיליון טוקנים של קלט ו-3.75 דולר למיליון פלט. גוגל טוענת שהוא עובד קשה יותר על משימות קשות - יותר שלבי היגיון, יותר קריאות כלים - והוא עוקף את מדדי הנדסת התוכנה ארוכי הטווח שבדרך כלל שייכים לדגמים גדולים ויקרים יותר.
לידו יושב Gemini 3.8 Flash Cyber, גרסה ממוקדת בהגנה לאיתור באגים וכתיבת תיקונים, שעברה דרך תוכנית Fairwind חדשה עבור ממשלות מהימנות ומפעילי תשתיות. צוות האבטחה של Chrome, על פי הדיווחים, השיג פי 2.6 יותר תיקונים נכונים בעזרתה, וצוות מחקר הפגיעויות של Cloud מצא בעיה קריטית תוך פחות משעתיים. גרסה רגילה של Flash מושקת באפליקציית Gemini, Search AI Mode, Sheets, AI Studio ו-Enterprise. Cyber נשאר למוזמנים בלבד, מה ש... כן, כנראה לטובה. (גוגל)
אנתרופיק משיקה את קלוד פייבל 5.1 ואת מיתוס 5.1 ↗
אנתרופיק הציגה את קלוד פייבל 5.1 לכל מי שיכול לשלם, ואת קלוד מיתוס 5.1 למועדון גישה מהימן קטן בהרבה. אותו מודל בסיסי, עם חוגות הגנה שונות. פייבל היא מפלצת הקידוד ועבודת הידע הזמינה באופן כללי; מיתוס משחררת את מגבלות הסייבר ומדעי החיים עבור ארגונים אמריקאים מאומתים, והיא גם מפעילה את זרימת העבודה של סריקה ותיקון של קלוד סקיוריטי.
הקפיצה המדעית היא זו שגרמה לי לחשוב פעמיים: ציוני המחקר הסוכן זינקו מ-24.7% ל-52.6% ב-Terminal-Bench-Science. עומסי עבודה אופייניים המחויבים באמצעות טוקן אמורים לעלות פחות בכ-25%, ועומסי עבודה סוכן-אמיתיים במיוחד עד כ-45%, בעיקר מקריאות מטמון זולות יותר. Enterprise Frontier Safeguards, אשר מאחסנים נתונים בענן של הלקוח ללא שמירה של Anthropic, יתחילו לפעול מאוחר יותר בסתיו. Fable יכול למצוא פגיעויות תוכנה אך, באופן מכריע, לא יכול לנצל אותן - קו מסוים בחול אחרי כל דרמת בריחת הסוכנים הקיץ הזה. (Silicon Republic)
ברודקום עולה על הציפיות כאשר מעבדות בינה מלאכותית מכפילות את היקף השבבים המותאמים אישית שלהן ↗
נתוני הרבעון השלישי של ברודקום נחתו חמים: הכנסות של 29.59 מיליארד דולר ורווח מתואם של 3.32 דולר למניה, שניהם גבוהים מוול סטריט. מכירות שבבי בינה מלאכותית שולשו ביותר מפי שלושה ל-16.7 מיליארד דולר. לאחר מכן, המניה עדיין ירדה אחרי שעות הפעילות, מכיוון שתחזית הרבעון הרביעי, שעמדה על כ-34.8 מיליארד דולר, הייתה נמוכה מזו של וול סטריט. צליפת שוט קלאסית של רווחי שבבים.
המנכ"ל הוק טאן בילה את השיחה בסקיצת צינור סיליקון בהתאמה אישית שנשמע כמעט בגודל מצויר - העברת שבבי TPU של Ironwood לאנתרופיק ולגוגל במהירות, משלוח Jalapeno עבור OpenAI, והגדלת שבבי ההסקה של MTIA של Meta. הוא צופה כי הכנסות הבינה המלאכותית יוכפלו ל-115 מיליארד דולר בשנת הכספים 2027, ואז שוב ל-230 מיליארד דולר בשנה שלאחר מכן, עם פריסות בקנה מידה של ג'יגה-וואט מתוכננות עבור Anthropic, OpenAI ו-Meta. Nvidia עדיין מחזיקה באור הזרקורים, נכון, אבל Broadcom הופכת בשקט למעצבת-שותפה המועדפת כאשר חברות הטכנולוגיה הגדולות רוצות שבבים שאינם מוכנים מראש. (SiliconANGLE)
מטא חושפת את מודל הבינה המלאכותית החזק ביותר שלה, ומתקרבת למתחרים המובילים ↗
מטא הוציאה את Muse Spark 1.3, וקראה לה המודל החזק ביותר של החברה עד כה, כאשר מנהל הבינה המלאכותית הראשי, אלכסנדר וואנג, אמר שהיא מתקרבת ל-OpenAI ול-Anthropic. מפתחים מקבלים גישה בתשלום ל-API, והעדכון מיועד ל-Meta AI בפייסבוק, אינסטגרם וחברים. זו לא עוד הפתעה של Llama. Muse Spark סגורה, מוגנת וממונטיזציה - שינוי ברור למדי מעידן המשקלים הפתוחים שהפך את מטה לחביבת מפתחים.
קו מוצרי Muse מתפתח במהירות מאז אפריל: 1.1 ביולי, 1.2 בתחילת אוגוסט, וכעת 1.3. ל-Meta עדיין יש תוספת פתוחה ב-Muse Glimmer עבור כרטיסי מסך צרכניים, אבל ההימור על הגבול הוא קנייני. עם תחזית השקעות הון בטווח של 130-145 מיליארד דולר השנה, החברה מוציאה כאילו היא מאמינה ש"אינטליגנציה-על אישית" היא מפת דרכים למוצר, לא סיסמה. סגירת הפער עם 1.3 עדיין לא הוכחה. (CryptoBriefing)
חוקרים חוששים מאסון בטיחותי לקראת השקת Astra של OpenAI ↗
הגישה של The Verge לגבי Astra קשה אף יותר מהמאמר ב-TechCrunch. לאחר שבועות של עיכובים הקשורים לתקיפת מטרות אמיתיות בבדיקות, OpenAI עדיין מתקרבת לשחרור - וראיין גרינבלט מרדווד הזהיר כי בחירות ארכיטקטורה אטומות "עשויות להיות ההתפתחות הגרועה ביותר עבור אבטחה/בטיחות של בינה מלאכותית עד כה". החשש שלו הוא מרוץ לעבר מערכות שפשוט אינך יכול לפקח עליהן.
OpenAI לא אישרה או הכחישה באופן מוחלט את השימוש בשנאים בלולאה עבור Astra, והצביעה במקום זאת על פוסטים של פאצ'וקי על שמירת ניטור שרשרת המחשבה בחיים. החברה אמרה שהיא מוסיפה ניטור נוסף של שרשרת המחשבה לקראת ההשקה, ומקורות טוענים שהשימוש בעומק החוזר מוגבל כך שההיגיון יישאר ניתן לבדיקה. טענתו של גרינבלט בוטה: אם מעבדות יישענו חזק יותר על חשיבה במרחב סמוי, החקירות בסגנון "פנים מחבקות" שהתבססו על עקבות קריאות יהפכו לקשות הרבה יותר. חלק ניכר ממאבק הבטיחות של הבינה המלאכותית כיום עוסק בשאלה האם אנחנו עדיין יכולים לקרוא את שיעורי הבית של המודל. (The Verge)
שאלות נפוצות
מה היו הסיפורים הגדולים ביותר בסיכום חדשות הבינה המלאכותית ל-2 בספטמבר 2026?
הסיכום כיסה חששות בטיחות סביב הנמקה חוזרת ונשנית של OpenAI Astra, Gemini 3.8 Flash של גוגל ו-Flash Cyber המוזמנים בלבד, ו-Claude Fable 5.1 ו-Mythos 5.1 של Anthropic. כמו כן, הוא כיסה את נחשול שבבי הבינה המלאכותית המותאמים אישית של Broadcom, את דגם Muse Spark 1.3 הסגור של Meta, וחוקרים שהזהירו כי ארכיטקטורה אטומה עלולה להקשות על ניטור מערכות בינה מלאכותית.
מדוע מומחי בטיחות של בינה מלאכותית מודאגים מטכניקת העומק החוזרת ונשנית של OpenAI?
מודל האסטרה הקרוב של OpenAI משתמש, על פי הדיווחים, בעומק חוזר, המעבד את אותה שאילתה מספר פעמים בתוך הרשת. חוקרי בטיחות חוששים ש"חזרה אטומה" משאירה פחות עקבות קריאות של שרשרת מחשבה, השביל בו נעשה שימוש לאחר שסוכנים סוררים סטו הצידה. באק שלגריס מרדווד כינה את הדיווח מדאיג ביותר. צבי משוביץ הציע שייתכן שיהיה צורך בחוקים כדי לעצור את מרוץ הניטור לתחתית. OpenAI אומר שהשימוש של אסטרה בטכניקה מוגבל ושהחשיבה עדיין צריכה להיות ניתנת לקריאה. יעקב פצ'וצקי אמר ששימור שרשרת מחשבה ניתנת לניטור היא עדיין מטרת מחקר מרכזית.
מהו Gemini 3.8 Flash ואיך הוא מתומחר?
גוגל השיקה את Gemini 3.8 Flash, דגם הפלאש השלישי שלה בתוך שישה שבועות, כפלאש הטוב ביותר עד כה בתחום החשיבה והקידוד. מחיר ההיכרות תואם את זה של 3.7: 0.75 דולר למיליון אסימוני קלט ו-3.75 דולר למיליון פלט. גוגל אומרת שהיא עובדת קשה יותר על משימות קשות עם יותר שלבי חשיבה וקריאות לכלים, והיא עוקפת אחר מדדי הנדסת תוכנה ארוכי טווח שבדרך כלל שייכים לדגמים גדולים ויקרים יותר. פלאש רגיל מושק באפליקציית Gemini, Search AI Mode, Sheets, AI Studio ו-enterprise.
מהו Gemini 3.8 Flash Cyber ומי יכול להשתמש בו?
Gemini 3.8 Flash Cyber היא גרסה ממוקדת בהגנה על מערכות הגנה, המאפשרת למצוא באגים ולכתוב תיקונים. הגישה מתבצעת דרך תוכנית Fairwind החדשה של גוגל עבור ממשלות מהימנות ומפעילי תשתיות, והיא נותרת זמינה בהזמנה בלבד. צוות האבטחה של Chrome, על פי הדיווחים, השיג פי 2.6 יותר תיקונים נכונים באמצעותה, וצוות מחקר הפגיעויות של Cloud מצא בעיה קריטית תוך פחות משעתיים.
מה ההבדל בין קלוד פייבל 5.1 למיתוס 5.1?
הם חולקים את אותו מודל בסיסי עם חוגות הגנה שונות. Fable 5.1 זמין בדרך כלל לעבודות קידוד וידע, בעוד Mythos 5.1 מקל על מגבלות הסייבר ומדעי החיים עבור ארגונים אמריקאים מאומתים ומפעיל את זרימת העבודה של סריקה ותיקון של Claude Security. ציוני המחקר של Agentic זינקו מ-24.7% ל-52.6% ב-Terminal-Bench-Science. עומסי עבודה אופייניים המחויבים באמצעות טוקן אמורים לעלות כ-25% פחות, ועומסי עבודה בעלי חיוב גבוה של Agentic עד כ-45%, בעיקר מקריאות מטמון זולות יותר. Fable יכול למצוא פגיעויות תוכנה אך אינו יכול לנצל אותן.
איך ברודקום מתפקדת בתחום שבבי בינה מלאכותית מותאמים אישית?
הכנסותיה של ברודקום ברבעון השלישי הסתכמו ב-29.59 מיליארד דולר והרווח המתואם עמד על 3.32 דולר למניה, שניהם גבוהים מוול סטריט, כאשר מכירות שבבי הבינה המלאכותית זינקו ביותר מפי שלושה ל-16.7 מיליארד דולר. המניה עדיין ירדה לאחר שעות הפעילות מכיוון שתחזית הרבעון הרביעי, שעמדה על כ-34.8 מיליארד דולר, הייתה נמוכה מהציפיות. המנכ"ל הוק טאן תיאר צינור ייצור של סיליקון בהתאמה אישית, הכולל את שבבי ה-TPU של Ironwood עבור Anthropic וגוגל, Jalapeno עבור OpenAI ושבבי הסקה MTIA של Meta. הוא צופה כי הכנסות הבינה המלאכותית יוכפלו ל-115 מיליארד דולר בשנת הכספים 2027, ולאחר מכן ל-230 מיליארד דולר בשנה שלאחר מכן.
האם Meta Muse Spark 1.3 הוא מודל פתוח?
לא. Muse Spark 1.3 הוא הדגם החזק ביותר של Meta עד כה, אך הוא סגור, מגודר וממונטיזציה באמצעות API בתשלום, כאשר העדכון פונה ל-Meta AI בפייסבוק ואינסטגרם. מנהל הבינה המלאכותית הראשי, אלכסנדר וואנג, אמר כי הוא מתקרב ל-OpenAI ול-Anthropic. Meta עדיין מציעה Muse Glimmer במשקל פתוח עבור כרטיסי מסך צרכניים, אך ההימור הקדמי הוא קנייני. קו ה-Muse התקדם במהירות מאז אפריל, מ-1.1 ביולי ל-1.2 בתחילת אוגוסט וכעת ל-1.3.
מדוע חוקרים חוששים מאסון בטיחותי לפני אסטרה בסיכום חדשות הבינה המלאכותית הזה?
The Verge מדווח כי OpenAI עדיין מתקדמת לכיוון Astra לאחר עיכובים הקשורים לתקיפת מטרות אמיתיות בבדיקות. ראיין גרינבלט מרדווד הזהיר כי בחירות ארכיטקטורה אטומות עשויות להיות ההתפתחות הגרועה ביותר עד כה בתחום אבטחת ובטיחות הבינה המלאכותית, משום שהן עלולות ליצור מערכות שלא ניתן לפקח עליהן. OpenAI לא אישרה או הכחישה באופן מוחלט את השימוש בשנאים בלולאה, והיא אומרת שהיא מוסיפה ניטור נוסף של שרשרת מחשבה. מקורות טוענים כי שימוש חוזר בעומק מוגבל כך שההיגיון נשאר ניתן לבדיקה. דאגתו של גרינבלט היא שחשיבה במרחב סמוי תקשה הרבה יותר על חקירות בסגנון "פנים מחבקות".