התוצאות הראשונות של חלפיניו מראות מהירות ויעילות מובילות בתעשייה בהסקת בינה מלאכותית ↗
OpenAI פרסמה את תוצאות הביצועים הראשונות עבור Jalapeño, שבב ההסקה המותאם אישית שלה. ב-GPT-OSS 120B, היא אומרת שהשבב סיפק תפוקת שיא גדולה פי 1.9 לקילוואט וכ -1.7 פחות זמן השהייה מקצה לקצה בהשוואה למערכת ההשוואה.
היתרונות נרשמו גם ב-DeepSeek R1 וב-Kimi K2.5. OpenAI מתכננת לפרוס את Jalapeño בתוך תשתית המחשוב שלה, בעוד שעיצובים של הדור השני והשלישי כבר נמצאים בעיצומם... אז כן, OpenAI הופכת יותר ויותר לחברת שבבים, במידה מסוימת. (OpenAI)
קלוד קוקורק סוף סוף זוכר מה אמרת לאפליקציה בצ'אט ↗
אנתרופיק איחד את הזיכרון של קלוד בצ'אט הרגיל ובעבודה משותפת. מידע שנלמד במהלך שיחות יכול כעת לעקוב אחר משתמשים במשימות סוכניות, ובכך להסיר את הטקס המעצבן במקצת של הסבר שוב ושוב על אותו פרויקט.
משתמשים יכולים לבדוק, לערוך ולמחוק נושאים שנזכרו, בעוד שזיכרונות מתעדכנים בזמן שהשיחות עדיין מתנהלות. התכונה מופעלת כברירת מחדל בתוכניות Free, Pro ו-Max. (TechCrunch)
גוגל קלאוד משיקה את ג'מיני אנטרפרייז לתחום המשפטי ↗
גוגל קלאוד חשפה חבילת Gemini Enterprise ייעודית לעורכי דין, ודוחפת את סוכניה מעבר לצ'אט גנרי ונכנסה גם לבחינת חוזים, מחקר משפטי, ניטור רגולטורי, בקשות פרטיות וניסוח מסמכים.
זה כולל מחברים לפלטפורמות כמו Harvey, iManage, Docusign, RelativityOne ו-Thomson Reuters, תוך שמירה על בקרות הגישה והחומות האתיות הקיימות של החברות. השתלטות הקרקעות על ידי סוכני בינה מלאכותית הגיעה למחלקה המשפטית... כצפוי, אבל עדיין די מהר. (פינת העיתונות של גוגל קלאוד)
גוגל קלאוד משיקה את ג'מיני אנטרפרייז לשירותים פיננסיים ↗
גוגל השיקה גם הצעה ספציפית למימון של Gemini Enterprise, הכוללת סוכן מחקר פיננסי מנוהל, יותר מ -50 מיומנויות מיוחדות ו -13 חיבורים למערכות פיננסיות ונתוני שוק.
הפלטפורמה מתמקדת בתהליכי עבודה הכוללים הערכת סיכוני אשראי, ניטור תיקי השקעות, מחקר KYC וניתוח שוק. קבוצת CME ודויטשה בנק הן בין הארגונים שכבר מעורבים - סוכני ארגונים הופכים להתמחות גוברת, כמעט כמו תוכנה שלובשת חליפה. (פינת העיתונות של גוגל קלאוד)
NVIDIA מכריזה על מחשב הרובוטיקה Jetson Orin Nano 2 שיגדיר מחדש את הבינה המלאכותית הבסיסית ↗
אנבידיה הציגה את Jetson Orin Nano 2, מחשב קומפקטי המיועד לרובוטים, רחפנים ומערכות פיזיות-בינה מלאכותית אחרות. הוא מציע 78 טריליון פעולות בשנייה, 8GB של זיכרון ומעבד Arm בעל שמונה ליבות.
Nvidia אומרת שביצועי ההסקה מוכפלים בהשוואה ל-Nano Super הקודם, בעוד שהשוואת הביצועים שלו יכולה לדרוש 40% פחות חשמל. החלק המעניין כאן הוא שהדגמים הקטנים יותר הופכים ליכולות אמיתיות על חומרה קומפקטית - הבינה המלאכותית לא תמיד צריכה יותר להתקשר למרכז הנתונים הענק. (חדשות NVIDIA)
Perplexity משתפת פעולה עם Nvidia להשקת Portable Computer, סוכן בינה מלאכותית מקומי לחלוטין ללא עלויות אסימונים ↗
Perplexity השיקה את Portable Computer, והביאה את חוויית ה-agentic Computer שלה לחומרה מקומית המופעלת על ידי Nvidia. מודלים, קבצים וביצוע סוכנים יכולים להישאר במחשב המשתמש, כאשר עבודה שהושלמה באופן מקומי אינה דורשת זיכויים לחיוב בענן.
משימות מתחילות באופן מקומי, והמערכת מבקשת אישור לפני שהיא מתקדמת למודל ענן חזיתי. המערכת מופעלת סביב מערכות Nvidia DGX Spark ו-Linux עם מעבדי RTX חזקים מספיק - פרטיות ועלות הופכות פתאום לחלק מנאום המכירות המקומי של בינה מלאכותית, לא רק למהירות. (Venturebeat)
אנתרופיק צפויה להודיע למשקיעים שהיא צופה הכנסות פוטנציאליות של מעל 30 טריליון דולר, כך מדווח WSJ ↗
על פי הדיווחים, אנתרופיק מתכוננת להודיע למשקיעים כי סך שוק השיווק שלה עשוי לעלות על 30 טריליון דולר. הבחנה חשובה - זוהי ההזדמנות השנתית התיאורטית אם בינה מלאכותית תתפוס את העבודה הרלוונטית, ולא אנתרופיק שחוזה שהיא תמשיך להרוויח 30 טריליון דולר. (רויטרס)
המספר העצום מסייע למסגר את הוצאות התשתיות של אנתרופיק, את התחרות שלה עם OpenAI וגוגל, ואת סיפור המשקיעים הרחב יותר. זהו מספר גדול באופן מרשים... אפילו בסטנדרטים של תעשיית הבינה המלאכותית. (רויטרס)
שאלות נפוצות
מה המשמעות של תוצאות שבב החלפיניו של OpenAI עבור הסקת מסקנות של בינה מלאכותית?
OpenAI טוענת ש-Jalapeño סיפקה תפוקת שיא גבוהה יותר לקילוואט והשהיה נמוכה יותר מקצה לקצה בהשוואה למערכת ההשוואה שלה, תוך כדי הפעלת GPT-OSS 120B. שיפורים דומים דווחו עם DeepSeek R1 ו-Kimi K2.5. התוצאות מצביעות על כך ש-OpenAI מתכננת יותר ויותר חומרה סביב דרישות היעילות והמהירות הספציפיות של הסקה בקנה מידה גדול של בינה מלאכותית.
כיצד פועל הזיכרון המשותף של קלוד בצ'אט וב-Cowork?
קלוד יכול כעת להעביר מידע שנלמד משיחות רגילות למשימות עבודה משותפות, ובכך להפחית את הצורך להסביר שוב ושוב את אותו פרויקט או הקשר. משתמשים יכולים לבדוק, לערוך ולמחוק נושאים שנזכרו, בעוד שזיכרונות אלה יכולים להמשיך להתעדכן ככל שהשיחות מתפתחות. על פי ההכרזה המופיעה במאמר, התכונה מופעלת כברירת מחדל בתוכניות Free, Pro ו-Max.
מה יכולה לעשות חברת Gemini Enterprise לשירותים משפטיים ופיננסיים?
הצעות Gemini Enterprise הייעודיות של Google Cloud מכוונות לזרימות עבודה ספציפיות לתעשייה ולא לצ'אטים כלליים של בינה מלאכותית. החבילה המשפטית מכסה תחומים כגון סקירת חוזים, מחקר, ניטור רגולטורי, בקשות פרטיות וניסוח, בעוד שגרסת השירותים הפיננסיים תומכת בזרימות עבודה הכוללות הערכת סיכוני אשראי, ניטור תיקי השקעות, מחקר KYC וניתוח שוק. שניהם יכולים גם להתחבר למערכות נתונים ותוכנה מקצועיות קיימות.
מדוע הסקה מקומית של בינה מלאכותית הופכת לחשובה יותר?
הסקה מקומית של בינה מלאכותית יכולה לחזק את הפרטיות, להפחית את התלות בתשתית ענן ואולי להפחית את עלויות השימוש השוטפות. ה-Jetson Orin Nano 2 של Nvidia מכוון לרובוטים, רחפנים ומערכות קצה אחרות, בעוד שהמחשב הנייד של Perplexity שומר מודלים, קבצים וביצוע סוכנים על חומרה מקומית תואמת. בזרימות עבודה רבות, ניתן לשמור מודלים של ענן למשימות הדורשות יכולת נוספת.
כיצד מחליטה חברת Perplexity Portable Computer מתי להשתמש בבינה מלאכותית בענן?
משימות מתוכננות להתחיל בחומרה המקומית של המשתמש המופעלת על ידי Nvidia, תוך שמירה על ביצוע מודל תואם וקבצים במחשב. אם שלב דורש מודל ענן קדמי, המערכת מבקשת מהמשתמש אישור לפני הסלמה. עבודה שבוצעה באופן מקומי אינה צורכת זיכויים לחיוב ענן, מה שהופך את הגישה לרלוונטית למשתמשים המודאגים הן מפרטיות והן מעלויות הסקה חוזרות.
מה משמעה הערכת שוק הבינה המלאכותית של אנתרופיק, שדווחה על 30 טריליון דולר?
הנתון המדווח מתייחס לתפיסתה של אנתרופיק לגבי השוק הכולל הפוטנציאלי של בינה מלאכותית, ולא לתחזית שאנתרופיק עצמה תייצר הכנסות שנתיות של 30 טריליון דולר. הוא מייצג את הערך התיאורטי של העבודה שבינה מלאכותית יכולה לטפל בה ברחבי הכלכלה. האומדן גם מסייע להסביר מדוע חברות בינה מלאכותית מובילות משקיעות כל כך הרבה בתשתיות וביכולות ארגוניות.