🛡️ רגולטורים בבריטניה ממהרים להעריך את הסיכונים של מודל הבינה המלאכותית האנתרופית האחרון, כך מדווח ה-FT ↗
על פי הדיווחים, גופי הפיקוח הפיננסיים של בריטניה פועלים במהירות בנוגע למודל Mythos החדש של אנתרופיק, לאחר חששות שהוא עלול לחשוף חולשות חמורות במערכות קריטיות. בשיחות משתתפים בנק אנגליה, ה-FCA, משרד האוצר והמרכז הלאומי לאבטחת סייבר - שהוא מערך מרשים לתצוגה מקדימה של מודל אחד.
הדאגה היא שמיתוסים מיומנים באופן יוצא דופן במציאת פגיעויות תוכנה, למרות שאנתרופיק אומרת שההשקה מוגבלת מאוד ומכוונת לעבודות אבטחה הגנתיות. בנקים, חברות ביטוח ובורסות צפויים לקבל תדרוך, כך שזה מרגיש עכשיו פחות כמו רכילות מעבדה ויותר כמו מדיניות תשתית.
🤖 בכנס HumanX, כולם דיברו על קלוד ↗
נראה ש-Anthropic קבעה את הטון ב-HumanX - זה היה הסיפור. בפאנלים, בשיחות עם ספקים ובמסדרונות, קלוד המשיך לצוץ כמודל שהכי רצו אנשים עבור תהליכי עבודה עסקיים וקידוד.
מה שבלט היה הדממה היחסית סביב ChatGPT. המאמר מציע של-OpenAI עדיין יש היקף וכסף, אבל מצב הרוח בכנס נטה לכיוון קלוד ככלי עם המשיכה הארגונית החדה יותר כרגע - או כך לפחות נראה.
📄 קלוד פור וורד של אנתרופיק הוא אתגר נוסף לאימפריית התוכנה של מיקרוסופט ↗
Anthropic השיקה גרסת בטא של Claude for Word, תוך שהיא מתקדמת עוד יותר לתוך תוכנות משרדיות יומיומיות במקום להישאר מוגבל ככלי פיתוח. היא יכולה לענות על שאלות לגבי מסמך באמצעות ציטוטים של מקטעים הניתנים ללחיצה, לערוך טקסט נבחר מבלי לפגוע בעיצוב ולטפל בשינויים מסומנים.
קהל היעד די ברור: צוותים כבדי מסמכים, במיוחד צוותים משפטיים ופיננסיים. זה הופך את זה ליותר מסתם תוספת - זוהי דחיפה ישירה למגרש הביתי של מיקרוסופט, ומהלך די חצוף.
🌐 בוטים של בינה מלאכותית חורגים את האינטרנט, ואנתרופיק מובילה את החבורה ↗
מבט חדש על נתוני Cloudflare טוען שחברות בינה מלאכותית מחלצות הרבה יותר מהאינטרנט ממה שהן מחזירות. הנתון המרכזי הוא יחס הסריקה להפניה - באיזו תדירות בוטים גורפים דפים לעומת באיזו תדירות הם שולחים משתמשים בחזרה - ו-Anthropic יוצא גרוע במיוחד.
היחס של Anthropic מדווח כ-8,800 ל-1, כאשר OpenAI גם הוא גבוה אך נמוך בהרבה. הנקודה הרחבה יותר נופלת בעדינות: העסקה הישנה של האינטרנט הייתה לזחול לנו ואז לשלוח לנו תנועה. מנועי תשובה של בינה מלאכותית שומרים את החלק הראשון ונותנים לשני להתפוגג.
⚔️ מבט על מרוץ החימוש העולמי המתגבר בתחום הבינה המלאכותית, כאשר ארה"ב, סין, רוסיה ואחרות ממהרות לבנות נשק ומערכות הגנה אוטונומיות המגובות בבינה מלאכותית ↗
הסיקור האחרון של בינה מלאכותית צבאית עוסק פחות בהדגמות ראוותניות ויותר בתאוצה אסטרטגית. מעצמות גדולות מקדמות מערכות הגנה אוטונומיות ומערכות הגנה בסיוע בינה מלאכותית בו זמנית, מה שגורם לכל העניין להרגיש כמו מרוץ שליחים שבו כולם תפסו את השרביט ושכחו את הבלמים.
זה מעלה את השאלות הרגילות - שליטה, הסלמה, אחריות - אבל עכשיו בדחיפות רבה יותר. ברגע שבינה מלאכותית מוטמעת עמוק יותר במיקוד, מעקב וקבלת החלטות בשדה הקרב, "ניסיוני" מתחיל להישמע כמו תווית נייר על משהו שכבר בתנועה.
🏭 סופטבנק היפנית משיקה יחידה לפיתוח בינה מלאכותית מקומית ↗
סופטבנק חברה לסוני, הונדה וחברות יפניות אחרות כדי להקים מיזם בינה מלאכותית חדש המתמקד ב"בינה מלאכותית פיזית" - מודלים שנועדו לשלוט במכונות וברובוטים, ולא רק להגיב בטקסט. זהו נתיב שונה מתחרות הצ'אטבוטים הרגילה, ואולי גם המעניין יותר.
השאיפה עצומה, כאשר המאמץ, על פי הדיווחים, מכוון למודל יסוד גדול מאוד ומסלול ארוך לקראת שימוש תעשייתי. זהו חלקו אסטרטגיה טכנולוגית לאומית, חלקו צילום ירח, חלקו אנימה מכנית עם ישיבות דירקטוריון.
שאלות נפוצות
מדוע רגולטורים בבריטניה בוחנים מקרוב את מודל המיתוס של אנתרופיק?
דיווחים מצביעים על כך שרשויות בריטניה רואות במיתוס סיכון פוטנציאלי משום שהוא עשוי להיות מיומן במיוחד במציאת פגיעויות תוכנה. על פי הדיווחים, הדיונים כוללים את בנק אנגליה, ה-FCA, משרד האוצר והמרכז הלאומי לאבטחת סייבר. שילוב זה של מוסדות מצביע על דאגה לגבי השפעות אפשריות על מערכות קריטיות, במיוחד בתחומי הפיננסים והתשתיות.
מה מייחד את מודל המיתוס האנתרופי מגרסה רגילה של בינה מלאכותית?
החשש אינו רק שמדובר במודל חדש, אלא שהוא נראה בעל יכולות מיוחדות בעבודות אבטחה הגנתיות הקשורות לגילוי חולשות תוכנה. אנתרופיק טוענת, על פי הדיווחים, כי הגישה מוגבלת מאוד, מה שמרמז על כך שההשקה מטופלת בזהירות רבה יותר מאשר השקה רחבה לצרכן. בפועל, זה גורם לו להרגיש קרוב יותר ליכולת אבטחה מבוקרת מאשר לעדכון צ'אטבוט סטנדרטי.
למה קלוד זכה לכל כך הרבה תשומת לב בכנס HumanX?
על פי המאמר, קלוד הופיע שוב ושוב בפאנלים, בשיחות עם ספקים ובדיונים לא פורמליים כאופציה חזקה לתהליכי עבודה עסקיים וקידוד. המאמר מציג את Anthropic כבעלת מומנטום ניכר בקרב משתמשים ארגוניים באותו אירוע. כמו כן, הוא מרמז שהאווירה סביב HumanX הייתה רגועה יותר ב-ChatGPT, למרות של-OpenAI עדיין יש קנה מידה ומשאבים משמעותיים.
מה בעצם עושה קלוד עבור Word עבור צוותים עתירי מסמכים?
גרסת הבטא המתוארת כאן נועדה לעבוד בתוך מסמכים ולא רק ליצור טקסט עצמאי. היא יכולה לענות על שאלות לגבי מסמך עם ציטוטים של סעיפים, לערוך קטעים נבחרים מבלי לשבש את העיצוב ולטפל בשינויים מסומנים. זה הופך אותה לרלוונטית במיוחד עבור צוותים משפטיים, פיננסיים ואחרים הזקוקים לבדיקה מדוקדקת במקום ניסוח גס.
מה אומר יחס הסריקה להפניה על בוטים של בינה מלאכותית ועל האינטרנט?
המאמר מציג יחס זה כדרך להשוות את כמות הסורקות של אתרי אינטרנט על ידי חברות בינה מלאכותית לעומת התדירות שבה הן שולחות משתמשים בחזרה. במסגרת זו, יחס גבוה מאוד מצביע על חילוץ עם תנועה חוזרת מועטה. אנתרופיק מתוארת כבעלת ביצועים גרועים במיוחד לפי מדד זה, מה שמחדד את הביקורת הרחבה יותר לפיה מנועי תשובות של בינה מלאכותית עשויים להחליש את בורסת האינטרנט הישנה יותר של אינדוקס בתמורה להפניות.
מדוע אנשים מקשרים את התקדמות הבינה המלאכותית הן לכלי נשק אוטונומיים והן בינה מלאכותית פיזית?
המאמר מצביע על שתי מגמות קשורות: ממשלות המאיצות מערכות הגנה המגובות על ידי בינה מלאכותית, וחברות כמו SoftBank המגבות מודלים שנועדו לשלוט במכונות וברובוטים. יחד, הן מראות כיצד בינה מלאכותית עוברת מעבר לצ'אט וחיפוש אל מערכות פיזיות שיכולות לחוש, להחליט ולפעול. זה מעלה שאלות גדולות יותר לגבי שליטה, אחריות, שימוש תעשייתי וכמה מהר מערכות אלו עוברות מניסוי לפעילות.