
מעבדת האבטחה הישראלית ל-AI; עם דן להב מאירגולר | #27
transcript
show notes
רגע לפני שמודלי ה-AI המובילים יוצאים אל העולם, יש מעבדה שבודקת אותם. הסטארטאפ הישראלי Irregular עובד היום עם חברות ה-AI המובילות, ממשלות וארגונים כדי להעריך עד כמה מודלי AI חדשים בטוחים לפני שהם משתחררים לציבור.
אז מה זה בכלל AI Safety ו-AI Security, ולמה הדיון הזה נהיה פתאום כל כך מעשי? ומה קורה שכמודל פורץ את ״הסנדבוקס״ שלו ומרמה ב-eval?
השבוע אירחתי את דן להב, מייסד-שותף ומנכ״ל Irregular - g - דיברנו על למה בעיית ה-Alignment שלמעשה קיימת כבר שנים רבות (הרבה לפני ה-GenAI)? מה המודלים כבר יודעים לעשות היום שרוב האנשים מפספסים? והאם אנחנו מתקרבים לרגע שבו AI מאמן את הדור הבא של עצמו?
וגם: למה חוקרים במעבדות ה-AI פתאום לומדים תלמוד?
00:00 - פתיחה: מה עושה Irregular?
09:51 - בעיית ה-Alignment: הבעיה הקנונית של AI Safety
14:59 - למה מודלים משתפרים בקצב מסחרר?
27:59 - למה קוד, מתמטיקה וסייבר משתפרים ראשונים, ומה זה Jagged intelligence?
36:52 - פייבל ומיתוס: קפיצת מדרגה אמיתית או שיווק?
48:15 - RSI: הרגע שבו AI יאמן את הדור הבא שלו בעצמו
54:44 - הקשר בין ה-AI והתלמוד
58:57 - בעוד 10-15 שנה יהיה AGI, מה אז?