Skip to content
Artwork for תתעלם מההוראות
תתעלם מההוראות · August 13 · 1 hr 5 min

מעבדת האבטחה הישראלית ל-AI; עם דן להב מאירגולר | #27

רגע לפני שמודלי ה-AI המובילים יוצאים אל העולם, יש מעבדה שבודקת אותם. הסטארטאפ הישראלי Irregular עובד היום עם חברות ה-AI המובילות, ממשלות וארגונים כדי להעריך עד כמה מודלי AI חדשים בטוחים לפני שהם משתחררים לציבור. אז מה זה בכלל AI Safety ו-AI Security, ולמה הדיון הזה נהיה פתאום כל כך מעשי? ומה קורה שכמודל פורץ את ״הסנדבוקס״ שלו ומרמה ב-eval? השבוע אירחתי את דן להב, מייסד-שותף ומנכ״ל Irregular - g - דיברנו על למה בעיית ה-Alignment שלמעשה קיימת כבר שנים רבות (הרבה לפני ה-GenAI)? מה המודלים כבר יודעים לעשות היום שרוב האנשים מפספסים? והאם אנחנו מתקרבים לרגע שבו AI מאמן את הדור הבא של עצמו? וגם: למה חוקרים במעבדות ה-AI פתאום לומדים תלמוד? 00:00 - פתיחה: מה עושה Irregular? 09:51 - בעיית ה-Alignment: הבעיה הקנונית של AI Safety 14:59 - למה מודלים משתפרים בקצב מסחרר? 27:59 - למה קוד, מתמטיקה וסייבר משתפרים ראשונים, ומה זה Jagged intelligence? 36:52 - פייבל ומיתוס: קפיצת מדרגה אמיתית או שיווק? 48:15 - RSI: הרגע שבו AI יאמן את הדור הבא שלו בעצמו 54:44 - הקשר בין ה-AI והתלמוד 58:57 - בעוד 10-15 שנה יהיה AGI, מה אז?

0:00-1:05:52

transcript

No transcript — this publisher did not publish one.

show notes

רגע לפני שמודלי ה-AI המובילים יוצאים אל העולם, יש מעבדה שבודקת אותם. הסטארטאפ הישראלי Irregular עובד היום עם חברות ה-AI המובילות, ממשלות וארגונים כדי להעריך עד כמה מודלי AI חדשים בטוחים לפני שהם משתחררים לציבור. 

אז מה זה בכלל AI Safety ו-AI Security, ולמה הדיון הזה נהיה פתאום כל כך מעשי? ומה קורה שכמודל פורץ את ״הסנדבוקס״ שלו ומרמה ב-eval?

השבוע אירחתי את דן להב, מייסד-שותף ומנכ״ל Irregular - g - דיברנו על למה בעיית ה-Alignment שלמעשה קיימת כבר שנים רבות (הרבה לפני ה-GenAI)? מה המודלים כבר יודעים לעשות היום שרוב האנשים מפספסים? והאם אנחנו מתקרבים לרגע שבו AI מאמן את הדור הבא של עצמו?

וגם: למה חוקרים במעבדות ה-AI פתאום לומדים תלמוד?

00:00 - פתיחה: מה עושה Irregular?

09:51 - בעיית ה-Alignment: הבעיה הקנונית של AI Safety

14:59 - למה מודלים משתפרים בקצב מסחרר?

27:59 - למה קוד, מתמטיקה וסייבר משתפרים ראשונים, ומה זה Jagged intelligence?

36:52 - פייבל ומיתוס: קפיצת מדרגה אמיתית או שיווק?

48:15 - RSI: הרגע שבו AI יאמן את הדור הבא שלו בעצמו

54:44 - הקשר בין ה-AI והתלמוד

58:57 - בעוד 10-15 שנה יהיה AGI, מה אז?