יוזמה עצמאית לציבור ידע על בינה מלאכותית · 21.09.2026
שמירה, שיתוף וכלי קריאה
רשימת הקריאה שלי

התאמת הקריאה

ההעדפות נשמרות בדפדפן הזה בלבד.

→ לספריית הידע
פתרונות ובטיחות

בטיחות עם ערבויות: מה בדיוק אפשר להוכיח?

מחקרגרסה 3; פרסום ראשון במאי 2024: 2024-07-08תקציר מערכת בעברית
כתובת המקור
arxiv.org
סוג המקור
מחקר
הנושא
פתרונות ובטיחות
הקשר ומגבלות
מפורטים להלן ליד התקציר

מחבר או מפרסם המקור: Dalrymple ועמיתים · arXiv

בדיקת הרשומה: 2026-09-21

איך לקרוא את הרשומה

התקציר מציג את עיקרי הפרסום. הסעיפים שמתחתיו מפרטים את גבולות הטענה ואת היקף הבדיקה, כדי שתוכלו להחליט מה אפשר להסיק ממנו.

עיקר הדברים

מסגרת מוצעת המשלבת מודל של העולם, הגדרה של התנהגות מותרת ומאמת פורמלי. הערבות היא ביחס למודל ולמפרט שנבחרו.

גבולות הטענה

עולם שלא תואר היטב או הגדרת נזק חסרה עלולים להשאיר פער גם כשהאימות המתמטי תקין.

מה נקרא ונבדק?

נקראו התקציר ורשומת הגרסה, לא כל ההוכחות או הנספחים..

התקציר הוא סיכום מקורי בעברית. הוא אינו תרגום מלא של המקור ואינו תמלול. לפני ציטוט חשוב לקרוא את הניסוח המקורי ואת ההקשר.

למקור המקורי ↗

שאלות לקחת לקריאה

  1. מה המקור מדד או תיעד בפועל?
  2. אילו הנחות מפרידות בין הממצא למסקנה?
  3. איזה ממצא נוסף עשוי לשנות את ההערכה?
כך אנחנו מפרידים בין ראיה לפרשנות
להצליב את הקריאה

לחבר בין יכולת, סיכון ואחריות

קראו מסגרת מחקרית לצד מסגרת לניהול סיכונים. הבחינו בין תוצאה של ניסוי לבין החלטה על שימוש במציאות.

מחקרחמש בעיות מעשיות בבטיחות AIלמקור ולמגבלות ←מסגרת עבודהNIST: איך הופכים אחריות לניהול סיכונים?למקור ולמגבלות ←דוחדוח בטיחות ה־AI הבין־לאומי, 2026למקור ולמגבלות ←
מונח לא ברור? פותחים את המילון ←

להצליב ולהעמיק

Inspect: כלי פתוח לבדיקת מערכות AI

AI Control: פיקוח גם כשאי אפשר להניח שהמודל משתף פעולה

Scientist AI: לחקור בלי להפוך לסוכן בעל יעד

מה תרצו לחקור?

קיצור מקלדת: / לפתיחה, Esc לסגירה. השאילתה מופיעה בכתובת עמוד התוצאות.