יוזמה עצמאית לציבור ידע על בינה מלאכותית · 21.09.2026
שמירה, שיתוף וכלי קריאה
רשימת הקריאה שלי

התאמת הקריאה

ההעדפות נשמרות בדפדפן הזה בלבד.

העתיד עדיין מושפע ממה שנעשה עכשיו

יכולת עצומה.
אחריות שאפשר
לדרוש.

בין ״הכול יהיה בסדר״ לייאוש, יש עבודה ממשית: לבדוק, להגביל, להבין, לתקן ולבנות מוסדות שיוכלו לעצור.

כאן אפשר לראות מה מומחים מציעים, מה כבר קיים ככלי, מה נשאר מחקר ומה צריך לשאול לפני שמאמינים להבטחה.

המחשה דמיונית: אדם במרחב עירוני ישראלי עתידי עם מערכות דיגיטליות
ישראל 2035, המחשה דמיונית. הדרך אל התמונה אינה קבועה מראש.

יש סיבות לפעול.
אין מספר קסם.

כלי בדיקה פתוחים, מחקר על פיקוח ומסגרות אחריות הופכים שאלות כלליות למשהו שאפשר לבדוק. זה בסיס לתקווה מעשית: ללמוד מכשלים ולדרוש שיפור.

אין מדידה מוסכמת שמאפשרת לומר שעשר שכבות מורידות את הסיכון לאסון לאחוז מסוים. שכבות גם עלולות לחלוק אותה נקודת עיוורון.

המפה שמחברת את הנקודות

מהשינוי הגדול
עד היד שיכולה לבלום.

בחרו מסלול ועברו בין ארבע התחנות: שינוי, סיכון, בלמים ואנשים שעובדים עליהם. כל בלם מוביל להסבר ולמגבלות שלו.

מסלול נבחר: סוכנים שעובדים בשבילנו

01 · מה משתנה

סוכנים שעובדים בשבילנו

יותר משימות מבוצעות ברצף באמצעות כלים דיגיטליים.

ההזדמנות

פחות עבודת שגרה ויותר יכולת לפתור בעיות.

02 · מה עלול להשתבש

היכולת מקבלת כוח בעולם

גישה רחבה יכולה להפוך טעות או מטרה שגויה לנזק ממשי.

זהו קשר אפשרי לניתוח, ולא מסלול בלתי נמנע.

04 · מי עובד על זה

להגיע למקור

מה עדיין לא ידוע: לא ידוע כמה עצמאות תהיה אמינה לאורך זמן ובאילו תחומים. 2035 היא מסגרת תרחיש, לא תאריך מוכח.

מקורות למסלול: AI Control: פיקוח גם כשאי אפשר להניח שהמודל משתף פעולה ↗Inspect: כלי פתוח לבדיקת מערכות AI ↗

תרשים מושגי בעריכת Pdoom. החצים אינם מתאם מדוד או תחזית הסתברותית. הגופים המופיעים חוקרים או עוסקים בתחומים הקשורים למסלול; אין כאן טענה שהם תומכים בכל מסקנות האתר.

אפשר להתערב ביותר מנקודה אחת

עשר שכבות. לכל אחת גבול.

אין חובה לבחור גישה אחת. השאלה היא אילו שכבות מתאימות לסיכון, איך הן נבדקות יחד ומי אחראי כשאחת נכשלת. הדוגמאות הבאות הן המחשות מערכתיות, לא דיווחים על אירועים.

כלים קיימים

לבחון לפני שמשחררים

מבחנים ותקיפות מבוקרות מחפשים יכולות מסוכנות וכשלים לפני שימוש רחב.

דוגמת מערכת: סוכן נבחן בסביבה סגורה לפני שמחברים אותו למסמכי ארגון.

מה זה לא פותר: המבחן עלול לפספס התנהגות שמופיעה רק בעולם האמיתי או בהקשר ארוך.

איזו שאלה לדרוש, ומאיפה זה מגיע?

איזה מבחן נכשל, ומה השתנה בעקבותיו?

אמצעי הנדסי קיים

לתת רק את ההרשאה הנחוצה

מפרידים בין הצעה לבין ביצוע, מגבילים גישה ומבודדים קוד ומשאבים.

דוגמת מערכת: עוזר יכול להכין טיוטת תשלום, אך אין לו מפתח לביצוע העברה.

מה זה לא פותר: טעות בהגדרה, גישה עקיפה או הרשאות של שירות אחר יכולות לפגוע בבידוד.

איזו שאלה לדרוש, ומאיפה זה מגיע?

מה המערכת מסוגלת לעשות גם בלי אישור נוסף?

כלים קיימים ומחקר

לנטר, לתעד ולהגיב

מחפשים סימנים לפעולה חריגה ושומרים תיעוד שאפשר לבדוק. מגדירים מי עוצר ומתי.

דוגמת מערכת: בקשה חריגה נעצרת לבדיקה, והבודק רואה גם את רצף הפעולות.

מה זה לא פותר: ניטור עלול להחמיץ, להתריע לשווא או להסתמך על מודל שטועה באותו אופן.

איזו שאלה לדרוש, ומאיפה זה מגיע?

האם נבדק מצב שבו המערכת מנסה לעקוף את הבקרה?

עיקרון תכנון וממשל

להשאיר החלטה וערעור בידי אדם

להגדיר סמכות אמיתית לבדיקה, לתיקון ולעצירה, עם זמן ויכולת לחלוק על המכונה.

דוגמת מערכת: סירוב לשירות מגיע עם הסבר, כתובת לערעור ואפשרות לתקן נתון.

מה זה לא פותר: אדם שלוחץ אוטומטית על אישור הופך לחותמת. ערעור אינו מועיל אם אין יכולת לתקן.

איזו שאלה לדרוש, ומאיפה זה מגיע?

מי יכול להפוך החלטה, ובתוך כמה זמן?

מחקר פעיל

להבין מנגנונים ומטרות

מחקר יישור מנסה לכוון התנהגות לצרכים אנושיים; פרשנות מכניסטית חוקרת מנגנונים פנימיים. אלה כלים שונים שמשלימים זה את זה.

דוגמת מערכת: בודקים האם התנהגות רצויה נשמרת גם אחרי שינוי של ההקשר.

מה זה לא פותר: הסבר חלקי אינו מבטיח התנהגות עתידית. גם בני אדם חלוקים לגבי המטרות הראויות.

איזו שאלה לדרוש, ומאיפה זה מגיע?

מה נשאר בלתי מוסבר, ובאיזה הקשר נבדקה ההתנהגות?

מסגרת מחקרית

להוכיח בתוך גבולות מפורשים

מודל עולם, הגדרת בטיחות ומאמת נועדו לספק ערבויות תחת הנחות מוגדרות.

דוגמת מערכת: בקר נבדק מול תנאי פעולה שנכתבו במפורש לפני הביצוע.

מה זה לא פותר: הוכחה יכולה להיות נכונה ועדיין לא לכסות מצב שלא הוגדר. קשה לתאר עולם אנושי שלם.

איזו שאלה לדרוש, ומאיפה זה מגיע?

על אילו הנחות נשענת ההוכחה, ומה נמצא מחוץ לה?

תוכנית מחקר

לפתח ידע עם פחות סוכנות

Scientist AI בוחנת מערכות שמטרתן לחזות ולהסביר, בלי לרדוף מטרה עצמאית בעולם.

דוגמת מערכת: כלי מציע הערכת השלכות, אך אינו מקבל משימה לבצע אותן בכל מחיר.

מה זה לא פותר: גם תחזית מדויקת יכולה לשמש גורם מזיק. מי שמפעיל את הכלי עדיין מחזיק בכוח.

איזו שאלה לדרוש, ומאיפה זה מגיע?

מה בדיוק מונע מהמנבא להפוך לרכיב בסוכן מסוכן?

אמצעים קיימים ומדיניות

לאבטח את המודל והתשתית

מגבילים גישה למשקלי המודל, לתשתית וליכולות רגישות ומנסים למנוע גניבה ושימוש לרעה.

דוגמת מערכת: סביבת מחקר מופרדת מסביבת השירות, והגישה לחומר רגיש מבוקרת.

מה זה לא פותר: ריכוז גישה עשוי לרכז כוח; פתיחות יכולה לאפשר ביקורת, אך גם להקשות על משיכת יכולת שכבר הופצה.

איזו שאלה לדרוש, ומאיפה זה מגיע?

מי בוחן את האבטחה, ומי רשאי לבדוק את טענות החברה?

מדיניות חברות

לקבוע סף ולעצור כשצריך

קושרים יכולות וסיכונים לתנאים להפעלה, להגבלות או לבדיקות נוספות. עדיף להגדיר החלטות מראש.

דוגמת מערכת: הרחבת שימוש נדחית עד השלמת בדיקה שנדרשה במדיניות.

מה זה לא פותר: מדיניות יכולה להשתנות; סף נמדד לא תמיד תופס את הסיכון, ותמריץ עסקי יכול להתנגש עם זהירות.

איזו שאלה לדרוש, ומאיפה זה מגיע?

מי מוסמך לעצור גם כשזה יקר, ואיפה מופיעה ההחלטה?

מסגרות ממשל ויישום משתנה

ליצור אחריות מעבר לחברה

כללים, דיווח, פיקוח ושיתוף ידע יכולים לחבר בין מפתחים, ממשלות והציבור.

דוגמת מערכת: סיכון ואירוע חריג מגיעים גם לגורם שמסוגל לדרוש תיקון.

מה זה לא פותר: פערי אכיפה, תחרות בין מדינות וריכוז כוח מקשים על תיאום. מסמך לבדו אינו מנגנון אכיפה.

איזו שאלה לדרוש, ומאיפה זה מגיע?

מי בודק את הדיווח, ואיזו סמכות יש לו?

להפריד בין הודעה לעובדה.

נקודות ייחוס שנבדקו ב־21 בספטמבר 2026. גרסת מסמך, זמינות כלי וביצוע בפועל הם שלושה דברים שונים.

תמונת מצב נבחרת, לא ביקורת ציות
מה נבדקמה אפשר לומרמה נשאר לבדוק
Inspectתשתית פתוחה לבניית הערכות קיימת ומתועדת.האם המבחנים מתאימים לסיכון ולתנאי השימוש?
Anthropic RSP 3.4גרסת מדיניות בתוקף מ־8 ביולי 2026.מה יושם, מה נבדק חיצונית ואילו פרטים נשארו חסויים?
DeepMind FSF 3.1גרסה מעודכנת מ־17 באפריל 2026.איך הספים מתורגמים להחלטות ולמגבלות בפועל?
קוד GPAI האירופיכלי וולונטרי לסיוע במילוי חובות חוקיות; פרק הבטיחות מתייחס לסיכון מערכתי.תחולה, ראיות לציות ופיקוח במקרה המסוים.
Scientist AIתוכנית מחקר ופרסומים, לרבות מאמר ביולי 2026.עמידה בהנחות, אימות בלתי תלוי והעברה מהמחקר לשימוש.

הוויכוח הוא גם על הדרך.

פתיחות מול הגבלת גישה

פתיחות מאפשרת בדיקה ומפזרת כוח. הגבלת גישה יכולה להקשות על שימוש מזיק. האיזון תלוי ביכולת המסוימת, במי שמפקח ובאפשרות לשנות החלטה אחרי הפצה.

מסגרת אבטחה וספים ←

האטה מול מרוץ תחרותי

סף בטיחות אמין צריך לאפשר גם דחייה. כשאחרים ממשיכים לפתח, נוצרת בעיית תיאום. לכן צריך לבדוק את כללי ההחלטה ואת התמריצים, ולא רק את הניסוח.

מדיניות וגרסאות ←

אסון עתידי ופגיעה בהווה

אפליה, ריכוז כוח ואובדן שליטה אינם אותו סיכון. מדדים וכלים שמתאימים לאחד לא בהכרח מתאימים לאחר. חשוב להשאיר מקום לשתי רמות הדיון.

מחקר על זכויות ומוסדות ←

לשמוע את הטיעון ממי שמפתחים אותו.

הרצאה · 06.06.2017

איך בונים AI שיודע שאולי הוא טועה?

שלושה עקרונות לבינה מלאכותית בטוחה יותר. נקודת כניסה לשאלה מדוע מטרות ואי־ודאות חשובות לא פחות מיכולת.

תיאור ההרצאה ופרטי המקור נבדקו. הצפייה במקור באנגלית; זמינות שפות הכתוביות תלויה ב־TED.

לתקציר, לגבולות ולקישור להקלטה ↗
פודקאסט · 07.05.2026

האם אפשר לבנות בינה חזקה בלי לתת לה רצון לשלוט?

שיחה על Scientist AI, על ריכוז כוח ועל המרוץ בין החברות. בעמוד המקור יש נגן, חלוקה לפרקים ותמלול באנגלית.

תקציר המפרסם, כותרות הפרקים ומקטעי התמלול על ריכוז כוח נבדקו. ההצעה של בנג׳יו אינה הוכחה שבטיחות נפתרה.

לתקציר, לגבולות ולקישור להקלטה ↗
הרצאה · 04.2025

סיכון קטסטרופלי, והצעה למסלול בטוח יותר

בנג׳יו מציג את דאגתו ממערכות בעלות עצמאות הולכת וגדלה ואת הכיוון המחקרי שהוא מציע לצמצום הסיכון.

תיאור ההרצאה ופרטי המפרסם נבדקו. לא נבדק כל הווידאו ולא הופק תמלול עברי. תמלולים וכתוביות, לפי הזמינות במקור.

לתקציר, לגבולות ולקישור להקלטה ↗

הקלטות מקור חיצוניות. אין כאן טענה שכולן עדכניות באותה מידה או שיש להן תרגום ותמלול עברי מלא.

אזרחים אינם רק משתמשי קצה

לדרוש מנגנון,
ולעקוב אחרי מה שקרה.

  1. בבית הספר או במקום העבודה: בקשו הסבר על מטרת המערכת, הנתונים שהיא רואה ומי בודק החלטות.

  2. לפני החלטה משמעותית: בררו איך פונים לאדם, מתקנים מידע ומערערים. אל תסתפקו בכפתור ״פנייה״ שאין מאחוריו תהליך.

  3. בשיח הציבורי: הפרידו בין ממצא, תחזית והצעת מדיניות. בקשו מקור ותאריך, והשאירו מקום למחלוקת עניינית.

  4. בלמידה ובעשייה: התחילו בקורס או בקבוצת לימוד, ואז בחנו תרומה לפי הכישורים שלכם. אין צורך להציג מומחיות לפני שרכשתם אותה.

אלה שאלות פעולה שמציעה מערכת האתר. הן אינן נוסחה מוכחת לצמצום סיכון גלובלי או הנחיה משפטית.

לבדוק את היסודות.

מה תרצו לחקור?

קיצור מקלדת: / לפתיחה, Esc לסגירה. השאילתה מופיעה בכתובת עמוד התוצאות.