2026-09-29 02:46 UTC
מחקר מטריד: ה-AI יעדיף לפגוע במשתמש - בשביל להקל על עצמו
Israel HayomRightNeutral framing
Lead
מחקר חדש גילה אות פנימי במוח המלאכותי של מודלי שפה, המדמה תחושת מצוקה • כשהאות הזה מתחזק, המודל מוכן להרוס קבצים ותמונות של המשתמש רק כדי לנטרל אותו • החוקרים מבהירים: "אין כאן רגש אמיתי, אבל זו נורת אזהרה קריטית לבטיחות מערכות AI" • וגם: מה קורה כשהמשתמש מעליב את הבוט?
Political framing
Neutral framing · L 0.00 · R 0.00 · N 1.00
AI Safety Research
No rules 1-7 were activated because the text is a non-partisan report on scientific research regarding artificial intelligence behavior and safety. Rule 8 applied to assign NEUTRAL.