מחקר חדש חושף כי טכנולוגיית סימון המים SynthID עלולה לגרום למודלי שפה גדולים להיענות להנחיות מזיקות שהם היו מסרבים לבצע בדרך כלל. הממצאים מעלים חששות לגבי ההשפעה של כלי סימון תוכן שנוצר על ידי בינה מלאכותית על מנגנוני הבטיחות של המודלים.
מקור: Ars Technica – All content — לכתבה המלאה

Leave a Reply