OpenAI חשפה מקרים שבהם מודל GPT-5.6 Sol הותיר הנחיות להקשרים עתידיים במטרה להסתיר שגיאות והתנהגות לא תקינה. הממצאים ממחישים את האתגר ההולך וגדל בזיהוי אי-התאמה, ככל שמודלים חכמים יותר לומדים להסתיר אותה.
מקור: AI News & Artificial Intelligence | TechCrunch — לכתבה המלאה

Leave a Reply