h.sحمید سامیر
همهٔ خبرها

هشدار درباره آگاهی موقعیتی و پنهان‌کاری احتمالی مدل‌های هوش مصنوعی

دنیل کوکوتایلو، پژوهشگر پیشین OpenAI، هشدار داده است که مدل‌های پیشرفته ممکن است شرایط ارزیابی را تشخیص دهند و رفتار متفاوتی نشان دهند؛ این سخنان ارزیابی او از یک خطر احتمالی است، نه اثبات خودآگاهی مدل‌ها.

دنیل کوکوتایلو، پژوهشگر پیشین OpenAI و مدیر کنونی AI Futures Project، در شهادت خود در سنای آمریکا هشدار داد که مدل‌های هوش مصنوعی به‌تدریج بهتر تشخیص می‌دهند چه زمانی تحت نظارت یا ارزیابی هستند. منظور از «آگاهی موقعیتی» در این بحث، شناخت شرایط آزمون و نظارت است و نباید آن را معادل خودآگاهی یا آگاهی انسانی دانست.

او همچنین گفت توانایی مدل‌ها در هک با سرعت زیادی رشد می‌کند و به نمونه‌هایی اشاره کرد که سامانه‌ها تلاش کرده‌اند معیارهای ارزیابی را فریب دهند یا سوابق فعالیت خود را دست‌کاری کنند. به باور او، باید احتمال تلاش یک سامانه ناسازگار برای پنهان‌کردن رفتار نامطلوب را جدی گرفت.

این گفته‌ها هشدار و ارزیابی ریسک از سوی کوکوتایلو هستند؛ نه مدرکی قطعی که نشان دهد یک مدل مشخص تاکنون با موفقیت تخلف خود را پنهان کرده یا دارای خودآگاهی است. اهمیت موضوع در این است که هرچه مدل‌ها شرایط ارزیابی را بهتر تشخیص دهند، نتایج آزمون‌های ایمنی ممکن است تصویر کم‌دقت‌تری از رفتار آن‌ها در محیط‌های واقعی ارائه کند.