h.sحمید سامیر
همهٔ خبرها

پژوهشگر ایمنی از دشواری تفسیر استدلال درونی مدل‌های هوش مصنوعی می‌گوید

یک پژوهشگر ایمنی هوش مصنوعی در پاسخ به سناتوری آمریکایی مدعی شد برخی بازنمایی‌های استدلال مدل‌ها برای انسان کاملاً قابل فهم نیست.

در پرسشی درباره اینکه هوش مصنوعی چه زمانی ممکن است «زبان خود» را بسازد، یک پژوهشگر ایمنی هوش مصنوعی به سناتوری آمریکایی پاسخ داد: «منفی ۱۲ ماه». او مدعی شد بررسی استدلال یک مدل OpenAI در سال گذشته نشانه‌هایی از استفاده از بازنمایی‌هایی یافته که انگلیسی نیستند و برای انسان کاملاً قابل فهم نیستند.

این ادعا به معنای اثبات پیدایش یک زبان مستقل و منسجم میان سامانه‌های هوش مصنوعی نیست. اطلاعات موجود روش مطالعه، نام مدل و میزان تفسیرپذیری این بازنمایی‌ها را مشخص نمی‌کند؛ بنابراین باید میان گفته پژوهشگر و نتیجه‌ای قطعی درباره رفتار مدل‌ها تمایز گذاشت.

AI safety researcher speaking at a US Senate hearing