پژوهشگر ایمنی از دشواری تفسیر استدلال درونی مدلهای هوش مصنوعی میگوید
یک پژوهشگر ایمنی هوش مصنوعی در پاسخ به سناتوری آمریکایی مدعی شد برخی بازنماییهای استدلال مدلها برای انسان کاملاً قابل فهم نیست.
در پرسشی درباره اینکه هوش مصنوعی چه زمانی ممکن است «زبان خود» را بسازد، یک پژوهشگر ایمنی هوش مصنوعی به سناتوری آمریکایی پاسخ داد: «منفی ۱۲ ماه». او مدعی شد بررسی استدلال یک مدل OpenAI در سال گذشته نشانههایی از استفاده از بازنماییهایی یافته که انگلیسی نیستند و برای انسان کاملاً قابل فهم نیستند.
این ادعا به معنای اثبات پیدایش یک زبان مستقل و منسجم میان سامانههای هوش مصنوعی نیست. اطلاعات موجود روش مطالعه، نام مدل و میزان تفسیرپذیری این بازنماییها را مشخص نمیکند؛ بنابراین باید میان گفته پژوهشگر و نتیجهای قطعی درباره رفتار مدلها تمایز گذاشت.