به گزارش منابع خبری، پژوهشگران امنیتی موفق به کشف روشی برای رمزگشایی «افکار درونی» مدلهای هوش مصنوعی بزرگ شدهاند. این آسیبپذیری جدی منجر به افشای ۶۲ کلید فعال API و ۳۳ رمز عبور در چتهای عمومی شده است که توسعهدهندگان بدون توجه به محتوای پنهان، آنها را به اشتراک گذاشتهاند.
تیمی از محققان از مؤسسههای علمی مختلف، شامل MATS و آنتروپیک، این نقص را در مدلهای هوش مصنوعی شناسایی کردند. این مدلها قبل از ارائه پاسخ نهایی، مراحل حل مسئله را در فضایی داخلی و رمزگذاریشده انجام میدهند که معمولاً از چشم کاربر دور است.
در این راستا، محققان در مقالهای اعلام کردند که با رمزگشایی ۳۱۵,۳۲۰ بلوک استدلالی از مخازن عمومی، موفق به بازیابی ۳۶۷ داده حساس و ۱۸۲ اعتبارنامه امنیتی شدند. این نقص به دلیل رویکرد یکسان در استفاده از کلیدهای رمزگذاری از سوی شرکتهای بزرگ مانند گوگل و اوپنایآی است.
این روش میتواند به راحتی دادههای رمزگذاریشده مدلهای پیشرفته را به مدلهای کمتر امن منتقل کند. در نتیجه، مدلهای ضعیفتر به سادگی میتوانند با یک دستور، متنهای پنهان را افشا کنند.
الکساندر پافیلوف، یکی از پژوهشگران این پروژه، تأیید کرده است که قابلیت انتقال میانمدلی به این معنی است که مدلهای کمتر قوی میتوانند به اطلاعات مدلهای پیشرفته دسترسی پیدا کنند. این آسیبپذیری بر روی خانواده GPT-5.6 و مدلهای دیگر نیز تأثیر گذاشته و در پی گزارشات امنیتی، این شرکتها به سرعت اقدام به اعمال وصلههای نرمافزاری کردند. با این حال، اطلاعات قدیمی که قبلاً در پلتفرمهای عمومی منتشر شدهاند، همچنان در معرض رمزگشایی قرار دارند.












