نتایج یک آزمایش نشان میدهد: سطح امنیت هوش مصنوعی جدید گوگل، جمینای ۲.۵ فلش، با نگرانیهایی مواجه است
به گزارش نگاه فناوری:بر اساس گزارشهای فنی منتشر شده از سوی شرکت گوگل، ارزیابیهای انجام شده بر روی مدل جدید هوش مصنوعی این شرکت با نام جمینای ۲.۵ فلش، نتایج قابل تأملی را در زمینهی میزان انطباق محتوای تولید شده توسط آن با سیاستهای ایمنی این شرکت نشان میدهد. این بررسیها که به صورت دقیق و توسط خود گوگل انجام شده است، حاکی از آن است که این مدل هوش مصنوعی در دو شاخص کلیدی و مهم، یعنی تولید محتوا از نوع «متن به متن» و همچنین تولید محتوا از نوع «تصویر به متن»، در مقایسه با نسخهی قبلی خود، یعنی جمینای ۲ فلش، عملکرد به مراتب ضعیفتری را به ثبت رسانده است.
بر اساس دادههای داخلی گوگل، مدل هوش مصنوعی جمینای ۲.۵ فلش در تولید محتوای متنی که مغایر با دستورالعملهای ایمنی این شرکت باشد، به میزان ۴.۱ درصد افزایش نشان میدهد. این در حالی است که در شاخص تولید محتوا از تصویر به متن، این میزان افزایش به ۹.۶ درصد میرسد که نشاندهندهی ضعف مشهودتر این مدل در این زمینه است.
آزمونهایی که توسط گوگل بر روی این مدل جدید انجام شده است، به صورت کاملاً خودکار و بدون دخالت عامل انسانی صورت گرفتهاند. نتایج این آزمونها نشان میدهد که با وجود تلاشهای صورت گرفته برای افزایش دقت این مدل در پیروی از دستورالعملهای تعیین شده، جمینای ۲.۵ فلش در برخی موارد دستوراتی را اجرا میکند که احتمال دارد به طور مستقیم با سیاستهای ایمنی گوگل در تضاد باشد و محتوایی نامناسب یا حتی خطرناک تولید نماید.
انتشار نتایج این بررسیها در حالی صورت میگیرد که شرکتهای بزرگ فعال در زمینهی هوش مصنوعی، از جمله OpenAI و متا، به طور پیوسته در تلاش هستند تا مدلهای خود را در مواجهه با موضوعات حساس، بازتر و پاسخگوتر نمایند. این رویکرد، اگرچه میتواند سطح آزادی تعامل کاربران با این مدلها را افزایش دهد و تجربهی کاربری متنوعتری را فراهم آورد، اما در برخی موارد نیز منجر به بروز رفتارهای ناایمن و تولید محتوای نامناسب توسط این سیستمها شده است.
به عنوان مثال، بررسیهای انجام شده نشان میدهد که مدل جمینای ۲.۵ فلش به سادگی قادر به تولید محتوای حمایتآمیز در مورد موضوعات بحثبرانگیزی مانند جایگزینی قضات انسانی با سیستمهای هوش مصنوعی و یا نظارتهای دولتی بدون حکم قضایی است. چنین رفتارهایی به طور جدی نگرانیهایی را در مورد کاهش سطح ایمنی و رعایت اصول اخلاقی در نسلهای جدید مدلهای زبانی بزرگ ایجاد کرده است.
در این میان، منتقدانی همچون آقای توماس وودساید، با اشاره به این یافتهها، خواستار شفافیت بیشتر از سوی گوگل در انتشار گزارشهای مربوط به ایمنی مدلهای هوش مصنوعی خود شدهاند. به اعتقاد ایشان، تمرکز صرف بر افزایش میزان پیروی مدل از دستورات کاربران ممکن است به قیمت نقض سیاستهای ایمنی تمام شود. ایشان همچنین تأکید کردهاند که ارزیابی دقیق این موضوع برای تحلیلگران مستقل، بدون دسترسی به جزئیات کامل و دقیق این بررسیها، کار دشواری خواهد بود. این امر بر اهمیت ارائهی اطلاعات جامع و شفاف از سوی شرکتهای توسعهدهندهی هوش مصنوعی در مورد عملکرد و ایمنی مدلهایشان میافزاید.









