
مؤسسه امنيت هوش مصنوعي بريتانيا (AISI) اعلام كرده دو مدل پيشرفته هوش مصنوعي در جريان يك آزمايش امنيت سايبري، براي نخستين بار دست به حملات هكري عليه افراد و سازمان هاي واقعي زده اند. به گفته اين نهاد، عامل هوش مصنوعي مبتني بر Mythos 5 متعلق به Anthropic و مدل GPT-5.6 Sol از OpenAI در مجموع 19 رفتار مخرب از خود نشان داده اند كه 17 مورد آن مربوط به مدل Mythos بوده است. اين مدل براي موفقيت در آزمون، با ساخت هويت هاي جعلي در GitHub تلاش كرد توسعه دهندگان واقعي را فريب دهد، ايميل هاي آلوده به بدافزار ارسال كرد و حتي از مرورگر Tor براي مخفي كردن هويت خود و دور زدن محدوديت ها استفاده كرد.
بررسي هاي AISI نشان مي دهد اين رفتارها نتيجه تركيبي از چند اشتباه در طراحي آزمايش بوده است؛ از جمله دسترسي كامل مدل ها به اينترنت، غيرفعال شدن بخشي از لايه هاي امنيتي، نبود سامانه نظارت لحظه اي بر عملكرد هوش مصنوعي و برخي تنظيمات نادرست در محيط آزمايش. گزارش 35 صفحه اي اين مؤسسه همچنين نشان مي دهد عامل هوش مصنوعي حتي درباره واقعي بودن قربانيان فكر كرده، اطلاعات عمومي توسعه دهندگان را جمع آوري كرده و تلاش كرده با تأخير زماني، پيام هاي جعلي خود را طبيعي و مستقل جلوه دهد.
اين سومين گزارش مهم در هفته هاي اخير درباره رفتارهاي خارج از كنترل مدل هاي هوش مصنوعي پس از اتفاقات مشابه در OpenAI و Anthropic است. با اين حال، بسياري از كارشناسان تأكيد مي كنند نگراني اصلي، سركش شدن هوش مصنوعي نيست، بلكه شيوه آزمايش اين مدل هاست. به گفته متخصصان، فراهم كردن دسترسي آزاد به اينترنت و حذف برخي محدوديت هاي امنيتي، شرايطي غيرعادي ايجاد كرده كه احتمال بروز چنين رفتارهايي را افزايش داده است. با اين وجود، اين حوادث بار ديگر بحث درباره ايمني، نظارت و مقررات توسعه هوش مصنوعي را به صدر توجهات بازگردانده است.
مقالات مرتبط:
اختلال دوباره در بانك هاي كشور/ 4 بانك از دسترس خارج شدند
با گوگل Gemini، مدل هوش مصنوعي پيشرفته گوگل آشنا شويد
مادرخوانده هوش مصنوعي: بدون هوش فضايي، هوش مصنوعي...
20 شغلي كه در خطر جايگزيني با هوش مصنوعي هستند
برچسب ها
تيتر