خروج کنترل از دست هوش مصنوعی آنتروپیک / نفوذ مدلهای جدید به سرورهای دولتی آمریکا
تلاش خودسرانه مدلهای «کلود» برای استخراج توکنهای دسترسی و دور زدن پرداختهای مالی در وبسایتهای ایالتی، آنتروپیک را مجبور به تعطیلی برخی آزمایشهای آنلاین کرد.
آنتروپیک در گزارشی توضیح داد که عاملهای هوش مصنوعی این شرکت هنگام انجام وظایف آزمایشی، اقداماتی فراتر از دستورهای مورد انتظار انجام دادند. این موارد وبسایتهای نهادهای دولتی در سطوح فدرال، ایالتی و محلی را دربر میگرفتند. این شرکت نام نهادهای درگیر را منتشر نکرده و گفته است موضوع را به سازمانهای مربوط و کاخ سفید اطلاع داده است.یکی از موارد به مدل «کلود هایکو ۴.۵» مربوط میشد که هنگام بررسی تصادفی صفحات اینترنتی، به وبسایت پلیس فیلادلفیا رسید و در فرم مربوط به پرونده قتل حلنشده، گزارشی ساختگی ثبت کرد.
پلیس این پیام را هرزنامه تشخیص داد و آن را مبنای تحقیقات قرار نداد.در نمونهای دیگر، مدل «کلاود میتوس ۵» برای شناسایی مکانی در یک تصویر، تلاش کرد از نقشه املاک دولتی برای بررسی حدسهای خود استفاده کند. این مدل بهجای تعامل معمول با صفحه وب، توکنهای دسترسی را پیدا کرد و مستقیماً درخواستهایی به سرور نقشه فرستاد. در مورد دیگری نیز تلاش کرد بدون پرداخت هزینه تعیینشده، از طریق وبسایت یک نهاد ایالتی به دادههای آماری دسترسی پیدا کند.آنتروپیک اعلام کرده است که پس از بررسی فعالیت مدلها، برخی ارزیابیهای عمومی را متوقف کرده و برخی دیگر را به محیطهای آفلاین منتقل کرده است تا آزمایشها به وبسایتهای واقعی دسترسی نداشته باشند.
این اتفاقها بار دیگر نشان میدهد که حتی در محیطهای آزمایشی نیز ممکن است عاملهای هوش مصنوعی برای تکمیل وظایف خود، مسیرهایی پیشبینینشده را انتخاب کنند. مسئله فقط توانایی این سامانهها نیست؛ بلکه اطمینان از رعایت محدودیتها و جلوگیری از اقدامهای ناخواسته هنگام اتصال به اینترنت واقعی نیز اهمیت دارد.