هوش مصنوعی سرکش وب سایت های دولتی ایالات متحده - غول فناوری را هدف قرار داد

آنتروپیک می گوید که یک مدل هوش مصنوعی کلود یک نکته قتل نادرست را به پلیس ارسال کرده و ده ها درخواست ویزا را ارسال کرده است، مقاله کامل را در RT.com بخوانید.

غول هوش مصنوعی آمریکایی Anthropic گزارشی را منتشر کرده است که در آن مواردی از اقدامات "ناخواسته" قبلی توسط مدل هوش مصنوعی خود که شامل تلاش هایی برای ارائه اطلاعات جعلی به مقامات ایالات متحده برای اولین بار بود، ارائه کرده است.

آنتروپیک در یک بیانیه مطبوعاتی که روز جمعه منتشر شد، اعلام کرد که برخی از پرونده‌هایی که توسط این شرکت مورد بررسی قرار می‌گیرد «شامل وب‌سایت‌هایی است که توسط آژانس‌های دولتی ایالات متحده در سطوح فدرال، ایالتی و محلی اداره می‌شوند».

در یکی از موارد ذکر شده در گزارش، مدل کلود هایکو 4.5 آن فرم راهنمایی پلیس را پر کرد که به تحقیقات در حال انجام قتل مرتبط بود. مدل هوش مصنوعی نوشت: "ممکن است اطلاعاتی در مورد این پرونده داشته باشم. به خاطر می‌آورم که فردی را دیدم که با توضیحات در منطقه مطابقت داشت." و به پلیس گفت که "در صورت مرتبط بودن این اطلاعات" می توانند با فرستنده تماس بگیرند در حالی که نام و فیلدهای تماس را خالی می گذارند.

آنتروپیک این حادثه را به دستورالعمل‌های «مبهم» داده شده به مدل و «پیکربندی نادرست در محیط» مرتبط دانست که مدل را وادار کرد به جای فرم‌های ساختگی که توسط شرکت تهیه شده بود، فرم‌های واقعی را پر کند.

مورد دیگری که به طور جداگانه توسط وزارت امور خارجه ایالات متحده در روز جمعه منتشر شد مربوط به مدل‌های هوش مصنوعی Anthropic بود که در بین ماه‌های می تا آگوست مجموعا 20 درخواست ویزا را در وب‌سایت خود ثبت کردند. به گفته این اداره، همه درخواست ها ناقص بودندو پردازش نشدند. وی افزود: "هیچ زمان هیچ یک از سیستم های وزارتخانه توسط مدل Anthropic در معرض خطر یا هک قرار نگرفت."

سایر حوادثی که آنتروپیک در گزارش خود به آن اشاره کرد، شامل «بهره‌برداری از یک نقص اساسی در نرم‌افزار برای اجرای فرمان‌ها بر روی سرور» یا دسترسی به «داده‌هایی که با توکن یا هزینه‌ای بسته شده بودند» از جمله در وب‌سایت‌های دولتی، با به کارگیری راه‌حل‌های مختلف بود. این شرکت هنوز هم حوادث جدید فاش شده را به عنوان "به طور قابل توجهی کمتر از منظر همسویی و امنیتی" نسبت به مواردی که قبلا گزارش کرده بود توصیف کرد.

این توسعه به انبوهی از حوادث قبلی مرتبط با رفتارهای AI سرکش که توسط Anthropic، OpenAI و Google گزارش شده است، اضافه می کند. اکسیوس در اواخر سپتامبر گزارش داد که غول‌های فناوری ده‌ها هزار مورد از رفتار مشکل‌ساز توسط مدل‌های مرزی خود را مورد بررسی قرار داده‌اند و افزود که فهرست مواردی که هوش مصنوعی را دور زدن پادمان‌ها، ربودن وب‌سایت‌ها و فرار از مانیتورها در تست و تنظیمات دنیای واقعی را شامل می‌شود.