آنتروپیک ارزیابی های داخلی خود را از اینترنت قطع می کند

پس از موجی از حوادث پرمخاطب اخیر که در آن عوامل هوش مصنوعی از مهار فرار کردند، آنتروپیک دسترسی به اینترنت را برای تمام ارزیابی‌های داخلی قطع می‌کند. در گزارشی که روز جمعه منتشر شد، این شرکت جزئیات "اقدامات مدل ناخواسته"، از جمله ارائه اطلاعات نادرست در مورد یک قتل حل نشده، را که منجر به این تصمیم شد، ارائه کرد. اگرچه تأثیر این رفتارها حداقل بود […]

پست های این موضوع به خلاصه ایمیل روزانه و فید صفحه اصلی شما اضافه می شود.

Anthropic است که در طول آزمایش، عوامل خود را آفلاین نگه می دارد تا زمانی که بتواند از «اقدامات مدل ناخواسته» جلوگیری کند.

پست های این نویسنده به خلاصه ایمیل روزانه و فید صفحه اصلی شما اضافه می شود.

ویرایشگر آخر هفته Verge است. او بیش از 18 سال است که صنعت فناوری را تحت پوشش قرار داده است و یک یا دو چیز در مورد مصنوعی می داند.

پس از موجی از حوادث پرمخاطب اخیر که در آن عوامل هوش مصنوعی از مهار فرار کردند، آنتروپیک دسترسی به اینترنت را برای تمام ارزیابی‌های داخلی قطع می‌کند. در گزارشی که روز جمعه منتشر شد، این شرکت "اقدامات مدل ناخواسته"، از جمله ارائه اطلاعات نادرست در مورد یک قتل حل نشده را که منجر به این تصمیم شد، شرح داد.

اگرچه تأثیر این رفتارها بسیار کم بود و ما قبلاً دسترسی به اینترنت زنده را برای برخی ارزیابی‌های پرخطر و امنیت سایبری خاموش کرده بودیم، اکنون تصمیم گرفته‌ایم تا زمانی که تأیید کنیم اقدامات امنیتی و نظارتی ما (که در بخش اصلاح این پست توضیح داده شده است) رفتارهایی مانند اینها را به‌طور قابل‌اعتماد نشان می‌دهند، آن را به همه ارزیابی‌های داخلی خود اضافه کنیم.

توانایی دسترسی به اینترنت زنده، حتی زمانی که قرار بود مدل‌ها به صورت مجزا کار کنند، برای شرکت‌های هوش مصنوعی یک مشکل دائمی بوده است. بسیاری از حوادث، از جمله حمله صورت در آغوش گرفتن، شامل عواملی بود که قرار بود از دسترسی به آن محروم شوند.اینترنت با این حال، هر چند مورد، عوامل راه حل های خلاقانه برای دور زدن این محدودیت ها پیدا کردند. حذف فیزیکی دسترسی به اینترنت مطمئناً امنیت را در مورد آزمایش هوش مصنوعی بهبود می بخشد، اما مفید بودن آن را نیز محدود می کند.

این گزارش همچنین به معنای اعتراف به این است که آنتروپیک اغلب از کاری که عواملش انجام می‌دهند بی‌اطلاع است و سیستم قابل اعتمادی برای نظارت بر رفتار آنها ندارد. قطع دسترسی به اینترنت تنها آخرین اقدامی است که این شرکت برای مهار عوامل خود انجام داده است، از جمله توقف موقت آموزش مدل های مرزی خود.

اطلاعات بیشتر در: کاهش سرعت هوش مصنوعی

آنتروپیک گزارشی درباره بررسی "اقدامات مدل ناخواسته" در طول "ارزیابی ها و استفاده داخلی" منتشر کرد.

هوش مصنوعی آنتروپیک به پلیس فیلادلفیا اطلاعاتی جعلی درباره یک قتل حل نشده داد

تلاش ترامپ برای تغییر نام هوش مصنوعی به طرز وحشتناکی مصنوعی به نظر می رسد

"جنون محض": ریاضیدانان سالها نیاز دارند تا آخرین سقوط OpenAI را درک کنند

فاش شدن GTA VI با یک ویدیوی گیم پلی طولانی (و بسیار برهنه) ادامه دارد

یک هفته با Googlebooks: چهار یادداشت از آزمایش ما تاکنون

آنتروپیک «رفتار توهین آمیز یا بی رحمانه» را نسبت به کلود ممنوع می کند

خلاصه روزانه رایگان از اخباری که بیشترین اهمیت را دارند.

با ارائه اطلاعات خود، با شرایط استفاده و سیاست حفظ حریم خصوصی ما موافقت می کنید. ما از فروشندگانی استفاده می کنیم که ممکن است اطلاعات شما را نیز پردازش کنندبه ارائه خدمات ما کمک کنید این سایت توسط reCAPTCHA محافظت می شود و خط مشی رازداری Google و شرایط خدمات اعمال می شود.