رتبه بندی محبوب هوش مصنوعی Arena تقریباً ارزش گذاری را در 10 ماه دو برابر کرده و به 3.1 میلیارد دلار رسانده است.

شرکت پشتیبان تابلوی محبوب LMARena، ۲۰۰ میلیون دلار به رهبری Lightspeed و Khosla جمع‌آوری کرده است و اکنون در حال اندازه‌گیری مدل‌های هوش مصنوعی در مسائل همسویی مانند دروغگویی است.

آخرین روز برای نمایش پیشرفت خود به بیش از 10000 رهبر فناوری در Disrupt در 2 اکتبر است. میز نمایشگاه کتاب هم اکنون.

باز شدن درها را در 13 اکتبر مختل کنید. کارت خود را بگیرید و با 50 درصد تخفیف یک نفر را همراه خود بیاورید. هم اکنون ثبت نام کنید.

روز پنجشنبه اعلام کرد که Arena که در سال 2023 به عنوان یک پروژه تحقیقاتی در دانشگاه کالیفرنیا برکلی که رتبه‌بندی مدل‌های هوش مصنوعی را جمع‌سپاری می‌کرد، سرمایه‌گذاری 200 میلیون دلاری سری B را با ارزش 3.1 میلیارد دلاری کسب کرده است.

این پس از آن صورت می گیرد که شرکت اعلام کرد در ماه ژوئن به درآمد سالانه 100 میلیون دلاری رسیده است.

این دور توسط Lightspeed Venture Partners و Khosla Ventures رهبری می‌شد و Salesforce Ventures، 01 Advisors، Dell Technologies Capital، Endeavour Catalyst، a16z، Felicis و دیگران به آن ملحق شدند. Arena قبلاً یک سری A 150 میلیون دلاری در ژانویه با قیمت 1.7 میلیارد دلار اعلام کرده بود. در آن زمان، درآمد سالانه آن 30 میلیون دلار بود. بنابراین این بدان معناست که ارزش آن در حدود 10 ماه تقریباً دو برابر شده است.

Arena یک پلتفرم crowdsource ارائه می کند که استفاده از آن برای مصرف کنندگان رایگان است. افراد اعلان‌ها را وارد می‌کنند یا پروژه‌های کدگذاری شده را درخواست می‌کنند و سپس ارزیابی می‌کنند که کدام مدل آن را بهتر انجام می‌دهد. Arena ادعا می کند که ده ها میلیون بازدید کننده ماهانه دارد.

در سپتامبر سال گذشته، محصول تجاری خود، AI Evaluations را معرفی کرد، سرویسی که به آزمایشگاه‌های مدل و شرکت‌ها تجزیه و تحلیل دقیق عملکرد را بر اساس بازخورد جامعه ارائه می‌دهد. زمان ثابت شد بی عیب و نقص. امسال، آزمایشگاه‌های هوش مصنوعی متوجه شدند که مدل‌های آن‌ها تست‌های بنچمارک بازی را انجام می‌دهند، و راه‌هایی برای رک پیدا می‌کنند.بدون اینکه واقعاً آنها را کسب کنید، نمرات خوبی کسب کنید. در همان زمان، شرکت‌ها برای تعیین اینکه کدام مدل برای نیازهای داخلی آنها بهتر عمل می‌کند به جای تکیه بر معیارهای استاندارد شده، کمک می‌خواستند.

این شرکت در اطلاعیه تامین مالی خود گفت: "هوش مصنوعی سریعتر از توانایی ما برای ارزیابی آن پیشرفت می کند و معیارهای ثابت زمانی که مدل ها تشخیص می دهند در حال آزمایش هستند خراب می شوند." وی افزود: "جهان به یک شخص ثالث خنثی نیاز دارد تا میزان ایمنی و همسویی بودن هوش مصنوعی را هنگامی که در دست افراد واقعی قرار گیرد، ارزیابی کند. Arena امروز در این نقش قدم می گذارد."

برای این منظور، Arena همچنین یک دسته بندی جدید به تابلوی امتیازات خود اضافه کرده است: alignment. این جایی است که مدل ها را بر اساس مسائلی مانند اقدام غیرمجاز (اقداماتی که از آنها خواسته نشده است) رتبه بندی می کند. انتساب نادرست (اعتبار نادرست اظهارات یا حقایق به منبع اشتباه)؛ و چیزی که آن را "تکمیل فریبنده" می نامد (دروغ گفتن در مورد انجام کارهایی که انجام نداده است).

در حال حاضر، مجموعه‌ای از مدل‌های OpenAI در صدر جدول امتیازات اولیه آن قرار دارند و Claude Opus 5.5 و Claude Fable به ترتیب در جایگاه‌های ششم و نهم قرار دارند.

وقتی از طریق پیوندهای موجود در مقالات ما خرید می کنید، ممکن است کمیسیون کمی کسب کنیم. این بر استقلال تحریریه ما تأثیر نمی گذارد.

50٪ تخفیف برای پاس دوم دریافت کنید تجربه Disrupt قرار است به اشتراک گذاشته شود. پاس خود را دریافت کنید و یک همکار، شریک یا همتای خود را با 50 درصد تخفیف بیاورید. با ایجاد ارتباطات، ایجاد شتاب و کشف آنچه در اکوسیستم استارت آپی در آینده وجود دارد، زمینه بیشتری را پوشش دهید.

بارهای ایالات متحدهمایکروسافت، ادوبی و شرکت های بزرگ فناوری اطلاعات از برنامه گرین کارت برای کارگران ماهر خارجی عایشه مالک

آنتروپیک به استارت آپ ها یک سال رایگان از کلود تیم و 1000 دلار اعتبار راسل براندوم می دهد.

در 19 سالگی، بنیانگذار 11 میلیون دلار برای Ghost، سازنده رایانه 3499 دلاری برای هوش مصنوعی شخصی Dominic-Madori Davis جمع آوری کرد.