رتبه بندی محبوب هوش مصنوعی Arena تقریباً ارزش گذاری را در 10 ماه دو برابر کرده و به 3.1 میلیارد دلار رسانده است.
شرکت پشتیبان تابلوی محبوب LMARena، ۲۰۰ میلیون دلار به رهبری Lightspeed و Khosla جمعآوری کرده است و اکنون در حال اندازهگیری مدلهای هوش مصنوعی در مسائل همسویی مانند دروغگویی است.
آخرین روز برای نمایش پیشرفت خود به بیش از 10000 رهبر فناوری در Disrupt در 2 اکتبر است. میز نمایشگاه کتاب هم اکنون.
باز شدن درها را در 13 اکتبر مختل کنید. کارت خود را بگیرید و با 50 درصد تخفیف یک نفر را همراه خود بیاورید. هم اکنون ثبت نام کنید.
روز پنجشنبه اعلام کرد که Arena که در سال 2023 به عنوان یک پروژه تحقیقاتی در دانشگاه کالیفرنیا برکلی که رتبهبندی مدلهای هوش مصنوعی را جمعسپاری میکرد، سرمایهگذاری 200 میلیون دلاری سری B را با ارزش 3.1 میلیارد دلاری کسب کرده است.
این پس از آن صورت می گیرد که شرکت اعلام کرد در ماه ژوئن به درآمد سالانه 100 میلیون دلاری رسیده است.
این دور توسط Lightspeed Venture Partners و Khosla Ventures رهبری میشد و Salesforce Ventures، 01 Advisors، Dell Technologies Capital، Endeavour Catalyst، a16z، Felicis و دیگران به آن ملحق شدند. Arena قبلاً یک سری A 150 میلیون دلاری در ژانویه با قیمت 1.7 میلیارد دلار اعلام کرده بود. در آن زمان، درآمد سالانه آن 30 میلیون دلار بود. بنابراین این بدان معناست که ارزش آن در حدود 10 ماه تقریباً دو برابر شده است.
Arena یک پلتفرم crowdsource ارائه می کند که استفاده از آن برای مصرف کنندگان رایگان است. افراد اعلانها را وارد میکنند یا پروژههای کدگذاری شده را درخواست میکنند و سپس ارزیابی میکنند که کدام مدل آن را بهتر انجام میدهد. Arena ادعا می کند که ده ها میلیون بازدید کننده ماهانه دارد.
در سپتامبر سال گذشته، محصول تجاری خود، AI Evaluations را معرفی کرد، سرویسی که به آزمایشگاههای مدل و شرکتها تجزیه و تحلیل دقیق عملکرد را بر اساس بازخورد جامعه ارائه میدهد. زمان ثابت شد بی عیب و نقص. امسال، آزمایشگاههای هوش مصنوعی متوجه شدند که مدلهای آنها تستهای بنچمارک بازی را انجام میدهند، و راههایی برای رک پیدا میکنند.بدون اینکه واقعاً آنها را کسب کنید، نمرات خوبی کسب کنید. در همان زمان، شرکتها برای تعیین اینکه کدام مدل برای نیازهای داخلی آنها بهتر عمل میکند به جای تکیه بر معیارهای استاندارد شده، کمک میخواستند.
این شرکت در اطلاعیه تامین مالی خود گفت: "هوش مصنوعی سریعتر از توانایی ما برای ارزیابی آن پیشرفت می کند و معیارهای ثابت زمانی که مدل ها تشخیص می دهند در حال آزمایش هستند خراب می شوند." وی افزود: "جهان به یک شخص ثالث خنثی نیاز دارد تا میزان ایمنی و همسویی بودن هوش مصنوعی را هنگامی که در دست افراد واقعی قرار گیرد، ارزیابی کند. Arena امروز در این نقش قدم می گذارد."
برای این منظور، Arena همچنین یک دسته بندی جدید به تابلوی امتیازات خود اضافه کرده است: alignment. این جایی است که مدل ها را بر اساس مسائلی مانند اقدام غیرمجاز (اقداماتی که از آنها خواسته نشده است) رتبه بندی می کند. انتساب نادرست (اعتبار نادرست اظهارات یا حقایق به منبع اشتباه)؛ و چیزی که آن را "تکمیل فریبنده" می نامد (دروغ گفتن در مورد انجام کارهایی که انجام نداده است).
در حال حاضر، مجموعهای از مدلهای OpenAI در صدر جدول امتیازات اولیه آن قرار دارند و Claude Opus 5.5 و Claude Fable به ترتیب در جایگاههای ششم و نهم قرار دارند.
وقتی از طریق پیوندهای موجود در مقالات ما خرید می کنید، ممکن است کمیسیون کمی کسب کنیم. این بر استقلال تحریریه ما تأثیر نمی گذارد.
50٪ تخفیف برای پاس دوم دریافت کنید تجربه Disrupt قرار است به اشتراک گذاشته شود. پاس خود را دریافت کنید و یک همکار، شریک یا همتای خود را با 50 درصد تخفیف بیاورید. با ایجاد ارتباطات، ایجاد شتاب و کشف آنچه در اکوسیستم استارت آپی در آینده وجود دارد، زمینه بیشتری را پوشش دهید.
بارهای ایالات متحدهمایکروسافت، ادوبی و شرکت های بزرگ فناوری اطلاعات از برنامه گرین کارت برای کارگران ماهر خارجی عایشه مالک
آنتروپیک به استارت آپ ها یک سال رایگان از کلود تیم و 1000 دلار اعتبار راسل براندوم می دهد.
در 19 سالگی، بنیانگذار 11 میلیون دلار برای Ghost، سازنده رایانه 3499 دلاری برای هوش مصنوعی شخصی Dominic-Madori Davis جمع آوری کرد.