[ad_1] شانتانو کومار / پکسل پس از ماهها گمانهزنی و پیشبینی، OpenAI نسخه تولیدی مدل استدلال پیشرفته خود، Project Strawberry را منتشر کرد که به “o1” تغییر نام داده است. با یک نسخه “مینی” (همانطور که GPT-4o بود) به...
پس از ماهها گمانهزنی و پیشبینی، OpenAI نسخه تولیدی مدل استدلال پیشرفته خود، Project Strawberry را منتشر کرد که به “o1” تغییر نام داده است. با یک نسخه “مینی” (همانطور که GPT-4o بود) به آن ملحق شده است که تعاملات سریعتر و پاسخگوتر را به قیمت استفاده از یک پایگاه دانش بزرگتر ارائه می دهد.
به نظر می رسد که o1 مجموعه ای از پیشرفت های فنی را ارائه می دهد. این اولین مدل از مدلهای استدلال OpenAI است که برای استفاده از استنتاج انسانمانند برای پاسخ دادن به سؤالات پیچیده در مورد موضوعات – از جمله علوم، کدنویسی و ریاضی – سریعتر از انسانها طراحی شده است.
به عنوان مثال، در طول تست، به o1 یک آزمون واجد شرایط برای المپیاد بین المللی ریاضیات داده شد. در حالی که سلف آن، GPT-4o، تنها توانست 13 درصد از مشکلات ارائه شده را به درستی حل کند، o1 83 درصد از آنها را به درستی حل کرد. در رقابت آنلاین Codeforces، o1 در صدک 89 امتیاز کسب کرد. علاوه بر این، o1 میتواند به پرسشهایی پاسخ دهد که مدلهای قبلی را تحت تأثیر قرار دادهاند (مانند «کدام بزرگتر است، 9.11 یا 9.9؟»). با این حال، این شرکت روشن می کند که این نسخه تنها پیش نمایشی از قابلیت های کامل مدل neophyte است.
جری تورک، سرپرست تحقیقات OpenAI، گفت: o1 جدید با استفاده از یک الگوریتم بهینهسازی کاملاً جدید و مجموعه دادههای آموزشی جدیدی که به طور خاص برای آن طراحی شده است، آموزش داده شده است. آستانه. بر اساس گزارش ها، o1 با استفاده از ترکیبی از یادگیری تقویتی و استدلال “زنجیره ای فکر” استنباط های دقیق تری را نسبت به نسخه قبلی خود ارائه می دهد. تورک گفت: «ما متوجه شدهایم که این مدل کمتر توهم میزند، اما نمیتوانیم بگوییم که توهمات را حل کردهایم.»
هر دو مشترک ChatGPT-Plus و Teams از امروز می توانند o1 و o1-mini را آزمایش کنند. مشترکین Enterprise و Edu باید تا هفته آینده دسترسی داشته باشند.
این شرکت می گوید که o1-mini در نهایت در دسترس کاربران سطح رایگان قرار می گیرد، اگرچه جدول زمانی مشخصی را مشخص نکرده است. توسعه دهندگان متوجه افزایش شدید قیمت API برای o1 در مقایسه با GPT-4o خواهند شد. دسترسی به o1 برای هر میلیون توکن ورودی 15 دلار (در مقایسه با 5 دلار در هر میلیون برای GPT-4o) و 60 دلار به ازای هر میلیون توکن خروجی هزینه خواهد داشت که چهار برابر بیشتر از هزینه 15 دلاری 4o در هر میلیون است. سوال واقعی این است که آیا مدل جدید فکر میکند کلمه “توت فرنگی” حاوی دو یا سه R است.