با وجود ماهها شایعه توسعه، انتشار پروژه توت فرنگی OpenAI در هفته گذشته غافلگیرکننده بود و بسیاری از تحلیلگران معتقد بودند که این مدل حداقل برای هفتهها، اگر نه در اواخر پاییز، آماده نخواهد شد.
مدل جدید o1-preview، و همتای o1-mini آن، در حال حاضر برای استفاده و ارزیابی در دسترس هستند، در اینجا نحوه دسترسی برای خود آورده شده است.
ما پیشنمایش OpenAI o1 را منتشر میکنیم—سری جدیدی از مدلهای هوش مصنوعی که برای صرف زمان بیشتری برای فکر کردن قبل از پاسخ دادن طراحی شدهاند.
این مدل ها می توانند از طریق کارهای پیچیده استدلال کنند و مسائل سخت تری را نسبت به مدل های قبلی در علوم، کدنویسی و ریاضی حل کنند. https://t.co/peKzzKX1bu
– OpenAI (@OpenAI) 12 سپتامبر 2024
o1 چیست؟
OpenAI آرمان های هوش عمومی مصنوعی (AGI) خود را پنهان نکرده است و پروژه توت فرنگی (که اکنون با نام “o1” شناخته می شود) گام بعدی این شرکت به سمت این هدف است. این اولین مدل از سری جدید مدلهای «استدلال» است که طبق یک پست اعلامیه OpenAI، «طراحی شده است تا زمان بیشتری را قبل از پاسخ دادن به فکر کردن صرف کند». این استراتژی مدل را قادر میسازد تا از طریق وظایف پیچیده استدلال کند و مسائل سختتر را نسبت به مدلهای قبلی در علوم، کدنویسی و ریاضی حل کند.
طبق گزارشها، مدلها به شیوهای شبیه انسان استدلال میکنند و به آنها اجازه میدهند «فرایند تفکر خود را اصلاح کنند، استراتژیهای مختلف را امتحان کنند و اشتباهات خود را تشخیص دهند»، زیرا از طریق آموزش تجربه کسب میکنند. طبق گفته OpenAI، o1-preview همتراز با Ph.D عمل می کند. دانشآموزان فیزیک، شیمی و زیستشناسی هستند و در آزمونهای معیار در آن موضوعات به طور مشابه عمل میکنند. o1 همچنین در کدنویسی و مسائل ریاضی مهارت دارد و در آزمون مقدماتی المپیاد ریاضی بینالمللی (IMO) که در آن GPT-4o تنها 13 درصد امتیاز کسب کرد و در رقابت Codeforces در برابر حریفان انسانی به صدک 89 رسید، 83% را کسب کرد.
در اینجا o1، مجموعهای از توانمندترین و هماهنگترین مدلهای ما تا کنون آمده است: https://t.co/yzZGNN8HvD
o1 هنوز ناقص است، هنوز محدود است، و هنوز در اولین استفاده از آن تاثیرگذارتر از زمانی است که زمان بیشتری را با آن سپری می کنید. pic.twitter.com/Qs1HoSDOz1
– سم آلتمن (@sama) 12 سپتامبر 2024
o1-mini یک نسخه سبک وزن از مدل استاندارد o1-preview است. طبق گزارشات، کارکرد آن 80 درصد کمتر از تکرار بزرگتر است، و به ویژه در تجزیه و تحلیل کدنویسی و وظایف تولید قابلیت دارد.
آیا o1-preview برای امتحان در دسترس است؟
بله، مدل های o1-preview در 12 سپتامبر برای مشترکین ChatGPT Plus و Teams. کاربران سازمانی و آموزشی در آغاز هفته آینده دسترسی خواهند داشت.
o1 در برابر بازیگران بد چقدر ایمن است؟
خیلی، به نظر می رسد. گزارش شده است که OpenAI یک برنامه آموزشی ایمنی کاملاً جدید توسعه داده است که از قابلیتهای استدلالی افزایش یافته مدل برای پایبندی مؤثرتر به دستورالعملهای ایمنی و تراز آن استفاده میکند. این شرکت خاطرنشان میکند که در آزمایش، جایی که GPT-4o امتیاز 22 (از 100) را در مقاومت در برابر تلاشهای فرار از زندان کسب کرد، مدل جدید o1 امتیاز 84 را کسب کرد.
چگونه به o1-preview دسترسی پیدا کنم؟
همانند سایر ویژگیهای جدید هوش مصنوعی، O1-preview جدید منتشر شده در حال حاضر فقط برای مشترکین پولی در دسترس است. اگر میخواهید خودتان آن را امتحان کنید، باید یک اشتراک 20 دلاری در ماه Plus را انتخاب کنید. به سادگی بر روی دکمه رادیویی برنامه ارتقاء در پایین صفحه ناوبری سمت چپ کلیک کنید و اعلان های روی صفحه را دنبال کنید تا جزئیات پرداخت خود را وارد کنید.
هنگامی که اشتراک شما فعال شد، o1-preview یا o1-mini را از دکمه انتخابگر مدل در سمت چپ صفحه اصلی ChatGPT انتخاب کنید. توجه داشته باشید که دسترسی محدود است، حتی برای کاربران پولی، با محدودیت نرخ هفتگی 30 پیام برای o1-preview و 50 پیام برای o1-mini. OpenAI می گوید که در نهایت o1-mini را برای کاربران سطح رایگان در دسترس قرار می دهد، اگرچه این شرکت هنوز تاریخی برای عرضه آن تعیین نکرده است.