تغییر مهمی در دنیای مدلهای زبانی بزرگ (LLM) اتفاق میافتد – تغییری که میتواند نحوه تعامل ما با هوش مصنوعی را دوباره تعریف کند. و پاسخ، که امروز توسط OpenAi پیشنمایش شده است، ممکن است در رویکرد جدیدی به نحوه یادگیری و سازگاری این مدلها باشد.
بذار توضیح بدم
راه قدیم: از قبل آموزش دیده و در سنگ تنظیم شده است
به طور سنتی، LLM ها یک فرآیند آموزش خطی را دنبال می کنند. این مدلها بیشتر عمر خود را در پیشآموزش میگذرانند، که شامل هضم حجم عظیمی از دادههای متنی است. این مرحله از نظر محاسباتی فشرده است و بخش عمده ای از منابع و زمان را به خود اختصاص می دهد. پس از این، پس از آموزش یا تنظیم دقیق، مدل برای تخصص در کارهای خاص تنظیم می شود. در نهایت، به استنتاج میرسی، جایی که مدل بر اساس آموختههایش پاسخهایی را تولید میکند.
نکته اینجاست: در اکثر LLMها، مرحله استنتاج بسیار ایستا است. پس از آموزش، مدل در طول استفاده تغییر زیادی نمی کند. این فقط الگوهای مبتنی بر آموزش قبلی خود را بدون بهبود یا انطباق فعال در طول تعامل بازمی گرداند.
به عبارت دیگر، این مدلها مانند یک فرد تحصیلکرده هستند که میتوانند به سؤالات شما پاسخ دهند – بسیار عالی – اما نمیتوانند چیز جدیدی را در زمان واقعی یاد بگیرند. آنها ممکن است بسیار صلاحیت داشته باشند، اما هیچ رشد مداومی در تعامل با شما وجود ندارد.
OpenAI o1 LLM را وارد کنید
اکنون، یک LLM را تصور کنید که بیشتر شبیه یک ذهن کنجکاو است – ذهنی که نه تنها به شما پاسخ های ثابت می دهد، بلکه با هر تعامل یاد می گیرد، سازگار می شود و تکامل می یابد. اینجاست که OpenAI به تازگی معرفی شده است مدل o1 وارد بازی می شود.
بر خلاف رویکرد سنتی که در آن استنتاج بخشی کوچک و ایستا از زندگی مدل است، مدل o1 استنتاج را به عنوان یک فرآیند پویا و در حال تکامل در نظر میگیرد. در طول استنتاج (مرحله ای که از مدل استفاده می کنید)، مدل o1 می تواند به طور فعال خود را یاد بگیرد و اصلاح کند. این بدان معنی است که فقط در قبل و بعد از تمرین متوقف نمی شود، بلکه در طول استفاده به رشد خود ادامه می دهد. پاسخگوتر، سازگارتر، و به طور بالقوه بیشتر با پیچیدگی های دنیای واقعی هماهنگ است. داده های OpenAI قابل توجه است.
در تست های ما، به روز رسانی مدل بعدی مشابه Ph.D عمل می کند. دانش آموزان در تکالیف معیار چالش برانگیز در فیزیک، شیمی و زیست شناسی. ما همچنین دریافتیم که در ریاضیات و کدنویسی برتر است. در یک امتحان مقدماتی برای المپیاد بین المللی ریاضیات (IMO)، GPT-4o تنها 13 درصد از مسائل را به درستی حل کرد، در حالی که مدل استدلال 83 درصد را به دست آورد. توانایی کدنویسی آنها در مسابقات مورد ارزیابی قرار گرفت و در مسابقات Codeforces به صدک 89 رسید.
چرا این مهم است؟
در مورد آن فکر کنید: در جهانی که سریعتر از همیشه در حال تغییر است، دانش ایستا کافی نیست. ما به مدلهایی نیاز داریم که بتوانند به آن ادامه دهند. مدل o1 فرصتهایی را برای هوش مصنوعی فراهم میکند تا شهودیتر شود و با نیازهای لحظهای ما هماهنگ شود. این می تواند به معنای تشخیص مراقبت های بهداشتی دقیق تر و شخصی تر، پشتیبانی دقیق تر از مشتری و حتی هوش مصنوعی باشد که در کنار کاربران خود به گونه ای تکامل می یابد که بیشتر از همیشه احساس انسان بودن می کند.
به جای تکیه بر مجموعه داده های عظیم پیش از آموزش که قدیمی می شوند، مدل هایی که می توانند در حین استفاده یاد بگیرید این پتانسیل را دارند که با دنیای اطراف خود در جریان باشند. این نشان دهنده جهشی از آموزش “یک و انجام” به چیزی بسیار پویاتر است.
آینده هوش مصنوعی: یادگیری در لحظه
بنابراین، آینده هوش مصنوعی چیست؟ مدلهایی که نه تنها قبل از ورود به بازار هوشمندتر میشوند، بلکه مدلهایی که پس از آن به تکامل خود ادامه میدهند. رویکرد سنتی LLM ممکن است هنوز برای محیطهای ثابت کار کند، اما در دنیایی با گام سریع و همیشه در حال تغییر، مدل o1 به آیندهای اشاره میکند که در آن هوش مصنوعی در زمان واقعی یاد میگیرد، در زمان واقعی تطبیق مییابد و به بخشی جداییناپذیر از ما تبدیل میشود. زندگی می کند.
این فقط در مورد بزرگتر یا سریعتر کردن LLMها نیست. این در مورد ساخت آنها است باهوش تر– و نسبت به دنیای اطرافشان بیشتر پاسخگو هستند.