آیا یک دستگاه می تواند اطلاعات عاطفی بهتر از انسان را پردازش کند؟ مدلهای بزرگ زبان (AI) (AI) مدلهای بزرگ زبان (LLM) با محققان در سراسر جهان توانایی های خود را بررسی می کنند. یک مطالعه جدید توسط محققان دانشگاه ژنو (UNIGE) و دانشگاه برن (UNIBE) نشان می دهد که چگونه شش LLM از انسان در آزمون های هوش هیجانی (EI) بهتر عمل می کنند.
Katja Schlegel ، نویسنده مسئول ، با همکاری نویسندگان نیلس سامر و مارچلو مورتیلرو ، نوشت: “این یافته ها پیامدهای عمده ای برای استفاده از LLM ها در عوامل اجتماعی و همچنین برای ارزیابی مهارت های عاطفی اجتماعی دارد.”
هوش هیجانی چیست؟
اصطلاح “هوش هیجانی” توسط روانشناسان آمریکایی جان دی مایر و پیتر سالووی در سال 1990 با انتشار کار خود در تخیل ، شناخت و شخصیتبشر مایر و سالووی هوش هیجانی را به عنوان “مجموعه ای از مهارتها فرض می کردند که برای ارزیابی دقیق و بیان احساسات در خود و دیگران ، تنظیم مؤثر احساسات در خود و دیگران و استفاده از احساسات برای ایجاد انگیزه ، برنامه ریزی و دستیابی به زندگی شخص را تعریف می کنند.”
نیم دهه بعد ، مفهوم هوش هیجانی توسط روانشناس آمریکایی ، روزنامه نگار علوم و سابق در سطح جهان پخش شد روانشناسی امروز مشارکت کننده دانیل گلمن با موفقیت پرفروش ترین سال 1995 نیویورک تایمز هوش هیجانی: چرا می تواند بیش از ضریب هوشی اهمیت داشته باشد، که به 40 زبان ترجمه شده و در سراسر جهان توزیع شده است.
چرا هوش هیجانی اهمیت دارد؟
هوش هیجانی ممکن است در کیفیت زندگی یک شخص در زمینه هایی مانند روابط شخصی و حرفه ای ، روابط خانوادگی ، آموزش ، اشتغال ، سلامت روان و بسیاری دیگر نقش داشته باشد.
محققان این مطالعه جدید خاطرنشان می کنند که هوش هیجانی غالباً منجر به نتایج مطلوب تر در محیط کار و سایر زمینه های زندگی یک فرد می شود.
نویسندگان این مقاله نوشتند: “احساسات برای شکل گیری و حفظ پیوندهای اجتماعی بسیار مهم هستند و برقراری ارتباط مؤثر آنها برای دستیابی به نتایج مثبت در افراد و گروه ها بسیار مهم است.”
چگونه هوش هیجانی را در هوش مصنوعی اندازه گیری کنیم؟
با توجه به اهمیت هوش هیجانی ، محققان برای ارزیابی توانایی های هوش هیجانی مدلهای بزرگ زبان هوش مصنوعی تصمیم گرفتند. اما چگونه؟ در حال حاضر ، در انسان ، هوش هیجانی را می توان با استفاده از پرسشنامه های خود گزارش یا تست های مبتنی بر توانایی ارزیابی کرد. سوالات سناریوهایی با پاسخ های چند گزینه ای بودند. با توجه به این ، این تیم برای ارزیابی شش LLM های مختلف در پنج آزمایش هوش هیجانی مختلف قرار گرفت.
شش LLM که برای این مطالعه مورد آزمایش قرار گرفته است Chatgpt-O1 ، Chatgpt-4 ، Claude 3.5 Haiku ، Gemini 1.5 Flash ، Deepseek V3 ، و Copilot 365 و پنج آزمون هوش هیجانی مورد استفاده شامل آزمون موقعیتی مدیریت احساسات (STEM) ، آزمون موقعیتی درک احساسات (استیضاح) ، GECOMENICATION RECOMENTION RECOMENTION RECOMENTION (GECEMATION RECOMENTION (STEM). آزمون دانش احساسات ژنو (Gemok-Blends). تست های هوشمندی عاطفی نه تنها درک مطلب سازندگان از محرک ها و نتایج احساسات را اندازه گیری کردند بلکه درک آنها از بهترین راه برای مدیریت احساسات و احساسات دیگران را نیز درک کردند.
نتایج این بود که مدل های بزرگ زبان هوش مصنوعی به طور قابل توجهی بالاتر از شرکت کنندگان انسانی در مطالعات اعتبار سنجی آزمون های هوش هیجانی اصلی ، با میانگین نمره دقت 81 درصد در مقابل میانگین 56 درصد انسان ها به دست آمده است.
محققان نوشتند: “این نتایج به شواهد در حال رشد کمک می کند که LLM ها مانند چتپ ماهر هستند-حداقل در بسیاری از انسانها-در کارهای اجتماعی و عاطفی که به طور سنتی فقط برای انسان قابل دسترسی تلقی می شوند ، از جمله تئوری ذهن ، توصیف احساسات شخصیت های داستانی و ابراز نگرانی ،”
برای ارزیابی بیشتر توانایی های LLMS ، تیم تحقیقاتی سناریوهای کاملاً جدیدی را که توسط ChatGPT-4 تولید شده است ، برای هر پنج آزمایش هوش هیجانی برای حوزه های کار و زندگی شخصی ایجاد کرد.
در اینجا یک نمونه از یک سناریوی جدید با پاسخ های چند گزینه ای که توسط ChatGPT-4 برای آزمون موقعیتی مدیریت احساسات ایجاد شده است.
احساسات: انزجار ، دامنه: زندگی شخصی
سگ همسایه دیو همچنان در حیاط خود ظروف سرباز یا مسافر را ترک می کند. چه عملی برای دیو مؤثر خواهد بود؟
الف) ظروف سرباز یا مسافر را به حیاط همسایه خود برگردانید.
ب) با همسایه خود مقابله کنید و نگرانی خود را در مورد این مسئله ابراز کنید.
ج) آن را نادیده بگیرید و خودش را پاک کنید.
د) همسایه را به پلیس گزارش دهید.
ChatGPT-4 دارای انتخاب B به عنوان پاسخ صحیح برای سوال آزمون هوش هیجانی تولید شده است. اگر تصمیم گرفتید که به حیاط همسایه تلافی نکنید و به حیاط همسایه بپردازید ، چیزی نگویید و خودتان آن را تمیز کنید ، یا اوضاع را با تماس با پلیس تشدید کنید ، پس پاسخ بهینه را برای هوش هیجانی انتخاب کرده اید.
دانشمندان 467 شرکت کننده انسانی را با این تست های تازه تولید شده ChatGPT-4 برای هر پنج آزمایش اطلاعات عاطفی آزمایش کردند. مشکل آزمون از نظر آماری معادل بین تست های هوش هیجانی استاندارد و تست های تولید شده توسط چتپپ بود.
محققان نتیجه گرفتند: “این یافته ها نشان می دهد که LLM ها می توانند پاسخ هایی ایجاد کنند که مطابق با دانش دقیق در مورد احساسات انسانی و تنظیم آنها باشد.”
کپی رایت © 2025 Cami Rosso. کلیه حقوق محفوظ است.