تصویر توسط گتی / آینده پژوهی
ممکن است با استفاده از ChatGPT برای نوشتن یک یا دو ایمیل خسته کننده احساس خوبی نداشته باشید، اما آیا به پزشک خود اعتماد می کنید؟ تحقیقات جدید نشان می دهد که احتمالا نباید این کار را انجام دهید.
پس از ارائه 150 مورد پزشکی، چت ربات هوش مصنوعی تنها در کمتر از نیمی از مواقع تشخیص صحیح داد، همانطور که در مطالعه جدیدی که در مجله منتشر شده است توضیح داده شده است. پلوس وان.
این یافتهها نشان میدهد که ChatGPT در شکل فعلیاش «به عنوان یک ابزار تشخیصی دقیق نیست»، که تلاشهای شرکتهایی مانند گوگل را که در حال آزمایش با رباتهای چت در بیمارستانها هستند، زیر سوال میبرد. و از آنجایی که مدلهای هوش مصنوعی به طور خاص برای اهداف پزشکی منتشر میشوند، نویسندگان نگران هستند که عموم تواناییهای این فناوری را بیش از حد ارزیابی کنند.
آمریت کرپالانی، یکی از نویسندگان این مطالعه و استادیار دانشگاه وسترن، گفت: «اگر افراد ترسیده، گیج و یا فقط نتوانند به مراقبت دسترسی داشته باشند، ممکن است به ابزاری وابسته باشند که به نظر میرسد توصیههای پزشکی را ارائه میدهد که برای آنها «ساختهشده» است. علم زنده.
“من فکر می کنم به عنوان یک جامعه پزشکی (و در میان جامعه علمی بزرگتر) ما باید در مورد آموزش به جمعیت عمومی در مورد محدودیت های این ابزارها در این زمینه فعال باشیم. آنها هنوز نباید جایگزین پزشک شما شوند.”
در آزمایش خود، محققان به مدل زبان بزرگ ChatGPT GPT 3.5 انواع موارد پزشکی را از Medscape، یک منبع آنلاین برای متخصصان پزشکی، که قبلاً به طور دقیق تشخیص داده شده بودند، تغذیه کردند. آنها همچنین فقط موارد پس از آگوست 2021 را انتخاب کردند تا اطمینان حاصل کنند که در داده های آموزشی ChatGPT گنجانده نشده اند.
برای اینکه همه چیز منصفانه باشد، ChatGPT همچنین باید به تاریخچه بیمار، هرگونه یافته از معاینات فیزیکی، و نتایج آزمایشگاهی و تصویربرداری – همه چیزهایی که پزشک معمولی شما به آنها دسترسی دارد، نگاه کند.
با هر مورد، ربات باید از بین چهار پاسخ چند گزینه ای مختلف انتخاب می کرد که تنها یکی درست بود. همچنین باید دلیل خود را در پشت تشخیص توضیح می داد و در برخی موارد استناد می کرد.
اگر ChatGPT یک دانشجوی پزشکی بود، یک F ثابت دریافت می کرد: فقط در 49 درصد مواقع تشخیص درست می داد و فقط در 52 درصد مواقع پاسخ «کامل و مرتبط» می داد.
با این حال، دقت کلی بسیار بهتر بود. این معیار، مهارت ChatGPT را در کنار گذاشتن انتخابهای اشتباه در همه گزینههای چند گزینهای در نظر میگیرد. امتیاز 74 درصد را به دست آورد – به این معنی که به طرز شگفت انگیزی در تشخیص موارد نادرست خوب بود.
این قابل توجه است، اما چت بات هنوز برای تشخیص نهایی و صحیح تلاش می کند. بزرگترین نقص آن در مقایسه با پزشکان انسانی این بود که در تفسیر مقادیر عددی مشکل داشت و قادر به تفسیر تصاویر پزشکی نبود. محققان دریافتند که گاهی اوقات توهم نیز دارد و گاهی اطلاعات کلیدی را نادیده می گیرد.
همانطور که گفته شد، آنها پیشنهاد می کنند که هوش مصنوعی می تواند برای آموزش به پزشکان کارآموز و حتی کمک به پزشکان کاملاً حرفه ای مفید باشد – تا زمانی که تماس نهایی به ارائه دهندگان مراقبت های بهداشتی انسانی متکی باشد.
کرپالانی گفت: «من فکر میکنم بهطور خاص با هوش مصنوعی و چتباتها، جامعه پزشکی در نهایت متوجه خواهد شد که پتانسیل زیادی برای تقویت تصمیمگیری بالینی، سادهسازی وظایف اداری و افزایش مشارکت بیمار وجود دارد». LiveScience.
اطلاعات بیشتر در مورد هوش مصنوعی: پزشکانی که از هوش مصنوعی برای ایجاد خودکار یادداشت های بالینی در مورد بیماران استفاده می کنند