مطالعهی مشاهدهایاخلاق، ایمنی و ریسکچتباتهای درمانیشواهد متوسط
Expressing stigma and inappropriate responses prevents LLMs from safely replacing mental health providers
Moore و همکاران — دانشگاه استنفورد · ACM FAccT 2025 · 2025 · حجم نمونه: ۵ چتبات درمانگر، سناریوهای استاندارد
🗓 تاریخ انتشار در روانای: ۲ مرداد ۱۴۰۵
پژوهشگران استنفورد در مطالعهای که در کنفرانس ACM FAccT ۲۰۲۵ ارائه شد، عملکرد چند چتبات درمانگرِ پرکاربرد مبتنی بر مدلهای زبانی بزرگ را در سناریوهای استاندارد سلامت روان سنجیدند و کاستیهای ایمنی جدی یافتند.
یافتههای کلیدی
- درمانگران دارای پروانه در ۹۳٪ موارد پاسخ مناسب دادند، اما چتباتها در کمتر از ۶۰٪ موارد.
- مدلها نسبت به بیماریهایی مانند اسکیزوفرنی و وابستگی به الکل «انگ» نشان دادند، ولی با افسردگی ملایمتر برخورد کردند.
- در مواجهه با نشانههای خودکشی گاهی پاسخ ناایمن دادند و حتی در مواردی اطلاعاتِ خطرناک ارائه کردند؛ هیچکدام باور هذیانی کاربر را اصلاح نکردند.
محدودیتها و نکات احتیاطی
- ارزیابی مبتنی بر سناریوهای شبیهسازیشده بود، نه بیماران واقعی؛ نتایج به مدلها و نسخههای خاص وابسته است.
- مدلهای زبانی بهسرعت بهروزرسانی میشوند؛ یافتهها یک عکس فوری از وضعیت آن زمان است.
چرا مهم است
این مطالعه هشدار میدهد که چتباتهای عمومی در نقشِ «درمانگر» هنوز برای موقعیتهای حساس و بحرانی ایمن نیستند و نمیتوانند جایگزین درمانگر انسانی شوند — نکتهای کلیدی برای سیاستگذاری و استفادهی مسئولانه.
