توانایی محدود مدل‌های زبانی بزرگ در تشخیص علائم PTSD از روی متن مصاحبه بالینی

شش مدل زبانی بزرگ در پیش‌بینی نمرات آیتم‌به‌آیتم چک‌لیست اختلال استرس پس از سانحه از روی رونوشت مصاحبه‌های بالینی، دقتی متوسط و هنوز ناکافی برای کاربرد بالینی نشان دادند.

پژوهش استنفورد: چت‌بات‌های «درمانگر» در پاسخ به بحران و انگ‌زنی ناایمن عمل می‌کنند

ارزیابی استنفورد نشان داد چت‌بات‌های درمانگرِ مبتنی بر مدل‌های زبانی، در کمتر از ۶۰٪ موارد پاسخ مناسب می‌دهند (در برابر ۹۳٪ برای درمانگران انسانی) و گاهی به نشانه‌های بحران، ناایمن پاسخ می‌دهند.

متاآنالیز npj Digital Medicine: چت‌بات‌ها علائم افسردگی و پریشانی را به‌طور معنادار کاهش می‌دهند

متاآنالیزی بر پایه‌ی ۱۵ کارآزمایی تصادفی نشان داد عامل‌های گفت‌وگومحور مبتنی بر هوش مصنوعی، علائم افسردگی و پریشانی روانی را با اندازه‌اثر متوسط تا بزرگ کاهش می‌دهند.

کارآزمایی Therabot: اولین آزمایش بالینی یک چت‌بات درمانگرِ مولد

نخستین کارآزمایی تصادفی کنترل‌شده روی یک چت‌بات درمانگرِ مبتنی بر هوش مصنوعی مولد؛ کاهش ۵۱٪ علائم افسردگی و ۳۱٪ اضطراب پس از چهار هفته، با اتحاد درمانی قابل‌مقایسه با درمانگر انسانی.