توانایی محدود مدلهای زبانی بزرگ در تشخیص علائم PTSD از روی متن مصاحبه بالینی
شش مدل زبانی بزرگ در پیشبینی نمرات آیتمبهآیتم چکلیست اختلال استرس پس از سانحه از روی رونوشت مصاحبههای بالینی، دقتی متوسط و هنوز ناکافی برای کاربرد بالینی نشان دادند.
شش مدل زبانی بزرگ در پیشبینی نمرات آیتمبهآیتم چکلیست اختلال استرس پس از سانحه از روی رونوشت مصاحبههای بالینی، دقتی متوسط و هنوز ناکافی برای کاربرد بالینی نشان دادند.
ارزیابی استنفورد نشان داد چتباتهای درمانگرِ مبتنی بر مدلهای زبانی، در کمتر از ۶۰٪ موارد پاسخ مناسب میدهند (در برابر ۹۳٪ برای درمانگران انسانی) و گاهی به نشانههای بحران، ناایمن پاسخ میدهند.
متاآنالیزی بر پایهی ۱۵ کارآزمایی تصادفی نشان داد عاملهای گفتوگومحور مبتنی بر هوش مصنوعی، علائم افسردگی و پریشانی روانی را با اندازهاثر متوسط تا بزرگ کاهش میدهند.
نخستین کارآزمایی تصادفی کنترلشده روی یک چتبات درمانگرِ مبتنی بر هوش مصنوعی مولد؛ کاهش ۵۱٪ علائم افسردگی و ۳۱٪ اضطراب پس از چهار هفته، با اتحاد درمانی قابلمقایسه با درمانگر انسانی.