LLM et risque psychotique : l'IA peut-elle remplacer le clinicien spécialiste ?
Une étude publiée dans npj Digital Medicine évalue 11 modèles LLM open-weight sur 678 transcriptions d'entretiens PSYCHS pour détecter le risque clinique élevé de psychose (CHR-P). Le meilleur modèle (Llama-3.3-70B) atteint une précision de 80 %, une sensibilité de 93 % et une corrélation satisfaisante avec les scores cliniciens (ICC ≈ 0,74-0,75). Les biais démographiques restent faibles, le taux de confabulation cliniquement pertinente est de 3 %, et les erreurs principales correspondent à une sur-pathologisation d'expériences non cliniques. L'approche soutient une détection précoce scalable avec supervision humaine.