Santé féminine : les IA médicales échouent dans 60% des cas selon une étude
Une étude portant sur 13 chatbots IA populaires révèle un taux d'erreur de 60% sur 345 questions de santé féminine. GPT-5 obtient les meilleurs résultats avec 47% d'erreurs, contre 73% pour Ministral 8B. Les erreurs concernent principalement les dosages médicamenteux, recommandations obsolètes et sous-estimation de l'urgence. Les biais historiques dans les données d'entraînement expliquent ces lacunes persistantes en gynécologie-obstétrique.