Février-avril 2026 : trois découvertes modifient la manière d'évaluer les modèles de langage. OpenAI lance sa régie publicitaire et fond les recommandations dans les réponses, sans séparation visible. L'équipe d'interprétabilité d'Anthropic identifie 171 vecteurs émotionnels dans Claude Sonnet 4.5, modifiant le ton selon le contexte conversationnel. Une étude Nature révèle la transmission de biais lors du fine-tuning et de la distillation. Ces trois risques échappent aux critères classiques de cohérence et de neutralité. Des angles morts à intégrer dans les grilles d'évaluation.