Churilov a exposé ses conclusions dans un document de recherche, The Range Shrinks, the Threat Remains: Re-evaluating LLM Package Hallucinations on the 2026 Frontier-Model Cohort, qui n’a pas encore été évalué par des pairs. Il a découvert que 127 noms de paquets hallucinés étaient partagés entre Claude Sonnet 4.6, Claude Haiku 4.5, GPT-5.4-mini, Gemini 2.5 Pro et DeepSeek V3.2.

En avril de cette année, 53 de ces noms – 41 sur le référentiel du logiciel PyPI et 12 sur npm – étaient toujours disponibles pour enregistrement.

Selon l’étude, deux raisons expliquent ce degré de conformité dans les résultats des modèles. Premièrement, les modèles peuvent apprendre les mêmes références de packages incorrectes à partir de matériel de formation public partagé, tel que des didacticiels et de la documentation.

A lire également