
Anthropic a accidentellement divulgué le code source de Claude Code, un outil de codage populaire.
La fuite survient quelques jours après que Fortune a rapporté que la société avait accidentellement publié près de 3 000 fichiers, y compris un projet d’article de blog détaillant un puissant modèle à venir qui pose des risques de cybersécurité sans précédent. Le modèle est connu en interne sous les noms de « Mythos » et de « Capybara », selon un article de blog divulgué obtenu par Fortune.
La fuite du code source a exposé environ 500 000 lignes de code réparties dans environ 1 900 fichiers. Lorsqu’on l’a contacté pour commenter, Anthropic a reconnu que « du code source interne » avait été divulgué dans une « version de code de Claude ».
Un porte-parole a déclaré : « Aucune donnée client ou identifiant sensible n’a été impliqué ou compromis. Il s’agit d’un problème lié à une version causée par une erreur humaine et ne constitue pas une faille de sécurité. Nous prenons des mesures pour garantir que cela ne se reproduise plus. »
La dernière violation de données est potentiellement plus dommageable pour Anthropic que la précédente divulgation accidentelle d’un brouillon du blog de l’entreprise sur son prochain modèle. Bien que l’erreur de sécurité n’ait pas révélé l’importance du modèle Claude lui-même, elle a permis à ceux qui possédaient des connaissances techniques d’extraire des informations privilégiées supplémentaires de la base de code de l’entreprise, selon les experts en cybersécurité chargés d’enquêter sur la violation.
Claude Code est peut-être le produit le plus populaire d’Anthropic, et son taux d’adoption parmi les grandes entreprises monte en flèche. Au moins certaines des fonctionnalités de Claude Code ne proviennent pas du modèle de langage à grande échelle sous-jacent qui alimente le produit, mais du « faisceau » logiciel placé autour du modèle d’IA sous-jacent et qui fournit des garde-fous et des instructions importants qui dirigent la manière dont les autres outils logiciels sont utilisés et contrôlent leur comportement. Le code source de ce harnais d’agent a maintenant été divulgué en ligne.
Cette violation pourrait permettre aux concurrents de faire de l’ingénierie inverse sur le fonctionnement du harnais d’agents de Claude Code et d’utiliser ces connaissances pour améliorer leurs propres produits. Certains développeurs peuvent également essayer de créer une version open source du harnais d’agents de Claude Code basée sur le code divulgué.
Selon Roy Paz, chercheur principal en sécurité de l’IA chez LayerX Security, le code divulgué a également fourni une preuve supplémentaire qu’Anthropic dispose d’un nouveau modèle, nommé en interne Capybara, que la société se prépare activement à lancer. Paz a déclaré que la société publierait probablement une version « rapide » et « lente » du nouveau modèle basée sur la fenêtre contextuelle apparemment plus grande du nouveau modèle, ce qui en fera le modèle le plus avancé du marché.
Actuellement, Anthropic vend chaque modèle en trois tailles différentes. La version du modèle la plus grande et la plus performante porte la marque Opus. Une version légèrement plus rapide, moins chère mais moins performante porte la marque Sonnet. Le plus petit, le moins cher et le plus rapide s’appelle Haiku. Dans un projet d’article de blog obtenu par Fortune la semaine dernière, Anthropic décrit Capybara comme un nouveau modèle de scène plus grand et plus performant qu’Opus, mais aussi plus cher.
La dernière fuite, publiée pour la première fois dans le post X, semble s’être produite après qu’Anthropic ait téléchargé tout le code original de Claude Code sur NPM, une plateforme utilisée par les développeurs pour partager et mettre à jour des logiciels, ainsi que la version finale que les ordinateurs exécutent réellement. Pass a déclaré que l’erreur semble être une « erreur humaine » après que quelqu’un ait pris un raccourci pour contourner les protections normales de libération. Anthropic a déclaré à Fortune que les garanties normales de libération n’avaient pas été contournées.
« En général, les grandes entreprises ont des processus rigoureux et de multiples contrôles avant que le code n’atteigne la production, comme un coffre-fort qui nécessite plusieurs clés pour s’ouvrir », a-t-il déclaré à Fortune. « Il semble qu’Anthropic n’ait pas suivi ce processus correctement, et une mauvaise configuration ou un mauvais clic a soudainement entraîné l’exposition du code source complet. »
Paz a également soulevé des questions sur la manière dont l’outil pourrait se connecter aux systèmes internes d’Anthropic. Il a déclaré que la plus grande préoccupation n’était pas l’accès direct aux modèles back-end, mais que le code divulgué pourrait révéler des détails non publics sur le fonctionnement du système, tels que les API et les processus internes. Il a ajouté que ce type d’informations pourrait aider les attaquants sophistiqués à mieux comprendre l’architecture du modèle d’Anthropic et comment il est déployé, ce qui pourrait à son tour éclairer les tentatives visant à contourner les protections existantes.
Le modèle actuel le plus puissant d’Anthropic, le Claude 4.6 Opus, a déjà été classé par l’entreprise comme modèle risqué en matière de risques de cybersécurité. Anthropic a déclaré que son modèle Opus actuel peut identifier de manière autonome les vulnérabilités zero-day des logiciels. Bien que ces fonctionnalités soient destinées à aider les entreprises à détecter et à corriger les failles, elles peuvent également être utilisées par des pirates informatiques, y compris par des États-nations, pour trouver et exploiter des vulnérabilités.
Ce n’est pas la première fois qu’Anthropic divulgue accidentellement des détails sur son populaire outil Claude Code. En février 2025, une première version de Claude Code a publié par inadvertance le code original dans une violation similaire. Cette révélation a révélé comment l’outil fonctionne en coulisses et comment il se connecte aux systèmes internes d’Anthropic. Anthropic a ensuite supprimé le logiciel et le code public.
Note de l’éditeur : cet article a été mis à jour pour inclure des commentaires supplémentaires d’Anthropic et des clarifications de certains détails techniques provenant de l’une de nos sources.

