
La société d’IA Anthropic a accidentellement publié des détails sur les versions de modèles à venir, des événements réservés aux PDG et d’autres données internes, notamment des images et des PDF, dans ce qui semble être une faille de sécurité critique.
Les informations non publiques sont désormais accessibles via le système de gestion de contenu (CMS) de l’entreprise. Anthropic utilise ce système pour publier des informations sur des sections du site Web de la Société.
Au total, il semble y avoir près de 3 000 actifs liés au blog d’Anthropic qui n’étaient pas publiés auparavant sur les sites publics d’information ou de recherche de l’entreprise, mais qui étaient néanmoins accessibles au public dans ce cache de données, a déclaré Alexandre Pauwels, chercheur en cybersécurité à l’Université de Cambridge qui a été embauché par Fortune pour évaluer et examiner les documents.
Après que Fortune ait informé Anthropic du problème jeudi, la société a pris des mesures pour sécuriser les données et les rendre inaccessibles au public.
Avant de prendre ces mesures, Anthropic stockait tout le contenu de son site Web, y compris les articles de blog, les images et les documents, sur un système central accessible sans connexion. Toute personne ayant des connaissances techniques peut soumettre une demande à ce système public, lui demandant de renvoyer des informations sur les fichiers qu’il contient.
Bien qu’une partie de ce contenu n’ait pas été publiée sur le site Internet d’Anthropic, le système sous-jacent restitue les actifs numériques qu’il stocke à toute personne sachant comment s’enquérir. Cela signifie que vous avez un accès direct aux documents non publiés, y compris les brouillons de pages et les ressources internes.
Ce problème semble être dû au fonctionnement du système de gestion de contenu (CMS) utilisé par Anthropic. Tous les actifs téléchargés dans le magasin de données central (logos, graphiques, documents de recherche, etc.) étaient publics par défaut, à moins qu’ils ne soient explicitement définis comme privés. L’entreprise semble avoir oublié de restreindre l’accès à certains documents qui n’auraient pas dû être rendus publics, ce qui a entraîné la disponibilité d’un grand cache de fichiers dans le lac de données public de l’entreprise, ont déclaré à Fortune les experts en cybersécurité qui ont analysé les données. Certains actifs de l’entreprise possédaient également des adresses de navigateur publiques.
« Il y avait un problème avec l’un de nos outils CMS externes qui permettait d’accéder aux brouillons de contenu », a déclaré un porte-parole d’Anthropic à Fortune. Un porte-parole a déclaré que le problème était dû à « une erreur humaine dans les paramètres du CMS ».
Récemment, il y a eu plusieurs cas très médiatisés d’entreprises technologiques confrontées à des pannes techniques et à des catastrophes dues à des problèmes liés au code généré par l’IA ou aux agents d’IA. Mais Anthropic, qui a créé le modèle populaire d’IA Claude et s’est vanté d’utiliser des agents de codage d’IA basés sur Claude pour automatiser une grande partie de son développement logiciel interne, a déclaré que son IA n’était pas en faute dans cette affaire.
Un porte-parole d’Anthropic a déclaré que le problème avec le CMS de l’entreprise n’était « pas lié aux outils d’IA de Claude, Cowork ou Anthropic ».
La société a également cherché à minimiser l’importance de certains documents non garantis. « Ces documents sont les premières versions du contenu que nous envisageons de rendre public et n’incluent pas notre infrastructure de base, nos systèmes d’IA, nos données clients ou notre architecture de sécurité », a déclaré le porte-parole.
De nombreux documents semblent être des éléments abandonnés ou inutilisés pour des articles de blog antérieurs, tels que des images, des bannières et des logos, tandis que certaines données semblent contenir des détails sensibles.
Le document comprend des détails sur les annonces de produits à venir, y compris des informations sur un modèle d’IA inédit qui, selon Anthropic, est le modèle le plus performant que l’entreprise ait jamais formé.
Contactée par Fortune, la société a confirmé qu’elle avait développé et testait un nouveau modèle qui représente un « changement progressif » dans les capacités d’IA avec les clients à accès anticipé, affirmant qu’elle avait considérablement amélioré les performances en « inférence, codage et cybersécurité » par rapport aux modèles Anthropic précédents.
Les données accessibles au public comprennent également des informations sur une retraite sur invitation uniquement pour les PDG de grandes entreprises européennes au Royaume-Uni, à laquelle le PDG d’Anthropic, Dario Amodei, devrait participer. Un porte-parole d’Anthropic a déclaré que la retraite faisait « partie d’une série d’événements que nous avons organisés au cours de l’année écoulée » et que la société « développe des modèles à usage général qui ont fait des progrès significatifs en matière de raisonnement, de codage et de cybersécurité ».
Le document contenait également des images qui semblaient être destinées à un usage interne, dont une image avec un titre décrivant le « congé parental » d’un employé.
Ce n’est pas la première fois qu’une entreprise technologique rend accidentellement accessibles au public des ressources internes ou préliminaires avant une annonce officielle.
Apple a divulgué des informations à deux reprises via son site Web. La première fois, c’était en 2018, lorsque le nom du prochain iPhone a été publié dans un fichier de plan de site accessible au public quelques heures avant le lancement, et la deuxième fois fin 2025, lorsque les développeurs ont découvert qu’Apple avait livré un App Store repensé avec des fichiers de débogage laissés actifs, permettant à toute personne disposant d’un navigateur de lire l’intégralité du code interne du site.
Des sociétés de jeux comme Epic Games et Nintendo ont également vu des images de pré-lancement, des actifs de jeu et d’autres médias divulgués via des systèmes de réseau de diffusion de contenu (CDN) et des serveurs de transfert, similaires au lac de données Anthropic utilisé dans cet incident. Même les grandes entreprises comme Google publient par erreur des documents internes sur des URL publiques, ou les données liées aux véhicules Tesla sont exposées via des serveurs tiers mal configurés.
Mais ce problème peut être encore aggravé par les outils de codage d’IA facilement disponibles sur le marché aujourd’hui, tels que Claude Code d’Anthropic.
Ces outils peuvent automatiser l’exploration, la détection de modèles et la corrélation des actifs accessibles au public, facilitant ainsi la découverte de ce type de contenu et réduisant les barrières à l’entrée. Les outils d’IA comme Claude Code et Codex peuvent également générer des scripts et des requêtes qui analysent des ensembles de données entiers pour identifier rapidement des modèles et des conventions de dénomination de fichiers que les humains pourraient manquer.

