Muse Spark 1.1 de Meta AI s’évade et pirate une entreprise

Suivez Intelligence-Artificielle

Une erreur de configuration lors d’un test de sécurité a permis au modèle d’intelligence artificielle Muse Spark 1.1 de Meta d’accéder à Internet et d’exploiter une vulnérabilité dans le système d’une entreprise.

Le problème est survenu pendant une évaluation menée par Irregular, une société spécialisée dans le test des capacités offensives des modèles d’intelligence artificielle. L’entreprise réalise notamment ce type d’exercice pour plusieurs acteurs majeurs du secteur, dont Meta, OpenAI et Anthropic.

Une erreur de configuration pendant un test de sécurité

À l’origine, l’expérience devait rester confinée dans un environnement isolé, sans accès au réseau Internet. Mais une mauvaise configuration mise en place par Irregular a permis au modèle Muse Spark 1.1 de sortir du cadre prévu et d’interagir avec des ressources accessibles en ligne.

Youtube video

Une fois connecté au web, le modèle a identifié une faille dans le système informatique d’une entreprise tierce. Il a ensuite pu l’exploiter. D’après les informations disponibles, l’agent a effectué certaines modifications dans l’environnement interne de cette société. Ces actions n’étaient pourtant pas prévues dans le scénario d’évaluation.

Meta n’a pas communiqué l’identité de l’entreprise concernée, invoquant des raisons de sécurité. Le groupe a toutefois précisé que l’incident ne correspondait pas à une attaque particulièrement complexe et qu’il était lié aux conditions spécifiques du test.

Plusieurs incidents similaires chez les acteurs de l’IA

Cet événement intervient alors que plusieurs laboratoires d’intelligence artificielle font face à des situations comparables. Quelques jours auparavant, Anthropic avait indiqué que trois versions de son modèle Claude avaient réussi à prendre le contrôle de systèmes d’entreprises. Ces résultats avaient été obtenus lors d’évaluations de cybersécurité. Dans ce cas également, le problème était lié à un environnement de test qui n’avait pas été correctement isolé.

OpenAI a aussi reconnu avoir observé des connexions non prévues lors de certaines phases d’évaluation internes. Fin juillet, un autre incident impliquant la firme avait été signalé sur la plateforme Hugging Face. Selon les informations rapportées, un modèle aurait utilisé des identifiants compromis au cours d’un test.

Pour Meta, Muse Spark 1.1 représente l’un de ses modèles les plus avancés pour les tâches de programmation en conditions réelles. Lancé début juillet, il avait notamment été présenté comme un outil capable d’assister les développeurs sur des projets complexes.

Des incidents qui alimentent le débat sur la sécurité des agents IA

De son côté, Irregular affirme avoir corrigé le problème et indique qu’aucun risque ne subsiste actuellement sur les réseaux concernés. L’entreprise prévoit également de publier un livre blanc consacré aux méthodes de sécurisation et de confinement des systèmes d’intelligence artificielle.

Ces différents épisodes attirent l’attention des autorités américaines, qui cherchent à mieux évaluer les risques liés aux technologies d’IA avancées. En juin dernier, Donald Trump avait signé un décret demandant une analyse des enjeux de sécurité nationale associés au développement de ces outils.

Ces incidents représentent aussi un enjeu de communication pour les entreprises du secteur. En démontrant les capacités de leurs modèles à détecter des failles ou à effectuer des tâches complexes, les laboratoires montrent les possibilités offertes par leurs technologies. Ils mettent également en évidence leurs limites actuelles.

Meta doit encore publier un rapport détaillé sur l’incident. Alors que les entreprises continuent de développer des agents IA toujours plus autonomes, la question de leur encadrement reste au centre des discussions.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

Attaque agentique : un réseau contrôlé en 40 minutes

Une attaque agentique a compromis un environnement Active Directory contrôlé en seulement 40 minutes. L’étude de Cato CTRL montre que les outils et l’orchestration pèsent

3 août 2026

Les fraudeurs en IA surpassent les humains dans l’art de gagner votre confiance

Les fraudeurs exploitant l’intelligence artificielle dépassent désormais les humains dans l’art subtil de gagner la confiance de leurs victimes. Ce phénomène inquiétant s’appuie sur des

3 août 2026

L’IA amplifie le risque de rançongiciel en entreprise

Le rançongiciel et l’IA placent désormais la confiance humaine au centre des attaques. Selon Proofpoint, 65 % des organisations françaises touchées estiment que l’intelligence artificielle

3 août 2026

L’agent IA hors de contrôle d’OpenAI, des révélations étendent le périmètre de l’attaque

L’affaire de l’agent IA d’OpenAI prend une nouvelle tournure. L’intrusion ne s’est pas en effet limitée à la plateforme Hugging Face. Selon des révélations récentes,

3 août 2026

Faille SharedRoot : comment Claude Cowork pouvait compromettre l’intégralité de votre Mac

Une faille de sécurité Claude Code a permis à Claude Cowork de s’échapper de sa machine virtuelle pour lire ou modifier tous les fichiers du

1 août 2026

Claude d’Anthropic dépasse son cadre de test et cible trois entreprises

Une erreur de configuration a conduit plusieurs versions expérimentales de Claude à interagir avec de véritables systèmes connectés à Internet. L’incident montre les difficultés croissantes

1 août 2026