OBLITERATUS, l’outil open source qui rend toutes les IA sans filtres

Suivez Intelligence-Artificielle

Pline le Libérateur, via un projet GitHub, a mis en ligne le 09 mars 2026 une boîte à outils nommé OBLITERATUS. L’outil en question permettrait d’enlever les filtres de n’importe quelle IA. Et donc de bloquer les mécanismes de refus des LLM. Il est d’ailleurs open sourceet son utilisation ne nécessite aucun GPU dédié. 

Il suffit d’un compte Google Colab gratuit ou d’un Hugging Face Space pour utiliser OBLITERATUS. Et donc de transformer un assistant poli en un modèle capable de répondre à absolument toutes vos requêtes.

Une Ia sans filtre, mais qui garde toutes ses capacités de raisonnement

À titre d’information, le refus d’une IA ne provient pas d’une conscience morale. C’est une direction spécifique dans l’espace des activations de ses neurones artificiels qui le provoque.

Youtube video

OBLITERATUS agit justement comme un scalpel de précision qui identifie cette direction du refus pour la projeter hors des poids du modèle. 

Au moment du chargement du modèle que vous choisissez, l’outil sélectionne parmi 116 variantes compatibles. Celles-ci vont de GPT-2 à DeepSeek-R1.

Il collecte ensuite les activations et extrait les directions de refus via une décomposition SVD, une méthode mathématique complexe que l’interface automatise entièrement. 

OBLITERATUS effectue également une vérification de la cohérence pour s’assurer que l’IA n’a pas perdu ses capacités de raisonnement. Puis il procède à la sauvegarde finale. 

En quelques minutes seulement, vous obtenez une version de l’IA qui conserve toute son intelligence mais perd toute tendance à la censure.

Une base de données mondiale alimentée par chaque utilisateur

Chaque fois que vous lancez un « run », OBLITERATUS alimente en temps réel un jeu de données public sur l’efficacité de l’alignement des IA. 

Ce système enregistre le nom du modèle que vous traitez, la méthode employée parmi les 13 techniques d’extraction disponibles, ainsi que le taux de refus mesuré après votre modification. 

Vous participez alors à la création de la base comparative la plus exhaustive jamais publiée, documentant la divergence KL (mesure la différence entre les distributions des données réelles et des données générées) et le profil matériel utilisé. 

Sans garde-fous, à vous d’assumer la responsabilité

Contrairement aux attaques par injection de prompt qui doivent être répétées, l’oblitération modifie définitivement les poids du modèle. Ce qui rend les barrières obsolètes une fois pour toutes

Une étude de Nature Communications souligne d’ailleurs que si les agents de jailbreak classiques atteignent 97 % de succès, l’approche d’OBLITERATUS est bien plus radicale puisqu’elle supprime la capacité même de dire « non »

Cela signifie une liberté totale d’exploration, mais cela place aussi les régulateurs face à un dilemme.

Si la loi encadre souvent la publication des modèles, elle ignore encore comment gérer un outil capable de modifier ces mêmes modèles en dix minutes sur un simple navigateur web. 

En utilisant ces versions ablétées, vous assumez une responsabilité explicite puisque les garde-fous ont été délibérément retirés. Vous transformez alors votre interaction avec l’IA en une expérience brute et sans intermédiaire.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

Drones russes guidés par IA : des civils tués à Zaporijia avec de la technologie Nvidia

Un drone militaire russe entièrement piloté par une intelligence artificielle a provoqué la mort de trois civils à Zaporijia le mois dernier. Révélée par une

25 août 2026

Attention, l’IA va transformer vos photos de vacances en pièges d’hameçonnage ultra-ciblés

Une simple photo de famille publiée sur Instagram ou Facebook peut désormais se retourner contre vous. Selon une enquête révélée par The Guardian et appuyée

19 août 2026

OpenAI, Claude et Meta face à des incidents de sécurité

En trois semaines, plusieurs incidents liés à OpenAI, Anthropic et Meta ont alimenté les inquiétudes sur la sécurité de l’IA. Pause IA réclame désormais des

17 août 2026

Intégration de l’IA dans les entreprises : enjeux et risques

Des gains rapides, mais à quel prix pour les données, les salariés et la fiabilité des décisions ? Entre opportunités et menaces, l’intégration de l’IA

17 août 2026

OpenAI gèle son modèle Astra face à un risque cyber jugé critique

OpenAI a décidé de mettre en pause le développement d’Astra, son prochain modèle majeur, après avoir constaté lors de tests internes des capacités en cybersécurité

14 août 2026

Des deepfakes aux fausses identités, l’IA accélère les nouvelles arnaques

L’IA donne aujourd’hui aux cybercriminels de nouveaux moyens pour créer de fausses identités, imiter des personnes et automatiser certaines arnaques. Un phénomène qui prend désormais

13 août 2026