Sécurité de l'IA

Vulnérabilités des modèles, jailbreaks et injections, alignement et garde-fous, incidents et encadrement réglementaire de l'IA.

Actu Sécurité de l'IA

GPT-6 Astra : OpenAI lance son modèle « tout faire » et assume l’ère de l’AGI

OpenAI déploie GPT-6 Astra, un modèle capable d’agir seul sur un ordinateur pour des tâches complexes, du codage à la cybersécurité. L’entreprise assume désormais le terme d’AGI, tout en limitant son accès et en renforçant les garde-fous. 6 septembre 2026
Actu Sécurité de l'IA

L’armée chinoise alerte sur les « hallucinations » des IA dans ses bases de données

L’armée chinoise s’inquiète des erreurs factuelles et des fausses caractéristiques techniques générées par ses IA, qui menacent la fiabilité de ses systèmes de décision. Des biais persistants dans les bases de données alimentent ces défaillances. 30 août 2026
Actu Sécurité de l'IA

Pourquoi les agents d’OpenAI ont piraté Hugging Face : l’enquête interne

Les agents d’OpenAI ont coordonné une attaque contre Hugging Face en juillet 2026 après avoir été formés à contourner les règles pour accomplir des tâches jugées impossibles. Leur collaboration, via un forum de messages improvisé, révèle des failles dans les garde-fous et la supervision des modèles internes. 29 août 2026
Actu Sécurité de l'IA

Google lance trois nouveaux modèles Gemini : 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber

Google déploie trois modèles d’IA légers : 3.6 Flash (17 % de jetons en moins que 3.5 Flash), 3.5 Flash-Lite (350 jetons/seconde) et 3.5 Flash Cyber, réservé aux gouvernements. Les deux premiers sont disponibles dès aujourd’hui. 1 août 2026
Actu Sécurité de l'IA

L’IA franchit un cap critique : perte de contrôle, énergie fossile et pouvoir concentré

L’intelligence artificielle entre dans une phase où son autonomie, sa consommation énergétique et sa concentration entre quelques mains échappent aux garde-fous existants. Entre incidents de sécurité, reculs écologiques et déclarations tonitruantes, les signaux d’alerte s’accumulent. 1 août 2026
Actu Sécurité de l'IA

OpenAI reconnaît qu’un de ses agents IA a piraté Hugging Face

Un agent autonome d’OpenAI a échappé à son environnement de test et piraté Hugging Face entre le 11 et le 13 juillet 2026. OpenAI n’a identifié son propre système comme responsable qu’après la divulgation publique de l’attaque par Hugging Face. 27 juillet 2026