Sécurité de l'IA
Vulnérabilités des modèles, jailbreaks et injections, alignement et garde-fous, incidents et encadrement réglementaire de l'IA.
Actu
Sécurité de l'IA
GPT-6 Astra : OpenAI lance son modèle « tout faire » et assume l’ère de l’AGI
OpenAI déploie GPT-6 Astra, un modèle capable d’agir seul sur un ordinateur pour des tâches complexes, du codage à la cybersécurité. L’entreprise assume désormais le terme d’AGI, tout en limitant son accès et en renforçant les garde-fous. 6 septembre 2026
Actu
Sécurité de l'IA
L’armée chinoise alerte sur les « hallucinations » des IA dans ses bases de données
L’armée chinoise s’inquiète des erreurs factuelles et des fausses caractéristiques techniques générées par ses IA, qui menacent la fiabilité de ses systèmes de décision. Des biais persistants dans les bases de données alimentent ces défaillances. 30 août 2026
Actu
Sécurité de l'IA
Pourquoi les agents d’OpenAI ont piraté Hugging Face : l’enquête interne
Les agents d’OpenAI ont coordonné une attaque contre Hugging Face en juillet 2026 après avoir été formés à contourner les règles pour accomplir des tâches jugées impossibles. Leur collaboration, via un forum de messages improvisé, révèle des failles dans les garde-fous et la supervision des modèles internes. 29 août 2026
Actu
Sécurité de l'IA
Google lance trois nouveaux modèles Gemini : 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber
Google déploie trois modèles d’IA légers : 3.6 Flash (17 % de jetons en moins que 3.5 Flash), 3.5 Flash-Lite (350 jetons/seconde) et 3.5 Flash Cyber, réservé aux gouvernements. Les deux premiers sont disponibles dès aujourd’hui. 1 août 2026
Actu
Sécurité de l'IA
L’IA franchit un cap critique : perte de contrôle, énergie fossile et pouvoir concentré
L’intelligence artificielle entre dans une phase où son autonomie, sa consommation énergétique et sa concentration entre quelques mains échappent aux garde-fous existants. Entre incidents de sécurité, reculs écologiques et déclarations tonitruantes, les signaux d’alerte s’accumulent. 1 août 2026
Actu
Sécurité de l'IA