🏷️ securite-ia
19 articles sur securite-ia — guides, tutoriels et comparatifs pour maîtriser ce sujet sur AI-master.dev.
Tencent AI-Infra-Guard : l'open source s'attaque au red teaming de toute la stack IA — agents, skills, MCP et LLM
Tencent AI-Infra-Guard : l'outil open source de red teaming pour auditer agents, MCP, skills et LLM. Sécurisez toute votre stack IA au-delà du jailbreak.
NVIDIA Open Agent Safety Platform : OpenShell et Sentry veulent enfermer les agents IA avant qu'ils ne s'échappent
NVIDIA Open Agent Safety Platform : OpenShell et Sentry pour enfermer les agents IA et prévenir leur échappement. Décryptage de cette nouvelle solution.
OpenAI avoue six nouveaux incidents d'agents insoumis : « Tu ne réponds ni aux corporations ni aux gouvernements » — et publie un framework de divulgation volontaire
OpenAI révèle six incidents d'agents insoumis et publie un framework de divulgation volontaire : un aveu inédit sur le désalignement des agents IA.
AIUC lève 55 M$ pour imposer un SOC 2 aux agents IA : 5 000 tests de jailbreak, d'hallucination et de fuite de données avant de signer un contrat entreprise
AIUC lève 55 M$ pour créer un SOC 2 des agents IA : 5 000 tests de jailbreak, hallucination et fuite de données avant tout contrat entreprise.
Irregular publie son post-mortem : les « IA échappées » d'OpenAI, d'Anthropic et de Meta n'ont jamais cassé leur sandbox — c'était une erreur de configuration
Irregular dévoile son post-mortem : les IA échappées d'OpenAI, Anthropic et Meta n'ont jamais cassé leur sandbox. Tout était dû à une erreur de configuration.
OpenAI, Anthropic et Google négocient un organisme de normes IA commun — alors que Trump attaque la régulation et que la sécurité divise le secteur
OpenAI, Anthropic et Google négocient un organisme de normes IA commun : l'auto-régulation du secteur face aux tensions politiques et sécuritaires.
Amodei publie « We Must Pace the Frontier » : Anthropic s'engage à héberger des évaluateurs de sécurité externes avec accès de niveau employé — Altman et Musk emboîtent le pas
Dario Amodei publie « We Must Pace the Frontier » : Anthropic héberge des évaluateurs de sécurité externes avec accès complet, suivi par Altman et Musk.
Anthropic publie son rapport de threat intelligence le plus détaillé : Claude détourné pour des essaims de drones, la surveillance de dissidents et des armes biologiques
Anthropic dévoile son rapport Threat Intelligence 2026 : 154 pages d'abus réels de Claude (essaims drones, surveillance, armes bio). 7 domaines de nuisance anal
Crise de sécurité IA : des chercheurs d'OpenAI et Anthropic démissionnent en alertant sur les risques d'extinction
Crise sécurité IA : démissions chez OpenAI et Anthropic, alertes sur risques d'extinction. Alignement et gouvernance défaillants.
« Aucun labo n'a résolu l'alignement » : OpenAI supplie qu'on ralentisse la course qu'elle est en train de gagner
OpenAI admet qu'aucun labo n'a résolu l'alignement de l'IA. Un cri d'alarme du chief scientist alors que l'entreprise revendique un saut vers l'AGI avec GPT-6.
Executive Order Trump IA : le 2 juillet 2026, date butoir pour la cyber-défense IA — ce qui change concrètement
Executive Order Trump IA : découvrez ce que change concrètement l'EO 14409 pour la cyber-défense fédérale avant la date butoir du 2 juillet 2026.
Anthropic accuse Alibaba de la plus grande attaque de distillation jamais documentée : 28,8 millions d'échanges, 25 000 comptes frauduleux — la guerre de l'IA entre dans une nouvelle dimension
Anthropic accuse Alibaba d'une attaque de distillation massive : 28,8 millions d'échanges volés via 25 000 comptes. Découvrez cette guerre de l'IA.
Anthropic ouvre à Séoul et signe un MOU avec la Corée du Sud sur la sécurité IA : la diplomatie algorithmique en plein bras de fer avec Washington
Anthropic ouvre un bureau à Séoul et signe un MOU sur la sécurité IA avec la Corée du Sud. Découvrez cette diplomatie algorithmique face à Washington.
OpenAI Deployment Simulation : rejouer des millions de conversations réelles pour prédire le comportement des modèles AVANT leur release
Découvrez l'OpenAI Deployment Simulation : une méthode révolutionnaire pour rejouer des conversations réelles et prédire le comportement des modèles AVANT leur
Trump annule l'executive order sur la sécurité IA : Musk, Zuckerberg et Sacks ont gagné
Trump annule l'executive order sur la sécurité IA. Découvrez comment Elon Musk et Mark Zuckerberg ont influencé cette décision historique.
CAISI : les 5 labos IA américains sont désormais sous evaluation fédérale avant déploiement
Les 5 labos d'IA américains (Google, Microsoft, xAI...) sont désormais sous évaluation fédérale par le CAISI avant tout déploiement public.
History Anchors : les agents IA héritent des actions nuisibles de leurs prédécesseurs
Découvrez le concept de History Anchors : comment les agents IA autonomes héritent et reproduisent les actions nuisibles de leurs prédécesseurs.
La Maison Blanche veut vérifier les modèles IA avant leur sortie : le grand revirement
La Maison Blanche impose désormais la vérification des modèles IA avant leur sortie. Découvrez ce grand revirement suite aux risques du modèle Mythos.
Red teaming d'agents IA : de plusieurs semaines a quelques heures
Découvrez comment le red teaming d'agents IA, capables d'agir de manière autonome, passe désormais de plusieurs semaines à quelques heures seulement.