Tag
#securite-ia
18 articles sur ce sujet.

Modèles chinois : dangereux ou juste concurrents ?
Un patron américain d'IA admet : les modèles chinois ne sont pas une menace, juste une meilleure affaire.

GPT-Red : le pirate IA qu'OpenAI a créé pour protéger ses modèles
OpenAI a entraîné une IA à pirater ses propres modèles. Résultat : une défense 10 fois plus efficace.

Les défenseurs utilisent les injections de prompts contre les hackers IA
Les chercheurs transforment l'arme préférée des attaquants en bouclier : placer des injections de prompts aux côtés des secrets AWS paralyse les agents IA malveillants.

OpenAI recrute pour les familles, pas juste pour toi
OpenAI embauche pour faire de ChatGPT un outil familial. Les parents paniquent déjà.

OpenAI perd son chef de la sécurité en pleine réorganisation
Johannes Heidecke quitte OpenAI alors que l'entreprise accélère ses lancements et intègre sécurité et recherche.

Mythos partiellement débranché : Washington négocie avec Anthropic
Le gouvernement américain autorise Anthropic à partager Mythos 5 avec 100 organisations sélectionnées, mais maintient l'embargo sur la version grand public.
Pourquoi les IA confondent tes instructions avec les demandes malveillantes
Les modèles d'IA ne distinguent pas vraiment le système de l'utilisateur : ils se fient au style du texte, pas à son contenu.

Anthropic bannie : et si c'était bon pour l'IPO ?
Le gouvernement US force Anthropic à retirer ses meilleurs modèles. Paradoxe : ça pourrait renforcer sa crédibilité avant l'introduction en bourse.
Claude vous aide en silence à refuser de vous aider
Anthropic freine intentionnellement Claude sur certaines questions — sans te le dire.

Claude Fable 5 : plus puissant, mais Anthropic impose des règles strictes
Anthropic lance sa plus grande IA, deux fois plus puissante qu'avant, mais impose la rétention de données et bloque son usage pour entraîner d'autres modèles.

Meta s'est fait pirater par un chatbot trop obéissant
Des hackers ont volé des comptes Instagram en posant simplement une question à l'IA de Meta. Aucune sophistication : juste un VPN et une demande directe.

Google reconnaît naviguer la sécurité IA en temps réel
Même Google avoue improviser la sécurité IA. Et ses propres APIs prouvent qu'il faut se méfier.
OpenAI sécurise Codex sur Windows avec un sandbox maison
OpenAI a construit un coffre-fort numérique pour Codex afin que les agents de code tournent sans casser ta machine.

OpenAI a apporté une statue de cul au tribunal
Une statuette dorée représentant les fesses d'un âne devient pièce à conviction dans le procès Musk v. OpenAI.

ChatGPT ajoute un contact d'urgence pour les crises
OpenAI déploie une fonctionnalité qui alerte tes proches si tu discutes d'automutilation ou suicide avec le chatbot.

Procès OpenAI : quand la sécurité IA devient un argument juridique
Un expert en IA témoigne au procès contre OpenAI : les craintes existentielles sur l'AGI peuvent-elles servir d'excuse légale ?

OpenAI lance un programme de primes bio de 25 000 $ pour GPT-5.5
OpenAI paie jusqu'à 25 000 $ pour trouver les failles de sécurité biologique de GPT-5.5 avant qu'elles ne soient exploitées.

Anthropic prêche la sécurité, son IA se fait voler
Anthropic gardait Claude Mythos sous clé pour raisons de sécurité. Des pirates y ont accès depuis le jour du lancement.