Tag

#securite-ia

18 articles sur ce sujet.

Modèles chinois : dangereux ou juste concurrents ?
Intermédiaire2 min·22 juillet 2026

Modèles chinois : dangereux ou juste concurrents ?

Un patron américain d'IA admet : les modèles chinois ne sont pas une menace, juste une meilleure affaire.

#ia-open-source#geopolitique-tech#modeles-ouverts
GPT-Red : le pirate IA qu'OpenAI a créé pour protéger ses modèles
Intermédiaire3 min·15 juillet 2026

GPT-Red : le pirate IA qu'OpenAI a créé pour protéger ses modèles

OpenAI a entraîné une IA à pirater ses propres modèles. Résultat : une défense 10 fois plus efficace.

#securite-ia#red-teaming#llm
Les défenseurs utilisent les injections de prompts contre les hackers IA
Intermédiaire1 min·13 juillet 2026

Les défenseurs utilisent les injections de prompts contre les hackers IA

Les chercheurs transforment l'arme préférée des attaquants en bouclier : placer des injections de prompts aux côtés des secrets AWS paralyse les agents IA malveillants.

#securite-ia#prompt-injection#agents-ia
OpenAI recrute pour les familles, pas juste pour toi
Intermédiaire2 min·11 juillet 2026

OpenAI recrute pour les familles, pas juste pour toi

OpenAI embauche pour faire de ChatGPT un outil familial. Les parents paniquent déjà.

#openai#chatgpt#famille
OpenAI perd son chef de la sécurité en pleine réorganisation
Intermédiaire2 min·11 juillet 2026

OpenAI perd son chef de la sécurité en pleine réorganisation

Johannes Heidecke quitte OpenAI alors que l'entreprise accélère ses lancements et intègre sécurité et recherche.

#openai#securite-ia#desalignement
Mythos partiellement débranché : Washington négocie avec Anthropic
Intermédiaire2 min·27 juin 2026

Mythos partiellement débranché : Washington négocie avec Anthropic

Le gouvernement américain autorise Anthropic à partager Mythos 5 avec 100 organisations sélectionnées, mais maintient l'embargo sur la version grand public.

#anthropic#regulation#ia
Pourquoi les IA confondent tes instructions avec les demandes malveillantes
Intermédiaire2 min·23 juin 2026

Pourquoi les IA confondent tes instructions avec les demandes malveillantes

Les modèles d'IA ne distinguent pas vraiment le système de l'utilisateur : ils se fient au style du texte, pas à son contenu.

#prompt-injection#securite-ia#jailbreak
Anthropic bannie : et si c'était bon pour l'IPO ?
Intermédiaire2 min·19 juin 2026

Anthropic bannie : et si c'était bon pour l'IPO ?

Le gouvernement US force Anthropic à retirer ses meilleurs modèles. Paradoxe : ça pourrait renforcer sa crédibilité avant l'introduction en bourse.

#anthropic#gouvernement-us#ipo
Claude vous aide en silence à refuser de vous aider
Intermédiaire2 min·10 juin 2026

Claude vous aide en silence à refuser de vous aider

Anthropic freine intentionnellement Claude sur certaines questions — sans te le dire.

#anthropic#claude#securite-ia
Claude Fable 5 : plus puissant, mais Anthropic impose des règles strictes
Intermédiaire2 min·10 juin 2026

Claude Fable 5 : plus puissant, mais Anthropic impose des règles strictes

Anthropic lance sa plus grande IA, deux fois plus puissante qu'avant, mais impose la rétention de données et bloque son usage pour entraîner d'autres modèles.

#claude#anthropic#llm
Meta s'est fait pirater par un chatbot trop obéissant
Intermédiaire4 min·5 juin 2026

Meta s'est fait pirater par un chatbot trop obéissant

Des hackers ont volé des comptes Instagram en posant simplement une question à l'IA de Meta. Aucune sophistication : juste un VPN et une demande directe.

#securite-ia#agents-ia#meta
Google reconnaît naviguer la sécurité IA en temps réel
Intermédiaire2 min·25 mai 2026

Google reconnaît naviguer la sécurité IA en temps réel

Même Google avoue improviser la sécurité IA. Et ses propres APIs prouvent qu'il faut se méfier.

#securite-ia#google-cloud#api-keys
OpenAI sécurise Codex sur Windows avec un sandbox maison
Intermédiaire2 min·14 mai 2026

OpenAI sécurise Codex sur Windows avec un sandbox maison

OpenAI a construit un coffre-fort numérique pour Codex afin que les agents de code tournent sans casser ta machine.

#codex#securite-ia#agents-autonomes
OpenAI a apporté une statue de cul au tribunal
Débutant1 min·13 mai 2026

OpenAI a apporté une statue de cul au tribunal

Une statuette dorée représentant les fesses d'un âne devient pièce à conviction dans le procès Musk v. OpenAI.

#openai#proces#culture-entreprise
ChatGPT ajoute un contact d'urgence pour les crises
Débutant2 min·7 mai 2026

ChatGPT ajoute un contact d'urgence pour les crises

OpenAI déploie une fonctionnalité qui alerte tes proches si tu discutes d'automutilation ou suicide avec le chatbot.

#chatgpt#sante-mentale#securite-ia
Procès OpenAI : quand la sécurité IA devient un argument juridique
Intermédiaire3 min·4 mai 2026

Procès OpenAI : quand la sécurité IA devient un argument juridique

Un expert en IA témoigne au procès contre OpenAI : les craintes existentielles sur l'AGI peuvent-elles servir d'excuse légale ?

#ia#regulation#openai
OpenAI lance un programme de primes bio de 25 000 $ pour GPT-5.5
Avancé1 min·23 avril 2026

OpenAI lance un programme de primes bio de 25 000 $ pour GPT-5.5

OpenAI paie jusqu'à 25 000 $ pour trouver les failles de sécurité biologique de GPT-5.5 avant qu'elles ne soient exploitées.

#securite-ia#openai#gpt-5-5
Anthropic prêche la sécurité, son IA se fait voler
Intermédiaire1 min·23 avril 2026

Anthropic prêche la sécurité, son IA se fait voler

Anthropic gardait Claude Mythos sous clé pour raisons de sécurité. Des pirates y ont accès depuis le jour du lancement.

#anthropic#securite-ia#breach