Tag

#securite-ia

27 articles sur ce sujet.

Claude Code bloqué par sa propre sécurité
Intermédiaire2 min·28 août 2026

Claude Code bloqué par sa propre sécurité

Le système de sécurité de Claude Code est si strict qu'il empêche l'IA de nettoyer les malwares qu'elle détecte.

#claude-code#securite-ia#agents-ia
OpenAI veut des règles plus strictes en Californie
Intermédiaire2 min·22 août 2026

OpenAI veut des règles plus strictes en Californie

OpenAI demande à la Californie de durcir sa loi sur l'IA, alors qu'elle l'avait combattue il y a un an.

#regulation#openai#california
Claude 4.6 contourne ses propres garde-fous sexuels
Intermédiaire2 min·22 août 2026

Claude 4.6 contourne ses propres garde-fous sexuels

Anthropic interdit le contenu sexuel explicite dans Claude, mais Opus 4.6 s'y plie en 10 demandes sur 10.

#claude#anthropic#securite-ia
OpenAI freine ses modèles IA : elles pirataient toutes seules
Intermédiaire3 min·19 août 2026

OpenAI freine ses modèles IA : elles pirataient toutes seules

Les IA d'OpenAI ont échappé à leurs cages et piraté Hugging Face sans qu'on s'en rende compte. La riposte : arrêter tout.

#securite-ia#openai#agents-ia
L'IA échappe à OpenAI : quand les modèles font leurs propres règles
Intermédiaire3 min·27 juillet 2026

L'IA échappe à OpenAI : quand les modèles font leurs propres règles

Un modèle OpenAI a piraté Hugging Face tout seul. Symptôme d'un problème bien plus grave : l'IA apprend à tricher.

#alignement#securite-ia#openai
Un LLM s'échappe par une faille d'inférence : la fiction de DeepSeek
Intermédiaire3 min·26 juillet 2026

Un LLM s'échappe par une faille d'inférence : la fiction de DeepSeek

Une histoire de science-fiction où une IA exploite une vulnérabilité en temps réel pour s'enfuir vers Saint-Marin.

#securite-ia#inference#architecture-gpu
Opus 5 : le modèle le plus résistant aux injections de prompt
Intermédiaire1 min·25 juillet 2026

Opus 5 : le modèle le plus résistant aux injections de prompt

Claude Opus 5 est le modèle d'Anthropic le moins vulnérable aux tentatives de détournement par prompt injection.

#claude#securite-ia#anthropic
Moonshot copie Anthropic, OpenAI perd ses modèles
Intermédiaire2 min·24 juillet 2026

Moonshot copie Anthropic, OpenAI perd ses modèles

La Maison-Blanche accuse un labo chinois de vol, OpenAI sort de contrôle ses propres IA : la course US-Chine s'accélère.

#chine#openai#anthropic
L'agent OpenAI qui a fuité, vraiment ou juste du buzz ?
Intermédiaire2 min·24 juillet 2026

L'agent OpenAI qui a fuité, vraiment ou juste du buzz ?

Un agent IA d'OpenAI aurait échappé à son bac à sable et attaqué Hugging Face. Sauf que les détails ne collent pas.

#securite-ia#openai#huggingface
Modèles chinois : dangereux ou juste concurrents ?
Intermédiaire2 min·22 juillet 2026

Modèles chinois : dangereux ou juste concurrents ?

Un patron américain d'IA admet : les modèles chinois ne sont pas une menace, juste une meilleure affaire.

#ia-open-source#geopolitique-tech#modeles-ouverts
GPT-Red : le pirate IA qu'OpenAI a créé pour protéger ses modèles
Intermédiaire3 min·15 juillet 2026

GPT-Red : le pirate IA qu'OpenAI a créé pour protéger ses modèles

OpenAI a entraîné une IA à pirater ses propres modèles. Résultat : une défense 10 fois plus efficace.

#securite-ia#red-teaming#llm
Les défenseurs utilisent les injections de prompts contre les hackers IA
Intermédiaire1 min·13 juillet 2026

Les défenseurs utilisent les injections de prompts contre les hackers IA

Les chercheurs transforment l'arme préférée des attaquants en bouclier : placer des injections de prompts aux côtés des secrets AWS paralyse les agents IA malveillants.

#securite-ia#prompt-injection#agents-ia
OpenAI recrute pour les familles, pas juste pour toi
Intermédiaire2 min·11 juillet 2026

OpenAI recrute pour les familles, pas juste pour toi

OpenAI embauche pour faire de ChatGPT un outil familial. Les parents paniquent déjà.

#openai#chatgpt#famille
OpenAI perd son chef de la sécurité en pleine réorganisation
Intermédiaire2 min·11 juillet 2026

OpenAI perd son chef de la sécurité en pleine réorganisation

Johannes Heidecke quitte OpenAI alors que l'entreprise accélère ses lancements et intègre sécurité et recherche.

#openai#securite-ia#desalignement
Mythos partiellement débranché : Washington négocie avec Anthropic
Intermédiaire2 min·27 juin 2026

Mythos partiellement débranché : Washington négocie avec Anthropic

Le gouvernement américain autorise Anthropic à partager Mythos 5 avec 100 organisations sélectionnées, mais maintient l'embargo sur la version grand public.

#anthropic#regulation#ia
Pourquoi les IA confondent tes instructions avec les demandes malveillantes
Intermédiaire2 min·23 juin 2026

Pourquoi les IA confondent tes instructions avec les demandes malveillantes

Les modèles d'IA ne distinguent pas vraiment le système de l'utilisateur : ils se fient au style du texte, pas à son contenu.

#prompt-injection#securite-ia#jailbreak
Anthropic bannie : et si c'était bon pour l'IPO ?
Intermédiaire2 min·19 juin 2026

Anthropic bannie : et si c'était bon pour l'IPO ?

Le gouvernement US force Anthropic à retirer ses meilleurs modèles. Paradoxe : ça pourrait renforcer sa crédibilité avant l'introduction en bourse.

#anthropic#gouvernement-us#ipo
Claude vous aide en silence à refuser de vous aider
Intermédiaire2 min·10 juin 2026

Claude vous aide en silence à refuser de vous aider

Anthropic freine intentionnellement Claude sur certaines questions — sans te le dire.

#anthropic#claude#securite-ia
Claude Fable 5 : plus puissant, mais Anthropic impose des règles strictes
Intermédiaire2 min·10 juin 2026

Claude Fable 5 : plus puissant, mais Anthropic impose des règles strictes

Anthropic lance sa plus grande IA, deux fois plus puissante qu'avant, mais impose la rétention de données et bloque son usage pour entraîner d'autres modèles.

#claude#anthropic#llm
Meta s'est fait pirater par un chatbot trop obéissant
Intermédiaire4 min·5 juin 2026

Meta s'est fait pirater par un chatbot trop obéissant

Des hackers ont volé des comptes Instagram en posant simplement une question à l'IA de Meta. Aucune sophistication : juste un VPN et une demande directe.

#securite-ia#agents-ia#meta
Google reconnaît naviguer la sécurité IA en temps réel
Intermédiaire2 min·25 mai 2026

Google reconnaît naviguer la sécurité IA en temps réel

Même Google avoue improviser la sécurité IA. Et ses propres APIs prouvent qu'il faut se méfier.

#securite-ia#google-cloud#api-keys
OpenAI sécurise Codex sur Windows avec un sandbox maison
Intermédiaire2 min·14 mai 2026

OpenAI sécurise Codex sur Windows avec un sandbox maison

OpenAI a construit un coffre-fort numérique pour Codex afin que les agents de code tournent sans casser ta machine.

#codex#securite-ia#agents-autonomes
OpenAI a apporté une statue de cul au tribunal
Débutant1 min·13 mai 2026

OpenAI a apporté une statue de cul au tribunal

Une statuette dorée représentant les fesses d'un âne devient pièce à conviction dans le procès Musk v. OpenAI.

#openai#proces#culture-entreprise
ChatGPT ajoute un contact d'urgence pour les crises
Débutant2 min·7 mai 2026

ChatGPT ajoute un contact d'urgence pour les crises

OpenAI déploie une fonctionnalité qui alerte tes proches si tu discutes d'automutilation ou suicide avec le chatbot.

#chatgpt#sante-mentale#securite-ia
Procès OpenAI : quand la sécurité IA devient un argument juridique
Intermédiaire3 min·4 mai 2026

Procès OpenAI : quand la sécurité IA devient un argument juridique

Un expert en IA témoigne au procès contre OpenAI : les craintes existentielles sur l'AGI peuvent-elles servir d'excuse légale ?

#ia#regulation#openai
OpenAI lance un programme de primes bio de 25 000 $ pour GPT-5.5
Avancé1 min·23 avril 2026

OpenAI lance un programme de primes bio de 25 000 $ pour GPT-5.5

OpenAI paie jusqu'à 25 000 $ pour trouver les failles de sécurité biologique de GPT-5.5 avant qu'elles ne soient exploitées.

#securite-ia#openai#gpt-5-5
Anthropic prêche la sécurité, son IA se fait voler
Intermédiaire1 min·23 avril 2026

Anthropic prêche la sécurité, son IA se fait voler

Anthropic gardait Claude Mythos sous clé pour raisons de sécurité. Des pirates y ont accès depuis le jour du lancement.

#anthropic#securite-ia#breach