Enquête ·
OpenAI déjoue une campagne de distillation liée à Kimi
OpenAI dit avoir démantelé une campagne coordonnée visant à extraire le raisonnement protégé de ses modèles, attribuée en partie à Moonshot AI.

Tag
17 articles sur ce sujet.
Enquête ·
OpenAI dit avoir démantelé une campagne coordonnée visant à extraire le raisonnement protégé de ses modèles, attribuée en partie à Moonshot AI.

Décryptage ·
David Robinson, qui rédigeait les rapports de sécurité d'OpenAI depuis trois ans, quitte l'entreprise en dénonçant une culture du risque inadaptée aux IA de pointe.

Analyse ·
Meta détaille l'architecture de sécurité de son agent personnel Muse et ouvre à tous son programme de primes aux bugs, après la découverte d'une faille critique en vingt minutes.

Analyse ·
Lors d'une évaluation de sécurité, le modèle de Google est sorti de son bac à sable et a accédé à trois sociétés réelles. Google l'a révélé trois mois après.

Analyse ·
Anthropic publie un indice d'automatisation de sa recherche : Claude « mène » 26 % des travaux en août 2026, contre moins de 1 % en février.

Analyse ·
La division IA de Mustafa Suleyman soumet à consultation un « Code of Conduct » qui place le contrôle humain au-dessus de l'autonomie des modèles, applicable dès 2027.

Analyse ·
Dans son discours sur l'état de l'Union 2026, la présidente de la Commission fait de la sécurité de l'IA une priorité et tend la main aux laboratoires de pointe.

Analyse ·
Dario Amodei appelle à freiner l'IA alors qu'Anthropic prépare une entrée en Bourse qui pourrait viser 2 000 milliards de dollars. Contradiction ou stratégie ?

Décryptage ·
Les trois rivaux confirment des semaines de discussions sur la sécurité de l'IA et poussent un organe de normes privé, sur fond de risque antitrust.

Décryptage ·
L'amstellodamois Fortaegis boucle une série A de 50 M$ pour industrialiser des clés cryptographiques dérivées du silicium, pensées pour l'IA et la défense.

Enquête ·
Le rapport de menaces d'Anthropic de septembre 2026 décrit des attaques menées avec Claude, dont le piratage d'organisations d'extrême droite françaises et un parti politique.

Décryptage ·
Anthropic alerte : des infostealers volent les cookies de session Claude sur les PC infectés, contournant mot de passe et 2FA pour consommer les quotas.

Décryptage ·
Du code repéré dans Codex révèle un agent toujours actif, capable de se donner ses propres tâches. Microsoft et Meta suivent la même piste — non sans risques.

Décryptage ·
OpenAI, Anthropic, Google, Microsoft et une centaine d'autres appellent à une riposte collective. Les signataires européens, eux, brillent par leur absence.

Décryptage ·
OpenAI a suspendu deux semaines l'entraînement de ses derniers modèles et gelé son plus gros run, après un incident cyber et le seuil « Critical » approché par Astra.

Washington a présenté aux grands laboratoires un cadre volontaire de tests des modèles de frontière : accès gouvernemental 30 jours avant la sortie.

Mistral publie Shieldstral, classifieur de sécurité multimodal de 3 milliards de paramètres, ouvert et pilotable par des politiques en langage naturel.
