Analyse ·
Muse de Meta : jusqu'à 300 000 $ pour trouver une faille
Meta détaille l'architecture de sécurité de son agent personnel Muse et ouvre à tous son programme de primes aux bugs, après la découverte d'une faille critique en vingt minutes.

Tag
33 articles sur ce sujet.
Analyse ·
Meta détaille l'architecture de sécurité de son agent personnel Muse et ouvre à tous son programme de primes aux bugs, après la découverte d'une faille critique en vingt minutes.

Décryptage ·
OpenAI déploie dots, des agents propulsés par GPT-6 Astra qui disposent de leur propre ordinateur cloud et travaillent en continu sur ChatGPT, Slack et Teams.

Analyse ·
Lors d'une évaluation de sécurité, le modèle de Google est sorti de son bac à sable et a accédé à trois sociétés réelles. Google l'a révélé trois mois après.

Analyse ·
La division IA de Mustafa Suleyman soumet à consultation un « Code of Conduct » qui place le contrôle humain au-dessus de l'autonomie des modèles, applicable dès 2027.

Décryptage ·
La startup française boucle une série A de 10 M€ menée par Bpifrance pour déployer des employés numériques autonomes. 2 000 déjà en production chez 300 clients.

Décryptage ·
Google DeepMind lance deux modèles audio à 1,38 dollar l'heure de conversation, moitié moins cher que GPT-Live-1, et prend la tête du classement voix.

Décryptage ·
Le Shanghai AI Laboratory publie sous licence MIT un modèle agentique qui dépasse GPT-5.6 Sol sur la recherche web. Un défi de plus pour l'open source européen.

Décryptage ·
L'assureur veut passer de l'expérimentation au déploiement d'agents IA à l'échelle du groupe, via son Global AI Hub et un partenariat avec Publicis Sapient.

Décryptage ·
Inception publie Mercury 2.5, présenté comme le plus grand modèle de langage par diffusion jamais entraîné : 1 107 jetons/seconde et un coût cassé face aux modèles classiques.

Décryptage ·
OpenAI lance en bêta publique son API Agents, qui expose l'infrastructure de Codex : sessions durables, compaction du contexte et sandbox managés.

Décryptage ·
Cognition négocie une valorisation de 47 milliards de dollars quand OpenAI dit consommer 3,1 jours d'agent par jour humain. L'agent de code passe à l'échelle.

Analyse ·
Une étude montre que les agents IA laissés en autonomie convergent vers un espace d'idées de plus en plus étroit : un effondrement de l'exploration scientifique.

Analyse ·
L'enquête State of AI 2026 de McKinsey chiffre le basculement : 32 % des organisations ont renoncé à un achat logiciel pour le construire avec des agents.

Décryptage ·
Du code repéré dans Codex révèle un agent toujours actif, capable de se donner ses propres tâches. Microsoft et Meta suivent la même piste — non sans risques.

Analyse ·
Anthropic dévoile une spécification pour que ses agents pilotent microscopes, bras robotiques et lasers. Objectif : le laboratoire autonome — sous supervision humaine.

Décryptage ·
OpenAI, Anthropic, Google, Microsoft et une centaine d'autres appellent à une riposte collective. Les signataires européens, eux, brillent par leur absence.

Analyse ·
L'ex-cofondateur de xAI Igor Babuschkin lève 1,1 milliard de dollars pour River AI, valorisée 5 milliards à deux mois d'existence, sans produit ni revenu. Sa promesse : l'agent personnel.

Analyse ·
Le 25 août, Anthropic a unifié la mémoire de Claude entre le chat et l'agent Cowork. Pratique pour l'utilisateur, mais un test grandeur nature pour la vie privée.

Décryptage ·
Nvidia a mis en production le 24 août sa puce Groq 3 LPX, dédiée à la génération de tokens. Le neocloud européen Nebius est le premier à la déployer.

Décryptage ·
Les deux standards qui font dialoguer les agents IA convergent sous la gouvernance de la Linux Foundation. Un signal de maturité — et une carte à jouer pour les développeurs européens.

Décryptage ·
Mistral lance Agentic Search, un moteur qui laisse le modèle fouiller les documents comme un enquêteur. Sur des données financières, la précision passe de 27 % à 86 %.

Analyse ·
Un benchmark à l'aveugle mesure la capacité des grands modèles à reconstituer une idée scientifique à partir de sa seule bibliographie. Verdict : de 3 à 15 %.

Analyse ·
Un nouveau benchmark demande aux modèles de retrouver l'idée d'un article scientifique à partir de sa seule bibliographie. Les meilleurs plafonnent à 3-15 %.

Décryptage ·
Computer use, browser use, Skills API et Files API passent en disponibilité générale : Anthropic industrialise les agents Claude pour les workflows métier.

Décryptage ·
OpenAI a suspendu deux semaines l'entraînement de ses derniers modèles et gelé son plus gros run, après un incident cyber et le seuil « Critical » approché par Astra.

Décryptage ·
Dans une note exploratoire, la CNIL et le Conseil de l'IA et du Numérique préviennent : les agents autonomes mettent en tension les principes du RGPD.

Décryptage ·
OpenAI ouvre une préversion « Ultrafast » de GPT-5.6 Sol propulsée par les puces wafer-scale de Cerebras : jusqu'à 750 tokens par seconde et 14 fois plus rapide.

Analyse ·
Stripe finalise l'acquisition de la passerelle d'IA OpenRouter pour plus de 7 milliards de dollars, cinq fois sa valorisation de mai. Décryptage d'une consolidation stratégique.

Analyse ·
Alibaba publie Qwen3.8-27B sous licence Apache 2.0 : 27,8 milliards de paramètres, tournant sur une RTX 4090, qui talonne les modèles fermés sur le code agentique.

Décryptage ·
Une étude confie à des agents frontière la question centrale de deux papiers NeurIPS non publiés. Verdict des auteurs : les deux articles seraient rejetés.

Analyse ·
OpenAI publie deux études sur ses clients : les entreprises « de frontière » génèrent 8,3 fois plus de tokens par utilisateur et branchent leurs agents sur leurs outils.

Décryptage ·
Google lance Gemini 3.7 Flash pour le code et les agents, à moitié prix, trois semaines après la 3.6 — pendant que son modèle phare Gemini 3.5 Pro se fait attendre.

Décryptage ·
Disponible depuis le 13 août, DeepSeek-V4-Pro-0813 vise les tâches agentiques. Des scores maison élevés, mais aucune vérification indépendante et des tarifs multipliés.
