Décryptage ·
GPT-6.1 Sol, l'intelligence d'Astra à prix cassé
OpenAI lance GPT-6.1 Sol, qui approche les performances de GPT-6 Astra en codage et usage d'ordinateur pour un cinquième du prix par tâche.

Tag
16 articles sur ce sujet.
Décryptage ·
OpenAI lance GPT-6.1 Sol, qui approche les performances de GPT-6 Astra en codage et usage d'ordinateur pour un cinquième du prix par tâche.

Décryptage ·
Google lance Gemini 4 Argon, modèle à un million de tokens de sortie, d'abord réservé aux équipes de cybersécurité via le programme Fairwind.

Analyse ·
Selon l'Artificial Analysis Intelligence Index v4.2, l'écart entre le meilleur modèle ouvert et le sommet fermé n'est plus que de six points. Sans acteur européen en tête.

Décryptage ·
Le Shanghai AI Laboratory publie sous licence MIT un modèle agentique qui dépasse GPT-5.6 Sol sur la recherche web. Un défi de plus pour l'open source européen.

Décryptage ·
Inception publie Mercury 2.5, présenté comme le plus grand modèle de langage par diffusion jamais entraîné : 1 107 jetons/seconde et un coût cassé face aux modèles classiques.

Analyse ·
DeepSeek publie V4.1-Flash sous licence MIT : des scores au niveau d'Opus 5 sur le code, une nouvelle architecture et des tarifs divisés par dix.

Décryptage ·
Zuckerberg promet d'ouvrir les poids de Muse Spark, l'un des meilleurs modèles du marché. Au 3 septembre, aucun poids n'est publié — et l'engagement se limite à la version 1.2.

Analyse ·
GLM-5.3, Qwen3.8, Hy4, MiniMax M3, DeepSeek V4-Vision : cinq poids ouverts en neuf jours banalisent contexte long et multimodalité. Le modèle devient la partie pas chère.

Analyse ·
Z.ai publie les poids de GLM-5.3, modèle de code deux à trois fois plus petit que ses rivaux. La preuve que la frontière ouverte reste sino-américaine — sans l'Europe.

Analyse ·
Kimi K3, DeepSeek V4-Pro, GLM-5.2 : sur le code, les modèles à poids ouverts talonnent désormais les modèles fermés. Pour l'Europe, l'enjeu se déplace du benchmark au coût.

Analyse ·
Un benchmark à l'aveugle mesure la capacité des grands modèles à reconstituer une idée scientifique à partir de sa seule bibliographie. Verdict : de 3 à 15 %.

Analyse ·
Un nouveau benchmark demande aux modèles de retrouver l'idée d'un article scientifique à partir de sa seule bibliographie. Les meilleurs plafonnent à 3-15 %.

Décryptage ·
OpenAI ouvre une préversion « Ultrafast » de GPT-5.6 Sol propulsée par les puces wafer-scale de Cerebras : jusqu'à 750 tokens par seconde et 14 fois plus rapide.

Décryptage ·
OpenAI a présenté le 9 août « Doug », un socle entraîné de zéro attendu d'ici novembre — le premier depuis 2024, sous les GPT-5.6.

Décryptage ·
Disponible depuis le 13 août, DeepSeek-V4-Pro-0813 vise les tâches agentiques. Des scores maison élevés, mais aucune vérification indépendante et des tarifs multipliés.

Alibaba lance Qwen3.8-Max, modèle MoE de 2 400 milliards de paramètres au niveau des références américaines, et promet une publication des poids.
