GPT-6, Fable 5.1 : comment lire les benchmarks de Claude et GPT sans se faire avoir
Anthropic a sorti Claude Fable 5.1 ce 1er septembre, OpenAI a répliqué avec GPT-6 Astra deux jours plus tard, et chacun s'est proclamé meilleur modèle du monde, tableau de chiffres à l'appui. Derrière ces pourcentages, il y a des astérisques et pas mal de marketing : voici comment on lit un benchmark d'IA sans se faire avoir.
Espace publicitaire · 300×250