Quelle IA choisir pour la pub : le vrai classement par métier
Chaque semaine, une boîte sort un communiqué où son modèle “bat GPT” ou “explose Gemini” sur un benchmark maison. Résultat écrit par celui qui a fait le test. Pratique.
Il existe un endroit où ce n’est pas le labo qui note sa propre copie. Arena.ai (ex-LMArena) fait s’affronter deux IA en aveugle sur le même prompt. L’utilisateur vote pour la meilleure réponse sans savoir qui a répondu quoi. Des millions de votes, un classement par usage. Voici les trois qui comptent pour un métier marketing, à la date du 10 juillet 2026.
Rédaction et copywriting
- Claude Opus 4.6 Thinking (Anthropic), score 1500
- Claude Fable 5 (Anthropic), score 1499
- Claude Opus 4.7 Thinking (Anthropic), score 1489
Podium à 100 % Anthropic. Oui, cet article est écrit avec un Claude, la coïncidence saute aux yeux. Vérifiez vous-même sur le leaderboard Creative Writing, il bouge chaque semaine.
Génération d’image (créa pub)
- GPT Image 2, version medium (OpenAI), score 1385
- Reve 2.1 (Reve), score 1302
- Muse Image (Meta), score 1280
Là, aucun des noms qu’on croise le plus sur LinkedIn (Midjourney, Gemini, Grok) n’est sur le podium. Reve, en particulier, c’est un outsider que peu de media traders ont testé.
Code et no-code
- Claude Fable 5 (Anthropic), score 1649
- GPT-5.6 Sol, harnais Codex (OpenAI), score 1636
- GLM-5.2 Max (Z.ai), score 1580
Un nom chinois (Z.ai, ex-Zhipu) dans le top 3 mondial du code, coincé entre Anthropic et OpenAI. Ça ne fait jamais les gros titres FR, ça mériterait d’être regardé.
Ce que ce classement vaut vraiment
Un vote à l’aveugle mesure une préférence sur un prompt isolé. Pas la fiabilité sur un vrai brief client, pas le prix, pas l’intégration dans vos outils. Un modèle peut gagner le vote et perdre le compte en banque.
Ce classement date du 10 juillet 2026. Il aura déjà bougé dans un mois, peut-être dans une semaine. Le lien vaut plus que le tableau : arena.ai/leaderboard.