- Opposer Claude Fable 5 et GPT-5.6 Sol sur un clip à 100 dollars produit du contenu, pas de la connaissance : le budget affiché tient lieu de méthode.
- Dans ce genre d'exercice, ce qui décide du gagnant n'est presque jamais la machine, c'est la personne qui tape les instructions.
- La musique se juge à l'oreille, et l'oreille ne remplit pas un tableau comparatif : le verdict est un goût déguisé en mesure.
Mini quiz : et vous, vous en êtes où ?
Trois questions, une réponse par clic et on enchaîne tout seul. À la fin, surprise.
1. Devant un titre du type « X écrase Y », votre premier réflexe ?
2. Selon vous, qui décide vraiment du résultat d'un tel comparatif ?
3. Un budget de 100 dollars affiché dans un titre, ça évoque quoi ?
Le meilleur pour la fin : on a déniché un article au hasard rien que pour vous. Vous allez adorer le lire !
🎲 Surprenez-moi, j'y vais !Jeudi soir, quelqu'un m'a fait écouter un morceau sorti d'une machine, et la première question posée n'a pas été « c'est beau ? » mais « ça a coûté combien ? ».
Un billet publié sur le forum Hacker News oppose Claude Fable 5 et GPT-5.6 Sol sur un clip musical fabriqué pour 100 dollars. Trois jours plus tôt, le 16 juillet, la chaîne française Parlons IA annonçait déjà que GPT 5.6 « écrase » son concurrent. Deux formats, une même certitude. Et toujours aucun protocole derrière le vainqueur.
Cent dollars, deux moteurs, un clip
Le billet posté sur Hacker News s'appelle « $100 AI Music Video: Claude Fable 5 vs. GPT-5.6 Sol ». Tout est dans le titre. Un clip musical fabriqué par machine, cent dollars de budget, deux concurrents dans le ring. D'un côté Claude Fable 5. De l'autre GPT-5.6 Sol. Au milieu, quelqu'un avec une carte bancaire et du temps devant lui. Le format rassure. Une somme ronde, deux marques, un vainqueur à la fin. On sait ce qu'on va lire, et on sait qu'on relira la même chose dans quinze jours avec deux autres noms de modèles. Pendant ce temps, en France, la chaîne Parlons IA publiait le 16 juillet une vidéo au titre tout aussi paisible : « J'ai testé GPT 5.6 : Pourquoi il écrase déjà Claude AI ! ». Écrase. Déjà. Deux mots qui font tout le travail du point d'exclamation. Sur quoi, comment, combien de fois : la question ne se pose plus. Le duel se suffit à lui-même. C'est exactement le problème.
Le comparatif est un genre, pas un protocole
Un vrai test, c'est mortellement ennuyeux. Même consigne, même nombre d'essais, même juge, et si possible un juge qui n'a rien à vendre. Un clip à cent dollars, c'est autre chose. C'est un spectacle avec le budget imprimé sur l'affiche. Ce qui décide du résultat, ce n'est presque jamais la machine. C'est la personne qui tape les instructions. Envoyer la même consigne à quatre agents et récolter quatre résultats différents ne prouve rien sur les agents. Ça prouve que la formulation pèse plus lourd que la marque. On a déjà vu un modèle chinois gratuit déclaré supérieur, chiffres à l'appui, appuyé par des classements maison. Le monde a continué de tourner pareil. Ces classements ont un charme constant : celui qui les publie gagne toujours. Le clip musical ajoute une couche de flou. Un morceau vous plaît ou ne vous plaît pas. Personne n'a jamais départagé deux mélodies avec un tableau à colonnes. Alors on maquille. On parle de cohérence, de rendu, de fidélité à la demande. Des mots qui sonnent comme de la science et qui signifient « j'ai préféré celui-là ». Ajoutez que ces outils savent maintenant regarder une vidéo, et la boucle se referme joliment. Une machine évalue le travail d'une autre machine. L'humain arbitre en signant la facture. On appelle ça un exemple concret. C'est surtout un exemple.
Ce que le chiffre rond sert à cacher
Cent dollars, c'est un décor. Le chiffre tient dans un titre, il donne l'illusion d'un plafond, il rend l'expérience sympathique. Un budget modeste, donc une démarche modeste : l'alibi est efficace. La vraie note ne s'arrête jamais sur un chiffre rond. On a vu des chantiers où l'automatisation coûte plus cher que l'ingénieur qu'elle devait remplacer. On sait qu'un assistant peut avaler 33 000 jetons (des fragments de texte facturés à l'unité) avant votre première phrase. Chaque trimestre apporte sa baisse de prix triomphale, et la facture mensuelle, elle, ne bouge pas d'un centime. Curieux. Pendant que deux géants s'échangent des clips, la partie intéressante se joue ailleurs, sans communiqué. Des petits modèles qui tiennent debout là où le réseau lâche. Un vieux PC de jeu reconverti en atelier de génération. Des outils qui tournent en local, sans abonnement et sans compteur qui tourne. Ça ne fait pas un titre avec un signe dollar dedans. Ça change pourtant plus de choses qu'un clip.
Le seul test qui vaudrait le coup
La bonne question n'est pas de savoir laquelle des deux machines gagne. Elle est de savoir si quelqu'un réécoutera ce morceau dans six mois. Les images fabriquées ont déjà envahi les murs et les écrans, et personne n'en garde le souvenir. On a vu Midjourney s'aventurer sur le terrain médical, des chatbots partout, une guerre des laboratoires que plus grand monde ne suit. La Norvège, elle, a quasiment banni ces outils à l'école primaire. Voilà une décision. Un comparatif, non. Le reste ressemble à ces annonces de puces avec rien à montrer : beaucoup de chiffres, aucun objet posé sur la table. Regardez plutôt qui prend du retard, qui laisse traîner des failles, qui facture quoi à qui. Le clip, lui, on peut le regarder. Une fois.
Questions fréquentes
Ce comparatif à 100 dollars sert-il vraiment à quelque chose ?
À se distraire, oui. À choisir un outil, non. Le budget affiché remplace la méthode, et un seul essai par machine ne dit rien de stable. Regardez-le comme un reportage, jamais comme un banc d'essai. La différence n'est pas un détail, elle change tout ce qu'on peut en conclure.
Faut-il croire les vidéos qui annoncent qu'un modèle en « écrase » un autre ?
Notre position est simple : un verbe pareil dans un titre signale un choix éditorial, pas un résultat. Ces formats vivent du duel, donc ils produisent du duel. Le contenu peut rester honnête, mais la promesse du titre, elle, est presque toujours plus large que ce qui a été testé.
Alors sur quoi juger Claude Fable 5 ou GPT-5.6 Sol ?
Sur votre propre usage, répété pendant deux semaines, avec vos consignes et vos contraintes. C'est lent, c'est ingrat, ça ne fait pas une vidéo. Mais c'est le seul protocole qui vous concerne. Le reste, ce sont les préférences d'un inconnu qui avait cent dollars à dépenser.