← tous les articles
Infolettre28 août 2026

Seedance 2.5 passe en 1080p et coûte 1$ US la seconde

Seedance 2.5 passe en 1080p et coûte 1$ US la seconde

Le meilleur modèle vidéo du marché passe en 1080p, et je te donne le vrai budget à prévoir avant de le vendre. Plus deux modèles gratuits qui tournent sur ta machine pour la musique et la voix, ma nouvelle série de fausses archives québécoises générée volontairement en 480p, et la structure de prompt complète pour sortir huit scènes en une seule prise.

Ceci est l'édition du 28 août 2026 de Pèse sur Play, mon infolettre hebdomadaire sur la vidéo IA et ce qui performe sur les médias sociaux.

Salut,

Quatre sorties importantes cette semaine, et elles sont reliées. D'un côté, le meilleur modèle vidéo du marché vient de passer en 1080p, et il coûte assez cher pour qu'il faille le budgéter avant de vendre le mandat. De l'autre, deux modèles gratuits que tu télécharges sur ta propre machine viennent remplacer des abonnements que tu paies peut-être déjà, pour la musique et pour la voix.

Je te donne mon verdict sur chacun. Ensuite, je te montre ma nouvelle série, celle que je génère volontairement en 480p, avec la structure de prompt au complet.

---

Ce qui sort. Hype ou ça vaut la peine?

Quatre sorties de la semaine : ce que la nouvelle résolution de Seedance va te coûter pour vrai, et deux modèles gratuits qui remplacent des abonnements que tu paies déjà.

Seedance 2.5 génère enfin en 1080p

Un plan de la vidéo de démonstration officielle de Seedance 2.5, une loge de théâtre éclairée aux ampoules de miroir

Depuis son lancement le 31 juillet, le modèle vidéo de ByteDance plafonnait à 720p, ce qui le rendait difficile à recommander pour du travail livré à un client. La version 1080p est arrivée à la mi-août et elle renverse ce constat.

Verdict : c'est le meilleur modèle vidéo sur le marché aujourd'hui, et il faut le budgéter avant de le vendre. Ces prix supposent que tu réussis ton plan du premier coup, et ça n'arrive à peu près jamais : compte une dizaine de générations avant d'obtenir quelque chose que tu es prêt à livrer. Ma règle du pouce, calculée sur Higgsfield : autour de 4$ US par seconde livrée. Un film de deux minutes revient donc à près de 500$ US en génération seulement, et au tarif affiché de Dreamina, le même film coûte plus du double. Magasine ta plateforme avant de chiffrer ton mandat.

MiniMax Music 3 génère cinq minutes de toune sur ton ordinateur

Le visuel d'annonce officiel de MiniMax Music 3

Sorti le 13 août, ce modèle de musique est à poids ouverts : tu télécharges les fichiers et tu le fais tourner chez toi.

Verdict : c'est la réponse directe à la nouvelle que je t'ai donnée la semaine passée. Suno plafonne ses téléchargements à partir du 3 septembre, avec 20 pièces par mois sur le forfait Pro, alors qu'un modèle que tu héberges toi-même n'a aucun plafond. Vérifie quand même la licence avant de l'utiliser sur un mandat payant : « gratuit à télécharger » ne veut jamais dire automatiquement « libre de droits en usage commercial ».

IndexTTS-2.5 clone une voix et te donne des curseurs d'émotion

Le logo officiel d'IndexTTS, le modèle de synthèse vocale de bilibili

Publié le 10 août, ce modèle de synthèse vocale est lui aussi à poids ouverts.

Verdict : le contrôle est réel, la qualité brute reste sous celle d'ElevenLabs. Sans travail sur l'émotion, la lecture sort plate et robotique, alors qu'une référence émotionnelle bien choisie la rend utilisable. La licence vient de bilibili et l'usage commercial se négocie avec eux directement, donc pour un projet client, vérifie avant plutôt qu'après.

Apple projette la performance d'un acteur sur le visage de quelqu'un d'autre

Le schéma officiel du système HeadsUp d'Apple, qui reconstruit un visage en trois dimensions à partir de plusieurs prises de vue

L'équipe de recherche d'Apple a publié ses travaux sur HeadsUp, un système de reconstruction du visage en trois dimensions.

Verdict : rien à essayer cette semaine, et c'est quand même la nouvelle la plus importante des quatre. HeadsUp est un outil de recherche interne, pas un produit que tu peux ouvrir aujourd'hui, mais il annonce la suite : la retouche d'expression après le tournage s'en vient dans les logiciels que tu utilises déjà, exactement comme la retouche de peau y est entrée il y a vingt ans.

---

Une démo sortie de mes propres productions.

Le meilleur modèle vidéo du monde vient de passer en 1080p, et je viens de générer ma nouvelle série en 480p, exprès. Voici pourquoi.

TEMPÊTE, et le format RAW Québec 90s

Quatre plans de TEMPÊTE : un homme en habit qui pellette, une souffleuse municipale, un gars en shorts et gougounes dans une tempête, un homme en fauteuil roulant remorqué par une motoneige

Je teste depuis quelques semaines un nouveau format : de fausses archives québécoises de 1993, filmées par quelqu'un qui n'avait pas le droit de filmer. Le gars cuvé dans le banc de neige avec un chien qui pisse à côté de sa tête. La bonne soeur qui fait un burnout en Camaro dans le stationnement de l'église. Personne autour ne réagit, et c'est exactement ça qui fait rire.

Ce que je cherche n'est pas la belle image. Le format repose sur quelques règles précises.

Sur DIMANCHE, c'est ma vraie voix enregistrée au micro, sur quinze secondes écrites dans le spleen d'Émile Nelligan. Sur TEMPÊTE, c'est un rap boom bap de 1993 fait avec Suno, rappé par un clone de ma propre voix, sur un texte écrit dans le registre de Gilles Vigneault.

Les chiffres de TEMPÊTE au 27 août :

C'est ce dernier chiffre que je surveille, parce qu'une moyenne de neuf secondes sur un format court, ça veut dire que les gens ont entendu au moins deux lignes avant de décider s'ils restaient. Ce qui les retient, c'est la reconnaissance : quarante-deux centimètres tombés au lieu des vingt annoncés, la souffleuse à trois heures du matin, les bas mouillés qu'on remet pour ressortir.

---

Une recette copiable.

Générer huit scènes différentes dans une seule vidéo de 30 secondes, sans montage entre les plans. Voici la structure de prompt exacte, prête à copier.

Avant d'écrire un seul prompt, j'ai passé une session complète dans Claude Code à documenter le format : les cinq constantes de caméra, les deux textures d'image, la banque de références culturelles québécoises, les modèles à utiliser selon la situation. Ce document, maintenant, je le rappelle en une seule phrase, et produire une vidéo se résume à choisir un fil conducteur et lancer la génération.

Un tableau blanc où huit cases égales se partagent une bande de 30 secondes, 3,75 secondes par case, avec 480P encerclé en rouge

La partie que tu peux reprendre telle quelle, c'est la structure du prompt.

[TEXTURE]
Quebec television archive footage, 1993. Analog Betacam SP standard-definition
broadcast video, interlaced, 480 lines. Heavy analog noise, chroma smearing,
everything soft, nothing critically sharp anywhere. Flat sickly green-grey cast,
no white balance. Blacks lifted to grey, whites dull, almost no contrast.
Degraded videotape, not film.

[LA LIGNE QUI POSE LE MULTI-SCÈNES]
Eight unrelated scenes across Quebec on the same grey Sunday. Every shot is filmed
from far away at full telephoto zoom by someone hiding, with a large out-of-focus
object blocking part of the frame, and the framing is always wrong.

[LES HUIT PLANS, UNE LIGNE CHACUN]
Shot 1: [action absurde]. Shot from behind [obstruction]. handheld, a quick zoom in
that overshoots before correcting.
[...]
Closing: tight on [un détail du plan 1], the frame drifting, held.

[FERMETURE]
Nobody reacts to anything. Nobody is posing. Nobody knows the camera is there.
No timestamp, no borders, no CRT frame, no letterboxing.
No music, no score, no library audio, no voiceover, no on-screen text, no logo.

[AUDIO]
wind, boots crunching packed snow, a dog panting, tires spinning on wet asphalt,
a two-stroke engine, church coughing, a diesel truck idling.

La structure marche, mais l'effet tombe si tu rates certains détails.

Un dernier détail qui m'a coûté trois générations : Seedance refuse un visage de célébrité comme image de départ. La soumission passe, la génération casse. MiniMax H3 accepte le même visage sans se plaindre, mais il prend cinq minutes au lieu d'une.

---

Un morceau de notre stratégie vidéo pour médias sociaux.

Ta vidéo a fait 300 vues et tu es déçu. Avant de conclure que ça n'a pas marché, regarde qui l'a regardée.

Un tableau blanc opposant un grand cercle « 1 million de vues, zéro client » à un petit cercle rouge « 800 vues, les bonnes personnes » qui mène à un signe de dollar

Viser le viral est le plus vieux réflexe des médias sociaux, et c'est aussi celui qui coûte le plus cher aux entreprises.

Notre façon de travailler part donc de l'autre bout :

  1. On commence par l'offre, jamais par l'idée de vidéo. Tant qu'on ne sait pas ce qui se vend au bout et à qui, on ne sait pas quelle vidéo mérite d'être faite.
  2. On choisit une place que personne n'occupe (ou presque) dans ton marché. Être la deuxième version de quelqu'un d'autre ne convertit pas, parce que les gens retiennent une seule personne par sujet.
  3. On mesure les gestes qui annoncent une vente : les enregistrements, les partages, les messages privés. Le compteur de vues, lui, ne décide de rien. Bref, les vues c'est aussi important, mais avant tout c'est l'engagement qui compte.

Ça donne des courbes moins spectaculaires mais au moins ça génère des rendez-vous dans ton calendrier!

C'est de cette façon qu'on travaille sur les mandats de vidéo sociale.

---

Réponds-moi directement si t'as une question, un sujet ou un désaccord. Je lis tout, et c'est souvent ce qui décide de l'édition suivante.

Bonne fin de semaine,

Alex

---

Tu veux recevoir Pèse sur Play chaque vendredi matin? Abonne-toi ici.

pour aller plus loin
Production vidéo IA ->Vidéo médias sociaux ->
à lire aussi