Tencent sort Hy Image 3.5 Preview au moment exact où Alibaba ouvre Apsara : la guerre des modèles d'images chinoise passe à la vitesse supérieure
🔎 Un lancement calibré comme une frappe chirurgicale
Le 22 septembre 2026, Tencent met en ligne Hy Image 3.5 Preview. Ce même jour, Alibaba ouvre sa conférence Apsara, son grand rendez-vous annuel de l'IA. Ce n'est pas une coïncidence de calendrier : c'est une tactique, et Bloomberg via The Edge Malaysia le dit explicitement — le lancement tombe « le jour exact » de l'ouverture d'Apsara.
La génération d'images est devenue le front le plus chaud de l'IA en Chine. ByteDance appuie fort avec Seedream, Alibaba déroule Qwen-Image, et Tencent vient de rappeler qu'il ne comptait pas regarder la scène depuis le banc. Les acteurs ne se contentent plus de se répondre : ils se calent désormais sur les événements des uns et des autres pour leur voler la lumière.
En une seule journée, on a eu droit aux deux stratégies du moment : un modèle fermé à prix cassé côté Tencent, un open-source spectaculaire mais à licence verrouillée côté Alibaba. On a passé les annonces au tamis des sources primaires — docs API, communiqués, presse financière. Voici ce qui compte vraiment, surtout si vous développez.
L'essentiel
- Timing offensif : Hy Image 3.5 Preview est sorti le 22 septembre 2026, le jour exact de l'ouverture de l'Apsara Conference d'Alibaba.
- Chiffre marketing : +30 % de capacités vs Hunyuan Image 3.0, mesuré par des tests GSB en aveugle internes. Aucune évaluation indépendante à ce jour.
- API agressive : protocole Chat/Messages, édition multi-tours, jusqu'à 20 images de référence, 4K possible, et 0,15 RMB par image 2K (septembre 2026, vérifiez sur Tencent Cloud) — facturation uniquement sur les images générées.
- Côté Alibaba : Qwen-Image-2.1 (7B) et deux checkpoints 9B de prompt-rewriting en poids ouverts… mais la licence quitte Apache 2.0 pour un usage strictement non-commercial.
- Le marché a validé le bruit : l'action Tencent a fortement bondi à l'annonce, selon MarketWatch.
Outils recommandés
| Outil | Usage principal | Prix (mois année) | Idéal pour |
|---|---|---|---|
| Hy Image 3.5 Preview — API Tencent Cloud | Génération + édition multi-tours, jusqu'à 4K | 0,15 RMB/image 2K (septembre 2026, vérifiez sur Tencent Cloud) | Équipes produit, e-commerce, pipelines d'édition |
| Qwen-Image-2.1 — poids ouverts | Auto-hébergement, prompt-rewriting, recherche | Gratuit (licence recherche non-commerciale) | Chercheurs, prototypage, évaluation |
| Nano Banana Pro (Gemini API) | Génération image avec grounding web | Par crédits API (septembre 2026, vérifiez sur ai.google.dev) | Créatifs exigeants, visuels marketing |
| GPT-Image-2 (OpenAI) | Génération haute fidélité | Par crédits API (septembre 2026, vérifiez sur openai.com) | Production généraliste, itération rapide |
Un timing calibré à la journée près : la tactique du tir synchronisé
Tencent a délibérément choisi le jour de l'ouverture d'Apsara pour lancer Hy Image 3.5 Preview — et ce n'est pas sa première manœuvre du genre. En Chine, la date d'annonce est devenue une arme à part entière : GLM-5.3-Flash et Qwen3.8-Flash-Next sont déjà sortis le même jour, signe que cette synchronisation est devenue un réflexe.
La logique est simple et redoutablement efficace. Quand Alibaba réunit presse et développeurs pour sa conférence annuelle, toute l'attention tech du pays est déjà mobilisée. Publier son propre modèle ce jour-là, c'est capter une partie des retombées médiatiques sans dépenser un yuan de communication. Le marché a suivi : l'action Tencent a fortement grimpé dans les heures qui ont suivi, d'après MarketWatch.
En face, Alibaba n'est pas arrivé les mains vides. À l'Apsara, Eddie Wu a annoncé un futur modèle flagship de 5 à 10 trillions de paramètres ainsi qu'une puce accélérateur maison, la Zhenwu V900, selon The Arabian Post. La famille Qwen3.6 côté LLM montre déjà qu'Alibaba joue sur tous les tableaux — langage, images, silicium.
Dernier signal à ne pas négliger : les talents. Tian Yonglong, passé par OpenAI sur la vision, a rejoint l'équipe Hunyuan dès juillet. Quand un géant chinois recrute un spécialiste vision formé chez l'ennemi juré quelques semaines avant un lancement majeur, ce n'est pas un détail d'annuaire — c'est un aveu d'ambition.
Mon avis : ce timing assumé dit quelque chose de sain sur la maturité du marché chinois. On est passé aux annonces de duels, presque de la boxe médiatique. Pour nous, observateurs et développeurs, c'est une excellente nouvelle : la pression concurrentielle accélère tout, prix compris.
Hy Image 3.5 Preview : que valent vraiment les « +30 % » de Tencent ?
Soyons directs : le « +30 % de capacités globales » avancé par Tencent vient de tests comparatifs en aveugle (méthodologie GSB) menés auprès de centaines de designers… internes à Tencent. C'est un chiffre de communication, pas un benchmark indépendant.
La méthodologie GSB (Good/Same/Bad — mieux, égal, pire) consiste à faire comparer deux images par des évaluateurs qui ignorent leur provenance. C'est un outil honnête pour mesurer une progression entre deux versions d'un même modèle. C'est un outil dangereux pour comparer deux éditeurs différents, surtout quand les évaluateurs travaillent pour l'un d'entre eux.
Sur cette base interne, Tencent affirme que Hy Image 3.5 Preview fait jeu égal avec Seedream 5.0 Pro de ByteDance et se place légèrement devant Nano Banana Pro de Google et Qwen-Image-3.0 Pro d'Alibaba. Superpower Daily le souligne clairement : ces claims restent non quantifiés et non vérifiés de manière indépendante. Présumez innocent, mais vérifiez quand même.
Ce que le modèle sait faire, côté capacités
Là où les choses deviennent intéressantes, c'est sur le périmètre fonctionnel, qui est factuel et vérifiable dans la doc :
- Text-to-image et image-to-image, avec multi-ratios d'image.
- Création conversationnelle multi-tours : le modèle conserve l'historique, on itère comme dans un chat.
- Jusqu'à 5 images de référence par requête côté produit, et jusqu'à 20 via l'API (≤ 20 Mo par image).
- Sortie synchrone : pas de job asynchrone ni de polling, la réponse arrive directement.
Le positionnement produit est lui aussi révélateur. Le communiqué Hunyuan relayé par GMT EIGHT parle de passer « de la belle image aux scénarios esthétiques professionnels » : affiches commerciales, storyboards, matériaux audiovisuels, UI design, illustration, visuels de marque, e-commerce. Traduction : Tencent ne vise plus le grand public amateur, il vise vos équipes créatives.
Le modèle est déjà intégré dans Yuanbao, ima, WorkRally, OnSolo, Miora et WorkBuddy, selon TechFlow. Ce n'est pas un modèle de vitrine : c'est une brique d'écosystème, adossée à Hy3, le modèle de langage MoE sorti en juillet et déjà déployé dans Yuanbao, WorkBuddy et Tencent Cloud.
L'API sous le capot : Messages, 4K et 0,15 RMB l'image
Pour les développeurs, c'est ici que tout se joue : l'API hy-image-v3.5-preview parle le protocole Chat/Messages, le même paradigme que vos LLM. Concrètement, votre stack d'orchestration existante peut piloter un modèle d'images sans refonte.
Le fonctionnement est limpide. On envoie un prompt, on reçoit une image, et pour modifier le résultat on réinjecte l'image précédente dans l'historique de conversation avec une instruction. La boucle de révision — réinjecter l'image + l'historique — est native, pas un bricolage. C'est du design d'API pensé pour l'édition itérative, pas pour le one-shot.
Les paramètres techniques méritent le détour, d'après la doc officielle Tencent Cloud (mise à jour du 21 septembre) :
- Résolution : détermination automatique de la taille, ou
sizeexplicite jusqu'à 4096×4096 (4K). Largeur et hauteur entre 256 et 8192 pixels, avec une aire maximale de 16 777 216 pixels — soit exactement un carré 4K. - Recherche externe optionnelle (
use_search_tool) : le modèle peut s'appuyer sur une recherche pour ancrer le visuel dans des informations à jour — pertinent pour des affiches produit ou du branding. - Entrées riches : jusqu'à 20 images de référence, 20 Mo maximum chacune.
- URLs temporaires de 12 heures : les images générées expirent, téléchargez vos assets immédiatement.
Petite contradiction à signaler, parce qu'elle compte : TechFlow évoque une sortie « jusqu'à 2K », quand la doc API autorise du 4K avec size explicite. Règle habituelle en pareil cas : la documentation technique, datée et précise, prime sur le billet d'annonce. Mais testez avant de promettre du 4K à votre client.
Le tarif, lui, ne souffre d'ambiguïté : 0,15 RMB par image 2K, soit environ 0,02 dollar au taux de septembre 2026, facturés uniquement sur les images effectivement générées. L'API est aussi disponible via Tencent Cloud TokenHub, MPS et VOD. À ce prix, le coût image devient un poste négligeable dans presque tout pipeline de production — c'est exactement le but.
Qwen-Image-2.1 : l'open-source comme vitrine, la licence comme douve
Alibaba a joué les deux tableaux pendant sa conférence : d'un côté des annonces fermées spectaculaires, de l'autre un release open-source — Qwen-Image-2.1, un modèle compact de 7B paramètres qui prétend, selon The Decoder, dépasser des modèles fermés en génération d'images.
Le package livré est plus intelligent qu'un simple dump de poids. Alibaba publie deux checkpoints de prompt-rewriting, PE-T2I pour le text-to-image et PE-I2I pour l'édition, fine-tunés depuis Qwen3.5-VL 9B. Leur rôle : prendre vos prompts courts et les expansion en prompts riches, ce qui change mécaniquement la qualité de sortie d'un modèle d'image. Côté édition, on parle de jusqu'à 10 images de référence, d'éditions locales par masque et d'un support du RGBA transparent, selon Mixed News.
Et c'est là que le bât blesse. Les Qwen-Image historiques étaient sous Apache 2.0 — vous pouviez les embarquer dans un produit commercial sans en demander la permission, comme le rappelle le dépôt GitHub officiel. Qwen-Image-2.1 passe sous Qwen Research License Agreement : « FOR NON-COMMERCIAL PURPOSES ONLY ». Recherche et évaluation, point final.
Ma lecture est sans détour : c'est de l'open-washing stratégique. Les poids ouverts servent à attirer les chercheurs, générer des benchmarks communautaires et nourrir l'écosystème — mais la licence empêche précisément le public qui télécharge des poids open-source, les développeurs, d'en faire un produit. La douve, elle, reste fermée.
La nuance qui sauve partiellement la donne : les anciens checkpoints Qwen-Image restent sous Apache 2.0. Si vous avez besoin de poids ouverts pour un usage commercial, la porte n'est pas fermée — elle est juste déplacée vers les versions précédentes. Et si l'écosystème open vous intéresse au-delà des licences, notez que Stanford vient de libérer GPIC, 28 trillions de pixels pour entraîner les modèles de génération d'images : les données ouvertes avancent aussi.
| Hy Image 3.5 Preview (Tencent) | Qwen-Image-2.1 (Alibaba) | |
|---|---|---|
| Statut | API fermée (preview) | Poids ouverts (recherche) |
| Architecture | Non communiquée | 7B + checkpoints 9B de prompt-rewriting |
| Images de référence | 5 (produit) / 20 (API) | Jusqu'à 10 (édition) |
| Résolution max | 4096×4096 via size explicite |
Non communiquée |
| Édition | Multi-tours conversationnelle | Locale par masque |
| Prix | 0,15 RMB/image 2K | Gratuit (auto-hébergé) |
| Licence | Propriétaire | Non-commercial uniquement |
Le tableau de bord : où sont vraiment les modèles chinois ?
Réponse courte : pas dans le top 10 des classements publics de génération d'images — et c'est précisément là que se loge toute l'ambiguïté de cette guerre. D'un côté des claims internes flatteurs, de l'autre des leaderboards indépendants où aucun modèle chinois n'apparaît.
Voici l'état des lieux des classements publics consultés à date (septembre 2026, vérifiez les classements à jour) :
| Modèle | Éditeur | Score |
|---|---|---|
| gpt-image-2 (medium) | OpenAI | 1398 |
| gemini-3.1-flash-image-preview (nano-banana-2, web search) | 1268 | |
| gemini-3-pro-image-preview-2k (nano-banana-pro) | 1242 | |
| gpt-image-1.5-high-fidelity | OpenAI | 1240 |
| gemini-3-pro-image-preview (nano-banana-pro) | 1232 | |
| grok-imagine-image-quality | xAI | 1223 |
| uni-1.1-max | Luma AI | 1207 |
| uni-1.1 | Luma AI | 1190 |
| mai-image-2 | Microsoft AI | 1181 |
| reve-v1.5 | Reve | 1177 |
Trois lectures s'imposent. D'abord, OpenAI domine avec un écart de près de 130 points sur le deuxième — ce n'est pas un écart, c'est un fossé. Ensuite, Google sature le classement avec trois modèles, et le plus intéressant n'est pas un Pro : c'est nano-banana-2 avec recherche web (1268), qui dépasse ses propres variantes Pro. Le grounding web paie, littéralement.
Enfin, l'absence chinoise. Tencent revendique la parité avec Seedream 5.0 Pro et l'avantage sur Nano Banana Pro — un modèle qui pointe ici à 1242. Soit les modèles chinois ne sont pas soumis à ces classements, soit les évaluations indépendantes ne les ont pas encore intégrés, soit les claims internes sont optimistes. Les trois hypothèses se défendent ; aucune n'est vérifiable aujourd'hui.
C'est le point de vigilance central de cette actualité : la Chine se bat sur des benchmarks internes, l'Occident sur des arènes publiques. Notre comparatif des meilleures IA de génération d'images sera mis à jour dès qu'une évaluation indépendante de Hy Image 3.5 sortira — en attendant, tout classement chinois est une déclaration, pas une mesure. Pour le contexte plus large, AI Weekly suit ces lancements au fil de l'eau.
Trois scénarios concrets pour en profiter dès maintenant
Ces deux lancements ne sont pas que du spectacle : il y a des décisions pratiques à prendre cette semaine, selon votre profil.
1. Vous gérez des visuels e-commerce ou marketing. C'est le terrain de chasse déclaré de Hy Image 3.5 : affiches, visuels de marque, catalogues. Avec 5 images de référence par requête et 0,15 RMB l'image 2K, générer 1 000 déclinaisons produit coûte environ 150 RMB — moins de 20 euros. À ce tarif, le vrai coût n'est plus la génération, c'est la curation. Pour structurer cette chaîne, voyez nos outils IA pour le marketing.
2. Vous êtes designer produit ou UI. L'édition conversationnelle multi-tours change la manière de travailler : on itère sur un mockup comme avec un collègue junior infatigable, en réinjectant l'image précédente avec une correction. La sortie synchrone rend ce flux utilisable dans un outil interactif — pas dans un pipeline batch. Les storyboards et l'UI design sont explicitement cités par Tencent comme cibles.
3. Vous êtes développeur et voulez construire dessus. Le protocole Messages fait presque tout le travail : votre couche d'orchestration LLM existante pilote le modèle d'image. Deux précautions non négociables : téléchargez immédiatement les images (URLs valables 12 h) et abstrayez le fournisseur, car vous êtes sur une preview. Pour explorer sans budget, notre sélection d'IA d'images gratuites fait le job, et pour publier un portfolio de vos tests, un hébergement simple comme Hostinger suffit largement.
❌ Erreurs courantes
Erreur 1 : prendre les « +30 % » pour argent comptant
Ce chiffre vient de tests GSB en aveugle menés par des designers internes à Tencent, sur des comparaisons contre la version précédente et des concurrents. Aucune évaluation indépendante ne le confirme. La solution : construisez votre propre jeu de 20 à 50 prompts représentatifs de vos cas d'usage, faites évaluer les résultats en aveugle par votre équipe, et laissez vos données parler.
Erreur 2 : bâtir un produit sur une API « Preview » sans plan B
Le model ID contient « preview » pour une raison : le comportement, les prix et même la disponibilité peuvent changer sans préavis. Solution : isolez le fournisseur derrière une couche d'abstraction, conservez vos historiques de conversation portables (le protocole Messages aide), et gardez un second modèle testé en parallèle.
Erreur 3 : déployer Qwen-Image-2.1 en production sans lire la licence
La licence Qwen Research Agreement est explicite : usage non-commercial uniquement. L'intégrer dans un produit payant vous expose juridiquement, même en auto-hébergement. Solution : si vous avez besoin de poids ouverts pour du commercial, repassez sur les Qwen-Image historiques sous Apache 2.0, ou assumez une API fermée.
Erreur 4 : ignorer les URLs temporaires et les limites de taille
Les images générées sont servies via des URLs valables 12 heures : si votre pipeline ne les télécharge pas immédiatement, vous perdez des assets. Et côté dimensions, l'aire maximale de 16 777 216 pixels avec des côtés entre 256 et 8192 px impose une validation en amont — sinon, erreurs API en production.
❓ Questions fréquentes
Hy Image 3.5 Preview est-il accessible depuis l'Europe ?
Le modèle passe par l'API Tencent Cloud, dont la documentation est publique, et il est intégré aux produits Tencent comme Yuanbao et ima. L'accès effectif depuis l'international dépend des conditions commerciales de Tencent Cloud et de la disponibilité régionale des endpoints. Vérifiez la disponibilité dans votre région avant d'engager un développement.
Combien coûte réellement une image avec Hy Image 3.5 ?
L'API est facturée 0,15 RMB par image 2K, soit environ 0,02 dollar au taux de septembre 2026, et uniquement sur les images effectivement générées. La facturation à l'usage, sans minimum annoncé, rend le coût marginal quasi nul pour des tests. Vérifiez la grille tarifaire actuelle sur Tencent Cloud avant d'engager un volume.
Peut-on utiliser Qwen-Image-2.1 dans un produit commercial ?
Non. Le modèle est sous Qwen Research License Agreement, explicitement limité aux usages non-commerciaux — recherche et évaluation uniquement. C'est une rupture avec l'Apache 2.0 des Qwen-Image précédents, qui restent utilisables commercialement. Pour un produit, votre option open-weight reste donc les checkpoints historiques.
Hy Image 3.5 Preview bat-il Nano Banana Pro ?
Selon les tests GSB internes de Tencent, légèrement — mais aucune évaluation indépendante ne le confirme à ce stade. Sur les classements publics consultés en septembre 2026, nano-banana-pro tourne autour de 1242, sans modèle chinois au top 10. La seule réponse fiable : testez les deux sur vos propres cas d'usage.
Qu'est-ce que la méthodologie GSB mentionnée par Tencent ?
GSB signifie Good/Same/Bad : des évaluateurs comparent deux images produites à partir du même prompt, sans savoir qui les a générées, et votent « mieux », « égal » ou « pire ». C'est une méthodologie solide pour mesurer la progression entre deux versions d'un même modèle, mais nettement moins fiable pour comparer deux éditeurs concurrents.
✅ Conclusion
En une seule journée, le 22 septembre 2026, la Chine a montré les trois armes de sa guerre de l'image générative : le timing calibré sur le concurrent, le prix cassé et la licence qui se resserre — à vous de jouer maintenant, en testant par vous-même plutôt qu'en croyant les benchmarks internes ; pour choisir le modèle adapté à vos usages, commencez par notre comparatif des meilleures IA de génération d'images et suivez les nouveautés IA du moment.