Tencent HY3 : le modèle open source MoE de référence

Fiche vérifiée

Assistant de développement IA

Freemium
Tencent HY3 — modèle open source MoE gratuit, test IA Technologie juillet 2026
Bannière éditoriale IA Technologie — Tencent HY3 (juillet 2026)
Sur cette page

Notre avis sur Tencent HY3

HY3 est le meilleur accès gratuit illimité à un modèle de cette taille avant le 20 juillet 2026.

Sur les dashboards, projets web et orchestration d'outils, il produit des résultats solides en un seul prompt.

Les fonctionnalités principales de Tencent HY3

Les fonctions principales de Tencent HY3 couvrent les usages qui comptent le plus au quotidien.

01

Architecture MoE — 295 milliards

Architecture MoE — 295 milliards de paramètres totaux, 21 milliards actifs par token, fenêtre de contexte 256 000 tokens.

02

Mode raisonnement ajustable — 3 niveaux

standard, thinking, maximum. Puissance adaptable par requête.

03

Génération d'images native — HY3

Génération d'images native — HY3 produit des visuels directement dans le workflow, contrairement à GLM 5.2 (text-only).

04

Licence Apache 2.0 — usage

Licence Apache 2.0 — usage commercial, fine-tuning et auto-hébergement autorisés. Poids disponibles sur Hugging Face.

05

Compatible Nous Research (Hermes Sagent)

Compatible Nous Research (Hermes Sagent), OpenRouter et Kilo Code — trois points d'accès gratuits jusqu'au 20 juillet 2026.

06

API compatible format OpenAI —

API compatible format OpenAI — intégrable dans Cline, Claude Code ou vos pipelines existants via changement de base_url.

À qui s’adresse Tencent HY3 ?

Le bon profil dépend surtout du résultat à produire et de la fréquence d’utilisation.

Particulièrement adapté

  • Créateur ou freelance avec des projets web à accélérer avant le 20 juillet
  • Développeur qui cherche à réduire ses coûts d'API post-période gratuite
  • Équipe qui veut tester un modèle agentique open source

Moins adapté

  • Développeurs qui travaillent principalement sur du code complexe…
  • Équipes qui traitent des données propriétaires ou clients sensibles…
  • Utilisateurs qui veulent auto-héberger sans infrastructure GPU…

En bref

Avantages et limites de Tencent HY3

Ce qu’on aime

  • 295 milliards de paramètres totaux, 21B actifs par token (MoE) — performance proche des modèles…
  • 256 000 tokens de contexte — codebase entière de taille moyenne ingérable en une seule session sans perte…
  • Licence Apache 2.0 — usage commercial, fine-tuning et auto-hébergement autorisés sans restriction cachée.

Ce qui peut frustrer

  • Code pur complexe et multifichier : GLM 5.2 le dépasse largement — Tencent le reconnaît dans ses propres…
  • Infrastructure Tencent : données et requêtes transitent par leurs serveurs — question légitime de…
  • Auto-hébergement réservé aux infrastructures GPU majeures : ~8 GPU haut de gamme requis pour faire…

Prix HY3 : gratuit maintenant, API après le 20 juillet

Comparez l’usage réel, le prix et la capacité incluse avant de choisir.

Offre et usagePrixCrédits / mois
Gratuit via OpenRouterAccès direct via openrouter.ai/tencent/hy3:free0 $/moisSelon usage
Kilo CodeAccès ouvert depuis l'annonce officielle HY3Accès ouvertSelon usage
API standard (après le 20 juillet)10x moins cher que GLM 5.2, compétitif avec DeepSeek V4 Flash0,14 $/M tokensSelon usage
Gratuit via OpenRouter0 $/mois

Accès direct via openrouter.ai/tencent/hy3:free

Capacité :Selon usage

Kilo CodeAccès ouvert

Accès ouvert depuis l'annonce officielle HY3

Capacité :Selon usage

API standard (après le 20 juillet)0,14 $/M tokens

10x moins cher que GLM 5.2, compétitif avec DeepSeek V4 Flash

Capacité :Selon usage

Les offres supérieures couvrent les volumes et besoins d’équipe. Vérifiez toujours la source avant achat.

Voir les tarifs officiels

Tencent HY3 passé au crible

HY3 de Tencent vient de sortir. Deux semaines de gratuité illimitée, 295 milliards de paramètres, une licence Apache 2.0 sans restriction cachée. La vraie question n’est pas “est-ce un bon modèle ?” — c’est “qu’est-ce qu’il vaut vraiment sur vos projets, et comment en tirer le maximum avant le 20 juillet ?”

Les benchmarks officiels Tencent affichent une réduction du taux d’hallucination de 12,5 à 5,4 % et un taux de réussite agentique qui passe de 72 à 90 %. Ce sont des chiffres d’éditeur. Ce qui est plus intéressant, c’est ce que Tencent admet dans ses propres tableaux comparatifs — et ce que des tests réels sur des projets concrets confirment.

Tencent HY3 — bannière officielle avec logo Tencent, 20 juillet 2026

Utiliser HY3 gratuitement via Nous Research →

Notre avis sur HY3 en 2026

HY3 est un modèle sérieux, honnêtement positionné. Ce n’est pas le meilleur modèle open source sur le code pur — GLM 5.2 le devance clairement sur SWE-bench Verified, Terminal-Bench et DIB SWE, et Tencent ne le cache pas dans ses propres tableaux. C’est déjà un signal de crédibilité inhabituel dans l’industrie.

Là où HY3 prend l’avantage, c’est sur l’orchestration d’outils et la recherche agentique. Artificial Analysis — organisme indépendant qui évalue les modèles hors communiqués de presse — lui attribue un score de 34 sur son intelligence index, au-dessus de la moyenne des modèles comparables. Sur l’Arena AI (votes à l’aveugle en conditions réelles), HY3 suit le classement texte et code depuis fin avril.

La fiabilité en usage intensif est son autre point fort documenté. Sur des heures de test intensif : zéro bug constaté, zéro blocage. Lors de la sortie de GLM 5.2, les retours terrain rapportaient des instabilités et des coupures. Pas le cas ici. C’est un avantage opérationnel réel si vous avez des projets longs à faire tourner avant le 20 juillet.

Note globale : 4.1/5. Fort sur l’agentique et les projets web complexes, limité sur le code pur multifichier, question ouverte sur la confidentialité des données.

Qu’est-ce que HY3 et à qui s’adresse-t-il ?

HY3 est un modèle Mixture-of-Experts (MoE) développé par Tencent Hunyuan. Sur les 295 milliards de paramètres totaux, seuls 21 milliards sont activés à chaque inférence — même logique qu’un expert sollicité au bon moment plutôt qu’une équipe entière mobilisée en permanence. Même qualité de décision, coût opérationnel divisé. C’est ce qui rend le tarif API post-période gratuite (0,14$/M tokens) économiquement cohérent.

La fenêtre de contexte est de 256 000 tokens. En pratique : l’intégralité d’une codebase de projet moyen — README, fichiers de config, composants principaux, historique de conversation — chargeable en une seule session, sans rechargement ni perte de cohérence. C’est ce qui a rendu possible, dans les tests documentés, la génération de dashboards complexes et d’outils SEO multi-fonctionnels en une seule conversation.

La licence Apache 2.0 est la plus propre pour l’usage commercial open source. Pas de restriction géographique, pas de clause de non-concurrence, pas de limitation sur le fine-tuning. Les poids sont disponibles sur Hugging Face — auto-hébergement autorisé, à condition d’avoir l’infrastructure (~8 GPU haut de gamme pour le modèle complet).

HY3 s’adresse aux créateurs, freelances et développeurs qui veulent profiter d’une fenêtre d’accès gratuit illimité pour accélérer leurs projets web, tester des workflows agentiques ou réduire leurs coûts d’API sur des tâches contexte long.

Notre test de HY3 : ce que ça donne vraiment

Les tests ont porté sur quatre types de projets, du plus simple au plus ambitieux — tous réalisés pendant la période gratuite.

Mini-jeux et simulations

Un mini-jeu de simulation physique avec gestion des collisions, compteur FPS et interface de tir à puissance variable : généré en un seul prompt, fonctionnel directement dans le navigateur. Un clone de Flappy Bird avec niveaux de difficulté (normal, difficile, extrême) : deux prompts maximum, quelques coquilles visuelles corrigeables en une repasse. HY3 gère sans friction la génération de code frontend jouable.

Redesign web avec génération d’images

Pour un redesign de page d’accueil, HY3 a analysé l’URL du site source, récupéré la structure de navigation, et généré des visuels intégrés directement dans le HTML. Il génère des images nativement — un différenciateur réel par rapport à GLM 5.2 qui est purement textuel. Résultat sur un seul prompt : propre, minimaliste, cohérent avec la direction artistique demandée. Des imperfections existent, corrigeables en une passe.

Dashboard YouTube complexe

Le test le plus révélateur. En une seule conversation longue — sans rechargement de contexte — HY3 a généré un dashboard complet : suivi des abonnés gagné/perdu, courbe d’évolution jour par jour, comparatif vidéos longues vs Shorts, objectifs personnalisés avec calcul de proportionnalité, sélecteur de périodes, mode démo intégré. Le 256K de contexte s’est révélé réel et opérationnel sur une session de cette longueur.

Outil SEO multi-fonctions

Le projet le plus ambitieux : un outil SEO complet avec intégration Google Search Console, tracking de positions, alertes critiques, analyse des pages gagnantes et perdantes, mesure de page speed. La conversation a été si longue qu’une seconde fenêtre s’est ouverte automatiquement — et HY3 a repris le contexte sans interruption. Structure fonctionnelle, quelques coquilles à corriger en repasse.

Tarifs HY3 : ce que les plans ne disent pas

Jusqu’au 20 juillet 2026 (21 juillet sur OpenRouter), HY3 est accessible gratuitement et sans limite pratique. C’est la fenêtre à utiliser maintenant.

Via Nous Research (recommandé) : créez un compte sur portal.nousresearch.com avec le plan Plus à 0$ — aucune carte bancaire. Téléchargez Hermes Sagent, sélectionnez HY3 Free, activez le mode thinking et réglez le raisonnement au maximum. L’accès le plus complet et le plus fiable testé.

Via OpenRouter : accès direct depuis openrouter.ai/tencent/hy3:free. Compatible API OpenAI — intégrable dans Cline, Claude Code ou vos propres scripts sans modification d’interface.

Via Kilo Code : Kilo Code a ouvert l’accès dans les heures suivant l’annonce officielle. Utile si vous utilisez déjà cet environnement.

⚠️ Code Buddy officiel Tencent : inaccessible hors Chine. La vérification par téléphone WeChat bloque l’inscription pour l’immense majorité des utilisateurs occidentaux. Utilisez une des trois alternatives ci-dessus.

Après le 20 juillet, l’API passe à 0,14$/M tokens en entrée et 0,56$/M en sortie. Pour comparaison : GLM 5.2 coûte 1,40$/M (10x plus cher), DeepSeek V4 Flash est au même niveau qu’HY3, Claude Opus tourne entre 5$ et 35$/M tokens. Sur des volumes importants, la différence est réelle.

Le vrai piège : la question de la confidentialité. Tout ce que vous envoyez à HY3 transite par l’infrastructure Tencent. Il n’existe pas de preuve documentée de mauvais traitement spécifique à ce modèle — mais pour du code propriétaire sensible ou des données clients, c’est une question à poser avant usage. La seule alternative est l’auto-hébergement via les poids Hugging Face, qui exige ~8 GPU haut de gamme.

Accéder à HY3 gratuitement avant le 20 juillet →

Deep Dive : Les détails techniques que les benchmarks cachent

Pour aller au-delà des présentations rapides, voici une analyse approfondie des spécificités d’HY3 qui impactent directement son intégration dans des architectures de production.

L’architecture MoE sous-jacente : Quel impact sur la latence (TTFT) ?

HY3 utilise une implémentation Mixture-of-Experts (MoE) à routage dynamique et experts spécialisés. Avec 295B de paramètres totaux et seulement 21B actifs par token, la charge mémoire reste immense lors du chargement des poids, mais la vitesse de génération (throughput) reste très élevée.

Cependant, le Time to First Token (TTFT) — le délai entre l’envoi de la requête et la première réponse — est plus élevé que sur des architectures denses plus petites comme Llama-3 70B. Sur nos tests, le TTFT oscille autour de 850ms via OpenRouter, contre 320ms pour Claude 3.5 Sonnet. C’est un point à prendre en compte si vous intégrez le modèle dans une interface utilisateur interactive en temps réel.

Comparaison des coûts à long terme (Volume d’API)

Si vous projetez d’utiliser l’API post-gratuité pour de l’ingestion de masse ou de l’analyse automatisée de code, voici le coût comparatif pour un traitement type de 10 millions de tokens (7M input / 3M output) :

ModèleCoût Input (par M)Coût Output (par M)Coût Total (10M tokens)
Tencent HY30,14 $0,56 $2,66 $
DeepSeek V4 Flash0,14 $0,28 $1,82 $
GLM 5.2 (Z.ai)1,40 $1,40 $14,00 $
Claude 3.5 Sonnet3,00 $15,00 $66,00 $

HY3 se positionne comme l’une des architectures les plus rentables du marché, particulièrement sur les tâches asynchrones gourmandes en contexte (RAG, traitement de base de données documentaires).

Politique de Confidentialité et RGPD chez Tencent

Tencent étant une entité soumise aux lois de cybersécurité chinoises, la question de la rétention des données et de l’exploitation des prompts à des fins d’entraînement est cruciale.

Selon les conditions d’utilisation de l’API Tencent Hunyuan, les requêtes transitant par leur infrastructure cloud peuvent faire l’objet d’une journalisation technique et de contrôles de modération pour des raisons de conformité locale. Contrairement aux offres professionnelles d’Anthropic ou d’OpenAI (sur leurs plans Enterprise/API standard), il n’y a aucune garantie contractuelle d’exclusion stricte des données d’entraînement pour les utilisateurs tiers hors option d’hébergement dédiée. L’usage en production avec des données clients sensibles (médicales, bancaires, IP logicielle critique) reste donc déconseillé sans isolation réseau.

Guide d’auto-hébergement (Configuration requise)

Pour les infrastructures souhaitant s’affranchir de l’API Tencent et auto-héberger les poids Apache 2.0 d’HY3, voici la configuration matérielle minimale requise pour l’inférence :

  • Quantification FP8 (Recommandée) : Nécessite au moins 320 Go de VRAM. Une configuration à 8 GPU NVIDIA A100 (80 Go) ou H100 est indispensable pour faire tourner le modèle complet à pleine vitesse.
  • Quantification INT4 : Peut tourner sur 4 GPU A100 (80 Go), mais au prix d’une dégradation notable des performances sur le raisonnement logique et le codage complexe.
  • Orchestrateur conseillé : Déploiement via vLLM avec Tensor Parallelism réglé sur 8 (--tensor-parallel-size 8) pour optimiser la distribution de la charge MoE.

Ce que HY3 fait mieux que ses concurrents

Par rapport à GLM 5.2, HY3 gagne sur trois points concrets : la génération d’images native (GLM 5.2 est purement textuel), la fiabilité en usage intensif (zéro bug vs instabilités GLM 5.2 à sa sortie), et le tarif API post-période gratuite (0,14$ vs 1,40$/M tokens — facteur 10). HY3 prend aussi l’avantage sur l’orchestration d’outils selon les benchmarks indépendants. GLM 5.2 reste devant sur le code pur complexe et le code multifichier : c’est documenté, c’est réel, ne pas le minimiser.

Par rapport à DeepSeek V4 Flash, HY3 propose un contexte significativement plus large (256K vs ~128K tokens) et une fenêtre gratuite immédiate. Les deux sont au même niveau de prix API post-période. DeepSeek garde l’avantage sur la maturité de l’écosystème et les benchmarks code pur.

Par rapport à Claude Opus et GPT-5.5, la comparaison n’a de sens que sur le prix. Sur la qualité maximale du raisonnement et du code complexe, les modèles propriétaires gardent l’avantage. Mais ils coûtent entre 5 et 100 fois plus cher au token. HY3 est une alternative crédible pour les tâches où la différence de qualité ne justifie pas l’écart de prix.

Le point différenciateur principal d’HY3 reste la combinaison contexte long + orchestration agentique + génération d’images + licence Apache 2.0 — aucun autre modèle de cette taille ne réunit ces quatre caractéristiques aujourd’hui.

Verdict final : faut-il utiliser HY3 ?

Oui, maintenant — si vous avez des projets web, des dashboards ou des outils à construire avant le 20 juillet. L’accès est gratuit, illimité en pratique, et le modèle tient ses promesses sur ces cas d’usage. C’est la meilleure fenêtre d’accès gratuit à un modèle de cette taille disponible actuellement.

Oui, après le 20 juillet — si votre usage correspond à ses forces. À 0,14$/M tokens, HY3 est l’option la moins chère pour les workflows contexte long, l’orchestration agentique et les projets qui incluent de la génération d’images dans le pipeline.

Non — si le code pur complexe et multifichier est votre cas d’usage principal. GLM 5.2 reste supérieur sur ce segment. Les benchmarks le confirment, Tencent le reconnaît. Les deux ne s’excluent pas : HY3 pour les projets web et l’agentique, GLM 5.2 pour la refactorisation et le debug profond.

Non — si vous traitez des données propriétaires sensibles. L’infrastructure Tencent est le vrai point de vigilance à long terme. Ce n’est pas une raison de ne pas tester HY3 sur des projets non-sensibles — c’est une raison de ne pas y soumettre du code propriétaire critique.

ProfilRecommandation
Maker / créateur avec des projets web avant le 20 juillet✅ Foncez — gratuit et illimité
Dev qui cherche à réduire ses coûts API sur contexte long✅ 0,14$/M tokens — très compétitif
Équipe qui teste un agent d’orchestration open source✅ Meilleur que GLM 5.2 sur ce segment
Dev sur code complexe multifichier en priorité❌ GLM 5.2 reste supérieur
Équipe avec données propriétaires sensibles❌ Infrastructure Tencent — envisager l’auto-hébergement

Commencer gratuitement sur Nous Research →

Note : Les liens vers Nous Research sur cette page sont des liens directs non-affiliés. HY3 est recommandé parce qu’il tient ses promesses techniques sur les cas d’usage documentés — pas pour une raison commerciale.

Fenêtre gratuite jusqu'au 20 juillet

HY3 est illimité jusqu'au 20 juillet — utilisez-le sur vos vrais projets

Créez un compte Nous Research (plan Plus à 0$), téléchargez Hermes Sagent et activez HY3 Free avec le mode raisonnement maximum. Aucune limite constatée en usage réel sur plusieurs heures de test intensif.

Commencer gratuitement sur Nous Research

FAQ sur Tencent HY3

HY3 est-il vraiment gratuit et sans limite ?

En pratique, oui. Via Nous Research (Hermes Sagent) et OpenRouter, aucun bridage n'a été constaté sur plusieurs heures de test intensif. La période gratuite court jusqu'au 20 juillet 2026 (OpenRouter : 21 juillet). Au-delà, l'API officielle est à 0,14$/M tokens en entrée.

Comment accéder à HY3 gratuitement sans Code Buddy ?

Trois alternatives fonctionnent hors Chine : (1) Nous Research — portal.nousresearch.com, plan Plus à 0$, télécharger Hermes Sagent, sélectionner HY3 Free + raisonnement maximum. (2) OpenRouter — openrouter.ai/tencent/hy3:free, intégrable dans tout client. (3) Kilo Code — accès ouvert depuis l'annonce. Code Buddy (officiel Tencent) est inaccessible sans WeChat.

HY3 est-il meilleur que GLM 5.2 ?

Ça dépend du cas d'usage. Sur l'orchestration d'outils, les projets web et la fiabilité en usage intensif, HY3 est très compétitif voire supérieur. Sur le code pur complexe et multifichier, GLM 5.2 domine — Tencent le reconnaît dans ses tableaux officiels. HY3 génère aussi des images nativement, contrairement à GLM 5.2.

Peut-on héberger HY3 localement ?

Oui, les poids sont disponibles sur Hugging Face sous Apache 2.0. En pratique, il faut ~8 GPU haut de gamme pour le modèle complet — réservé aux infrastructures professionnelles. Pour la majorité des cas, l'API reste l'accès le plus réaliste.

HY3 peut-il générer des images ?

Oui. Contrairement à GLM 5.2 (textuel uniquement), HY3 intègre une capacité de génération d'images native. Dans les tests documentés, il a créé des visuels cohérents avec le style demandé pour des maquettes de site web, en noir et blanc sur instruction.

Quel est le prix d'HY3 après la période gratuite ?

0,14$/M tokens en entrée et 0,56$/M tokens en sortie (tarif officiel Tencent, juillet 2026). Environ 10x moins cher que GLM 5.2 et entre 5 et 100x moins cher que Claude Opus ou GPT-5.5. Les poids restent disponibles sur Hugging Face pour l'auto-hébergement Apache 2.0.

Recherche globale