L'équipe Hy de Tencent a publié Hy3, un modèle de mélange d'experts (MoE) de 295 milliards qui n'active que 21 milliards de paramètres par jeton. Il est livré sous Apache 2.0 avec une fenêtre contextuelle de 256 Ko, ciblant les tâches de raisonnement, d'agent et de contexte long…
Les prix des jetons fixent le plancher des marges de chaque produit d’IA. Lorsqu’un fournisseur modifie ses tarifs, cela se répercute sur ses concurrents, sur ses choix de routage et sur le coût de chaque fonctionnalité en aval.
Les résumés sont regroupés à titre d’information uniquement – suivez le lien source pour l’histoire complète. Les entrées de démonstration sont illustratives.