AMD a publié Instella-MoE-16B-A3B, un modèle de langage mixte d'experts entièrement ouvert, formé à partir de zéro sur les GPU Instinct MI300X et MI325X. Il contient 16 milliards de paramètres au total mais n'en active que 2,8 milliards par jeton, en utilisant Gated MLA…
Les prix des jetons fixent le plancher des marges de chaque produit d’IA. Lorsqu’un fournisseur modifie ses tarifs, cela se répercute sur ses concurrents, sur ses choix de routage et sur le coût de chaque fonctionnalité en aval.
Les résumés sont regroupés à titre d’information uniquement – suivez le lien source pour l’histoire complète. Les entrées de démonstration sont illustratives.