Microsoft AI a publié MAI-Transcribe-2-Streaming, son premier modèle de synthèse vocale en temps réel. Il se classe n°1 sur 38 modèles sur l’analyse artificielle AA-WER Streaming. Il obtient 2,5% WER à 0,13s sur les transcriptions finales et 2,5%…
Les nouveaux modèles repoussent les limites des capacités et du rapport qualité-prix. Les équipes réévaluent les éléments sur lesquels s'appuyer chaque fois qu'un lancement modifie ce qui est possible par dollar.
Entreprises et modèles mentionnés dans cette histoire — ouvrez leurs pages et prix en direct
Les résumés sont regroupés à titre d’information uniquement – suivez le lien source pour l’histoire complète. Les entrées de démonstration sont illustratives.