Google a publié Gemini 3.5 Transcribe, un modèle de synthèse vocale livré sous forme de deux points de terminaison distincts plutôt qu'un seul. Le point de terminaison de streaming fournit une transcription en moins d'une seconde, mais supprime la diarisation du locuteur et la synchronisation des mots…
Les nouveaux modèles repoussent les limites des capacités et du rapport qualité-prix. Les équipes réévaluent les éléments sur lesquels s'appuyer chaque fois qu'un lancement modifie ce qui est possible par dollar.
Entreprises et modèles mentionnés dans cette histoire — ouvrez leurs pages et prix en direct
Les résumés sont regroupés à titre d’information uniquement – suivez le lien source pour l’histoire complète. Les entrées de démonstration sont illustratives.