O Google lançou o Gemini 3.5 Transcribe, um modelo de fala para texto fornecido como dois endpoints separados, em vez de um. O endpoint de streaming oferece transcrição em menos de um segundo, mas elimina a diarização do alto-falante e o tempo de palavra…
Novos modelos redefinem a fronteira de capacidade e preço-desempenho. As equipes reavaliam o que desenvolver sempre que um lançamento muda o que é possível por dólar.
Empresas e modelos mencionados nesta história – abra suas páginas e preços ao vivo
Os resumos são agregados apenas para fins informativos – siga o link da fonte para ver a história completa. As entradas de demonstração são ilustrativas.