Saaras V4 von Sarvam AI ist ein Speech-to-Text-Modell, das alle 22 indischen Sprachen sowie globales Englisch abdeckt. Es kombiniert einen Audio-Encoder mit einem 3B-Hybrid-State-Space-Decoder. Es fügt Schlüsselbegriff-Eingabeaufforderung für bis zu 50 Begriffe und 5 Ausgabemöglichkeiten hinzu.
Neue Modelle setzen die Leistungs- und Preis-Leistungs-Grenze neu. Die Teams bewerten neu, worauf sie aufbauen können, wenn eine Markteinführung das Mögliche pro Dollar verändert.
Zusammenfassungen werden nur zu Informationszwecken aggregiert – folgen Sie dem Quelllink für die vollständige Geschichte. Demo-Einträge dienen der Veranschaulichung.