Miso Labs hat MisoTTS veröffentlicht, ein 8B-Text-to-Speech-Modell mit offenen Gewichten. Es verwendet Restvektorquantisierung (RVQ), um seinen Klangbereich ohne Skalierungsparameter zu skalieren, und Bedingungen sowohl für den Text- als auch für den Audiokontext, um …
Open-Weights verringern den Preisdruck und erweitern den Zugang, wodurch sich die Build-vs-Buy-Mathematik für das gesamte Ökosystem ändert.
Zusammenfassungen werden nur zu Informationszwecken aggregiert – folgen Sie dem Quelllink für die vollständige Geschichte. Demo-Einträge dienen der Veranschaulichung.