Prime Intellect hat Prime Inference auf den Markt gebracht, eine OpenAI-kompatible Plattform zur Bereitstellung offener Frontier-Modelle auf NVIDIA Blackwell. Die GLM-5.3-Bereitstellung nutzt Dynamo-, vLLM- und NVFP4-KV-Komprimierung, um 66 Sitzungen pro Sekunde zu bedienen.
Open-Weights verringern den Preisdruck und erweitern den Zugang, wodurch sich die Build-vs-Buy-Mathematik für das gesamte Ökosystem ändert.
In dieser Geschichte erwähnte Unternehmen und Modelle – öffnen Sie ihre Seiten und sehen Sie die aktuellen Preise
Zusammenfassungen werden nur zu Informationszwecken aggregiert – folgen Sie dem Quelllink für die vollständige Geschichte. Demo-Einträge dienen der Veranschaulichung.