PerceptionBench von Moonshot AI testet, wie gut multimodale KI-Modelle tatsächlich „sehen“ können, getrennt vom logischen Denken. Kein Grenzmodell erreicht eine Genauigkeit von 60 Prozent und GPT-5.6 Sol führt mit knappem Vorsprung. Viele vermuten…
Neue Modelle setzen die Leistungs- und Preis-Leistungs-Grenze neu. Die Teams bewerten neu, worauf sie aufbauen können, wenn eine Markteinführung das Mögliche pro Dollar verändert.
In dieser Geschichte erwähnte Unternehmen und Modelle – öffnen Sie ihre Seiten und sehen Sie die aktuellen Preise
Zusammenfassungen werden nur zu Informationszwecken aggregiert – folgen Sie dem Quelllink für die vollständige Geschichte. Demo-Einträge dienen der Veranschaulichung.