OpenAI kontert den ARC-AGI-3-Rekord von Anthropic: GPT-5.6 Sol erreicht 38,3 Prozent, allerdings nur mit eigenen API-Features statt mit dem offiziellen Testaufbau, wo das Modell bei 7,8 Prozent landete. ARC Prize beansprucht seine Testumgebung…
Neue Modelle setzen die Leistungs- und Preis-Leistungs-Grenze neu. Die Teams bewerten neu, worauf sie aufbauen können, wenn eine Markteinführung das Mögliche pro Dollar verändert.
In dieser Geschichte erwähnte Unternehmen und Modelle – öffnen Sie ihre Seiten und sehen Sie die aktuellen Preise
Zusammenfassungen werden nur zu Informationszwecken aggregiert – folgen Sie dem Quelllink für die vollständige Geschichte. Demo-Einträge dienen der Veranschaulichung.