Selbst die besten AI-Modelle versagen bei realistischer Wissensarbeit und lösen nur 3 Prozent der Aufgaben vollständig. Der Artikel „Neuer Benchmark zeigt, wie schlecht KI mit realistischer Wissensarbeit kämpft“ erschien zuerst auf The Decoder.
Neue Modelle setzen die Leistungs- und Preis-Leistungs-Grenze neu. Die Teams bewerten neu, worauf sie aufbauen können, wenn eine Markteinführung das Mögliche pro Dollar verändert.
Zusammenfassungen werden nur zu Informationszwecken aggregiert – folgen Sie dem Quelllink für die vollständige Geschichte. Demo-Einträge dienen der Veranschaulichung.