Mesmo o melhor modelo de IA falha no trabalho de conhecimento realista, solucionando apenas 3% das tarefas. O artigo Novo benchmark expõe como a IA luta terrivelmente com o trabalho de conhecimento real apareceu primeiro no The Decoder.
Novos modelos redefinem a fronteira de capacidade e preço-desempenho. As equipes reavaliam o que desenvolver sempre que um lançamento muda o que é possível por dólar.
Os resumos são agregados apenas para fins informativos – siga o link da fonte para ver a história completa. As entradas de demonstração são ilustrativas.