Des chercheurs de l'AI Security Institute du Royaume-Uni ont utilisé des méthodes psychométriques pour montrer que les critères de sécurité populaires pour les modèles de langage ne mesurent pas un trait cohérent. Le blocage général des demandes peut gonfler artificiellement…
Les nouveaux modèles repoussent les limites des capacités et du rapport qualité-prix. Les équipes réévaluent les éléments sur lesquels s'appuyer chaque fois qu'un lancement modifie ce qui est possible par dollar.
Les résumés sont regroupés à titre d’information uniquement – suivez le lien source pour l’histoire complète. Les entrées de démonstration sont illustratives.