Investigadores del Instituto de Seguridad de IA del Reino Unido utilizaron métodos psicométricos para demostrar que los puntos de referencia de seguridad populares para modelos de lenguaje no miden un rasgo consistente. El bloqueo general de solicitudes puede inflar artificialmente...
Los nuevos modelos restablecen la frontera entre capacidad y precio-rendimiento. Los equipos reevalúan sobre qué construir cada vez que un lanzamiento cambia lo que es posible por dólar.
Los resúmenes se agregan únicamente con fines informativos; siga el enlace fuente para ver la historia completa. Las entradas de demostración son ilustrativas.