Para peneliti di Institut Keamanan AI Inggris menggunakan metode psikometri untuk menunjukkan bahwa tolok ukur keamanan populer untuk model bahasa tidak mengukur satu sifat yang konsisten. Pemblokiran permintaan secara menyeluruh dapat membengkak secara artifisial…
Model-model baru mengatur ulang batas kemampuan dan harga-kinerja. Tim mengevaluasi kembali apa yang harus dikembangkan setiap kali peluncuran mengubah apa yang mungkin dilakukan per dolar.
Ringkasan dikumpulkan untuk informasi saja — ikuti tautan sumber untuk cerita selengkapnya. Entri demo bersifat ilustratif.