영국 AI 보안 연구소(UK AI Security Institute)의 연구원들은 심리학적 방법을 사용하여 언어 모델에 대한 인기 있는 안전 벤치마크가 하나의 일관된 특성을 측정하지 않는다는 것을 보여주었습니다. 요청의 전면 차단은 인위적으로 부풀릴 수 있습니다…
새로운 모델은 기능과 가격 대비 성능의 경계를 재설정합니다. 팀은 출시로 인해 달러당 가능한 것이 바뀔 때마다 무엇을 구축할지 재평가합니다.
요약은 정보 제공 목적으로만 집계되었습니다. 전체 내용을 보려면 소스 링크를 따르세요. 데모 항목은 예시입니다.