Prime Intellect는 trillion-parameter Mixture-of-Experts 모델에서 비동기 강화학습을 위한 오픈 프레임워크인 prime-rl 0.6.0를 출시하였습니다. 이 프레임워크는 SWE 작업에서 GLM-5를 최대 131k 시퀀스 길이로 훈련했습니다.
새로운 모델은 기능과 가격 대비 성능의 경계를 재설정합니다. 팀은 출시로 인해 달러당 가능한 것이 바뀔 때마다 무엇을 구축할지 재평가합니다.
이 이야기에 언급된 회사 및 모델 — 페이지를 열고 실시간 가격을 확인하세요.
요약은 정보 제공 목적으로만 집계되었습니다. 전체 내용을 보려면 소스 링크를 따르세요. 데모 항목은 예시입니다.