AMD는 Instinct MI300X 및 MI325X GPU에서 처음부터 훈련된 완전 개방형 전문가 혼합 언어 모델인 Instella-MoE-16B-A3B를 출시했습니다. 총 16B 매개변수를 보유하지만 Gated MLA를 사용하여 토큰당 2.8B만 활성화합니다.
토큰 가격은 모든 AI 제품의 마진에 대한 하한선을 설정합니다. 공급자가 가격을 이동하면 경쟁사, 라우팅 선택 및 모든 다운스트림 기능의 비용에 파급됩니다.
요약은 정보 제공 목적으로만 집계되었습니다. 전체 내용을 보려면 소스 링크를 따르세요. 데모 항목은 예시입니다.