OpenAI는 API에 두 가지 실시간 모델을 추가했습니다. GPT-Realtime-2.1-mini는 음성용 미니 추론 모델로 가격은 이전 gpt-realtime-mini와 비슷합니다. OpenAI는 또한 향상된 캐싱을 통해 p95 대기 시간을 25% 이상 줄였습니다. 그…
컴퓨팅 공급, 에너지 및 데이터 센터 용량은 AI를 얼마나 저렴하게 실행할 수 있는지를 결정합니다. 인프라 변화는 몇 주 후에 추론 비용에 나타납니다.
이 이야기에 언급된 회사 및 모델 — 페이지를 열고 실시간 가격을 확인하세요.
요약은 정보 제공 목적으로만 집계되었습니다. 전체 내용을 보려면 소스 링크를 따르세요. 데모 항목은 예시입니다.