OpenAI는 Anthropic의 ARC-AGI-3 기록에 반격합니다. GPT-5.6 Sol은 38.3%를 기록했지만 모델이 7.8%에 도달한 공식 테스트 설정 대신 자체 API 기능만 사용했습니다. ARC Prize는 테스트 환경을 주장합니다…
새로운 모델은 기능과 가격 대비 성능의 경계를 재설정합니다. 팀은 출시로 인해 달러당 가능한 것이 바뀔 때마다 무엇을 구축할지 재평가합니다.
이 이야기에 언급된 회사 및 모델 — 페이지를 열고 실시간 가격을 확인하세요.
요약은 정보 제공 목적으로만 집계되었습니다. 전체 내용을 보려면 소스 링크를 따르세요. 데모 항목은 예시입니다.