OpenAI는 AI 모델의 프로그래밍 기술을 측정하기 위해 널리 사용되는 테스트인 SWE-Bench Pro를 검토한 결과 약 30%의 작업이 중단된 것으로 나타났습니다. 회사는 벤치마크에 대한 초기 승인을 철회하고 있습니다. …
새로운 모델은 기능과 가격 대비 성능의 경계를 재설정합니다. 팀은 출시로 인해 달러당 가능한 것이 바뀔 때마다 무엇을 구축할지 재평가합니다.
요약은 정보 제공 목적으로만 집계되었습니다. 전체 내용을 보려면 소스 링크를 따르세요. 데모 항목은 예시입니다.