터미널 벤치 57.9%…오픈AI 평가표서 GPT-6 아스트라, 클로드 앞서
오픈AI의 GPT-6 아스트라가 코딩 벤치마크에서 앤트로픽의 클로드 페이블 5.1보다 높은 점수를 기록했다. 다만 두 회사가 공개한 자체 평가 결과만으로 폐쇄형 모델과 오픈소스·오픈웨이트 모델 전체의 성능 격차를 판단하기는 어렵다.
요약은 원문을 바탕으로 AI가 작성했어요. 투자 조언이 아닙니다.
오픈AI의 GPT-6 아스트라가 코딩 벤치마크에서 앤트로픽의 클로드 페이블 5.1보다 높은 점수를 기록했다. 다만 두 회사가 공개한 자체 평가 결과만으로 폐쇄형 모델과 오픈소스·오픈웨이트 모델 전체의 성능 격차를 판단하기는 어렵다.
요약은 원문을 바탕으로 AI가 작성했어요. 투자 조언이 아닙니다.