공개 순위 출처
LiveBench AI 모델 순위 데이터
OpenGPT는 LiveBench 공개 레코드 30개를 원래 출처 범위로 보존합니다. 재평가하거나 다른 벤치마크와 합치지 않습니다.
- 공개 레코드
- 30
- 순위 보기
- 객관적 과제 · 점수당 비용 · 오픈 웨이트
- 출처 데이터 날짜
- 수집일
근거 범위
LiveBench-2026-06-25. 46 published model configurations across twenty-three objective tasks and seven categories; questions refresh every six months.
OpenGPT의 근거 처리 방식
게시자의 이름, 순위, 구성, 날짜와 값을 같은 범위로 보존합니다. 누락값을 0으로 바꾸거나 출처 간 종합 점수를 만들지 않습니다.
비교 범위
- 순위와 값은 명시된 출처 릴리스와 범위 안에서만 비교할 수 있습니다.
- 공식 모델 ID 연결은 매핑 근거를 검토한 경우에만 제공합니다.
- 공개 순위는 후보 신호이며 실제 업무에서 정확한 버전을 검증해야 합니다.
LiveBench-2026-06-25
공개 30개 중 대표 18개를 표시합니다. 각 행에서 출처 ID와 매핑 근거를 확인할 수 있습니다.
- Claude Fable 5 Max EffortAnthropic · 객관적 과제#182.97Published benchmark configuration
- GPT-5.6 Sol Max EffortOpenAI · 객관적 과제#281.05Published benchmark configuration
- GPT-5.5 Thinking xHigh EffortOpenAI · 객관적 과제#380.19Published benchmark configuration
- Claude 5 Opus Thinking Max EffortAnthropic · 객관적 과제#480.08Published benchmark configuration
- Kimi K3Moonshot AI · 객관적 과제#579.19Published benchmark configuration
- Gemini 3.7 Flash HighGoogle · 객관적 과제#678.83Published benchmark configuration
- Grok Build 0.1xAI · 점수당 비용#1$0.0240Published benchmark configuration
- GLM-5.3 FlashZ.AI · 점수당 비용#2$0.0305Published benchmark configuration
- Qwen 3.8 Flash NextAlibaba · 점수당 비용#3$0.0423Published benchmark configuration
- DeepSeek V4 Pro 0813DeepSeek · 점수당 비용#4$0.0442Published benchmark configuration
- DeepSeek V4 Flash Vision ExpDeepSeek · 점수당 비용#5$0.0505Published benchmark configuration
- DeepSeek V4 Flash 0731DeepSeek · 점수당 비용#6$0.0596Published benchmark configuration
- Kimi K3Moonshot AI · 오픈 웨이트#179.19Open weights
- Qwen 3.8 MaxAlibaba · 오픈 웨이트#278.46Open weights
- DeepSeek V4 Pro 0813DeepSeek · 오픈 웨이트#377.44Open weights
- Qwen 3.8 Flash NextAlibaba · 오픈 웨이트#476.19Open weights
- GLM-5.3Z.AI · 오픈 웨이트#576.14Open weights
- Qwen3.8 27BAlibaba · 오픈 웨이트#675.27Open weights