04 · 작업별 순위

문서 및 근거 기반 Q&A

긴 문서, 요약, 인용과 제공된 문서에 한정한 답변.

공식 버전
3
공개 근거
1
데이터 기준일:
후보 선정 이유
긴 맥락이나 기업 검색용 모델을 비교한 뒤 실제 문서에서 인용과 거부 동작을 확인합니다.
추가로 확인할 점
컨텍스트 길이만으로 검색 품질이나 긴 문서에 대한 충실도를 알 수 없습니다.
공개 근거
종합 능력
데이터 기준일
시작 후보

먼저 시험할 공식 버전 3개

공개 데이터는 후보를 좁히는 출발점이며 실제 작업 비교를 대신하지 않습니다.

3 / 3
시작 후보 1

Gemini 3.1 Pro

미리 보기
gemini-3.1-pro-preview

Google이 정확한 버전에 연결된 비교 가능한 공개 결과가 현재 없습니다.

공식 사이트
시작 후보 2

Claude Fable 5

안정 버전
claude-fable-5

Anthropic종합 능력 · #1

공식 사이트
시작 후보 3

Command A+

안정 버전
command-a-plus-05-2026

Cohere이 정확한 버전에 연결된 비교 가능한 공개 결과가 현재 없습니다.

공식 사이트
공개 근거공개 자료는 서로 다른 척도를 사용합니다. 누락 값을 0으로 처리하지 않고 서로 다른 출처를 하나의 점수로 합치지 않습니다.

Gemini 3.1 Pro

이 정확한 버전에 연결된 비교 가능한 공개 결과가 현재 없습니다.

Command A+

이 정확한 버전에 연결된 비교 가능한 공개 결과가 현재 없습니다.

만능 우승자가 아닌 실제 검증의 출발점후보 2~3개를 선택해 공개 데이터를 나란히 비교하세요.

공개 자료는 서로 다른 척도를 사용합니다. 누락 값을 0으로 처리하지 않고 서로 다른 출처를 하나의 점수로 합치지 않습니다.

컨텍스트 길이만으로 검색 품질이나 긴 문서에 대한 충실도를 알 수 없습니다.

이 작업 템플릿과 선택한 첫 두 후보를 미리 선택해 엽니다. 답변 수집 전에 모든 작업을 편집할 수 있습니다.