Edição dos dados
2026-09Publicado ·
Escopo da decisão automatizada
20 na verificação automatizada / 79 modelos do catálogoData-limite dos dados · 2026-08-30
Cobertura do ciclo de vida
36 estados de ciclo de vida documentados / 79 · 20 no escopo da automaçãoData-limite dos dados · 2026-08-30
06 · CLASSIFICAÇÃO POR TAREFA

Trabalho em chinês e multilíngue

Redação, tradução, localização e tarefas em vários idiomas com prioridade para o chinês.

Versão oficial
0
Evidência pública
0
Data-limite dos dados
Por que estes candidatos
Assumption · Historical. Comece com provedores que publiquem linhas de modelos voltadas ao chinês ou multilíngues e depois avalie a terminologia e a linguagem regional com suas próprias amostras.
O que permanece incerto
A classificação pública geral não é um benchmark de língua chinesa; a qualidade no idioma deve ser testada diretamente.
Candidato inicial

Três versões oficiais para testar primeiro

Os dados públicos delimitam as opções. Eles não substituem um teste controlado no seu próprio trabalho. Selecione dois ou três candidatos para comparar dados públicos lado a lado.

0 / 3

Unknown · Not automatically certified

No momento, nenhum resultado público comparável está mapeado para esta versão exata.

Todos os rankings por tarefa
Evidência públicaOs modelos usam escalas diferentes de evidências públicas. Evidências ausentes não são tratadas como zero, e o OpenGPT não combina fontes distintas em uma só pontuação.
Um ponto de partida prático, não um vencedor universalSelecione dois ou três candidatos para comparar dados públicos lado a lado.

Os modelos usam escalas diferentes de evidências públicas. Evidências ausentes não são tratadas como zero, e o OpenGPT não combina fontes distintas em uma só pontuação.

A classificação pública geral não é um benchmark de língua chinesa; a qualidade no idioma deve ser testada diretamente.

A avaliação é aberta com este modelo de tarefa e os dois primeiros modelos selecionados. Você pode editar todas as tarefas antes de coletar respostas.