Edição dos dados
2026-09Publicado ·
Escopo da decisão automatizada
20 na verificação automatizada / 79 modelos do catálogoData-limite dos dados · 2026-08-30
Cobertura do ciclo de vida
36 estados de ciclo de vida documentados / 79 · 20 no escopo da automaçãoData-limite dos dados · 2026-08-30
02 · CLASSIFICAÇÃO POR TAREFA

Programação e depuração

Implementação, análise de defeitos, testes e concessões técnicas.

Versão oficial
0
Evidência pública
0
Data-limite dos dados
Por que estes candidatos
Assumption · Historical. Use a cobertura de tarefas objetivas como sinal inicial e inclua uma versão oficial específica para programação nos testes diretos.
O que permanece incerto
A classificação pública de tarefas objetivas é mais ampla que programação; o contexto do repositório e o acesso às ferramentas podem alterar o resultado.
Candidato inicial

Três versões oficiais para testar primeiro

Os dados públicos delimitam as opções. Eles não substituem um teste controlado no seu próprio trabalho. Selecione dois ou três candidatos para comparar dados públicos lado a lado.

0 / 3

Unknown · Not automatically certified

No momento, nenhum resultado público comparável está mapeado para esta versão exata.

Todos os rankings por tarefa
Evidência públicaOs modelos usam escalas diferentes de evidências públicas. Evidências ausentes não são tratadas como zero, e o OpenGPT não combina fontes distintas em uma só pontuação.
Um ponto de partida prático, não um vencedor universalSelecione dois ou três candidatos para comparar dados públicos lado a lado.

Os modelos usam escalas diferentes de evidências públicas. Evidências ausentes não são tratadas como zero, e o OpenGPT não combina fontes distintas em uma só pontuação.

A classificação pública de tarefas objetivas é mais ampla que programação; o contexto do repositório e o acesso às ferramentas podem alterar o resultado.

A avaliação é aberta com este modelo de tarefa e os dois primeiros modelos selecionados. Você pode editar todas as tarefas antes de coletar respostas.