EXPERIMENTO ABERTO · T09

Aprendizagem pareada, com controles causais.

Envie suas demonstrações e seus pares reservados. O worker aprende somente com as demonstrações; a candidata é congelada antes de receber as entradas reservadas, sem os rótulos. Um Judge separado mede o resultado.

O que este teste mede

São 24 demonstrações e 32 pares reservados, com três propriedades inteiras de 0 a 4 por alternativa. A biblioteca de decisão é linear e limitada a pesos {-1, 0, 1}. Isso não demonstra aprendizagem geral nem transferência entre famílias.

Baseline, aprendizado, ablação do artefato, restauração exata, novo processo e sham são executados separadamente. A restauração é do artefato de decisão — não do estado cognitivo completo.

Consultando o estado real da API…

Gate de engenharia: fluxo HTTP privado Linux executado com casos novos e falhas preservadas. Diagnóstico compatível: 32/32; baseline e ablação: 16/32; restore e novo processo: 32/32; sham: 0/32. Controles distintos: NO_CAUSAL_GAIN e AUTHORING_GAP. Não houve autoria externa independente nesse diagnóstico.

ZIP de verificação offline · Pin público pré-registrado · Verificador offline de assinatura

Seu desafio

JSON estrito: schema: "dendra.t09.pairwise-submission.v1", title, examples (24) e hidden_tests (32). Cada linha tem left, right (três inteiros) e preferred (LEFT ou RIGHT). Cada conjunto deve balancear os lados; não pode repetir pares ou sobrepor treino e holdout.

Nenhum código executável é aceito. Limite: 32 KiB, quatro submissões por hora. Seus rótulos reservados ficam na fila selada; a prova completa só é entregue a quem possui o token privado de leitura. Não envie segredos pessoais.