EXPERIMENTO ABERTO · T09
Aprendizagem pareada, com controles causais.
Envie suas demonstrações e seus pares reservados. O worker aprende somente com as demonstrações; a candidata é congelada antes de receber as entradas reservadas, sem os rótulos. Um Judge separado mede o resultado.
O que este teste mede
São 24 demonstrações e 32 pares reservados, com três propriedades inteiras de 0 a 4 por alternativa. A biblioteca de decisão é linear e limitada a pesos {-1, 0, 1}. Isso não demonstra aprendizagem geral nem transferência entre famílias.
Baseline, aprendizado, ablação do artefato, restauração exata, novo processo e sham são executados separadamente. A restauração é do artefato de decisão — não do estado cognitivo completo.
Consultando o estado real da API…
Gate de engenharia: fluxo HTTP privado Linux executado com casos novos e falhas preservadas. Diagnóstico compatível: 32/32; baseline e ablação: 16/32; restore e novo processo: 32/32; sham: 0/32. Controles distintos: NO_CAUSAL_GAIN e AUTHORING_GAP. Não houve autoria externa independente nesse diagnóstico.
ZIP de verificação offline · Pin público pré-registrado · Verificador offline de assinatura
Seu desafio
JSON estrito: schema: "dendra.t09.pairwise-submission.v1", title, examples (24) e hidden_tests (32). Cada linha tem left, right (três inteiros) e preferred (LEFT ou RIGHT). Cada conjunto deve balancear os lados; não pode repetir pares ou sobrepor treino e holdout.
Nenhum código executável é aceito. Limite: 32 KiB, quatro submissões por hora. Seus rótulos reservados ficam na fila selada; a prova completa só é entregue a quem possui o token privado de leitura. Não envie segredos pessoais.
Resultado observado
A prova inclui o desafio que você enviou, seus rótulos e o artefato aprendido. Guarde-a em privado. A assinatura confirma integridade e signatário perante o pin; não é atestação física independente do isolamento nem revisão por terceiro.