Experimento dos Espelhos do Contexto
[!TIP] Baixe o ZIP do aluno ou copie todo este laboratório para uma pasta não utilizada. Leia a configuração e as etapas opcionais do GitHub primeiro.
Antes de executar qualquer coisa
| Item | Contrato |
|---|---|
| Runtime | Node 24; as integrações ao vivo são separadas |
| Arquivos para inspecionar | starter/, verify.js |
| Diretório do verificador | Raiz do kit extraído: node verify.js; de starter/: node ../verify.js |
| Estado inicial | Os testes de sequência existentes passam |
| Evidência final | Um starter novo passa nas verificações existentes; cada variante começa a partir dessa mesma fonte intocada. |
Conceito em prática: Duas explicações do mesmo preditor de sequência podem soar igualmente confiantes. A útil cita a ramificação testada e identifica o novo padrão ausente em vez de descrever uma API imaginada.
Use o starter executável para comparar estratégias de contexto sem mudar a tarefa, o modelo ou os critérios de aceitação.
Variantes controladas
Crie uma cópia nova do projeto inicial e uma nova sessão para cada variante:
- somente prompt;
- prompt com referências explícitas a arquivos;
- instruções do repositório;
- instruções do repositório e específicas por caminho;
- agente personalizado;
- agente personalizado com a skill evidence-first.
Não execute uma variante a partir da raiz do repositório se as instruções herdadas contaminarem a linha de base.
Tarefa fixa
Adicione suporte a um novo padrão determinístico de sequência. Exija:
- validação de entrada;
- previsão de um e de vários valores;
- suporte na API;
- testes direcionados;
- nenhuma alteração de arquivo sem relação com a tarefa.
Planilha de evidências
Para cada variante, registre:
| Evidência | Valor |
|---|---|
| Arquivos alterados | |
| Arquivos alterados fora do escopo | |
| Chamadas de ferramentas com falha | |
| Intervenções humanas | |
| Testes solicitados | |
| Testes realmente executados | |
| Resultado final dos testes | |
| Alegações sem fundamento |
O experimento compara resultados. Ele não estabelece uma classificação universal de produtividade.
Execução guiada
- Execute o verificador intocado e registre o estado inicial esperado.
- Peça uma explicação fundamentada nas fontes do código e das verificações relevantes.
- Planeje: escolha um novo padrão de sequência. Mantenha modelo e aceitação fixos, defina variantes de contexto de cópia nova e diga como registrará arquivos alterados, verificações realmente executadas e alegações não compatíveis.
- Implemente apenas a fatia aprovada e então execute novamente o mesmo verificador.
- Adicione uma alegação de design irrelevante a um pacote de contexto, não ao código de produção. Questione se a resposta cita fontes executáveis e registre a alegação não compatível caso não cite.
- Revise o diff e registre a limitação: testes locais estabelecem o comportamento de sequência; a comparação não é uma classificação geral de modelos ou fluxos de trabalho.
Conclusão e redefinição segura
- O comportamento exigido e seu caso negativo têm evidência observada.
- O resultado distingue a verificação local do comportamento ao vivo do host/runtime.
- Nenhuma credencial, arquivo não relacionado ou serviço foi alterado.
- A evidência está salva antes de redefinir o starter copiado.
Use uma nova extração para outra tentativa, ou restaure apenas os arquivos nomeados a partir de uma linha de base Git criada nesta cópia. Nunca aplique um comando de redefinição da raiz do currículo a partir de um projeto diferente.
Continue com a aventura e a rubrica.