idea_world_labDEV JOURNAL
quarta-feira, 15 de julho de 2026

15 de julho de 2026

  • Hoje continuei o trabalho no ônibus que vai para Seul.
  • Revisitei do início o fluxo de classificação, geração de código sintético, criação de JSONL e validação, com base no documento de análise de código Qwen Validation Debugger escrito em 13 de julho.
  • Ao analisar, identifiquei os seguintes problemas:
    • A explicação da fase de classificação common/separate foi copiada diretamente para a entrada da geração de código, permitindo que sintaxe de versão incorreta se misturasse como base factual nas etapas subsequentes.
    • Como não verifiquei se o código sintético gerado era realmente analisado pelo motor Godot, sintaxe exclusiva do Godot 4 podia aparecer em código Godot 3 e ainda avançar para a próxima etapa.
    • Era difícil garantir que o código gerado independentemente para cada versão mantivesse a mesma funcionalidade, fluxo de entrada, alvo e resultado.
    • O tipo de campo e a estrutura aninhada das respostas JSONL não foram suficientemente restritos, permitindo a criação de formatos diferentes do esquema original.
    • Na geração de JSONL negativo, o código atual podia ser incluído, o que poderia fazer o modelo reutilizar a evidência direta do código atual.
    • Quando não havia evidência direta de versões diferentes ou de alterações anteriores, o modelo poderia decidir erroneamente um sim.
    • Falta de restrições de re‑tentativa e respostas estruturadas para distinguir HTTP 429, 502, 503, 504, encerramento de conexão e timeout de solicitação.
  • Decidi que, em vez de corrigir apenas partes do prompt, devemos redefinir o fluxo desde o início; assim, elaborei um novo documento que define a ordem de entrada, geração, inspeção, esquema e julgamento para dados sintéticos E2E.
  • Reafirmei o objetivo do Qwen Validation Debugger: validar o E2E com dados sintéticos antes de criar o Retriever e o validador reais.
  • Separei a saída da classificação da entrada da geração de código sintético para que a descrição do modelo de classificação não se misture com a geração de código Godot 3/4.
  • Melhoramos a inspeção: o código sintético gerado não é mais avaliado apenas pelo julgamento interno do Qwen, mas é imediatamente verificado com --check-only --script nos motores Godot 3/4.
  • Para JSONL negativo, evitamos copiar o código atual; em vez disso, selecionamos dinamicamente outros itens de teste para gerar e, após a geração, verificamos se há sobreposição com a evidência direta do código atual.
  • Mantemos a verificação do esquema JSONL existente para campos obrigatórios, tipos, enums e campos adicionais; julgamentos que podem ser confirmados apenas por versão e evidência textual direta são processados antes da chamada ao modelo.
  • Projeto e registro de testes: docs/observations/2026-07-15-qwen-validation-debugger-synthetic-e2e-contract.md
  • Conectei o domínio ideaworldlab.com, adquirido na Cloudflare, ao projeto Vercel e concluí a verificação de DNS e a emissão do certificado HTTPS.
  • Configurei a base SEO/GEO para que páginas analisadas a partir de README e docs sejam refletidas automaticamente em canonical, hreflang, sitemap, robots, Open Graph e JSON‑LD, sem necessidade de registro manual.
  • Registrei um sitemap dinâmico contendo coreano, inglês, japonês, chinês, português (Brasil), espanhol, francês, alemão, russo e x-default no Google Search Console; verifiquei que 1 074 páginas de ideaworldlab.com foram reconhecidas corretamente.
  • Também registrei nos motores Google, Bing, Naver e Yandex.
  • O Baidu exige número de telefone e informações regionais chinesas para registro de site, portanto foi excluído desta rodada de registro.
  • Retrospectiva: docs/retrospectives/2026-07-15.md