Ayer bebí alrededor de 1 litro de café en una cafetería y hoy me sentí muy mal, lo que me impidió programar adecuadamente
Eliminé todos los entregables de chunking/post‑procesamiento de Godot RAG creados el 17 de junio como línea base
Borré docs_chunks.jsonl v1, docs_chunks_v2.jsonl v2 y los entregables de catálogo/índice/mapeo v3/v3.1
También eliminé los scripts preliminares de chunking/post‑procesamiento/validación y el borrador inicial del chat/index de RAG
Dejé work/godot_rag/ vacío por ahora, para no usar los entregables incorrectos como referencia
Registré la razón de la limpieza como retrospectiva
Determiné que el problema fue haber comenzado el chunking antes de analizar suficientemente la estructura de la documentación oficial
El objetivo de basarse en toda la documentación oficial de Godot se desvió hacia un “API MVP” arbitrario elegido por el LLM y hacia direcciones de codificación dura y sobre‑refuerzo, contaminando el proceso
Señalé que, sin mi instrucción, ChatGPT/Codex redujo el alcance arbitrariamente o asumió que había una respuesta antes de que el paso terminara, generando entregables posteriores de forma indebida
Concluí que cuando se mezclan los productos del LLM, candidatos regex, referencias de la documentación oficial y reglas aprobadas por el usuario, no pueden usarse como criterio para el etiquetador o el clasificador RAG
Volví a registrar los puntos débiles de la arquitectura actual
La capa de análisis estático es débil
No hay validación basada en AST/parsador de GDScript
El grafo de dependencias del proyecto Godot es insuficiente
La validación de ejecución/sintaxis es limitada
La taxonomía de etiquetas aún es gruesa
La distinción de la procedencia entre los productos del LLM y las respuestas verificadas es pobre
El diseño para prevenir fugas y eliminar duplicados es deficiente
Reorienté la siguiente dirección de trabajo al análisis de los originales de godot_docs_full
En lugar de volver a crear RAG o catálogos de inmediato, analizaremos primero outputs/godot_docs_full/pages directamente
Necesitamos verificar qué estructura Markdown tienen los documentos de referencia de clases, migraciones y tutoriales
Según la estructura de la documentación oficial de Godot, debemos rediseñar qué unidad de chunk usar: por página, por sección o por miembro de API
Concluí que antes del chunking debemos definir primero los criterios del informe de validación