Janitorial — bugs de enrich.mjs en el grafo second-brain
Fecha: 2026-09-19 · Proyecto: ~/nef/second-brain (main, commits e0cad78, d813794)
Qué era
scripts/enrich.mjs pega extractos de Wikipedia en el body de los nodos.
Bug: en varios nodos resolvió el artículo equivocado y pegó contenido de
otro tema (no desambiguación — contenido real de un concepto distinto).
Nodos afectados y corregidos
calculus.md→ traía Lambda Calculusdocker.md,dbt.md→ dump crudo de página de desambiguacióncap-theorem.md→ traía Bayes’ Theorem completoforward-propagation.md→ traía Backpropagationpolicy-gradient.md→ traía Stochastic Gradient Descentconvolutional-neural-network.md→ Feedforward NN genéricolstm.md,autoencoders.md→ mismo párrafo genérico de “Deep Learning” pegado en ambos (fuente idéntica, bug reproducible)embeddings.md→ “Embedded system” (hardware, dominio totalmente distinto)
Cómo se encontraron
Grep por patrones de desambiguación (most often refers to, may refer to)
encontró 2 de 9. Los otros 7 aparecieron al leer los nodos completos durante
la expansión enciclopédica (batch 1, ver
2026-09-19-grafo-analisis-zettelkasten) — el grep no los detecta porque
es contenido real, solo que del tema equivocado.
Señal para la próxima pasada
Si se sigue ampliando el grafo nodo por nodo, cualquier sources: Wikipedia
con contenido pegado (no reescrito) es sospechoso por default — verificar
que el primer sustantivo del párrafo scrapeado coincide con el title del
nodo antes de confiar en él. No hay manera barata de automatizar esto sin
falsos negativos (embeddings→“embedded system” comparte raíz léxica, un
diff léxico simple no lo habría atrapado).