Janitorial — bugs de enrich.mjs en el grafo second-brain

Fecha: 2026-09-19 · Proyecto: ~/nef/second-brain (main, commits e0cad78, d813794)

Qué era

scripts/enrich.mjs pega extractos de Wikipedia en el body de los nodos. Bug: en varios nodos resolvió el artículo equivocado y pegó contenido de otro tema (no desambiguación — contenido real de un concepto distinto).

Nodos afectados y corregidos

  • calculus.md → traía Lambda Calculus
  • docker.md, dbt.md → dump crudo de página de desambiguación
  • cap-theorem.md → traía Bayes’ Theorem completo
  • forward-propagation.md → traía Backpropagation
  • policy-gradient.md → traía Stochastic Gradient Descent
  • convolutional-neural-network.md → Feedforward NN genérico
  • lstm.md, autoencoders.md → mismo párrafo genérico de “Deep Learning” pegado en ambos (fuente idéntica, bug reproducible)
  • embeddings.md → “Embedded system” (hardware, dominio totalmente distinto)

Cómo se encontraron

Grep por patrones de desambiguación (most often refers to, may refer to) encontró 2 de 9. Los otros 7 aparecieron al leer los nodos completos durante la expansión enciclopédica (batch 1, ver 2026-09-19-grafo-analisis-zettelkasten) — el grep no los detecta porque es contenido real, solo que del tema equivocado.

Señal para la próxima pasada

Si se sigue ampliando el grafo nodo por nodo, cualquier sources: Wikipedia con contenido pegado (no reescrito) es sospechoso por default — verificar que el primer sustantivo del párrafo scrapeado coincide con el title del nodo antes de confiar en él. No hay manera barata de automatizar esto sin falsos negativos (embeddings→“embedded system” comparte raíz léxica, un diff léxico simple no lo habría atrapado).