El conocimiento está repartido
Documentación, decisiones, incidencias, correos y la cabeza de tres personas. Encontrar la respuesta cuesta más que aplicarla.
IA aplicada · Conocimiento
He montado canalizaciones de recuperación sobre documentación propia, y a menudo el problema no era de búsqueda. Era que el procedimiento estaba desactualizado, que había tres versiones circulando o que la respuesta no estaba escrita. Indexar eso solo consigue que la máquina repita el desorden más deprisa. Cuando el material tiene una versión vigente, una persona responsable y un procedimiento de retirada, existe una base fiable para la recuperación; todavía hay que medir el método de búsqueda sobre el corpus y las consultas reales.
Diseño la recuperación de información con fuentes versionadas, permisos heredados y citas que permitan volver al fragmento original. Comparo búsqueda literal, vectorial e híbrida con un corpus de evaluación y documento cuándo el sistema debe declarar que no dispone de respaldo suficiente.
Mi trayectoriaCasi siempre después de que alguien pruebe un asistente genérico y vea que no sabe nada de la organización.
Documentación, decisiones, incidencias, correos y la cabeza de tres personas. Encontrar la respuesta cuesta más que aplicarla.
Y cada vez se responde un poco distinto, según quién conteste.
Circulan un procedimiento en el gestor documental, otro en un correo y un tercero en una carpeta compartida.
Devuelve el documento correcto solo si se escribe el término exacto, y nadie recuerda cómo se llamaba.
Seis pasos que decido antes de escribir código.
Tomo veinte preguntas reales y busco la respuesta a mano. Si no está escrita, el problema es editorial y ninguna canalización lo arregla.
Qué versión manda, quién la aprueba, cuándo caduca y quién retira lo derogado. Sin esto, el índice hereda el desorden.
El tamaño del fragmento decide qué se recupera. Trozos grandes traen ruido; trozos pequeños pierden el contexto que da sentido a la frase.
La literal para códigos, nombres y referencias exactas; la vectorial para preguntas formuladas con otras palabras. Los resultados se combinan y se ordenan.
El sistema recibe los fragmentos recuperados y debe citar el documento y la posición de cada afirmación o abstenerse. La evaluación comprueba que no introduce afirmaciones sin apoyo; la arquitectura reduce ese riesgo, pero no permite darlo por imposible.
El índice se refresca cuando el material cambia. Al retirar un documento, el sistema inicia su eliminación del índice y comprueba que deja de recuperarse dentro del plazo acordado.
Siete preguntas antes de montar nada.
Compruébalo a mano con veinte preguntas reales. Si no está, el trabajo es editorial, no técnico.
Una persona por familia documental, con capacidad de aprobar y de retirar.
Determina si el índice se refresca en tiempo real, cada noche o cuando alguien lo pide.
Si hay material restringido, el filtrado por permisos condiciona toda la arquitectura.
Un agente con herramientas se añade sobre una recuperación ya evaluada. Cada acción exige autorización para la identidad y el alcance correspondientes, contratos explícitos, confirmación cuando proceda, límites y una forma de revertir o compensar el efecto.
Con un conjunto de preguntas de respuesta conocida y de casos sin respuesta posible, formulados al sistema antes y después de cada cambio.
Estimado con supuestos explícitos y contrastado con el uso real del primer mes.
Cinco problemas que aparecen a los pocos meses.
El cambio del material pasa inadvertido hasta que alguien actúa con un procedimiento derogado.
Una tabla partida por la mitad o una condición separada de su excepción producen respuestas correctas en apariencia y equivocadas en el fondo.
Borradores, plantillas vacías y actas antiguas compiten con el documento bueno y a veces ganan.
Se cambia el troceado o la instrucción y, sin una medida previa, no se puede saber si ha mejorado.
La estimación se hizo con preguntas cortas y el uso real trae preguntas largas con mucho contexto recuperado.
Hay controles comunes y otros que solo corresponden a las opciones que componen respuestas o ejecutan acciones.
El volumen de material y el de consultas escalan por caminos distintos.
Se puede revisar el corpus a mano. Ajusto el troceado mediante una muestra documentada de consultas y reviso manualmente los fragmentos resultantes. La calidad depende sobre todo de la limpieza del material.
Aparece la necesidad de metadatos: familia, vigencia, responsable. Sin ellos, el ruido gana.
El coste y la latencia pasan al primer plano. Puede compensar almacenar resultados o respuestas en caché solo si la clave incorpora la identidad o el alcance de los permisos, la versión de las fuentes y el contexto relevante, y si la caché se invalida cuando cambian el corpus o los permisos. También mido qué parte del contexto puede recortarse sin reducir la calidad.
El aislamiento entre corpus deja de ser una opción de configuración: lo trato como un requisito que tengo que demostrar con pruebas.
Cuatro requisitos que distinguen lo operable de lo demostrable.
| Requisito | Evidencia exigible | Criterio de aceptación |
|---|---|---|
| Gobierno del material | Lista de fuentes con responsable, vigencia y procedimiento de retirada | Toda fuente indexada tiene responsable y fecha de revisión |
| Frescura del índice | Procedimiento de reindexación y prueba de que un documento retirado desaparece | El material retirado deja de recuperarse dentro del plazo acordado |
| Evaluación propia de la arquitectura | Consultas de búsqueda, preguntas con respuesta y abstención o acciones permitidas, según la opción elegida | La ficha define qué cambios de instrucciones, modelo, proveedor, fuentes, permisos o configuración obligan a repetir la evaluación; los resultados se conservan por versión |
| Coste y latencia | Rangos aceptables acordados para el volumen previsto, con supuestos declarados | Durante el primer mes se miden el coste por consulta y la latencia con el uso real; toda desviación fuera de los rangos abre la revisión acordada |
Tres formas de gastar tiempo sin resolver el problema.
Meter la unidad compartida entera en el índice permite que los documentos derogados compitan con los vigentes y puede hacer que el sistema los cite sin distinguir su estado.
Cargar todo el material en el contexto solo funciona mientras cabe y sigue siendo pertinente. Cuando el contenido se acerca al límite de la ventana de contexto o lo supera, el proveedor puede rechazar la petición. La aplicación solo seleccionará, resumirá o truncará material si ese comportamiento se ha definido e implementado; también debe medirse y hacerse visible.
Si el problema es que el documento no existe o está mal, un modelo mejor solo redacta mejor la respuesta equivocada.
Referencias
Documentación consultada el 3 de agosto de 2026. Define cómo la plataforma gestiona proveedores, acciones y políticas. Miro qué resuelve de serie antes de construir una capa propia.
Esto sale de canalizaciones que he montado y operado sobre documentación propia. No incluye comparativas de proveedores ni cifras de precisión: dependen tanto del corpus que un número aislado no significaría nada.
Blog
En el blog desarrollo casos particulares, pruebas y fuentes que amplían esta página de referencia.
Ir a blog.albertolarah.comContacto
Antes de montar nada compruebo, con una muestra de preguntas reales, si las respuestas existen y están vigentes. Esa comprobación acotada permite decidir si el problema es editorial o de recuperación antes de invertir en un índice.
hola@albertolarah.comLinkedIn ↗