Grafo de conocimiento organizativo — memoria ontológica para operaciones empresariales
Un grafo de conocimiento organizativo almacena lo que una empresa sabe sobre sí misma: quiénes son sus personas, empresas y proyectos; cómo se relacionan entre sí; qué decisiones se han tomado y por quién; qué políticas rigen qué actividades. Esta memoria estructurada está disponible para cada solicitud de inferencia de IA, inyectada como contexto antes de que el modelo produzca su respuesta.
El grafo responde una clase de pregunta que una búsqueda de similitud vectorial no puede responder: no solo "¿qué documentos mencionan a ACME Corp?" sino "¿qué es ACME Corp, a quién conocemos allí, qué contrato rige nuestra relación, y qué decisiones hemos tomado sobre sus facturas?" El recorrido sigue aristas. La respuesta emerge de la estructura, no de la proximidad de palabras clave.
Un grafo por nodo de despliegue
Un nodo de despliegue mantiene exactamente un grafo de conocimiento organizativo. Todos los servicios que se ejecutan en ese nodo contribuyen entidades a este almacén único, delimitadas por un identificador de módulo que mantiene los datos de cada dominio aislados dentro de la misma base de datos física.
Este diseño permite el razonamiento entre dominios sin duplicación. Cuando un servicio de contabilidad escribe "ACME Corp es un proveedor con condiciones de pago net-30" y un servicio de extracción de documentos escribe "ACME Corp tiene sede en Toronto", ambos hechos existen en el mismo grafo, adjuntos a la misma entidad. Una consulta sobre ACME Corp recupera ambos hechos en un solo recorrido.
Un grafo separado por servicio requeriría que el [[soft-slm-tiered-gateway|enrutador de inferencia]] consultara múltiples fuentes, combinara resultados y resolviera conflictos — complejidad que produce respuestas peores a un costo operativo mayor. Los sistemas de grafos de conocimiento a escala industrial convergen en una capa semántica unificada, sin importar cuántos servicios produzcan los datos subyacentes.
Qué pertenece al grafo
El grafo almacena hechos ontológicos: qué entidades existen, cómo se relacionan y qué es verdad sobre ellas en un momento dado. No almacena registros transaccionales.
En el grafo:
- Una organización es un proveedor (entidad con atributo de relación).
- Un contrato existe entre dos partes con términos específicos.
- Una decisión fue tomada por una persona específica bajo una política concreta.
- Una propiedad es propiedad de una empresa con una clasificación específica.
No en el grafo:
- Líneas de factura individuales (son registros transaccionales; pertenecen al libro de contabilidad).
- Asientos contables (pertenecen al libro mayor).
- Texto de documento sin procesar (pertenece al almacén de documentos).
Tipos de entidades
El grafo se configura mediante archivos de ontología cargados al inicio. Cada nodo de despliegue puede definir clasificaciones de entidades apropiadas para su dominio empresarial. Las clasificaciones base presentes en cada despliegue cubren los primitivos organizativos fundamentales:
- Persona — individuos con nombre; lleva rol, información de contacto y afiliación organizativa.
- Empresa — organizaciones registradas; lleva clasificación (proveedor, cliente, socio, regulador) y atributos de relación como los términos del contrato.
- Proyecto — iniciativas con nombre; lleva estado, participantes y políticas que lo gobiernan.
- Cuenta — cuentas financieras y de servicio; lleva clase de saldo y relación con el contrato.
- Ubicación — lugares geográficos y direcciones; lleva jurisdicción y atributos físicos.
Las clasificaciones adicionales se añaden a través de archivos CSV de ontología. Un despacho de abogados podría añadir Caso, Regulación y Sentencia. Un administrador de propiedades podría añadir Propiedad, Arrendamiento e Inquilino. Un negocio de manufactura podría añadir Equipo, Orden de Trabajo y Especificación. Cada adición extiende la capacidad de razonamiento del grafo para ese dominio sin modificar código.
Validez temporal
Cada hecho en el grafo lleva una marca de tiempo de creación. Los hechos sobre entidades que cambian con el tiempo — como quién ocupa un rol, o qué términos lleva un contrato — pueden ser reemplazados en lugar de sobrescritos. El grafo conserva el hecho anterior con su ventana de validez. Una consulta puede preguntar tanto "¿qué es verdad ahora?" como "¿qué era verdad en una fecha dada?"
Esta propiedad temporal es valiosa para la auditoría y para el entrenamiento. Un modelo entrenado sobre hechos que eran precisos cuando se escribieron los datos de entrenamiento, pero que ya no están vigentes, produce respuestas incorrectas con confianza. La validez temporal permite que el grafo sirva contexto preciso incluso a medida que la organización cambia.
Recorrido multi-salto
El grafo está diseñado para el recorrido, no solo para la búsqueda. Un recorrido sigue aristas desde una entidad hacia entidades conectadas.
Ejemplo: ¿Qué políticas rigen las decisiones de adquisición en este proyecto?
- Iniciar en la entidad Proyecto.
- Seguir aristas
governed_byhacia entidades Política. - Seguir aristas
defines_exceptionsdesde cada Política hacia entidades Decisión. - Seguir aristas
approved_bydesde cada Decisión hacia entidades Persona.
El resultado: la cadena de gobierno completa, recuperada en una sola consulta estructurada.
Cómo entran las entidades al grafo
Las entidades entran al grafo a través de un pipeline de extracción. Documentos, correos electrónicos, notas de reuniones y otras fuentes en prosa llegan a un directorio de entrada vigilado. El servicio de extracción lee cada fuente y envía el texto al enrutador de inferencia para la extracción estructurada de entidades mediante un esquema restringido por gramática.
La calidad de la extracción depende del nivel de inferencia. El modelo compacto local (Tier A) extrae entidades con menor confianza. El nodo GPU de ráfaga (Tier B) extrae con mayor confianza, usando ventanas de contexto más amplias y restricciones de salida más estrictas. La extracción de Tier A es útil para cobertura rápida; la extracción de Tier B se usa para el registro organizativo canónico.
Que una entidad extraída llegue al grafo de inmediato o espere una aprobación firmada por un humano depende de una configuración del operador: existe un punto de control de captura-y-promoción exactamente para este caso, pero viene desactivado por defecto — véase Reconstrucción nocturna del grafo de datos para el mecanismo y su brecha de gobernanza actualmente abierta. Cada extracción se registra con una referencia de fuente y una puntuación de confianza, sin importar cuál ruta siga.
Las entidades extraídas de fuentes autoritativas (contratos ejecutados, documentos presentados, registros oficiales) llevan mayor confianza que las extraídas de correspondencia informal.
Inyección de contexto en tiempo de inferencia
Antes de despachar cualquier solicitud, el enrutador de inferencia consulta el grafo organizativo para obtener entidades relevantes para la solicitud actual. La consulta es una coincidencia de subcadena contra la última parte del mensaje del usuario. Las entidades coincidentes se formatean como un bloque de contexto estructurado y se anteponen al prompt del sistema. El modelo recibe este contexto de forma transparente; no necesita que se le indique "usar el grafo de conocimiento" — el contexto simplemente está presente, como si al modelo se le hubiera informado de antemano sobre las relaciones organizativas relevantes.
Esta inyección no es fatal. Si el servicio de grafo no está disponible o no devuelve coincidencias, la solicitud continúa sin contexto adicional. Un interruptor de circuito en la ruta de consulta del grafo evita que un servicio de grafo lento bloquee la inferencia.
Privacidad y soberanía
El grafo de conocimiento organizativo contiene información empresarial sensible. El grafo se ejecuta integrado dentro del nodo de despliegue. Su contenido nunca se envía a un proveedor de inferencia externo como datos de entrenamiento.
La organización es propietaria del archivo de base de datos del grafo, las definiciones de ontología, los datos de entidades y el historial de extracción. Estos activos son portables: pueden respaldarse, migrarse y restaurarse sin dependencia de ningún servicio de terceros.
Cite this record: /wiki/ontological-datagraph — revision 7ff56dd5, last updated 22 August 2026.