La mayoría de los programas empresariales de agentes se estanca por una razón que nunca llegó al caso de negocio: el agente no logra encontrar de forma confiable lo correcto. La capacidad del modelo dejó de ser la restricción determinante. Lo que hoy pone el límite es la capa de conocimiento que está por debajo: qué puede recuperar el agente, cómo está estructurada, quién tiene permiso para verla y si una respuesta se puede rastrear hasta una fuente. Julio de 2026 lo hizo visible en las hojas de ruta de producto. Pinecone lanzó Nexus, un motor de conocimiento que convierte los datos empresariales en una capa estructurada y consultable, precisamente para mejorar la exactitud de los agentes y reducir los costos de tokens. Box anunció nuevas capacidades de gobernanza de IA y seguridad de agentes el 22 de julio, orientadas a controlar cómo llegan los agentes al contenido empresarial. Su informe 2026 State of Enterprise AI concluyó que el 90 por ciento de los líderes de TI señala las preocupaciones de seguridad, regulación y confianza como la mayor barrera para darles a los agentes de IA acceso a ese contenido. Dos empresas, una misma conclusión: la recuperación es el problema de producto.
Una capa de conocimiento empresarial es una recuperación estructurada, consultable y consciente de los permisos sobre el contenido de su organización, construida para que un agente obtenga el pasaje correcto, de la versión vigente, que el usuario que pregunta tiene derecho a ver, con una cita adjunta. Es un sistema, no un formato de almacenamiento, y ahí es donde la mayoría de los proyectos se equivoca.
El primer intento habitual se ve distinto: rastrear SharePoint, el servidor de archivos, la wiki y unas cuantas colas de tickets. Fragmentarlo todo. Generar embeddings. Dejar que la similitud vectorial lo resuelva. Eso funciona en un piloto, donde las preguntas son las que el corpus responde con limpieza. Se degrada en producción, donde un corpus de decenas de miles de documentos guarda, digamos, seis versiones de la misma política de gastos, dos equipos que discrepan por escrito y usuarios con derechos de acceso distintos. La búsqueda por similitud no tiene opinión sobre cuál documento es correcto ni sobre quién puede leerlo. Devuelve lo que se le parece.
Una capa de conocimiento real agrega cuatro propiedades:
Tres de esas cuatro son problemas de gobernanza disfrazados de ingeniería, y por eso el trabajo se atasca entre TI, el área legal y quien sea dueño de los documentos.
Los agentes fallan en producción sobre todo porque la recuperación devuelve contenido obsoleto, duplicado, contradictorio, con permisos excesivos o imposible de citar, y el modelo responde con confianza a partir de él. Cinco modos de falla explican la mayor parte de lo que vemos.
El procedimiento de 2023 y el de 2026 están ambos en el índice. Son casi idénticos, así que la búsqueda por similitud a menudo prefiere el más antiguo porque es más largo o está mejor redactado. El agente no está alucinando. Está citando con exactitud su servidor de archivos, y su servidor de archivos está equivocado.
Pregúnteles a cinco personas dónde está la política vigente de excepciones de precios y obtendrá cinco respuestas: un PDF, una página de la wiki, una presentación, un hilo de mensajes y una hoja de cálculo. Un agente recupera las cinco y las mezcla. Las respuestas mezcladas son las peores, porque suenan autorizadas y no se pueden rastrear hasta un documento que usted pudiera corregir.
Un agente indexado con una cuenta de servicio que puede leerlo todo expondrá datos de compensación, un memorando de una adquisición no anunciada o un aviso de retención legal a quien haga una pregunta bien formulada. El contenido estaba técnicamente restringido en el origen. La ruta de recuperación no lo estaba. La fuga de permisos es exactamente el riesgo que hay detrás de ese 90 por ciento de la investigación de Box. El temor es racional, y la solución es arquitectónica y no una promesa: los derechos de acceso tienen que aplicarse en la consulta, el mismo principio que seguimos cuando ayudamos a los clientes a mantener seguros los datos de la empresa mientras adoptan IA.
Una respuesta sin fuente no se puede verificar, cuestionar ni defender ante un auditor. Cuando los usuarios no pueden comprobar una respuesta sin esfuerzo, o dejan de confiar en el agente o, peor, dejan de comprobar. Las citas son lo que convierte la salida de un agente en algo revisable.
La recuperación no estructurada es cara de una manera que se esconde en la línea de infraestructura. Cuando la capa no puede filtrar, el agente lo compensa arrastrando grandes volúmenes de texto vagamente relevante al contexto en cada llamada, así que el costo crece con el trámite y no con la respuesta. Que Pinecone posicione Nexus tanto por exactitud como por costo en tokens, en un lanzamiento cubierto a mediados de julio, es una lectura razonable del mercado: la estructura que hace correcta la recuperación también la hace más barata, porque el agente deja de leerse la biblioteca entera para responder una sola pregunta.
Este problema no se resuelve con un mejor modelo. Un modelo superior razona con más capacidad sobre lo que le entreguen, lo que significa una respuesta equivocada más elocuente cuando la recuperación le entrega una política ya superada. La calidad del agente está limitada por la capa de conocimiento: qué se puede recuperar, cómo está estructurado, quién puede verlo y si la respuesta cita una fuente. Eso es un programa de TI y de gobernanza de contenido, y es el que vale la pena financiar.
La gobernanza de agentes debe escalonarse según el riesgo porque las reglas uniformes fallan por partida doble: son demasiado pesadas para los agentes de bajo riesgo, lo que frena trabajo útil detrás de revisiones que nadie necesitaba, y demasiado ligeras para los de alto riesgo, que es donde ocurre el daño. Gartner lo advirtió sin rodeos en un comunicado del 26 de mayo de 2026, al afirmar que aplicar una gobernanza uniforme a todos los agentes de IA llevará al fracaso de los agentes de IA empresariales. Nuestra lectura es que la respuesta viable consiste en escalonar según el riesgo que conlleva cada agente.
La capa de conocimiento es donde ese escalonamiento se vuelve concreto. Escalonar por riesgo significa distintos alcances de recuperación, requisitos de vigencia, rigor en las citas y cadencias de revisión. Un agente que toca contratos, datos de pacientes o divulgaciones financieras necesita un alcance curado, aplicación estricta de los derechos de acceso, citas obligatorias y una persona en el circuito para cualquier acción consecuente. Trabajar esa división por adelantado es justamente para lo que sirve una lista de verificación de gobernanza de agentes de IA práctica. Es el mismo escalonamiento de riesgo que da forma a gobernar una fuerza laboral de agentes de IA, y pertenece a la misma disciplina que el resto de su programa de seguridad de IA.
El anuncio de Box en julio apunta a la otra mitad de esa idea: control en la capa de contenido, donde la organización decide a qué pueden llegar los agentes. Qué contenido, para qué agente, en nombre de quién. Dos de sus capacidades nombradas, las políticas de acceso basadas en clasificación que excluyen ciertas clasificaciones del acceso de los agentes y la aprobación humana previa a una acción sensible, solo funcionan cuando su contenido lleva clasificaciones confiables, que es de nuevo el argumento de la estructura y los metadatos. Lo mismo vale para los agentes que usted no construyó, los que llegan dentro del SaaS que ya posee, tratados en agentes de IA integrados por los proveedores.
Recuperación: solo por similitud, sin filtro de versión, responsable ni fecha.
Permisos: ingeridos una vez bajo una cuenta de servicio y luego dejados a la deriva.
Respuestas: plausibles, sin atribución, mezcladas entre fuentes que se contradicen.
Costo: crece con el tamaño del corpus, porque todo lo vagamente relevante entra al contexto.
Recuperación: estructurada y filtrable, acotada por agente y por flujo de trabajo.
Permisos: evaluados en el momento de la consulta contra el usuario que pregunta.
Respuestas: citadas a un documento y una versión que una persona puede abrir.
Costo: acotado, porque la precisión reemplaza al volumen en la ventana de contexto.
Constrúyala en secuencia, acotada a trabajo real, en lugar de intentar toda la intranet de una vez. El orden adelanta las decisiones que son caras de revertir.
Nada de esto exige reconstruir una plataforma de datos. Exige disciplina de alcance, responsables con nombre y alguien dispuesto a eliminar documentos. La mayoría de los equipos de TI del mercado medio tiene las habilidades y le falta el mandato, y ahí es donde una consultoría de IA justifica su costo: no por escribir código de recuperación, sino por lograr que se tomen las decisiones de fuente de verdad y se asignen los responsables.
El agente es la parte visible. La capa de conocimiento determina si es confiable. Si sus agentes rinden por debajo de lo esperado, resista el impulso de cambiar de modelo y mire qué devuelve la recuperación para sus diez preguntas reales más difíciles, formuladas por usuarios de tres niveles de privilegio. Estructure el contenido, nombre a los responsables, aplique los derechos de acceso en la consulta y exija citas. Las empresas que lleguen primero pasarán 2027 mejorando sus agentes en vez de disculparse por ellos. Infonaligy diseña y gobierna capas de conocimiento empresarial en Dallas–Fort Worth y, mediante entrega remota, en todo el país.
Infonaligy ayuda a los equipos de TI y de dirección a construir capas de conocimiento conscientes de los permisos que hacen que los agentes de IA sean exactos y defendibles, desde nuestra base en Dallas–Fort Worth y, mediante entrega remota, para empresas en todo el país.
Agende un diagnóstico y auditaremos qué recuperan de verdad sus agentes, encontraremos las fuentes obsoletas y contradictorias, probaremos si hay fuga de permisos y diseñaremos la capa de conocimiento gobernada que va por debajo.