Skip to main content
PromptQuorum
Inicio/LLM locales avanzados/Reseña de cognee: memoria en grafo de conocimiento de código abierto para agentes de IA
RAG & Document Chat

Reseña de cognee: memoria en grafo de conocimiento de código abierto para agentes de IA

·11 min de lectura·Por Hans Kuepper · Fundador de PromptQuorum, herramienta de despacho multi-modelo · PromptQuorum

cognee es una librería Python gratuita y de código abierto (Apache-2.0) que le da a los agentes de IA memoria persistente construyendo un grafo de conocimiento autoalojado a partir de tus documentos, código y conversaciones, en lugar de depender solo de la similitud vectorial plana. Se instala con pip install cognee, su motor y grafo se ejecutan por completo en tu propia infraestructura, y por defecto envía texto a un proveedor externo de LLM/embeddings configurado para su procesamiento, aunque también admite enrutar esas llamadas a un modelo local de Ollama. Cognee Cloud es una oferta gestionada aparte y opcional para equipos que no quieren autoalojarse.

cognee (cognee.ai, código fuente en github.com/topoteretes/cognee) es una librería Python gratuita y de código abierto (Apache-2.0) que le da a los agentes de IA memoria persistente y estructurada, convirtiendo documentos, código y conversaciones en un grafo de conocimiento consultable en lugar de un simple índice vectorial plano. La desarrolla Topoteretes UG, una empresa con sede en Berlín, y tiene más de 30.700 estrellas en GitHub. Esta reseña cubre qué hace realmente cognee, en qué se diferencia de una configuración RAG basada solo en una base de datos vectorial, cómo instalarlo y usarlo, y a quién le conviene.

Conclusiones clave

  • cognee (cognee.ai) es una librería Python gratuita y de código abierto para memoria de agentes de IA, construida alrededor de un grafo de conocimiento autoalojado, no de una app alojada
  • Con licencia Apache-2.0, confirmada en el repositorio de GitHub
  • Desarrollado por Topoteretes UG, una empresa berlinesa dirigida por el director gerente Vasilije Markovic
  • Más de 30.700 estrellas en GitHub al momento de esta reseña (verificado el 2026-09-18)
  • La localidad es híbrida: el motor de grafo de conocimiento y el almacén vectorial se ejecutan autoalojados, pero las llamadas de procesamiento LLM/embeddings por defecto van a un proveedor externo configurado; también se admiten modelos locales de Ollama
  • Las operaciones principales son cognee.add() (ingesta), cognee.cognify() (construir el grafo) y cognee.search() (consultarlo), con las funciones de conveniencia más recientes remember()/recall() construidas sobre ese mismo pipeline
  • Se integra con Claude Code, Cursor, LangGraph, CrewAI, OpenClaw y herramientas del Model Context Protocol (MCP)

📍 En una frase

cognee es una librería Python gratuita y de código abierto (Apache-2.0) de la empresa berlinesa Topoteretes, que le da a los agentes de IA memoria persistente construyendo un grafo de conocimiento autoalojado a partir de documentos, código y conversaciones, en lugar de depender solo de la búsqueda por similitud vectorial.

💬 En términos simples

En vez de simplemente trocear tus documentos y emparejarlos por similitud como en una configuración RAG típica, cognee lee tus datos y construye un mapa de las entidades y relaciones que contienen —un grafo de conocimiento— que un agente puede consultar para obtener respuestas más estructuradas y conectadas. Se ejecuta en tu propia máquina o servidor mediante pip install cognee, y es gratis.

📌Nota: Esta reseña es el complemento en profundidad de la entrada de cognee en el Directorio de software de LLM local — consulta esa página para ver cómo se compara cognee de un vistazo con docenas de otras herramientas de IA locales y autoalojadas.

¿Qué es cognee?

cognee es una librería Python que le da a los agentes y aplicaciones de IA memoria persistente y estructurada, transformando texto sin procesar, código e historial de conversaciones en un grafo de conocimiento consultable. Su propia descripción en GitHub lo posiciona como una plataforma de memoria de IA de código abierto para habilitar memoria persistente entre sesiones de agentes, construida ingiriendo datos mediante un pipeline que extrae entidades y relaciones en lugar de solo incrustar fragmentos de texto planos.

  • Tipo de producto: una librería Python y un framework de pipeline autoalojados, no una app independiente descargable ni un SaaS completamente gestionado por defecto
  • Creador: Topoteretes UG (haftungsbeschränkt), una empresa registrada en Berlín; director gerente Vasilije Markovic
  • Repositorio: github.com/topoteretes/cognee
  • Licencia: Apache-2.0, confirmada mediante el archivo de licencia del repositorio
  • Localidad: híbrida — el motor de grafo de conocimiento, el almacén vectorial y cualquier base de datos local se ejecutan en tu propia infraestructura, pero el texto enviado para extracción de entidades, enriquecimiento e incrustación se enruta por defecto al proveedor externo de LLM/embeddings que configures; cognee también documenta soporte para enrutar ese procesamiento a través de un modelo local de Ollama en su lugar
  • Escala: más de 30.700 estrellas en GitHub, y el propio sitio de cognee cita más de 5 millones de ejecuciones de SDK al mes al momento de esta reseña

Historia del proyecto cognee

cognee es desarrollado y mantenido por Topoteretes, una empresa con sede en Berlín, con el proyecto posicionado públicamente como una "plataforma de memoria de IA para agentes". Esta reseña verificó el nombre de la empresa, la ciudad de la sede y la escala actual (número de estrellas, volumen mensual de ejecuciones de SDK) directamente en el propio sitio de cognee y su repositorio de GitHub, pero no encontró un anuncio público fechado y específico de la fecha de lanzamiento inicial del proyecto para citar aquí — consulta directamente el historial de commits del repositorio de GitHub si necesitas ese nivel de detalle.

  • cognee se posiciona en torno a un pipeline de estilo Extract-Cognify-Load: ingerir datos, construir a partir de ellos un grafo de conocimiento y una capa de enriquecimiento ("cognify"), y luego hacer que ese grafo sea consultable — el SDK actual expone esto como add(), cognify() y search(), con las funciones envoltorio más recientes remember()/recall() añadidas encima para un uso más sencillo
  • cognee reporta más de 5 millones de ejecuciones de SDK al mes y nombra usuarios en producción como Bayer (memoria de investigación), Knowunity, SlideSpeak y la University of Wyoming, según el propio sitio de cognee
  • Cognee Cloud, una oferta gestionada aparte, se introdujo como una vía opcional para equipos que quieren la misma capa de memoria sin autoalojar el motor

¿Qué puedes hacer con cognee?

El conjunto de funciones de cognee se centra en convertir datos no estructurados en una capa de memoria estructurada y consultable para agentes y aplicaciones, según el propio README de GitHub y la documentación de cognee.

  • Construcción de grafo de conocimiento — cognee extrae entidades, relaciones y estructura del texto y el código, y construye un grafo a partir de eso, en lugar de almacenar solo vectores de embeddings planos
  • Ingesta multiformato — documentos, código fuente e historial de conversaciones pueden alimentarse todos al mismo pipeline
  • Enrutamiento automático de recuperación — la capa de búsqueda de cognee selecciona una estrategia de recuperación (recorrido de grafo, similitud vectorial o híbrida) según la consulta, en lugar de exigirte elegir una manualmente
  • Memoria de sesión con sincronización en segundo plano — el contexto conversacional puede mantenerse en memoria de sesión y sincronizarse con el grafo permanente en segundo plano
  • Visualización de grafo y ontologías personalizadas — puedes inspeccionar visualmente el grafo construido y definir tu propia ontología para que la extracción siga los tipos específicos de entidades y relaciones de tu dominio
  • Localidad híbrida con soporte de modelos locales — el flujo por defecto de cognee envía los datos a un proveedor externo de LLM/embeddings configurado para su procesamiento, pero documenta soporte para dirigir ese procesamiento a una instancia local de Ollama en su lugar, manteniendo todo el pipeline en tu propio hardware
  • Integraciones con agentes e IDE — las integraciones documentadas incluyen Claude Code (como plugin de memoria), Cursor, Cline, LangGraph, CrewAI, OpenClaw, y soporte del Model Context Protocol (MCP) para conectar cognee como herramienta a clientes compatibles con MCP

Ejemplos de uso: tres formas de usar cognee

Estos son flujos de trabajo concretos construidos a partir de la API de Python documentada de cognee, ejecutados tras pip install cognee.

  • Construir memoria a partir de un texto y consultarla: ejecuta pip install cognee, luego llama a cognee.remember(text) para ingerir y a cognee.recall(query_text=...) para consultar — la propia documentación de cognee describe remember() como la ejecución de ingesta, fragmentación, extracción de entidades y construcción del grafo en un solo paso, y recall() como el enrutamiento automático de la consulta a la mejor estrategia de recuperación
  • Usar directamente el pipeline de bajo nivel al estilo ECL para más control: llama a cognee.add(data) para ingerir texto sin procesar o archivos, cognee.cognify() para ejecutar la extracción de entidades/relaciones y construir el grafo de conocimiento, y luego cognee.search(query_text=...) para consultarlo — útil cuando quieres inspeccionar o personalizar lo que ocurre en cada etapa del pipeline en lugar de usar los envoltorios de llamada única remember()/recall()
  • Apuntar cognee a un modelo local de Ollama en lugar de un proveedor de LLM/embeddings en la nube: la configuración de cognee admite establecer el proveedor de LLM y embeddings en un endpoint local de Ollama, de modo que los pasos de extracción de entidades e incrustación se ejecuten en tu propio hardware en lugar de llamar a una API externa — revisa la propia documentación de configuración de cognee para los nombres actuales de las variables de entorno antes de integrar esto en un proyecto, ya que los detalles de configuración del proveedor pueden cambiar entre versiones
python
import asyncio
import cognee

async def main():
    text = "cognee turns documents into AI memory."
    await cognee.remember(text)
    results = await cognee.recall(query_text="What does cognee do?")
    for result in results:
        print(result.text)

asyncio.run(main())

Precios de cognee: ¿es realmente gratis?

El motor de código abierto de cognee es gratuito y tiene licencia Apache-2.0 — no hay un nivel de pago que limite ninguna función de la librería en sí. Cognee Cloud es una oferta gestionada aparte y opcional para equipos que quieren la misma capa de memoria sin autoalojar el motor; el propio sitio de cognee no publica precios detallados de Cognee Cloud en su página principal, así que consulta directamente cognee.ai para conocer los precios actuales del nivel gestionado antes de asumir una cifra concreta.

  • Motor de código abierto: gratuito, Apache-2.0, sin límites de uso impuestos por cognee mismo
  • Tus propios costos siguen incluyendo lo que cobre tu proveedor externo de LLM/embeddings configurado por las llamadas a la API que hace cognee durante cognify()/remember() — o ningún costo adicional más allá de tu propio hardware si enrutas ese procesamiento a través de un modelo local de Ollama
  • Cognee Cloud: una oferta gestionada aparte y opcional; el propio sitio de cognee invita a los equipos interesados a "pasar a Cognee Cloud cuando necesites escala gestionada" sin listar precios exactos por nivel en la página principal
  • No se requiere cuenta ni registro para instalar y usar la librería de código abierto

cognee vs. Langchain-Chatchat

cognee y Langchain-Chatchat te ayudan a construir aplicaciones de recuperación aumentada sobre tus propios datos, pero resuelven capas distintas del problema. Langchain-Chatchat es una aplicación de chat RAG autoalojada y lista para usar, construida sobre LangChain, orientada a poner en marcha rápidamente una interfaz de chat de documentos funcional. cognee es una librería de memoria de nivel más bajo que integras en tu propio código de agente o aplicación, y su diferenciador principal es construir un grafo de conocimiento — entidades y sus relaciones — en lugar de solo trocear documentos en un índice vectorial plano.

Qué es

cognee:
Una librería de memoria (grafo de conocimiento + recuperación) que integras en tu propio código
Langchain-Chatchat:
Una aplicación de chat RAG autoalojada y lista para usar

Enfoque de recuperación

cognee:
Grafo de conocimiento más enrutamiento automático de estrategia de recuperación (grafo, vector o híbrido)
Langchain-Chatchat:
Principalmente recuperación por similitud vectorial sobre documentos troceados

Interfaz

cognee:
API de Python y servidor MCP — sin interfaz de chat integrada
Langchain-Chatchat:
Interfaz de chat web integrada

Mejor para

cognee:
Desarrolladores que construyen memoria de agentes o una capa de recuperación personalizada basada en grafo de conocimiento
Langchain-Chatchat:
Equipos que quieren una app de chat de documentos funcional sin construirla desde cero

Licencia

cognee:
Apache-2.0
Langchain-Chatchat:
Apache-2.0

Estas herramientas no son mutuamente excluyentes — una aplicación al estilo de Langchain-Chatchat podría, en principio, usar cognee como su capa de memoria/recuperación subyacente en lugar de un almacén vectorial plano. Verifica las funciones actuales en el repositorio de cada proyecto antes de elegir, ya que ambos publican actualizaciones con frecuencia.

¿Quién debería usar cognee?

Que cognee te convenga depende de si estás escribiendo código que necesita memoria estructurada y conectada, en lugar de buscar una aplicación de chat ya hecha.

Competidores y alternativas

cognee se ubica en la capa de memoria RAG y de agentes, junto a frameworks de orquestación y otros frameworks de recuperación que los desarrolladores suelen evaluar juntos. Estos no son productos idénticos — algunos son frameworks de orquestación más amplios, otros librerías de recuperación más estrechas — pero compiten por la misma decisión: "cómo le doy a mi aplicación LLM acceso estructurado a mis datos".

LangChain

Best known for:
Framework de aplicaciones LLM de propósito general con un gran ecosistema de integraciones de recuperación y agentes
Artículos sobre LangChain (10)

+29 más no mostrados

LlamaIndex

Best known for:
Framework de datos centrado específicamente en indexación y recuperación para aplicaciones LLM
Artículos sobre LlamaIndex (10)

+15 más no mostrados

Haystack (deepset)

Best known for:
Framework de pipeline RAG y búsqueda de código abierto de deepset

txtai

Best known for:
Base de datos vectorial embebida ligera y librería de búsqueda semántica
Artículos sobre txtai (1)

También mencionado en:

Esta no es una lista exhaustiva de herramientas de memoria y recuperación — consulta el Directorio de software de LLM local para el catálogo completo y actualizado periódicamente, incluyendo la propia entrada de cognee.

Errores comunes al evaluar cognee

La mayoría de la confusión sobre cognee viene de asumir que es completamente local por defecto, confundirlo con una base de datos vectorial simple, o asumir que una función específica de la API es estable a largo plazo.

Preguntas frecuentes

¿Qué es cognee?

cognee (cognee.ai, código fuente en github.com/topoteretes/cognee) es una librería Python gratuita y de código abierto (Apache-2.0) que le da a los agentes de IA memoria persistente construyendo un grafo de conocimiento autoalojado a partir de documentos, código y conversaciones.

¿cognee es gratis?

Sí, el motor de código abierto de cognee es gratuito y tiene licencia Apache-2.0, sin ningún nivel de pago que limite alguna función de la librería. Cognee Cloud es una oferta gestionada aparte y opcional con su propio nivel de precio independiente — consulta cognee.ai para los precios actuales.

¿Cómo instalo cognee?

Ejecuta pip install cognee (o uv pip install cognee si usas uv). Requiere un entorno Python y, para el flujo por defecto, una clave de API para tu proveedor de LLM/embeddings configurado, o una instancia local de Ollama en ejecución si está configurado para procesamiento local.

¿cognee funciona completamente sin conexión?

No por defecto. La localidad de cognee es híbrida — el motor de grafo de conocimiento y el almacenamiento son autoalojados, pero las llamadas de LLM/embeddings por defecto van a un proveedor externo que configures. cognee documenta soporte para enrutar ese procesamiento a través de un modelo local de Ollama en su lugar, para una configuración totalmente local.

¿En qué se diferencia cognee de una configuración RAG/base de datos vectorial simple?

Una configuración RAG simple normalmente trocea documentos y los recupera solo por similitud vectorial. cognee además extrae entidades y relaciones de tus datos hacia un grafo de conocimiento, y luego enruta automáticamente las consultas a recorrido de grafo, similitud vectorial o una estrategia híbrida, buscando una recuperación más estructurada y conectada.

¿Cuál es la API de cognee para ingerir y consultar datos?

El inicio rápido actual muestra cognee.remember(text) para ingerir y cognee.recall(query_text=...) para consultar. El pipeline de nivel más bajo debajo es cognee.add() (ingesta), cognee.cognify() (construir el grafo) y cognee.search() (consultar), para un control más granular.

¿Quién desarrolla cognee?

cognee es desarrollado por Topoteretes UG (haftungsbeschränkt), una empresa berlinesa dirigida por el director gerente Vasilije Markovic.

¿Qué licencia usa cognee?

Apache-2.0, confirmada en el repositorio de GitHub.

¿Puede cognee usar modelos locales vía Ollama?

Sí. Aunque el flujo por defecto de cognee enruta las llamadas de LLM y embeddings a un proveedor externo configurado, también documenta soporte para dirigir ese procesamiento a una instancia local de Ollama en su lugar.

¿Con qué herramientas de agentes e IDE se integra cognee?

Las integraciones documentadas incluyen Claude Code (como plugin de memoria), Cursor, Cline, LangGraph, CrewAI, OpenClaw, y soporte del Model Context Protocol (MCP) para conectar cognee como herramienta a clientes compatibles con MCP.

¿Cómo se compara cognee con LangChain o LlamaIndex?

LangChain y LlamaIndex son frameworks más amplios de aplicaciones LLM e indexación de datos que pueden incorporar muchos backends de recuperación. cognee es más estrecho y específico: una librería de memoria centrada en construir y consultar un grafo de conocimiento, que puede usarse junto a frameworks como LangChain en lugar de estrictamente en su lugar.

Fuentes

← Volver a LLM locales avanzados