Image 1
Image 2
Image 3
Image 4
Image 5
Image 6

Merlyn 2.0 — Asistente IA Local con RAG

Sistema de IA local con RAG completo. Soporta múltiples LLMs (Ollama, HuggingFace, GGUF local), ChromaDB para embeddings, ingesta de documentos PDF/DOCX/CSV/MD y aceleración GPU automática.

Stack

Python
LangChain
ChromaDB
Ollama
RAG
HuggingFace
llama-cpp
Streamlit
NiceGUI
Chainlit
SQLite3
GPU/CUDA

¿Qué es Merlyn?

Merlyn es un asistente de inteligencia artificial que corre 100% local en tu máquina, sin depender de APIs externas ni enviar datos a la nube. Combina LLMs locales con un sistema RAG (Retrieval Augmented Generation) para responder preguntas basadas en tus propios documentos.

Capacidades principales

  • RAG multi-formato: ingesta PDF, DOCX, TXT, CSV, MD y JSON
  • Multi-proveedor de modelos: Ollama (Llama, Mistral, Gemma), HuggingFace API y modelos GGUF locales via llama-cpp
  • Aceleración GPU: detección automática de CUDA para acelerar inference
  • Historial persistente: conversaciones almacenadas en SQLite3, disponibles entre sesiones
  • Gestión de documentos: upload, indexación por lotes con feedback de progreso, eliminación individual
  • Tres interfaces: Streamlit, NiceGUI y Chainlit

Arquitectura

LangChain v0.3 → ChromaDB (vectores) → Ollama / HuggingFace / llama-cpp
                                         ↑
                              PDF / DOCX / CSV / MD / JSON

Stack técnico

  • Python + LangChain v0.3
  • ChromaDB para embeddings y retrieval
  • Ollama para LLMs locales (Llama 3, Mistral, Gemma)
  • llama-cpp-python para archivos GGUF
  • HuggingFace via API y modelos locales
  • Streamlit / NiceGUI / Chainlit (interfaces)
  • SQLite3 para historial de chat
Jul 16, 2026