





Merlyn 2.0 — Asistente IA Local con RAG
Sistema de IA local con RAG completo. Soporta múltiples LLMs (Ollama, HuggingFace, GGUF local), ChromaDB para embeddings, ingesta de documentos PDF/DOCX/CSV/MD y aceleración GPU automática.
Stack
Python
LangChain
ChromaDB
Ollama
RAG
HuggingFace
llama-cpp
Streamlit
NiceGUI
Chainlit
SQLite3
GPU/CUDA
¿Qué es Merlyn?
Merlyn es un asistente de inteligencia artificial que corre 100% local en tu máquina, sin depender de APIs externas ni enviar datos a la nube. Combina LLMs locales con un sistema RAG (Retrieval Augmented Generation) para responder preguntas basadas en tus propios documentos.
Capacidades principales
- RAG multi-formato: ingesta PDF, DOCX, TXT, CSV, MD y JSON
- Multi-proveedor de modelos: Ollama (Llama, Mistral, Gemma), HuggingFace API y modelos GGUF locales via llama-cpp
- Aceleración GPU: detección automática de CUDA para acelerar inference
- Historial persistente: conversaciones almacenadas en SQLite3, disponibles entre sesiones
- Gestión de documentos: upload, indexación por lotes con feedback de progreso, eliminación individual
- Tres interfaces: Streamlit, NiceGUI y Chainlit
Arquitectura
LangChain v0.3 → ChromaDB (vectores) → Ollama / HuggingFace / llama-cpp
↑
PDF / DOCX / CSV / MD / JSON
Stack técnico
- Python + LangChain v0.3
- ChromaDB para embeddings y retrieval
- Ollama para LLMs locales (Llama 3, Mistral, Gemma)
- llama-cpp-python para archivos GGUF
- HuggingFace via API y modelos locales
- Streamlit / NiceGUI / Chainlit (interfaces)
- SQLite3 para historial de chat
Jul 16, 2026