Construido sobre tecnología de código abierto
Todo lo que necesitás,
sin depender de nadie
Gestor de modelos + agente de código autónomo, funcionando en tu hardware.
Hugging Face Hub
Explorá miles de modelos GGUF por temática: código, razonamiento, agentes y más.
Detección de hardware
Badge por modelo: si entra en VRAM, si spill a RAM, o si no corre en tu máquina.
CPU y GPU
Funciona en cualquier CPU x64. Con GPU CUDA o Vulkan se acelera automáticamente.
La IA que
no te espía
Cada modelo corre en tu máquina. Cada token se genera localmente. Ningún dato tuyo — código, prompts ni conversaciones — sale nunca de tu computadora.
Empezá en minutos
Descargá, instalá y tenés tu primer modelo corriendo en menos de 5 minutos.
Bitácora de desarrollo
Cómo lo estamos
construyendo
Cómo probamos que Aleph no se miente solo
Agregamos una suite determinística con modelo falso para probar el harness real: tool calls, permisos, errores, loops, contexto, grammar y native.
Leer postAleph aprende a acordarse (sin la nube)
Memoria persistente entre sesiones con MEMORY.md por proyecto y USER.md global.
Aleph aprende a googlear (sin Google)
web_search y web_fetch sin ninguna API paga, con detección de páginas JavaScript puras.
El agente que sí puede hacer cosas
Herramientas, permisos y el loop autónomo que convierte al modelo en un asistente de verdad y no sólo un chatbot.
Streaming real: token a token sin esperar
Por qué el streaming importa y cómo conectamos llama-server con la UI en tiempo real sin que nada explote.
FAQ
Preguntas frecuentes
¿Dudas? Si no encontrás lo que buscás, usá el formulario de contacto.
Escribirnos¿Agent Aleph envía mis datos a la nube?
No. Agent Aleph es 100% local. Todos los modelos corren en tu máquina y ningún dato — código, prompts ni conversaciones — sale de tu computadora. No hay telemetría, no hay logs remotos.
¿Necesito una GPU para usarlo?
No. Funciona en cualquier CPU x64 con 8 GB de RAM. Si tenés una GPU NVIDIA (CUDA) o compatible con Vulkan, el rendimiento mejora automáticamente. Agent Aleph te muestra qué modelos caben en tu hardware antes de descargarlos.
¿Qué modelos puedo usar?
Cualquier modelo en formato GGUF disponible en Hugging Face Hub: Qwen, Mistral, DeepSeek, Llama, Phi, Gemma y muchos más. Hay un catálogo curado por temática (código, razonamiento, agentes) con badge de compatibilidad con tu hardware.
¿Cuánto cuesta?
Completamente gratis. Código abierto bajo licencia MIT. No hay suscripciones, no hay API keys, no hay costo por token. Descargás una vez y es tuyo para siempre.
¿En qué sistemas operativos funciona?
Actualmente solo Linux x64 (.AppImage y .deb). El soporte para Windows y macOS está planificado. Si querés contribuir con el porting, el repositorio está abierto.