RemarkableCloud

Apps / AnythingLLM

Hosting AnythingLLM administrado.
Un servidor, sin límite de apps.

Chat with your own documents. A private RAG workspace that ingests PDFs and sites, pairs with Ollama or any API model, and keeps data on your server.

Qué es

AnythingLLM convierte tus documentos en algo con lo que puedes conversar: un espacio RAG privado que ingiere PDFs, documentos y sitios web, los indexa y responde preguntas basadas en tu propio material, con citas.

RAM mínima

4 GB

Cabe en SC-4GB; SC-8GB es la opción cómoda con espacio para apilar.

Qué instalamos

Nuestro playbook despliega la imagen oficial de Docker con almacenamiento persistente para tus documentos y vectores, HTTPS emitido y forzado, y modo multiusuario listo. Apúntalo al modelo que prefieras: tu clave API o un Ollama en el mismo servidor.

Qué cubre administrado

Actualizaciones del servidor, snapshots, respaldos dobles fuera de sitio que incluyen tu almacén de documentos, monitoreo, firewall y humanos de guardia. Tus documentos no salen de tu servidor a menos que elijas un modelo en la nube para la inferencia.

La app es $0. El servidor administrado es la única factura, y todo lo de arriba es parte de ella.

¿Qué puedo hacer realmente con AnythingLLM?

Dale contratos, manuales, investigación o una wiki exportada y pregunta en lenguaje natural; las respuestas citan los pasajes fuente. Los equipos usan espacios de trabajo para separar clientes o proyectos, cada uno con sus documentos y su historial.

¿Mis datos quedan privados?

Documentos y embeddings viven en tu servidor, dentro de nuestros respaldos dobles fuera de sitio. Si lo combinas con Ollama en el mismo Cube, hasta la inferencia es local y nada sale de la máquina; con clave API comercial, solo viajan los pasajes recuperados al proveedor.

¿Cuánta RAM necesita AnythingLLM?

4 GB corre la app y su base vectorial embebida con colecciones serias de documentos. Suma Ollama para inferencia local y el par quiere 16 GB o más según el modelo; el medidor del carrito hace esa cuenta por ti.

¿Qué modelos funcionan con él?

OpenAI, Anthropic, Google y cualquier endpoint compatible con OpenAI, más modelos locales vía Ollama. Los embeddings pueden correr locales en cualquier caso, lo que mantiene la ingesta gratis y privada.

Apílalo

AnythingLLM funciona bien con.

Mismo servidor, sin factura extra. Estos son los compañeros que más se despliegan junto a AnythingLLM.

Ollama

+16 GB

Modelos de lenguaje en tu propio servidor: Llama, Mistral, Qwen y el mundo abierto tras una API local privada.

LiteLLM

+1 GB

Una pasarela API para más de 100 proveedores LLM: llamadas en formato OpenAI unificado, control de gasto, límites y failover, autoalojado.

Nextcloud

+2 GB

Tu propia nube de archivos: sync en cada plataforma, calendarios y colaboración, con el almacenamiento siendo tu NVMe.

Preguntas frecuentes

¿AnythingLLM sirve para un equipo pequeño?

Sí: el modo multiusuario con permisos por espacio de trabajo viene integrado en el despliegue Docker que entregamos. Un servidor sostiene espacios separados por cliente o departamento limpiamente.

¿AnythingLLM o un RAG a medida?

AnythingLLM te da un sistema privado de chat con documentos funcionando el día que el servidor se aprovisiona. Un pipeline propio en Flowise gana cuando necesitas lógica de recuperación exótica; muchos equipos corren ambos, y ambos cuestan $0 aquí.

¿Cuánto cuesta correrlo?

La app cuesta $0; un Cube gestionado de 4 GB empieza en $40/mo en facturación anual. Embeddings locales e inferencia con Ollama no suman costo por token; los modelos por API facturan con su proveedor.

¿Dimensionando una pila de apps? La calculadora de dimensionamiento VPS recomienda un plan según tus apps y tráfico, con el cálculo a la vista.

Your server runs. You sleep.

Fully managed hosting from people who have been doing this since 2001.