RemarkableCloud

Apps / LiteLLM

Hosting LiteLLM administrado.
Un servidor, sin límite de apps.

One API gateway for 100+ LLM providers: unified OpenAI-format calls, spend tracking, rate limits, and failover, self-hosted.

Qué es

LiteLLM es el controlador de tráfico de las APIs de IA: una pasarela autoalojada que habla formato OpenAI y enruta a más de 100 proveedores, con control de gasto por clave, límites de tasa, reintentos y failover. Apunta todas tus apps a una URL y gestiona el caos en un solo lugar.

RAM mínima

1 GB

Cabe en SC-1GB; SC-2GB es la opción cómoda con espacio para apilar.

Qué instalamos

Nuestro playbook despliega el proxy LiteLLM con almacén de claves respaldado en PostgreSQL, HTTPS emitido y forzado, y una clave de administrador generada para ti. Agregas claves de proveedores, acuñas claves virtuales por app o compañero, listo.

Qué cubre administrado

Actualizaciones del servidor, snapshots, respaldos dobles fuera de sitio, monitoreo, firewall y humanos de guardia. Tus claves de proveedor quedan en tu base de datos en tu servidor.

La app es $0. El servidor administrado es la única factura, y todo lo de arriba es parte de ella.

¿Por qué poner una pasarela frente a los proveedores de IA?

Porque cinco apps con cinco claves API incrustadas es como nacen las sorpresas de gasto y las caídas. LiteLLM le da a cada app una clave virtual con su presupuesto y su límite, rastrea el gasto por clave y conmuta a un segundo proveedor cuando el primero tiene un mal día.

¿Qué significa realmente compatible con OpenAI?

Cualquier herramienta que hable con la API de OpenAI puede hablar con tu URL de LiteLLM sin cambios, mientras la pasarela traduce a Anthropic, Google, Mistral, Ollama o cien más por detrás. Cambiar de proveedor pasa a ser una línea de configuración, no un cambio de código.

¿Cuánto servidor necesita LiteLLM?

Es la app más ligera de nuestro estante de IA: 1 GB corre el proxy para tráfico personal o de equipo pequeño. Casi siempre comparte servidor con las apps que lo llaman, que es exactamente para lo que existe el medidor del carrito.

¿LiteLLM ve mis prompts?

Las solicitudes pasan por tu pasarela en tu servidor camino al proveedor que elegiste; no se registra nada más allá de lo que tú habilites. Ese es el punto de autoalojar el plano de control.

Apílalo

LiteLLM funciona bien con.

Mismo servidor, sin factura extra. Estos son los compañeros que más se despliegan junto a LiteLLM.

LibreChat

+4 GB

Una interfaz privada estilo ChatGPT para todos los grandes proveedores de modelos. Una sola UI limpia, tus claves API, tu historial en tu servidor.

Flowise

+2 GB

Constructor visual de apps y agentes LLM. Prototipa chatbots y pipelines arrastrando bloques y sírvelos como APIs desde tu propio servidor.

PostgreSQL

+1 GB

La base de los ingenieros: JSONB, extensiones hasta pgvector y afinado correcto, del repositorio oficial PGDG.

Preguntas frecuentes

¿Quién debería correr LiteLLM?

Cualquiera con más de una app que consume IA o más de un compañero con claves de proveedor sueltas. Es el compañero natural de LibreChat, Flowise y OpenClaw en el mismo servidor, todos a $0 aquí.

¿La pasarela agrega latencia?

Milisegundos de un dígito en el mismo servidor, que desaparecen junto al tiempo de inferencia del modelo medido en segundos. El failover y los reintentos suelen ahorrar mucho más tiempo del que cuesta el salto.

¿Cuánto cuesta alojar LiteLLM?

La app cuesta $0; un Cube gestionado de 1 GB empieza en $20/mo en facturación anual y lo corre con espacio de sobra. El uso de proveedores factura con cada proveedor mediante tus propias claves.

¿Dimensionando una pila de apps? La calculadora de dimensionamiento VPS recomienda un plan según tus apps y tráfico, con el cálculo a la vista.

Your server runs. You sleep.

Fully managed hosting from people who have been doing this since 2001.