# 🚀 OmniRoute — La puerta de enlace de IA gratuita
## 💰 ~1.62B de tokens gratuitos al mes
> Combinar manualmente los niveles gratuitos es tedioso: docenas de SDK, docenas de límites de uso y ninguna idea de cuánto tienes realmente. OmniRoute cataloga **489 entradas de niveles gratuitos distribuidas entre 35 claves de pools recurrentes** y calcula la cifra principal de tokens a partir de los **17 pools con un presupuesto mensual positivo publicado, más cinco límites de Groq por modelo**, eliminando duplicados por pool compartido. Las cuotas que solo se habilitan después de una verificación de identidad regional (actualmente: ModelScope) se muestran por separado, +~6M sujetos a verificación de identidad regional, y nunca se suman a la cifra principal. El resultado permanece visible en el panel (`/dashboard/free-tiers`).
> Resumen animado de la página activa `/dashboard/free-tiers`. Metodología completa (deduplicación de pools, niveles de crédito y términos de los proveedores): **[docs/reference/FREE_TIERS.md](docs/reference/FREE_TIERS.md)**.
>
> Estas cifras se vuelven a auditar cada dos semanas comparándolas con el catálogo activo y **pueden moverse en ambas direcciones**: si un proveedor termina un nivel gratuito, la cifra baja; si aparece uno nuevo, sube. Publicamos lo que el catálogo calcula realmente, nunca el mejor escenario redondeado al alza.
⭐ Dale una estrella al repositorio si OMNIROUTE te ayudó a ahorrar dinero y facilitar tu trabajo.
[](https://github.com/diegosouzapw/OmniRoute)
[](https://www.star-history.com/diegosouzapw/omniroute)
[](https://olud.ai/project/diegosouzapw-omniroute.html)
### 💬 Únete a la comunidad
**👋 Sigue al mantenedor y entérate primero de nuevos proveedores, versiones y consejos:**
[](https://www.linkedin.com/in/diegosouzapw/)
[](https://github.com/diegosouzapw)
[](https://discord.gg/U47eFqAXCn)
[](https://t.me/omnirouteOficial)
[](https://chat.whatsapp.com/FvuCbrpZmQ6I85n2vW5QIC?s=cl&p=a&mlu=4)
[](https://chat.whatsapp.com/KWgatljAjmbELQory59Oti?s=cl&p=a&mlu=4)
[](https://omniroute.online)
**Preguntas, recomendaciones de proveedores, hoja de ruta y soporte → [Discord](https://discord.gg/U47eFqAXCn) · [Telegram](https://t.me/omnirouteOficial) · WhatsApp [🌍 Global](https://chat.whatsapp.com/FvuCbrpZmQ6I85n2vW5QIC?s=cl&p=a&mlu=4) / [🇧🇷 Brasil](https://chat.whatsapp.com/KWgatljAjmbELQory59Oti?s=cl&p=a&mlu=4) / [Portal](https://portal.sthub.com.br/communities/groups/st-hub/channels/Omniroute-World-8kRjmK)**
## 📈 El Gateway sigue creciendo
| | v3.8.49 | **v3.8.50** | `v3.8.51+` |
| -------------------------------- | :-----: | :-----------------------: | :-----------: |
| 🌐 Proveedores | 290 | **357** | más en espera |
| 🧠 IDs únicos de modelos de chat | 1185 | **1312** | — |
| 🖼️ Puente de modalidades | — | 🆕 visión + audio + vídeo | — |
| 📡 Catálogo gratuito de Radar | — | 🆕 participación opcional | — |
| ⚖️ Programación según cuota | — | 🆕 Quota-Share | — |
| 📊 Telemetría de cuotas | — | 🆕 en directo | — |
**→ [Hoja de ruta](ROADMAP.md) — avanzando por la vía hacia `v3.9.0 LTS`**
## 🧩 Disponible
[](https://www.npmjs.com/package/omniroute)

[](https://hub.docker.com/r/diegosouzapw/omniroute)
[](LICENSE)


## 🆓 Funciona al instante de instalarlo — sin claves, sin configuración
```bash
# Instalación nueva, cero credenciales — `auto` ya funciona:
curl http://localhost:20128/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"auto","messages":[{"role":"user","content":"Hello!"}]}'
```
¿Prefieres un backend gratuito específico? Llama a `oc/…` (OpenCode Free) directamente. Luego, pasa a `auto` y deja que OmniRoute elija.📦 Scripts de inicio rápido para copiar y pegar para **Python, Node.js, PHP y cURL** → [`examples/quickstart/`](examples/quickstart/)
# 💥 La Promesa
# 🤔 ¿Por qué OmniRoute?
## 🤝 Con el apoyo de nuestros amigos del código abierto
> **¿Quieres unirte como amigo del código abierto?** Estas son las empresas que respaldan el código abierto y ayudan a que OmniRoute siga avanzando, y explicamos públicamente a dónde va cada token que nos proporcionan. Contáctanos: [diegosouza.pw@outlook.com](mailto:diegosouza.pw@outlook.com)
Kimi Moonshot AI
¡Gracias a Kimi (Moonshot AI), nuestro amigo fundador del código abierto, por respaldar este proyecto! Kimi es el laboratorio de IA responsable de las familias de modelos de pesos abiertos K2 y K3. Kimi K3 ofrece una ventana de contexto de 1 millón de tokens, visión nativa y programación de nivel de frontera por una fracción del precio de los modelos cerrados, y funciona de inmediato con Claude Code, Codex y todas las herramientas de programación compatibles con OmniRoute.
Lo que hace posible el apoyo de Kimi: los créditos de la API de Kimi impulsan el proceso de lanzamientos de OmniRoute validado por IA —la etapa de validación de fusiones impulsada por Kimi K3, que revisa cada solicitud de incorporación antes de su publicación—, además del desarrollo diario de funcionalidades. La compatibilidad de primera clase con Kimi se ofrece por ambas vías: la API de Kimi directa (kimi-k3) y el plan de programación Kimi Code (OAuth y clave de API). OmniRoute también es el primer proyecto brasileño de código abierto que forma parte del programa de apoyo de Kimi. Obtén una clave de la API de Kimi con un 15 % de créditos adicionales →
Cheaper Inference cheaperinference.com
¡Gracias a Cheaper Inference, un amigo del código abierto de OmniRoute, por respaldar este proyecto! Cheaper Inference es una puerta de enlace clasificada por coste que revende 42 modelos de frontera —Claude, GPT-5.x, Gemini, Kimi K3, GLM, DeepSeek, Grok y MiniMax— mediante un único endpoint compatible con OpenAI, dirigiendo cada solicitud al proveedor elegible más barato sin cobrar nunca por encima del precio de lista del creador del modelo.
Compatibilidad de primera clase en OmniRoute: Chat Completions, el endpoint nativo /v1/responses, visión, llamadas a herramientas y 3 modelos de imágenes (grok-imagine, nano-banana-pro, nano-banana-2, accesibles como cheaperinference/<model>). Obtén una clave de API →
Los enlaces etiquetados con aff=omniroute son enlaces de socios. Financian el proyecto sin ningún coste adicional para ti. 🎟️ Promociones de afiliados — cupones gratuitos de registro de proveedores que no nos patrocinan (haz clic para desplegar)Esta sección es únicamente para códigos de recomendación o cupones. Las colaboraciones patrocinadas aparecen arriba, en 🤝 Con el apoyo de nuestros amigos del código abierto. OmniRoute no mantiene ningún patrocinio ni colaboración con los proveedores aquí indicados; estos son cupones públicos que cualquiera puede utilizar.
AgentRouter agentrouter.org
AgentRouter — registro de afiliado · $100 en créditos gratuitos al registrarte (servidor gratuito; puede tener una latencia mayor, por lo que es más adecuado para pruebas que para producción). Compatibilidad de primera clase en OmniRoute desde la versión v3.8.50: Chat Completions, el formato de transmisión compatible con Anthropic y la ruta compatible con OpenAI. Los modelos disponibles incluyen claude-opus-4-8, claude-opus-5, gpt-5.6-sol y más. Consigue tus $100 →
⚠️ Enlace de afiliado: OmniRoute no mantiene ningún patrocinio ni colaboración con este proveedor.
¿Conoces otro proveedor con un generoso cupón gratuito de registro que beneficie a los usuarios de OmniRoute? Abre una incidencia y lo añadiremos aquí.
## 🎯 Combos — La funcionalidad estrella
> Un **combo** es una cadena de modelos entre los que OmniRoute enruta **automáticamente**. Si se agota la cuota, falla un proveedor o aumentan los costes, el combo puede pasar al siguiente modelo válido y operativo. 🛡️
### ⚡ Sin configuración — solo usa `auto`
No es necesario crear ningún combo. Establece tu modelo como `auto` (o una variante) y OmniRoute crea un combo virtual a partir de tus proveedores conectados, evaluados en tiempo real:
ID del modelo
Qué optimiza
auto
🎯 Opción predeterminada equilibrada (LKGP — mantiene tu último proveedor funcional)
auto/coding
🧑💻 Ponderaciones que priorizan la calidad para la generación de código
auto/fast
⚡ Menor latencia primero
auto/cheap
💰 Menor coste por token primero
auto/offline
🔋 Mayor margen de cuota/límite de solicitudes primero
auto/smart
🔭 Prioriza la calidad + 10 % de exploración para descubrir mejores modelos
auto/lkgp
📌 Afinidad explícita con el último proveedor funcional conocido
auto/chaos
🧪 Ponderaciones de inyección de fallos para pruebas de resiliencia (ingeniería del caos)
##
### 🔀 O crea el tuyo — 19 estrategias de enrutamiento
Las **19** estrategias — combínalas como quieras en cada paso del combo:
#
Estrategia
Qué hace
1
priority
Lista ordenada con prioridad para el primer objetivo — agota cada uno antes de pasar al siguiente 🥇
2
fill-first
Agota por completo la cuota de cada objetivo antes de continuar
3
weighted
Selección aleatoria ponderada según el peso de cada objetivo
4
round-robin
Recorre los objetivos en orden de forma cíclica
5
p2c
Balanceo de carga aleatorio mediante elección entre dos opciones
6
least-used
Selecciona el objetivo con la menor carga actual
7
random
Selección aleatoria uniforme (sin duplicados)
8
strict-random
Selección aleatoria sin eliminar repeticiones 🎲
9
cost-optimized
Minimiza el coste por solicitud según los precios del catálogo en tiempo real 💸
10
headroom
Selecciona el objetivo con la mayor cuota restante
11
reset-window
Prioriza el objetivo cuya ventana de cuota se restablezca antes
12
reset-aware
Ordena según el tiempo de restablecimiento de la cuota — las ventanas cortas primero 📊
13
context-relay
Transfiere el contexto entre objetivos para conversaciones largas 🧠
14
context-optimized
Selecciona la opción más adecuada para el tamaño del contexto actual
15
cache-optimized
Asigna cada prefijo de prompt reutilizable a la misma cuenta — maximiza los aciertos de la caché de prompts 🎯
16
lkgp
Última ruta funcional conocida — mantiene el último proveedor que respondió correctamente y, si falla, aplica las reglas alternativas
17
auto
Evaluación en tiempo real de 16 factores en todas las conexiones 🤖
18
fusion
Distribuye la solicitud entre un panel de modelos y un juez sintetiza una única respuesta 🧬
19
pipeline
Encadena pasos — la salida de cada objetivo alimenta al siguiente 🔗
El motor Auto-Combo evalúa cada candidato según **16 factores** (estado, cuota, coste, latencia, adecuación a la tarea, calidad, disponibilidad de la sesión…) — consulta [`docs/routing/AUTO-COMBO.md`](docs/routing/AUTO-COMBO.md).
##
### 🧱 Resiliencia integrada (3 capas independientes)
📖 [Motor de combinación automática](docs/routing/AUTO-COMBO.md) · [Guía de resiliencia](docs/architecture/RESILIENCE_GUIDE.md)
## 🏆 Lo que distingue a OmniRoute
📊 Metodología completa y detalles por característica frente a 9router, OpenRouter, CLIProxyAPI y LiteLLM → [`docs/comparison/OMNIROUTE_VS_ALTERNATIVES.md`](docs/comparison/OMNIROUTE_VS_ALTERNATIVES.md)
## 💚 Apoya a OmniRoute
OmniRoute tiene licencia MIT y se mantiene de forma abierta. Si te ahorra tiempo o dinero, estas son algunas formas de ayudar a que siga siendo independiente; elige la que mejor se adapte a ti. El patrocinio nunca afecta la prioridad de enrutamiento; proporciona visibilidad, no una mejor posición.
**🇧🇷 PIX** — instantáneo, sin comisiones (Brasil)
Clave (aleatoria): `5d865059-bc44-483a-962d-43ceb80126eb`
Pix para copiar y pegar:
```
00020101021126580014br.gov.bcb.pix01365d865059-bc44-483a-962d-43ceb80126eb5204000053039865802BR5922OMNIROUTE CONTRIBUICAO6006BRASIL62070503***630475DD
```
₿ Criptomonedas — BTC · ETH · USDT-TRC20 · USDC-Solana (haz clic para desplegar)
₿ BTC
Bitcoin (SegWit)
bc1qh00smz004sy85wyl28v77tenkt3ckl6eaep7fd
Ξ ETH
Ethereum (ERC20)
0x64Cf6B68A6Ff34288e89172950a2d00102337a84
₮ USDT
Tron (TRC20)
TKAF41JpuQrHbKTnsQa9svJE2T192Hvsc2
$ USDC
Solana
2emNNZzVVWQc3FQ2wk9M6qXUQmW8AKdjjL174fXR28Tu
⚠️ Envía cada moneda únicamente a través de la red indicada; si la envías por la red equivocada, podrías perder los fondos.
🐛 ¿Has encontrado un error o tienes algún comentario? Abre una [Discusión](https://github.com/diegosouzapw/OmniRoute/discussions).
Notas para desarrolladores: El proyecto puede generar un archivo local .env durante la instalación o posinstalación con npm para facilitar el trabajo de los desarrolladores. Este archivo se ignora intencionadamente mediante .gitignore (consulta .gitignore) y nunca debe incluirse en un commit; si se incluye por accidente, cambia todos los secretos expuestos y elimina el archivo del historial. Consulta docs/DEVELOPER-ENVIRONMENT.md para obtener orientación sobre cómo gestionar los archivos de entorno locales y los secretos.
## 📡 Radar de OmniRoute
El principal límite destacado del nivel gratuito sigue siendo de **~1,62 mil millones de tokens/mes**, según el catálogo documentado y sin duplicados entre proveedores que aparece arriba. Los créditos temporales por registro de algunos proveedores pueden aumentar por separado el primer mes hasta **~2,22 mil millones**. Radar es una capa de catálogo opcional y firmada para quienes deseen información más actualizada sobre la disponibilidad de modelos gratuitos entre las versiones de OmniRoute; el catálogo de la comunidad y todas las funciones gratuitas existentes seguirán siendo gratuitos.
Los colaboradores pueden recibir el catálogo en tiempo real y oportunidades adicionales de proveedores. Su límite independiente y variable es de **aproximadamente 3 mil millones de tokens/mes como máximo**, en función de la disponibilidad de los proveedores. Este límite no está garantizado: los proveedores pueden modificar las cuotas, los requisitos de acceso, los modelos o las regiones en cualquier momento.
Radar es opcional y solo utiliza GET. El cliente de OmniRoute no carga prompts, tráfico, configuraciones de proveedores, telemetría de uso ni el estado local de descarte de avisos. Consulta los requisitos de acceso y el catálogo actual en **[radar.omniroute.online/planos](https://radar.omniroute.online/planos)**.
## ✨ Novedades
> Aspectos destacados recientes de **v3.8.20 → v3.8.50**. Historial completo en [`CHANGELOG.md`](CHANGELOG.md).
- **🎛️ OmniConductor** — delegación A2A entrante a tu flota de agentes, habilidades de Conductor en la tarjeta del agente y un panel de control con chat de voz pulsar-para-hablar de Faro. → [Servidor A2A](docs/frameworks/A2A-SERVER.md)
- **🛂 Admisión adaptativa y protección contra sobrecargas** — las solicitudes de chat pesadas se ponen en cola en lugar de devolver errores 503, con concesiones móviles de RPM atómicas por conexión. → [Guía de resiliencia](docs/architecture/RESILIENCE_GUIDE.md)
- **🗂️ Ordenación canónica de `/v1/models`** — un bloque contiguo agrupado por proveedor para cada proveedor (con las combinaciones fijadas primero), estable en todas las fuentes del catálogo. → [Referencia de la API](docs/reference/API_REFERENCE.md)
- **🗜️ Refuerzo de la compresión** — protección contra inflación activada de forma predeterminada, paquetes Caveman para DE / FR / JA + chino (wényán) y filtros RTK para Gradle y .NET. → [Compresión](docs/compression/COMPRESSION_ENGINES.md)
- **💸 Coste de tarifa plana realista** — los proveedores de suscripción / planes de programación muestran **$0** en el análisis de costes; el presupuesto, la cuota y el enrutamiento siguen realizando estimaciones. → [Referencia de la API](docs/reference/API_REFERENCE.md)
- **⚖️ Enrutamiento por cuota compartida** — divide equitativamente la cuota de una cuenta compartida entre claves agrupadas y aprovecha el trabajo disponible, de modo que las porciones inactivas se prestan. → [Guía de resiliencia](docs/architecture/RESILIENCE_GUIDE.md)
- **🤖 Configuración de CLI/agentes con un solo comando** — 13 comandos `setup-*` registrados; `omniroute run` inicia 7 CLI (Claude Code, Codex, Aider, Goose, OpenCode, Qwen Code, Gemini CLI); `omniroute configure` admite 10 destinos con un selector interactivo de proveedor+modelo y favoritos por contexto. → [Integraciones de CLI](docs/guides/CLI-INTEGRATIONS.md)
- **🛰️ Modo remoto** — controla una instancia remota de OmniRoute con tokens de alcance limitado (`connect` / `contexts` / `tokens`) y un asistente OAuth `antigravity` para instalaciones en VPS. → [Modo remoto](docs/guides/REMOTE-MODE.md)
- **🧭 Enrutamiento automático más inteligente** — combinaciones `auto/:`, **Fusion** (panel de modelos + juez), enrutamiento consciente de la tarea y anulaciones por solicitud de modelo / modo / presupuesto en USD. → [Auto-Combo](docs/routing/AUTO-COMBO.md)
- **🗜️ Compresión extensible** — 12 motores combinables + estudios de compresión: LLMLingua-2, Ultra de dos niveles, omniglyph, barrera de fidelidad por paso, GCF v3.2 y editor con reordenación mediante arrastrar y soltar. → [Compresión](docs/compression/COMPRESSION_ENGINES.md)
- **🕵️ Descifrado MITM transparente (TPROXY)** — captura CLI que ignoran las variables de entorno del proxy, con una CA por SNI y un instalador para el almacén de confianza. → [MITM/TPROXY](docs/security/MITM-TPROXY-DECRYPT.md)
- **💸 Telemetría de costes en todas partes** — encabezados de coste/uso `X-OmniRoute-*` en cada endpoint, encabezado de ahorro por aciertos de caché y cuotas de gasto en USD por clave. → [Referencia de la API](docs/reference/API_REFERENCE.md)
- **🧠 Memoria bajo tu control** — desactivada de forma predeterminada, cuantización vectorial int8 opcional + decaimiento tipado y `x-omniroute-no-memory` por solicitud. → [Memoria](docs/frameworks/MEMORY.md)
- **🛡️ Seguridad** — protección contra inyección de prompts en cada ruta de LLM (suite de pruebas de equipo rojo), barrera opcional de enmascaramiento de credenciales (censura claves de API/secretos filtrados en ambas direcciones), búsqueda web gratuita de último recurso con DuckDuckGo y una puerta de inicio de sesión OIDC opcional para el panel de control (el inicio de sesión con contraseña permanece siempre disponible). → [Barreras de seguridad](docs/security/GUARDRAILS.md)
- **🖼️ Nuevos endpoints** — `/v1/ocr` (Mistral OCR) y `/v1/audio/translations` (estilo Whisper) completan la superficie multimedia. → [Referencia de la API](docs/reference/API_REFERENCE.md)
- **🎨 Generación de imágenes / vídeo / audio** — una API para contenido multimedia: xAI Grok Imagine y vídeo de Novita AI, ComfyUI, Magnific, Adobe Firefly, Segmind y proveedores de voz como ElevenLabs. → [Referencia de la API](docs/reference/API_REFERENCE.md)
- **🌍 Despliegue y operaciones** — `basePath` para proxy inverso, detección automática del idioma del navegador, seguimiento de dispositivos por clave, confianza MITM sin privilegios de root y localización zh-TW. → [Entorno](docs/reference/ENVIRONMENT.md)
- **🤝 Más proveedores y agentes** — agentes en la nube (Codex Cloud, Cursor, Devin, Jules), Grok Build (xAI) con navegador + inicio de sesión OAuth, tarjeta nativa de Ollama, Claude Opus 5 y Sonnet 5, colaboración oficial con Kimi (Code/Web/Moonshot), Zed, Requesty, SenseNova, Yuanbao, Agnes AI… y un **catálogo renovado de 352 proveedores**. → [Proveedores](docs/reference/PROVIDER_REFERENCE.md)
- **📡 Transparencia del enrutamiento** — cada respuesta incluye un encabezado `X-OmniRoute-Decision` que indica la estrategia/proveedor/latencia que la atendió; una nueva estrategia de combinación `cache-optimized` + el factor `cacheAffinity` de Auto-Combo enrutan las solicitudes repetidas de vuelta a la conexión que conserva el prefijo en caché; y un endpoint de solo lectura `/v1/auto-combo/{channel}/candidates` expone el grupo activo de candidatos de un canal `auto/*`. → [Auto-Combo](docs/routing/AUTO-COMBO.md)
- **⚡ Rendimiento local e infraestructura** — Redis local con un solo clic, desplegadores de retransmisión para Cloudflare Workers / Deno Deploy y Bifrost y Mux como servicios integrados supervisados. → [Servicios integrados](docs/frameworks/EMBEDDED-SERVICES.md)
- **🧩 También incluido** — framework de plugins + marketplace, frameworks de habilidades Omni/Agent/GitHub, integración con bóvedas de Obsidian (22 herramientas MCP), APIs de Batch y Files compatibles con OpenAI, caché semántica de respuestas, gamificación con tablas de clasificación, descubrimiento de agentes ACP (15 agentes integrados), exportación programada de registros a BigQuery, inyección de fallos `auto/chaos`, un puente para bots de Telegram, un gestor de versiones dentro de la aplicación y clasificaciones de proveedores gratuitos de LMArena-ELO. → [Documentación](docs/README.md)
## 🤖 CLI y agentes de programación compatibles
> Una sola configuración — `http://localhost:20128/v1` — y **todos** los IDE o CLI con IA funcionan con modelos gratuitos y de bajo coste.
+ también funciona con · Agent Deck · Kiro · Command Code · Antigravity · Windsurf · AMP · cualquier herramienta compatible con OpenAI
📖 Configuración por herramienta para las 36 herramientas (26 CLI de código + 10 agentes CLI) → [`docs/reference/CLI-TOOLS.md`](docs/reference/CLI-TOOLS.md) · 🧩 Plugin de OpenCode → [`@omniroute/opencode-provider`](https://www.npmjs.com/package/@omniroute/opencode-provider)
**Ejecuta cualquier CLI compatible mediante OmniRoute con un solo comando**: no se escriben archivos de configuración,
las credenciales se inyectan por proceso y Qwen/Gemini obtienen un directorio personal aislado y desechable:
```bash
omniroute run claude --model openai/gpt-5.4 # Claude Code
omniroute run codex --model glm/glm-5.2 # CLI de OpenAI Codex
omniroute run aider --model glm/glm-5.2 -- --message "reply OK"
omniroute run goose --model glm/glm-5.2
omniroute run opencode --model glm/glm-5.2 -- run "reply OK"
omniroute run qwen --model glm/glm-5.2 -- -p "reply OK"
omniroute run gemini --model glm/glm-5.2 -- --skip-trust -p "reply OK"
# O selecciona el proveedor y el modelo de forma interactiva y escribe la configuración propia de la herramienta:
omniroute configure codex # también: claude opencode qwen aider goose gemini cline continue kilo
```
Cada comando respeta el contexto remoto activo (`omniroute connect `), `--dry-run`
muestra una vista previa de las variables de entorno y los argumentos exactos sin ejecutarlos, y `--api-key-env NAME` evita que los secretos
queden registrados en el historial de tu shell. → [Integraciones con CLI](docs/guides/CLI-INTEGRATIONS.md)
## 🌐 357 proveedores de IA — 152 marcados como gratuitos en el catálogo
> **357 proveedores registrados** en las colecciones canónicas de chat, medios, búsqueda, local, agentes en la nube y sistema, incluidos **152 que incluyen metadatos de descubrimiento `hasFree: true`**. El registro de modelos de chat abarca **229 proveedores / 2.554 pares distintos de proveedor-modelo / 1.283 IDs de modelo sin procesar**; el catálogo independiente de presupuestos gratuitos contiene **491 filas por modelo**, **35 fondos recurrentes** y **54 proveedores recurrentes/sin clave gratuitos para siempre**. Estos denominadores son diferentes por diseño; las definiciones y los cálculos con fondos sin duplicados se encuentran en la [Referencia de proveedores](docs/reference/PROVIDER_REFERENCE.md) y los [Niveles gratuitos](docs/reference/FREE_TIERS.md).
### 🏢 Todos los laboratorios principales — a través de un único endpoint
OpenAI
Anthropic
Gemini
xAI Grok
DeepSeek
Mistral
Qwen
Meta Llama
Groq
NVIDIA
MiniMax
Cohere
Perplexity
HuggingFace
Together
Fireworks
Cloudflare
Baidu
…y más de 330 adicionales — cada icono se obtiene en tiempo real del catálogo de proveedores del panel. 📖 [Referencia de proveedores](docs/reference/PROVIDER_REFERENCE.md)
### 🆓 Gratis para siempre — $0, sin tarjeta
OpenCode Zen DeepSeek V4, Nemotron 3 Sin límite de tokens
Kilo Code Enrutador automático, Tencent Hy3 Gratis para siempre
Requesty GPT-OSS 120B, Nemotron Gratis para siempre
SiliconFlow DeepSeek V3.2 / R1 Nivel gratuito
Z.AI GLM GLM-4.7 / 4.5-Flash Gratis para siempre
Baidu ERNIE ERNIE 4.0 Gratis para siempre
Qoder AI Qwen3-Max, Kimi-K2 GRATIS sin límites
Pollinations GPT, Llama, Claude No requiere clave
Cloudflare AI Más de 50 modelos 10K neuronas/día
NVIDIA NIM GLM, MiniMax ~40 RPM gratis
Cerebras GLM 4.7, GPT-OSS 1M de tokens/día
OpenRouter Modelos :free +$10 → mayor RPM
📖 Catálogo completo legible por máquinas → [`docs/reference/PROVIDER_REFERENCE.md`](docs/reference/PROVIDER_REFERENCE.md)
## 🖥️ Dónde se ejecuta OmniRoute — en cualquier lugar
> La misma aplicación, tu máquina, tus reglas. Desde una instalación global de npm hasta **tu teléfono** mediante Termux.
Plataforma
Instalación
Aspectos destacados
📦 npm (global)
npm install -g omniroute
Un solo comando, cualquier SO
🐳 Docker
docker run … diegosouzapw/omniroute
Multiarquitectura: AMD64 + ARM64
🖥️ Escritorio (Electron)
npm run electron:build
Ventana nativa + bandeja del sistema — Windows / macOS / Linux
🎩 Barra de menús (OmniRouteTray)
brew install --cask zoispag/tap/omniroute-tray
Supervisa y actualiza automáticamente el servidor — macOS
💪 ARM
arm64 nativo
Raspberry Pi, servidores ARM, Apple Silicon
📱 Android (Termux)
pkg install nodejs && npx -y omniroute
Se ejecuta en tu teléfono, las 24 horas, sin root
📲 PWA
"Añadir a la pantalla de inicio"
Pantalla completa, sin conexión, instalable desde el navegador
🧩 Plugin de OpenCode
@omniroute/opencode-provider
Integración nativa con OpenCode
🤖 VS Code Copilot Chat
instala la extensión OmniCopilot
Todos los modelos de OmniRoute en el selector nativo de Copilot Chat — versión estable e Insiders
🛠️ Desde el código fuente
npm install && npm run dev
Modifícalo, contribuye
📖 [Guía de Docker](docs/guides/DOCKER_GUIDE.md) · [Escritorio](electron/README.md) · [Bandeja de la barra de menús](https://github.com/zoispag/omniroute-tray) · [Termux](docs/guides/TERMUX_GUIDE.md) · [PWA](docs/guides/PWA_GUIDE.md) · [OpenCode](docs/frameworks/OPENCODE.md)
### 🧩 Novedad: OmniRoute dentro del Copilot Chat nativo de VS Code
> Sin una nueva barra lateral ni una nueva interfaz de chat: cada modelo ofrecido por OmniRoute aparece directamente en el
> **selector de modelos de Copilot Chat que ya utilizas**. Desde VS Code 1.122, los modelos de proveedores funcionan
> sin iniciar sesión en GitHub ni disponer de una suscripción a Copilot — modo agente, llamadas a herramientas y visión,
> gratis.
Instala la extensión **[OmniCopilot](https://github.com/diegosouzapw/OmniCopilot)**, conéctala
a tu servidor OmniRoute (de forma predeterminada, `localhost:20128`) y abre Copilot Chat → selector de modelos
→ **Administrar modelos…** → **OmniRoute**.
Desde el editor: abre la vista **Extensiones**, busca **"OmniRoute"** y haz clic en **Instalar**
— funciona de la misma forma en ambas tiendas. El código fuente, los problemas y el manual de publicación se encuentran en
[diegosouzapw/OmniCopilot](https://github.com/diegosouzapw/OmniCopilot).
📖 [Guía de VS Code Copilot Chat](docs/guides/VSCODE-COPILOT.md) — configuración, qué muestra el selector, panel en una pestaña y resolución de problemas
### 🎩 Novedad: OmniRouteTray — tu puerta de enlace en la barra de menús
> `omniroute serve` funciona mejor cuando está siempre activo. **[OmniRouteTray](https://github.com/zoispag/omniroute-tray)**
> lo convierte en una aplicación para la barra de menús de macOS que puedes configurar y olvidar: inicia el servidor, lo mantiene activo
> tras los reinicios, lo actualiza en el mismo lugar y deja tu presupuesto de tokens en tiempo real a un solo clic — **sin
> dejar abierta una ventana del terminal ni tener que ocuparte de `npm install -g omniroute`.**
Creado con [Tauri v2](https://v2.tauri.app/) (un núcleo de Rust minúsculo), incluye
su propio entorno de ejecución firmado de Node 24 y gestiona una instalación de OmniRoute propiedad de la aplicación, por lo que nunca entra en conflicto con tus
instalaciones globales de `node`/`bun`. **Comparte tu configuración y base de datos existentes en `~/.omniroute/`** — así que es el
mismo OmniRoute que ya utilizas, solo que con sombrero. 🎩
Qué hace
Cómo
🟢 Supervisa el servidor
Inicia omniroute serve y adopta una instancia que ya esté en ejecución en lugar de duplicarla
📊 Uso en tiempo real de un vistazo
Barras de cuota de los proveedores, límites de sesión/semanales de Claude con cuenta atrás hasta el restablecimiento y desglose de costes de 30 días
🔄 Actualización automática en el mismo lugar
Instalación por etapas, sustitución atómica y reversión en caso de fallo — siempre en la versión más reciente
🚀 Inicio al iniciar sesión
Inicio opcional al iniciar sesión; solo en la bandeja, sin icono en el Dock
🩺 Diagnóstico y registros
Diagnóstico con un solo clic y acceso a los registros del servidor
```sh
brew install --cask zoispag/tap/omniroute-tray
```
¿Prefieres una descarga? Obtén el archivo .dmg más reciente en
Versiones. El código fuente, las incidencias y la documentación de compilación
están disponibles en zoispag/omniroute-tray.
💛 Un proyecto comunitario de @zoispag, no una versión oficial de OmniRoute.
## 🔒 Privado y con prioridad local
📖 [Autorización](docs/architecture/AUTHZ_GUIDE.md) · [Medidas de protección](docs/security/GUARDRAILS.md) · [Cumplimiento](docs/security/COMPLIANCE.md)
## 🔌 CLI completa + A2A y MCP
> Más allá del servidor, OmniRoute es una **consola de línea de comandos completa** con **más de 80 comandos**, además de protocolos abiertos para agentes que permiten que un agente de IA la controle **por sí solo**.
### ⌨️ Una CLI real (no solo `start`)
```bash
omniroute # inicia la puerta de enlace y el panel (puerto 20128)
omniroute chat # cliente de chat TUI interactivo (comandos con barra: /model /combo /skill /memory)
omniroute setup # asistente guiado para la primera ejecución
omniroute doctor # diagnostica proveedores, puertos y dependencias nativas
```
### 🛰️ Modo remoto: ejecuta la CLI aquí y OmniRoute en un VPS
¿OmniRoute está en un servidor? Contrólalo desde tu portátil con la **misma CLI**. Inicia sesión una vez
con un token de acceso con alcance limitado; a partir de entonces, cada comando se dirigirá al servidor remoto.
```bash
omniroute connect 192.168.0.15 # contraseña → token con alcance limitado, guardado como contexto
omniroute models list # ← se ejecuta en el servidor REMOTO
omniroute configure codex # ← selecciona un modelo remoto y escribe un perfil local de Codex
omniroute tokens create --name ci --scope read # genera tokens con permisos más limitados para otros equipos
omniroute contexts use default # ← vuelve al servidor local
```
Los tokens tienen los alcances `read` / `write` / `admin`; las rutas que generan procesos siguen estando disponibles únicamente mediante loopback.
📖 [Modo remoto](docs/guides/REMOTE-MODE.md)
### 🤝 Conecta un agente y este controlará el propio OmniRoute
Expón OmniRoute mediante **MCP**, **A2A**, una **API REST**, **webhooks** o una **CLI remota**: cualquier agente compatible (o tu propio código) obtiene acceso a toda la puerta de enlace: enrutamiento, proveedores, combos, caché, compresión y memoria, de forma autónoma. Los endpoints HTTP indicados a continuación se sirven bajo `http://localhost:20128`.
Interfaz
Endpoint / comando
Úsalo para
🧰 MCP (stdio)
omniroute --mcp
Integrarlo con Claude Desktop, Cursor o cualquier cliente MCP
🌊 MCP (HTTP)
/api/mcp/stream
MCP remoto: 110 herramientas, 33 alcances (aplicación opcional) y registro de auditoría completo
📡 MCP (SSE)
/api/mcp/sse
Transporte MCP por streaming
🤝 A2A
/.well-known/agent.json
Agente a agente, JSON-RPC 2.0 + SSE, 6 habilidades
🌐 API REST
/v1/*
Compatible con OpenAI: chat, embeddings, imágenes, audio y OCR
🔔 Webhooks
/api/webhooks
Envía eventos de solicitudes y cuotas a Slack, Discord, Telegram o cualquier URL
🛰️ CLI remota
omniroute connect
Controla una instancia remota con tokens de acceso de alcance limitado
```bash
# Proporciona a Claude Code el conjunto completo de herramientas de OmniRoute mediante MCP:
claude mcp add-server omniroute --type http --url http://localhost:20128/api/mcp/stream
```
📖 [Servidor MCP](docs/frameworks/MCP-SERVER.md) · [Servidor A2A](docs/frameworks/A2A-SERVER.md) · [Protocolos para agentes](docs/frameworks/AGENT_PROTOCOLS_GUIDE.md)
## 🗜️ Ahorra entre un 15 y un 95% de tokens — automáticamente
### 📖 Cómo funciona — canalización, arquitectura y cálculo del ahorro
La combinación apilada predeterminada ejecuta `RTK → Caveman`. Cuando ambos actúan sobre la misma carga útil de herramientas/contexto, los ahorros se acumulan:
```txt
combined = 1 − (1 − RTK) × (1 − Caveman_input)
average = 1 − (1 − 0.80) × (1 − 0.46) = 89.2%
range = 78.4 – 94.6%
```
Los bloques de código, las URL, JSON y los datos estructurados están **siempre protegidos** por el motor de preservación.
> **¿Por qué usar muchos tokens cuando bastan unos pocos?** Cada solicitud pasa por la canalización de compresión de OmniRoute **de forma transparente**, sin cambios en el cliente. Ahora es una **pila de 12 motores componibles** que se ejecutan en orden y se combinan según cada configuración de enrutamiento, basándose en ideas de [RTK](https://github.com/rtk-ai/rtk), [Caveman](https://github.com/JuliusBrussee/caveman) (⭐ más de 90 000), [LLMLingua-2](https://github.com/microsoft/LLMLingua) y [Troglodita](https://github.com/leninejunior/troglodita) (PT-BR).
### 🧱 La pila de 12 motores
Los motores se ejecutan en el orden de la canalización; cada uno puede activarse o desactivarse y configurarse de forma independiente para cada combinación:
#
Motor
Qué hace
1
Session-Dedup
Descarta el contenido repetido entre turnos (direccionado por contenido, entre turnos)
2
CCR
Archiva bloques grandes tras marcadores de recuperación para obtenerlos bajo demanda
3
Lite
Recorte de espacios en blanco y URL de imágenes (base de baja latencia)
4
RTK
Filtrado, deduplicación y truncamiento inteligentes de resultados de herramientas (con reconocimiento de comandos)
5
Responses Tool Output
JSON priorizando una compresión sin pérdida + compresión acotada de diagnósticos para salidas de shell/parches/búsquedas/compilaciones (Responses API)
6
Headroom
Compactación tabular sin pérdida de matrices JSON (~30%) mediante un códec GCF integrado
7
Relevance
Puntuación extractiva de oraciones con respecto a la última consulta del usuario
8
Caveman
Compresión de texto basada en reglas (~65–75% en la salida)
9
Aggressive
Resumen + envejecimiento progresivo de turnos antiguos
10
LLMLingua-2
Poda semántica mediante ML con MobileBERT ONNX — segura para el código y asíncrona
11
Ultra
Poda heurística de tokens con un nivel opcional de modelo pequeño (SLM)
12
OmniGlyph
Codificación experimental del contexto como imagen para Claude Fable 5 medido mediante la conexión directa de Anthropic; los transformadores GPT 5.6 permanecen cerrados de forma segura a la espera de comprobantes del proveedor. Cuatro perfiles de compresión (agresivo predeterminado, equilibrado, seguro para programación y sin procesamiento) (el más agresivo; activación voluntaria)
Los bloques de código, las URL y los datos estructurados se conservan **siempre** idénticos byte por byte. Los **ajustes predefinidos con un solo clic** combinan los motores:
Modo
Ahorro
Ideal para
🪶 Lite
~15%
Opción predeterminada segura siempre activa
🪨 Standard (Caveman)
~30%
Programación diaria
⚡ Aggressive
~50%
Sesiones largas con uso intensivo de herramientas
🔥 Ultra
~75%
Ahorro máximo
🧰 RTK
60–90%
Salida de shell/pruebas/compilaciones/git
🔗 Stacked (RTK → Caveman)
78–95%
Prompts mixtos + registros de herramientas
**Ejemplo real — modo Standard:**
> **Antes (69 tokens):** _"Es probable que tu componente de React se vuelva a renderizar porque estás creando una nueva referencia de objeto en cada ciclo de renderizado. Cuando pasas un objeto en línea como prop, la comparación superficial de React lo detecta como un objeto diferente cada vez, lo que provoca un nuevo renderizado. Recomendaría usar useMemo para memorizar el objeto."_
>
> **Después (19 tokens):** _"Nueva ref. de objeto en cada renderizado. Prop. de objeto en línea = nueva ref. = nuevo renderizado. Envuélvelo en useMemo."_
>
> **Misma respuesta. Un 72% menos de tokens. Sin pérdida de precisión.** ✅
**Ejemplo en PT-BR — modo [Troglodita](https://github.com/leninejunior/troglodita):**
> **Antes (42 tokens):** _"El problema es que el componente se vuelve a renderizar porque se crea una nueva referencia de objeto en cada ciclo de renderizado. Recomendaría usar useMemo."_
>
> **Después (12 tokens):** _"Nuevo renderizado: nueva ref. en cada ciclo (objeto inline recreado). Usar `useMemo`."_
>
> **Misma respuesta. ~70 % menos tokens. Precisión técnica intacta.** ✅
### 🎚️ Más allá de los motores: estilos de salida, ajuste adaptativo y control por solicitud
Los 12 motores anteriores reducen lo que **entra**. Otras tres capas determinan **cómo**, **cuándo** y qué **sale**:
- **🪄 Estilos de salida** _(control del eje de salida)_ — inyectan instrucciones deterministas y compatibles con caché para dar forma a las respuestas; pueden combinarse, cada una con intensidad `lite` / `full` / `ultra`. Añadir un estilo requiere una sola línea en el registro:
- **Prosa concisa** — elimina relleno, artículos y expresiones dubitativas; mantiene intacta la precisión técnica.
- **Menos código** — YAGNI de «desarrollador sénior perezoso»: el cambio funcional más pequeño, sin estructura no solicitada.
- **Ponytail (desarrollador sénior perezoso)** — avanza por la escala YAGNI, corrige la causa raíz y genera el diff funcional más pequeño.
- **Tengo TDAH (acción primero)** — comienza con la siguiente acción, enumera los pasos, proporciona un único paso siguiente concreto y omite el preámbulo.
- **CJK conciso (文言)** — estilo ultraconciso de chino clásico (restringido a la configuración regional `zh`).
- **🎯 Presupuesto de contexto adaptativo** _(el ajuste)_ — en lugar de un único umbral de tokens para activar o desactivar la compresión, intensifica los motores más económicos y con menos pérdidas solo hasta donde sea necesario para **ajustarse a la ventana de contexto del modelo**. Política: `reserve-output` (predeterminada, adaptada al modelo) · `percentage` · `absolute`. Modo: `floor` (garantiza el ajuste) · `replace-autotrigger` (prevalece tu elección explícita) · `off` (umbral heredado).
- **🎛️ Dónde se decide la compresión** _(precedencia, de mayor a menor)_ — encabezado `x-omniroute-compression` por solicitud › sobrescritura de combinación de enrutamiento › perfil con nombre activo › adaptación / activación automática › valor predeterminado del panel › desactivado. El plan aplicado se devuelve en el encabezado de respuesta `X-OmniRoute-Compression: ; source=`.
Activa automáticamente según el umbral de tokens, habilita el ajuste adaptativo, fija un perfil con nombre, establece una configuración puntual por solicitud o asigna una canalización a cada combinación de enrutamiento: elige lo que mejor se adapte a la carga de trabajo. Un **entorno de evaluación** local y opcional (`npm run eval:compression`) puntúa la fidelidad frente al ahorro sobre un corpus fijado antes de promover un cambio.
📖 [`COMPRESSION_GUIDE.md`](docs/compression/COMPRESSION_GUIDE.md) · [`RTK_COMPRESSION.md`](docs/compression/RTK_COMPRESSION.md) · [`COMPRESSION_ENGINES.md`](docs/compression/COMPRESSION_ENGINES.md)
# ⚡ Inicio rápido
**1) Instalar y ejecutar**
```bash
npm install -g omniroute
omniroute
```
> 💡 ¿Aparecen `npm warn ERESOLVE` o advertencias de dependencias peer? [Son inofensivas](docs/guides/TROUBLESHOOTING.md#npm-install-warnings-eresolve--peer--deprecated).
Panel en `http://localhost:20128` · API en `http://localhost:20128/v1`.
**2) Conectar un proveedor GRATUITO (sin registro)**
Panel → **Proveedores** → conecta **Kiro AI** (Claude gratis, ~50 créditos/mes por cuenta) u **OpenCode Free** (sin autenticación) → listo.
**3) Configurar tu herramienta de programación**
```txt
URL base: http://localhost:20128/v1
Clave de API: [copiar desde Panel → Endpoints]
Modelo: auto (enrutamiento inteligente sin configuración, o cualquier proveedor/modelo)
```
**4) Verificar que funciona**
```bash
curl http://localhost:20128/v1/models -H "Authorization: Bearer YOUR_KEY"
```
Deberías ver tus modelos conectados. 🎉 Eso es todo: empieza a programar y OmniRoute se encargará automáticamente del enrutamiento y de usar alternativas en caso de error.
Si tu cliente no puede enviar encabezados personalizados, OmniRoute también ofrece alias de compatibilidad con tokens:
```txt
Catálogo OpenAI: http://localhost:20128/vscode/YOUR_KEY/
Modelos OpenAI: http://localhost:20128/vscode/YOUR_KEY/models
Chat OpenAI: http://localhost:20128/vscode/YOUR_KEY/chat/completions
Respuestas OpenAI: http://localhost:20128/vscode/YOUR_KEY/responses
Chat Ollama: http://localhost:20128/vscode/YOUR_KEY/api/chat
Etiquetas Ollama: http://localhost:20128/vscode/YOUR_KEY/api/tags
```
Úsalos únicamente con clientes que no puedan adjuntar `Authorization: Bearer ...`. La autenticación mediante encabezado sigue siendo el modo recomendado.
## 📦 Más métodos de instalación — Docker, código fuente, pnpm, Arch
**🐳 Docker**
```bash
docker run -d --name omniroute --restart unless-stopped --stop-timeout 40 \
-p 127.0.0.1:20128:20128 -v omniroute-data:/app/data diegosouzapw/omniroute:latest
```
`:latest` sigue la versión SemVer estable **publicada** más alta. No sigue la rama `main` de git. Fija `:X.Y.Z` para GitOps. Consulta [Canales de publicación de Docker](docs/guides/DOCKER_GUIDE.md#release-channels). La imagen fija **`OMNIROUTE_MEMORY_MB=1024`**. Esto es suficiente para el panel y un chat ligero. Los **agentes de programación** (`POST /v1/responses` desde Claude Code, Codex, Grok, …) necesitan un heap de V8 mucho mayor o el proceso genera un `FATAL ERROR` al alcanzar ~12 GiB con dos contextos largos que se solapan. Asigna al contenedor más memoria que el heap (los búferes nativos se encuentran fuera de V8):
| Carga de trabajo | Heap (`-e OMNIROUTE_MEMORY_MB`) | Contenedor (`--memory`) |
| -------------------------------------- | ------------------------------------------ | ----------------------- |
| Panel / chat ligero | `1024` (valor predeterminado de la imagen) | ≥2 g |
| Un agente de programación | `8192` | ≥10 g |
| Dos `/v1/responses` largos simultáneos | `10240`–`12288` | ≥12–16 g |
```bash
docker run -d --name omniroute --restart unless-stopped --stop-timeout 40 \
-e OMNIROUTE_MEMORY_MB=8192 --memory=10g \
-p 127.0.0.1:20128:20128 -v omniroute-data:/app/data diegosouzapw/omniroute:latest
```
Tabla completa: [Guía de Docker — RAM en tiempo de ejecución](docs/guides/DOCKER_GUIDE.md#runtime-ram-for-coding-agents).
> **Canal de versiones preliminares de Docker:** `diegosouzapw/omniroute:next` y
> `diegosouzapw/omniroute:next-web` siguen la rama `release/v*` predeterminada
> actual. Estas etiquetas mutables están destinadas únicamente a probar correcciones
> aún no publicadas y **no son compatibles con entornos de producción**. Consulta
> [Canales de publicación de Docker](docs/guides/DOCKER_GUIDE.md#release-channels).
**🥟 Bun**
La instalación estándar mediante `bun install` y la instalación global (`bun install -g omniroute`) son compatibles gracias a la detección del entorno de ejecución Bun:
- **`bun:sqlite` integrado**: OmniRoute utiliza el controlador `bun:sqlite` integrado de Bun cuando se ejecuta en Bun y recurre a `better-sqlite3` en Node.js o a `sql.js`.
- **Selección automática del empaquetador Webpack durante el desarrollo**: El entorno de desarrollo (`bun run dev`) detecta automáticamente Bun y desactiva Turbopack en favor de Webpack para evitar incompatibilidades con los enlaces nativos de V8. Las compilaciones de producción (`bun run build`) respetan `OMNIROUTE_USE_TURBOPACK` exactamente igual que en Node: Turbopack de forma predeterminada o `OMNIROUTE_USE_TURBOPACK=0` para compilar con Webpack (`Dockerfile.bun` lo expone como un `--build-arg`).
- **Dockerfile específico para Bun**: `Dockerfile.bun` multietapa para despliegues de producción nativos de Bun (`docker build -f Dockerfile.bun -t omniroute:bun .`).
```bash
# Instalar y ejecutar con Bun
bun install
bun run dev
```
**🛠️ Desde el código fuente**
```bash
cp .env.example .env && npm install
PORT=20128 npm run dev
```
**📦 pnpm**
```bash
pnpm add -g omniroute@latest --allow-build=better-sqlite3 --allow-build=@swc/core && omniroute
```
**🐧 Arch Linux (AUR)**
```bash
yay -S omniroute-bin && systemctl --user enable --now omniroute.service
```
**🔧 Nix (Flake)**
```bash
# Usando flakes de Nix
nix develop
npm run dev
# O usando devbox
devbox run npm run dev
```
📖 [Guía de Docker](docs/guides/DOCKER_GUIDE.md) — Perfiles de Compose, HTTPS con Caddy y túneles de Cloudflare.
**🦭 Podman**
```bash
# 1. Preparar el directorio de datos montado mediante enlace
mkdir -p data
# 2. Solo para Linux + Podman local sin privilegios de root (nunca un cliente remoto de Podman Machine):
podman unshare chown 1000:1000 ./data
# 3. Establecer la indicación del entorno de ejecución, compilar la imagen local de Compose e iniciar
echo "CONTAINER_HOST=podman" >> .env
podman compose --profile base up -d --build
```
En macOS o Windows, Podman utiliza una Podman Machine remota: omite `podman unshare` y
sigue las [instrucciones del directorio de datos específicas para cada topología](contrib/podman/README.md#data-directory-permissions-by-topology).
📖 [Guía de Podman](contrib/podman/README.md) — Compilaciones de Compose, Podman Machine y
configuración de Quadlet con Linux/systemd.
**⚡ Instalación más rápida / ligera (omitir la compilación nativa)**
El motor SQLite nativo (`better-sqlite3`) es una dependencia **opcional**, por lo que una
instalación global nunca se bloquea al compilar desde el código fuente: utiliza un binario precompilado cuando hay uno compatible
con tu plataforma/Node y, de lo contrario, recurre de forma transparente a un motor de JavaScript puro
(`node:sqlite` en Node 22+; en caso contrario, el WASM `sql.js` incluido), sin necesidad de herramientas de compilación.
Para omitir por completo la preparación nativa posterior a la instalación (CI, entornos sin interfaz gráfica o máquinas lentas):
```bash
OMNIROUTE_SKIP_POSTINSTALL=1 npm install -g omniroute # CI=1 también la omite
```
Para conseguir las instalaciones más rápidas, utiliza preferentemente **pnpm** (almacén direccionado por contenido + enlaces duros; consulta la sección anterior).
Para un entorno de ejecución sin panel ni interfaz gráfica, utiliza el perfil `base` de Docker (descrito anteriormente) o la
[guía de Termux](docs/guides/TERMUX_GUIDE.md). La CLI y el panel web se sirven mediante el
mismo proceso y en un único puerto, por lo que actualmente no existe un paquete independiente solo para la CLI.
**Clasificación completa (URL canónicas sin duplicados, `v > 0`, mayor alcance):**
| #1 | #2 | #3 | #4 | #5 |
| -------------------------------------------------------------------------------------- | ------------------------------------------------------------------------------------- | ------------------------------------------------------------------------------------------------------- | -------------------------------------------------------------------------------------- | ----------------------------------------------------------------------------------------- |
| [nick_saraev — Instagram](https://www.instagram.com/reel/Da8ZthUPK98/) — **3,042,474** | [theopenstack — Instagram](https://www.instagram.com/reel/DaSs65mMrHk/) — **692,419** | [milesreevesai — TikTok](https://www.tiktok.com/@milesreevesai/video/7667980059189366019) — **620,400** | [Vaibhav Sisinty — YouTube](https://www.youtube.com/watch?v=QucgvbO5gsM) — **391,109** | [buildwithai.club — Instagram](https://www.instagram.com/reel/DbIt9AjK7-U/) — **347,652** |
| #6 | #7 | #8 | #9 | #10 |
| ----------------------------------------------------------------------------------- | --------------------------------------------------------------------------------------- | ------------------------------------------------------------------------------------------- | ----------------------------------------------------------------------------------------- | ------------------------------------------------------------------------------------------- |
| [nivedan.ai — Instagram](https://www.instagram.com/reel/DbIrCksJiqq/) — **331,973** | [vaibhavsisinty — Instagram](https://www.instagram.com/reel/Dae05TSAK1l/) — **263,744** | [Nick Automates — YouTube Shorts](https://www.youtube.com/shorts/fZIBK_4fKq8) — **218,174** | [theroshankrishna — Instagram](https://www.instagram.com/reel/Dapjs58z0P0/) — **186,786** | [midudev — TikTok](https://www.tiktok.com/@midudev/video/7664636453544152342) — **177,800** |
Métricas canónicas a fecha de 2026-08-24: **1.029 videos únicos** · **11.132.922 visualizaciones conocidas** (`v > 0`) · **639 canales/perfiles por red**. El panel bruto contiene 1.070 filas; 41 duplicados de Instagram se normalizaron mediante la URL canónica, conservando el mayor número de visualizaciones por video.
> 🎬 **¿Has hecho un video sobre OmniRoute?** Abre una [incidencia](https://github.com/diegosouzapw/OmniRoute/issues/new) o un [debate](https://github.com/diegosouzapw/OmniRoute/discussions) con el enlace; lo destacaremos aquí.
# 📧 Comunidad y ayuda
> Todo en un solo lugar: sigue al responsable del mantenimiento, conversa con la comunidad o abre una incidencia.
| Canal | Dónde / cómo |
| ---------------------------------------------- | ----------------------------------------------------------------------------------------------------------------------------------------- |
| 💼 **LinkedIn** — sigue al mantenedor | [linkedin.com/in/diegosouzapw](https://www.linkedin.com/in/diegosouzapw/) |
| 🐙 **GitHub** — sigue las novedades y consejos | [@diegosouzapw](https://github.com/diegosouzapw) |
| 💬 **Discord** | [discord.gg/U47eFqAXCn](https://discord.gg/U47eFqAXCn) |
| ✈️ **Telegram** | [t.me/omnirouteOficial](https://t.me/omnirouteOficial) |
| 🟢 **WhatsApp — 🌍 Global** | [únete al grupo](https://chat.whatsapp.com/FvuCbrpZmQ6I85n2vW5QIC?s=cl&p=a&mlu=4) |
| 🟢 **WhatsApp — 🇧🇷 Brasil** | [únete al grupo](https://chat.whatsapp.com/KWgatljAjmbELQory59Oti?s=cl&p=a&mlu=4) |
| 🌍 **Sitio web** | [omniroute.online](https://omniroute.online) |
| 🌍 **🌍Comunidad StHub OmniRoute (gratuita)** | [portal de StHub](https://portal.sthub.com.br/communities/groups/st-hub/channels/Omniroute-World-8kRjmK) |
| 📦 **Código fuente** | [github.com/diegosouzapw/OmniRoute](https://github.com/diegosouzapw/OmniRoute) |
| 🐛 **Informar de un error** | [abre una incidencia](https://github.com/diegosouzapw/OmniRoute/issues) — adjunta la salida de `npm run system-info` |
| 🤝 **Contribuir** | [CONTRIBUTING.md](CONTRIBUTING.md) · [Modelo de ramas y versiones](docs/ops/BRANCHING_MODEL.md) · elige una incidencia `good first issue` |
| 💚 **Apoyar el proyecto** | [Formas de apoyar ↑](#-support-omniroute) · [GitHub Sponsors](https://github.com/sponsors/diegosouzapw) |
pino — registros JSON estructurados con contexto de solicitud
Pruebas
Node.js test runner + Vitest — más de 39,000 declaraciones de pruebas estáticas en más de 5,100 archivos de prueba rastreados (unitarias, integración, E2E, seguridad, ecosistema)
Estrategia de cobertura de pruebas para más de 39,000 declaraciones de pruebas estáticas en más de 5,100 archivos de pruebas rastreados
# ⭐ Principales colaboradores
> OmniRoute está formado por una apasionada comunidad de código abierto. Estas personas han realizado contribuciones excepcionales que afectan directamente a la calidad, la estabilidad y el alcance del proyecto. **Gracias.**
### Colaboradores externos por solicitudes de incorporación de cambios fusionadas
Datos fijados en la punta activa de release/v3.8.50, dafb4ae808, con fusiones hasta 2026-08-24 05:26:03 UTC. El censo paginado de GitHub GraphQL contiene 5,911 PR fusionadas: 2,707 del propietario del repositorio, 179 de Dependabot y 3,025 PR externas de 535 colaboradores distintos. «Líneas modificadas» corresponde a las adiciones + eliminaciones de GitHub e incluye archivos generados, archivos de bloqueo, catálogos, traducciones y documentación; mide la rotación de código, no las líneas de código de autoría propia. Se conservan los empates en el límite de la clasificación.
### Confirmaciones atribuidas por GitHub
Bob.Hou 🏅 51 commits atribuidos por GitHub · empatado en el puesto n.º 10
Xiangzhe 🏅 51 commits atribuidos por GitHub · empatado en el puesto n.º 10
Revisado de nuevo el 2026-08-24 06:14:31 UTC: commits atribuidos por GitHub según la API de colaboradores del repositorio para la rama predeterminada release/v3.8.50. La API devolvió 525 identidades (415 usuarios, 2 bots y 108 anónimas); esta tabla excluye al responsable del mantenimiento, los bots y las identidades anónimas, y conserva los empates de la clasificación. Es distinta tanto de la clasificación anterior de PR fusionadas como del censo de metadatos de Git de 639 personas que aparece a continuación.
> 🙏 Las funcionalidades, las correcciones de errores y las mejoras de infraestructura de estos colaboradores son una **parte fundamental** de lo que hace que OmniRoute sea fiable y tenga tantas funcionalidades. Cada solicitud de incorporación de cambios, cada caso de prueba y cada archivo de traducción i18n son importantes. El código abierto lo construyen personas como ellos.
---
## 💖 Patrocinadores
Un sincero agradecimiento a las personas que financian OmniRoute de su propio bolsillo: cada contribución mantiene el proyecto gratuito, independiente y en marcha.
longtao 💛 Antiguo colaborador con una aportación única
… y otras personas que prefieren mantener su privacidad 💛Los patrocinadores públicos de GitHub Sponsors se volvieron a validar el 2026-08-24. El estado activeOnly de GitHub determina las etiquetas de actividad anteriores; se mantiene el agradecimiento a los colaboradores públicos que realizaron una aportación única y se identificaron previamente, mientras que los patrocinadores privados permanecen anónimos.💖 Conviértete en patrocinador → — cada dólar mantiene OmniRoute gratuito e independiente.
## 👥 Más de 600 colaboradores
[](https://github.com/diegosouzapw/OmniRoute/graphs/contributors)
Auditado el 2026-08-24 sobre la base congelada ac02c5b42f y comprobado de nuevo en la punta activa de release/v3.8.50, dafb4ae808: 639 identidades humanas de Git normalizadas; 407 aparecen como autores de commits (incluido el responsable del mantenimiento) y 232 únicamente en pies de página explícitos Co-authored-by. El censo normaliza los identificadores noreply de GitHub, excluye 26 identidades de bots, agentes, servicios o marcadores de posición, y no combina direcciones de correo electrónico ordinarias solo porque coincidan sus nombres para mostrar.
### Cómo contribuir
1. Crea un fork del repositorio
2. Crea una rama desde la punta **activa** de `release/vX.Y.Z` (no desde `main`); consulta el [modelo de ramificación y versiones](docs/ops/BRANCHING_MODEL.md)
3. Crea tu rama de funcionalidad (`git checkout -b feat/amazing-feature`)
4. Confirma tus cambios (`git commit -m 'feat: add amazing feature'`)
5. Envía los cambios a la rama (`git push origin feat/amazing-feature`)
6. Abre una Pull Request con **base = esa rama `release/vX.Y.Z`**
Consulta [CONTRIBUTING.md](CONTRIBUTING.md) para obtener directrices detalladas.
### Publicar una nueva versión
```bash
# Crear una versión; npm publish se ejecuta automáticamente
VERSION=x.y.z
gh release create "v${VERSION}" --title "v${VERSION}" --generate-notes
```
## 📊 Estrellas
## 🌍 StarMapper
## 🙏 Agradecimientos
OmniRoute se apoya en el trabajo de gigantes. Comenzó como una bifurcación de **[9router](https://github.com/decolua/9router)** y una adaptación a TypeScript del proyecto en Go **[CLIProxyAPI](https://github.com/router-for-me/CLIProxyAPI)**; a partir de ahí, cada subsistema que aparece a continuación se inspiró en un proyecto de código abierto que llegó antes. Cada uno dio forma a una parte concreta de OmniRoute. Esta es nuestra forma de darles las gracias a todos. 🙏
> ⭐ recuentos de estrellas verificados mediante la API REST de GitHub el 24 de agosto de 2026; anímate a dar una estrella a estos proyectos. Los recuentos son una instantánea exacta de esa fecha y cambiarán de forma natural.
### 🧬 Linaje y puerta de enlace
La pasarela de IA cuyo conjunto de datos público de precios alimenta nuestra sincronización de seguimiento de costes y cuyo modelo de normalización de proveedores sirvió de base para nuestro enrutamiento.
Código fuente MIT adaptado para el puente integrado de ChatGPT Web → Codex Responses, incluidos los adaptadores de sesión del navegador, estructuración de respuestas, uso y búsqueda web.
Patrones adaptados para la recuperación de flujos, alias sin razonamiento, búsqueda web alternativa, límites de ventana deslizante, ocultación de datos en registros y flujos de inicio reforzados.
Patrones de selección de herramientas, restricciones de salida y confirmación de herramientas de Cursor Composer adaptados al ejecutor nativo de Cursor.
Valores predeterminados de transformación compatibles con Claude Code y comportamiento de las cabeceras de facturación, generalizados en el puente de OmniRoute basado en configuración.
Sus asignaciones de modelos Grok, su generador Statsig de TypeError simulado, sus valores predeterminados de solicitudes y dispositivos y su procesador de respuestas NDJSON se adaptaron de forma sustancial al ejecutor Grok Web de OmniRoute.
La principal fuente de código transitiva en la que se basa grok2api-merged; sus implementaciones de modelos, cabeceras, cargas útiles, Statsig y procesadores se conservan en el linaje de Grok Web.
El código fuente MIT subyacente para las cargas útiles y los valores predeterminados de dispositivos de Grok, el generador Statsig y el procesador result.response, transmitido a través de TQZHR y grok2api-merged.
Una fuente transitiva reconocida por grok2api-merged por su capa de grupo de proxies; OmniRoute conserva ese aviso de linaje, pero no afirma haber adaptado un grupo de proxies en su ejecutor Grok Web acotado.
Su proxy de Grok autenticado mediante cookies y su patrón de transmisión de result.response.token sirvieron de base para el transporte Grok Web de OmniRoute.
La implementación original de Grok Web tomó como referencia su diseño ascendente HTTP/navegador; su ruta HTTP directa deriva de GrokProxy, por lo que no se afirma haber realizado una adaptación de código independiente.
Sus esquemas de Rust ChatOptions y de envolturas de respuesta sirvieron de base para los tipos TypeScript de solicitudes y respuestas en streaming de Grok de OmniRoute.
El proyecto viral «¿por qué usar muchos tokens si pocos tokens bastan?»; su filosofía de habla cavernícola impulsa nuestro modo de compresión estándar y más de 30 reglas de eliminación de relleno y condensación.
Compresión de alto rendimiento de la salida de comandos; inspiró nuestro motor RTK, el DSL de filtrado JSON, la recuperación de salida sin procesar y el proceso apilado RTK → Caveman.
Investigación sobre compresión de prompts (LLMLingua / LLMLingua-2); inspiró nuestro motor llmlingua asíncrono, seguro para código y tolerante a fallos.
Compresión de tokens en portugués de Brasil; impulsa nuestro paquete de idioma pt-BR: reducción de pleonasmos y eliminación de relleno ajustadas a la gramática del portugués brasileño.
La habilidad viral de programación YAGNI del «desarrollador sénior perezoso»; inspiró nuestro estilo de salida less-code: una orientación hacia el cambio funcional más pequeño que reduce el código _generado_ (el equivalente en el eje de salida de la prosa concisa de Caveman).
Su formato compacto de grafos y su diseño de perfiles genéricos sirvieron de base para la compactación tabular de OmniRoute y el formato del códec Headroom.
Compactación de la salida de Bash y perfiles MCP; inspiró nuestra disciplina de interrupción de la compresión y la reducción de manifiestos de herramientas MCP.
Compresión de salida sensible al contenido y específica para cada tipo de archivo, con interrupción en caso de fallo; validó nuestro despacho por tipo y la omisión cuando la ganancia es mínima.
JSON columnar en Rust, recuperación direccionada por contenido y deduplicación entre mensajes; validó el diseño de nuestros motores headroom/ccr/session-dedup y la invariante estable para la caché «la forma comprimida es independiente de la posición».
Compresión de esquemas y descripciones de herramientas MCP; sirvió de base para nuestra reducción de la cardinalidad de manifiestos de herramientas MCP.
Clasificación de mapas de repositorios al estilo de Aider; sirvió de base para nuestra exploración de mapas de repositorios y clasificación de recuperación.
Kit de herramientas para la API del compilador de TypeScript; inspiró nuestra eliminación de comentarios basada en un analizador, que conserva los literales de cadena, de plantilla y de expresiones regulares.
La interceptación y el análisis MITM del tráfico entre asistentes de programación y LLM sirvieron de base para los primeros requisitos del Inspector de Tráfico. Cuatro módulos derivados anteriormente —fusión de SSE, normalización de conversaciones, enmascaramiento de secretos y saneamiento de encabezados— se han sustituido por implementaciones independientes de sala limpia basadas en estándares públicos de protocolos. Las dos superficies de transferencia directa al host (passthrough.ts y _internal/bypass.cjs) siguen siendo implementaciones internas de OmniRoute clasificadas de forma independiente; no se reescribieron como parte de esa sustitución.
Enrutamiento de proxy transparente por proceso: inspiró nuestro cierre seguro ante fallos de MITM, los tiempos de espera de inactividad de sockets, la atribución de procesos mediante /proc y la captura TPROXY.
### 📚 Datos de modelos, observabilidad e interfaz de usuario
Observabilidad de la malla de servicios de Istio: inspiró nuestras insignias de disyuntores y los elementos visuales de aristas con errores del Estudio de Enrutamiento/Combinación.
Una lista seleccionada de bibliotecas seguras de forma predeterminada que orienta nuestras decisiones de seguridad (Helmet.js, DOMPurify, ssrf-req-filter, safe-regex, Google Tink).
Inspiró la deduplicación de solicitudes, el mecanismo alternativo de emergencia sin coste, las estrategias Auto-Combo conectables y la clasificación multilingüe de intenciones.
Su reasignación de modelos según la cuenta, la validación de rutas de ejecutables y el comportamiento de las etiquetas de planes sirvieron de base para el entorno de ejecución Antigravity de OmniRoute.
Su formato compacto de cuenta atrás para el restablecimiento de cuotas inspiró la visualización correspondiente de límites de proveedores en OmniRoute.
Identificó la interfaz de cuotas de Grok Build; posteriormente, OmniRoute verificó y corrigió de forma independiente el formato real de transmisión.
## 📄 Licencia
Licencia MIT: consulta [LICENSE](LICENSE) para más detalles.
---
**[⬆ Volver arriba](#-omniroute)** · Creado con ❤️ para la comunidad de IA de código abierto.
OmniRoute v3.8.51 · Node ≥22.22.2 · Licencia MIT · omniroute.online