Catálogo de modelos
Una suscripción Theus da acceso a los mejores modelos frontier de código y razonamiento a través de una sola API key — y solo se marca «Disponible» lo verificado contra su proveedor. Theus configura de forma central las keys de cada proveedor upstream: tú nunca las ves ni las gestionas. Este catálogo es el único lugar del producto donde se muestran los nombres reales de los modelos.
Cómo funciona
El CLI y la API hablan siempre con el gateway de Theus (https://api.theus.pe/v1) usando el id Theus del modelo (p. ej. claude-sonnet-5, gpt-5-6-sol). El gateway resuelve, en cada petición, a qué proveedor upstream y con qué modelo real hacer proxy. La respuesta nunca expone el modelo upstream: el campo model devuelto es el id Theus que pediste.
Suscriptor ──(1 sola key Theus)──▶ Gateway Theus ──(keys de proveedor, gestionadas)──▶ proveedores upstream
│
└── TITAN: decide qué modelo(s) usar, orquesta y sintetiza
Los modelos incluidos
El catálogo suma 190 modelos servibles hoy, de un total de 316 catalogados y tarifados: los que aún no tienen ruta a un proveedor figuran como pendientes y se anuncian solos en cuanto la tienen. 190 es el total, no lo que alcanza cada plan: Free llega a 4, Pro Code a 145, Studio AI a 169, Max Agent a 178, Omnipresente a 185 y solo Omnipotente a los 190. El plan Free incluye TITAN, los modelos más baratos de servir y el modelo local; esos modelos consumen créditos igual que el resto —son los baratos del catálogo, no un carril gratis aparte. A partir de ahí el catálogo es escalonado: cada plan desbloquea lo del anterior y añade su tramo, y el escalón mínimo de cada modelo se deriva de su tarifa real (ver el escalonado por plan). Las modalidades creativas (imagen y vídeo) tienen cuota propia y se incluyen en Omnipresente y Omnipotente; no cuentan dentro del catálogo de código.
GET /v1/models, que devuelve exactamente lo que tu plan puede servir en este momento. La tabla de abajo destaca los modelos principales; no es la lista completa. Un grupo aparte de 17 modelos, los más caros de servir, queda fuera del autoservicio en un escalón «a consultar»: no se contratan con tarjeta.| Id Theus | Modelo | Proveedor | Modalidad | Plan mínimo |
|---|---|---|---|---|
titan | TITAN | Theus | Orquestador | Free |
claude-opus-4-8 | Claude Opus 4.8 | Anthropic | Código · visión | Pro Code |
claude-sonnet-5 | Claude Sonnet 5 | Anthropic | Código · visión | Pro Code |
claude-haiku-4-5 | Claude Haiku 4.5 | Anthropic | Código · visión | Pro Code |
gpt-5-1 | GPT-5.1 | OpenAI | Razonamiento · visión | Pro Code |
gpt-5-1-mini | GPT-5.1 Codex mini | OpenAI | Código · visión | Pro Code |
gpt-5-6-sol | GPT-5.6 Sol | OpenAI | Razonamiento | Pro Code |
gpt-5-6-terra | GPT-5.6 Terra | OpenAI | General | Pro Code |
gpt-5-6-luna | GPT-5.6 Luna | OpenAI | Texto | Pro Code |
gemini-3-pro | Gemini 3.1 Pro | Multimodal · visión | Pro Code | |
gemini-3-flash | Gemini 3 Flash | Multimodal · visión | Pro Code | |
deepseek-v3-2 | DeepSeek-V3.2 | DeepSeek | Código | Pro Code |
deepseek-r1 | DeepSeek-R1 | DeepSeek | Razonamiento | Pro Code |
grok-4 | Grok 4.5 | xAI | Razonamiento | Pro Code |
grok-4-fast | Grok 4.3 | xAI | Texto | Pro Code |
qwen3-coder | Qwen3-Coder | Alibaba Qwen | Código | Pro Code |
qwen3-max | Qwen3-Max | Alibaba Qwen | General | Pro Code |
kimi-k2 | Kimi K2 | Moonshot AI | Agentes | Pro Code |
glm-4-6 | GLM-4.6 | Z.ai | Código | Pro Code |
mistral-large-3 | Mistral Large 2512 | Mistral AI | General | Pro Code |
codestral-2 | Codestral 2 | Mistral AI | Código | Pro Code |
llama-4-maverick | Llama 4 Maverick | Meta | General | Pro Code |
minimax-m2 | MiniMax M2 | MiniMax | Agentes | Pro Code |
gpt-5-5 | GPT-5.5 | OpenAI | Razonamiento · visión | Pro Code |
gpt-5-4 | GPT-5.4 | OpenAI | General · visión | Pro Code |
claude-opus-4-7 | Claude Opus 4.7 | Anthropic | Código · visión | Pro Code |
kimi-k2-7-code | Kimi K2.7 Code | Moonshot AI | Agentes · visión | Pro Code |
kimi-k3 | Kimi K3 | Moonshot AI | Agentes · visión | Pro Code |
glm-5-2 | GLM-5.2 | Z.ai | Código | Pro Code |
minimax-m3 | MiniMax M3 | MiniMax | Agentes · visión | Pro Code |
qwen3-coder-plus | Qwen3-Coder Plus | Alibaba Qwen | Código | Pro Code |
deepseek-v4-pro | DeepSeek-V4 Pro | DeepSeek | Código | Pro Code |
deepseek-v4-flash | DeepSeek-V4 Flash | DeepSeek | Texto | Pro Code |
grok-4-20 | Grok 4.20 | xAI | Razonamiento · visión | Pro Code |
qwen3-coder-30b | Qwen3-Coder 30B | Alibaba Qwen | Código | Pro Code |
glm-4-7-flash | GLM-4.7 Flash | Z.ai | Código | Pro Code |
gpt-oss-120b | GPT-OSS 120B | OpenAI | Código | Pro Code |
gpt-oss-20b-free | GPT-OSS 20B | OpenAI | Código | Free |
gemma-4-26b-free | Gemma 4 26B | General | Free | |
north-mini-code-free | GPT-OSS 20B (alias) | OpenAI | Código | Free |
theus-free-auto | Theus Free Auto | Theus | General | Free |
theus-image-flash | Theus Imagen Flash | Imagen | Omnipresente · Omnipotente | |
theus-image-mini | Theus Imagen Mini | OpenAI | Imagen | Omnipresente · Omnipotente |
theus-image-pro | Theus Imagen Pro | Imagen | Omnipresente · Omnipotente | |
theus-llamada | Theus Llamada | OpenAI | Voz | Pro Code — próximamente |
theus-llamada-pro | Theus Llamada Pro | OpenAI | Voz | Studio AI — próximamente |
theus-transcribe | Theus Transcribe | NVIDIA | Voz | Pro Code |
theus-voz | Theus Voz | Hexgrad | Voz | Pro Code |
theus-voz-latina | Theus Voz Latina | Deepgram | Voz | Pro Code |
theus-video | Theus Video | ByteDance | Vídeo | Omnipresente · Omnipotente |
theus-video-plus | Theus Video Plus | Alibaba | Vídeo | Omnipresente · Omnipotente |
theus-video-max | Theus Video Max | MiniMax | Vídeo | Omnipresente · Omnipotente |
theus-video-ultra | Theus Video Ultra | Vídeo | Omnipresente · Omnipotente | |
theus-local-private | Theus Local Privado | Theus | Local | Free |
theus-embed | Theus Embed | Theus | Embeddings | Incluido |
whisper-1 | Whisper | OpenAI | Voz | Pro Code |
gpt-4o-mini-tts | Voz Theus | OpenAI | Voz | Pro Code |
theus-search | Búsqueda Theus | Theus | Búsqueda | Pro Code |
theus-research | Investigación Theus | Theus | Búsqueda | Studio AI |
theus-router-auto es el alias heredado de titan y sigue funcionando: es el modelo por defecto que configura el login del CLI. Ver TITAN.404 model_not_found, no una factura. Se anuncian en cuanto su ruta exista.El catálogo en la web: theus.pe/catalogo/
Desde el 28 de agosto de 2026 el catálogo tiene dirección propia: theus.pe/catalogo/. Es la versión pública y buscable de esta tabla —las 55 fichas del catálogo público, que son un subconjunto de los modelos servibles—, pensada para que una persona (o una IA) pueda citarla con una URL:
- Buscador por nombre, casa o capacidad; la tecla
/lo enfoca (el mismo gesto que/modelosen el CLI). - Cinco filtros por capacidad —Todas, Agentes, Código, Embeddings, General— y una fila de siete casas que filtra por proveedor.
- Orden por popularidad pública (la tendencia de 7 días de LLM Chart); las diez primeras coinciden con las de la portada.
- Cada ficha dice si está disponible hoy; lo que no lo está no se esconde. La cifra total del titular sale del gateway, y la banda «…Y N más» resta las fichas públicas de ese total.
- El bloque «El catálogo es escalonado» resume lo de el escalonado por plan y enlaza a planes en soles y a TITAN.
GET /v1/models, que responde exactamente lo que tu plan puede servir en este momento.Ruteo: id Theus → proveedor upstream
La resolución del transporte es dinámica y sigue esta prioridad:
- Rutas gestionadas (
model_routes, consola admin): el mapeomodelo Theus → {proveedor, modelo upstream}se administra desde el panel. Cada modelo puede ir a un proveedor distinto (multi-proveedor real), y un cambio en el panel aplica al instante porque el store se lee por request. - Fallback por entorno (
THEUS_MODEL_MAP): un objeto JSON{"id-theus": "modelo-upstream"}(inline o ruta a archivo). Una entrada del mapa es la verdad del operador y habilita ese modelo aunque el catálogo lo marque como planificado. Sirve también para definir alias propios fuera del catálogo. - Default del gateway: solo aplica en despliegues sin rutas gestionadas (env-only): ahí los modelos ready del catálogo sin mapeo caen al modelo por defecto del upstream principal (
THEUS_UPSTREAM_MODEL). Si el despliegue gestiona rutas en el panel (model_routescon al menos una entrada), un modelo sin ruta y sinTHEUS_MODEL_MAPno cae al default: es fail-closed (integridad de facturación — nunca se sirve otro modelo reetiquetado ni se cobra con el peso del modelo pedido), responde404 model_not_foundhonesto y no aparece en/v1/models. Ojo: basta una sola ruta —aunque sea solo de embeddings, imagen o video— para activar el modo gestionado; al crear la primera ruta, rutea también los modelos de texto que quieras seguir sirviendo (o decláralos enTHEUS_MODEL_MAP). Los modelos de imagen y video nunca usan el default en ningún modo (es un modelo de texto): sin ruta gestionada o entrada enTHEUS_MODEL_MAPno se sirven ni se anuncian.
Si un modelo no resuelve a ningún upstream, /v1/chat/completions responde 404 model_not_found con la lista de modelos disponibles hoy.
theus-embed — memoria semántica
theus-embed es el alias de embeddings del gateway: la capa semántica que usa el CLI para el recall del proyecto (memoria). Se consume por POST /v1/embeddings (compatible OpenAI) y se rutea desde el panel admin (model_routes) a cualquier proveedor con API de embeddings OpenAI-compatible. Su consumo entra al mismo ledger de tokens que el chat.
- Nunca actúa como trabajador de TITAN: los modelos de embeddings no generan texto para subtareas.
- Requiere un proveedor con endpoint
/embeddings; un proveedor con API nativaanthropicno ofrece embeddings y el gateway lo rechaza con un error accionable.
/v1/models — el catálogo servible
GET /v1/models (autenticado) devuelve, en formato de lista OpenAI, solo los modelos realmente servibles hoy: los del catálogo que resuelven a un upstream concreto, más los alias definidos en THEUS_MODEL_MAP o en rutas gestionadas con proveedor operativo. Cada entrada añade name, modality, tier y status a los campos estándar.
curl https://api.theus.pe/v1/models \
-H "Authorization: Bearer $THEUS_API_KEY"
/v1/models, es que aún no tiene ruta a un proveedor operativo en ese despliegue. El catálogo vigente siempre es el que responde el endpoint.