Saltar al contenido
theus.pe ↗

Catálogo de modelos

Una suscripción Theus da acceso a los mejores modelos frontier de código y razonamiento a través de una sola API key — y solo se marca «Disponible» lo verificado contra su proveedor. Theus configura de forma central las keys de cada proveedor upstream: tú nunca las ves ni las gestionas. Este catálogo es el único lugar del producto donde se muestran los nombres reales de los modelos.

Cómo funciona

El CLI y la API hablan siempre con el gateway de Theus (https://api.theus.pe/v1) usando el id Theus del modelo (p. ej. claude-sonnet-5, gpt-5-6-sol). El gateway resuelve, en cada petición, a qué proveedor upstream y con qué modelo real hacer proxy. La respuesta nunca expone el modelo upstream: el campo model devuelto es el id Theus que pediste.

Suscriptor ──(1 sola key Theus)──▶ Gateway Theus ──(keys de proveedor, gestionadas)──▶ proveedores upstream
                                        │
                                        └── TITAN: decide qué modelo(s) usar, orquesta y sintetiza

Los modelos incluidos

El catálogo suma 190 modelos servibles hoy, de un total de 316 catalogados y tarifados: los que aún no tienen ruta a un proveedor figuran como pendientes y se anuncian solos en cuanto la tienen. 190 es el total, no lo que alcanza cada plan: Free llega a 4, Pro Code a 145, Studio AI a 169, Max Agent a 178, Omnipresente a 185 y solo Omnipotente a los 190. El plan Free incluye TITAN, los modelos más baratos de servir y el modelo local; esos modelos consumen créditos igual que el resto —son los baratos del catálogo, no un carril gratis aparte. A partir de ahí el catálogo es escalonado: cada plan desbloquea lo del anterior y añade su tramo, y el escalón mínimo de cada modelo se deriva de su tarifa real (ver el escalonado por plan). Las modalidades creativas (imagen y vídeo) tienen cuota propia y se incluyen en Omnipresente y Omnipotente; no cuentan dentro del catálogo de código.

El catálogo vigente siempre es el que responde GET /v1/models, que devuelve exactamente lo que tu plan puede servir en este momento. La tabla de abajo destaca los modelos principales; no es la lista completa. Un grupo aparte de 17 modelos, los más caros de servir, queda fuera del autoservicio en un escalón «a consultar»: no se contratan con tarjeta.
Id TheusModeloProveedorModalidadPlan mínimo
titanTITANTheusOrquestadorFree
claude-opus-4-8Claude Opus 4.8AnthropicCódigo · visiónPro Code
claude-sonnet-5Claude Sonnet 5AnthropicCódigo · visiónPro Code
claude-haiku-4-5Claude Haiku 4.5AnthropicCódigo · visiónPro Code
gpt-5-1GPT-5.1OpenAIRazonamiento · visiónPro Code
gpt-5-1-miniGPT-5.1 Codex miniOpenAICódigo · visiónPro Code
gpt-5-6-solGPT-5.6 SolOpenAIRazonamientoPro Code
gpt-5-6-terraGPT-5.6 TerraOpenAIGeneralPro Code
gpt-5-6-lunaGPT-5.6 LunaOpenAITextoPro Code
gemini-3-proGemini 3.1 ProGoogleMultimodal · visiónPro Code
gemini-3-flashGemini 3 FlashGoogleMultimodal · visiónPro Code
deepseek-v3-2DeepSeek-V3.2DeepSeekCódigoPro Code
deepseek-r1DeepSeek-R1DeepSeekRazonamientoPro Code
grok-4Grok 4.5xAIRazonamientoPro Code
grok-4-fastGrok 4.3xAITextoPro Code
qwen3-coderQwen3-CoderAlibaba QwenCódigoPro Code
qwen3-maxQwen3-MaxAlibaba QwenGeneralPro Code
kimi-k2Kimi K2Moonshot AIAgentesPro Code
glm-4-6GLM-4.6Z.aiCódigoPro Code
mistral-large-3Mistral Large 2512Mistral AIGeneralPro Code
codestral-2Codestral 2Mistral AICódigoPro Code
llama-4-maverickLlama 4 MaverickMetaGeneralPro Code
minimax-m2MiniMax M2MiniMaxAgentesPro Code
gpt-5-5GPT-5.5OpenAIRazonamiento · visiónPro Code
gpt-5-4GPT-5.4OpenAIGeneral · visiónPro Code
claude-opus-4-7Claude Opus 4.7AnthropicCódigo · visiónPro Code
kimi-k2-7-codeKimi K2.7 CodeMoonshot AIAgentes · visiónPro Code
kimi-k3Kimi K3Moonshot AIAgentes · visiónPro Code
glm-5-2GLM-5.2Z.aiCódigoPro Code
minimax-m3MiniMax M3MiniMaxAgentes · visiónPro Code
qwen3-coder-plusQwen3-Coder PlusAlibaba QwenCódigoPro Code
deepseek-v4-proDeepSeek-V4 ProDeepSeekCódigoPro Code
deepseek-v4-flashDeepSeek-V4 FlashDeepSeekTextoPro Code
grok-4-20Grok 4.20xAIRazonamiento · visiónPro Code
qwen3-coder-30bQwen3-Coder 30BAlibaba QwenCódigoPro Code
glm-4-7-flashGLM-4.7 FlashZ.aiCódigoPro Code
gpt-oss-120bGPT-OSS 120BOpenAICódigoPro Code
gpt-oss-20b-freeGPT-OSS 20BOpenAICódigoFree
gemma-4-26b-freeGemma 4 26BGoogleGeneralFree
north-mini-code-freeGPT-OSS 20B (alias)OpenAICódigoFree
theus-free-autoTheus Free AutoTheusGeneralFree
theus-image-flashTheus Imagen FlashGoogleImagenOmnipresente · Omnipotente
theus-image-miniTheus Imagen MiniOpenAIImagenOmnipresente · Omnipotente
theus-image-proTheus Imagen ProGoogleImagenOmnipresente · Omnipotente
theus-llamadaTheus LlamadaOpenAIVozPro Code — próximamente
theus-llamada-proTheus Llamada ProOpenAIVozStudio AI — próximamente
theus-transcribeTheus TranscribeNVIDIAVozPro Code
theus-vozTheus VozHexgradVozPro Code
theus-voz-latinaTheus Voz LatinaDeepgramVozPro Code
theus-videoTheus VideoByteDanceVídeoOmnipresente · Omnipotente
theus-video-plusTheus Video PlusAlibabaVídeoOmnipresente · Omnipotente
theus-video-maxTheus Video MaxMiniMaxVídeoOmnipresente · Omnipotente
theus-video-ultraTheus Video UltraGoogleVídeoOmnipresente · Omnipotente
theus-local-privateTheus Local PrivadoTheusLocalFree
theus-embedTheus EmbedTheusEmbeddingsIncluido
whisper-1WhisperOpenAIVozPro Code
gpt-4o-mini-ttsVoz TheusOpenAIVozPro Code
theus-searchBúsqueda TheusTheusBúsquedaPro Code
theus-researchInvestigación TheusTheusBúsquedaStudio AI
theus-router-auto es el alias heredado de titan y sigue funcionando: es el modelo por defecto que configura el login del CLI. Ver TITAN.
Las filas marcadas próximamente están catalogadas y tarifadas pero no se sirven todavía: pedirlas responde 404 model_not_found, no una factura. Se anuncian en cuanto su ruta exista.

El catálogo en la web: theus.pe/catalogo/

Desde el 28 de agosto de 2026 el catálogo tiene dirección propia: theus.pe/catalogo/. Es la versión pública y buscable de esta tabla —las 55 fichas del catálogo público, que son un subconjunto de los modelos servibles—, pensada para que una persona (o una IA) pueda citarla con una URL:

  • Buscador por nombre, casa o capacidad; la tecla / lo enfoca (el mismo gesto que /modelos en el CLI).
  • Cinco filtros por capacidad —Todas, Agentes, Código, Embeddings, General— y una fila de siete casas que filtra por proveedor.
  • Orden por popularidad pública (la tendencia de 7 días de LLM Chart); las diez primeras coinciden con las de la portada.
  • Cada ficha dice si está disponible hoy; lo que no lo está no se esconde. La cifra total del titular sale del gateway, y la banda «…Y N más» resta las fichas públicas de ese total.
  • El bloque «El catálogo es escalonado» resume lo de el escalonado por plan y enlaza a planes en soles y a TITAN.
La página web es una vitrina; la lista autoritativa sigue siendo GET /v1/models, que responde exactamente lo que tu plan puede servir en este momento.

Ruteo: id Theus → proveedor upstream

La resolución del transporte es dinámica y sigue esta prioridad:

  1. Rutas gestionadas (model_routes, consola admin): el mapeo modelo Theus → {proveedor, modelo upstream} se administra desde el panel. Cada modelo puede ir a un proveedor distinto (multi-proveedor real), y un cambio en el panel aplica al instante porque el store se lee por request.
  2. Fallback por entorno (THEUS_MODEL_MAP): un objeto JSON {"id-theus": "modelo-upstream"} (inline o ruta a archivo). Una entrada del mapa es la verdad del operador y habilita ese modelo aunque el catálogo lo marque como planificado. Sirve también para definir alias propios fuera del catálogo.
  3. Default del gateway: solo aplica en despliegues sin rutas gestionadas (env-only): ahí los modelos ready del catálogo sin mapeo caen al modelo por defecto del upstream principal (THEUS_UPSTREAM_MODEL). Si el despliegue gestiona rutas en el panel (model_routes con al menos una entrada), un modelo sin ruta y sin THEUS_MODEL_MAP no cae al default: es fail-closed (integridad de facturación — nunca se sirve otro modelo reetiquetado ni se cobra con el peso del modelo pedido), responde 404 model_not_found honesto y no aparece en /v1/models. Ojo: basta una sola ruta —aunque sea solo de embeddings, imagen o video— para activar el modo gestionado; al crear la primera ruta, rutea también los modelos de texto que quieras seguir sirviendo (o decláralos en THEUS_MODEL_MAP). Los modelos de imagen y video nunca usan el default en ningún modo (es un modelo de texto): sin ruta gestionada o entrada en THEUS_MODEL_MAP no se sirven ni se anuncian.

Si un modelo no resuelve a ningún upstream, /v1/chat/completions responde 404 model_not_found con la lista de modelos disponibles hoy.

theus-embed — memoria semántica

theus-embed es el alias de embeddings del gateway: la capa semántica que usa el CLI para el recall del proyecto (memoria). Se consume por POST /v1/embeddings (compatible OpenAI) y se rutea desde el panel admin (model_routes) a cualquier proveedor con API de embeddings OpenAI-compatible. Su consumo entra al mismo ledger de tokens que el chat.

  • Nunca actúa como trabajador de TITAN: los modelos de embeddings no generan texto para subtareas.
  • Requiere un proveedor con endpoint /embeddings; un proveedor con API nativa anthropic no ofrece embeddings y el gateway lo rechaza con un error accionable.

/v1/models — el catálogo servible

GET /v1/models (autenticado) devuelve, en formato de lista OpenAI, solo los modelos realmente servibles hoy: los del catálogo que resuelven a un upstream concreto, más los alias definidos en THEUS_MODEL_MAP o en rutas gestionadas con proveedor operativo. Cada entrada añade name, modality, tier y status a los campos estándar.

curl https://api.theus.pe/v1/models \
  -H "Authorization: Bearer $THEUS_API_KEY"
Si un modelo aparece en esta página pero no en tu /v1/models, es que aún no tiene ruta a un proveedor operativo en ese despliegue. El catálogo vigente siempre es el que responde el endpoint.
    ↑↓ navegar · ↵ abrir · esc cerrarDocumentación de Theus