El modelo de IA adecuado para cada tarea

Siesta AI enruta cada tarea al modelo adecuado y permite a los equipos optimizar calidad, coste o rendimiento equilibrado sin cambiar la experiencia de usuario.

Ver opciones de enrutamiento
Enrutamiento inteligente de modelos

Elija el resultado, no el modelo

Defina políticas de enrutamiento para calidad, coste o rendimiento equilibrado. Siesta AI evalúa cada tarea y la enruta al modelo más adecuado, manteniendo la gobernanza, el despliegue y los controles regionales alineados con su entorno de Azure.

Modo calidad

Priorice modelos de razonamiento más potentes para análisis complejos, coding y trabajo crítico.

Modo coste

Enrute prompts rutinarios a modelos más rápidos y eficientes para mantener el gasto bajo control.

Modo equilibrado

Use una política predeterminada que equilibra calidad, latencia y coste para el trabajo diario.

La disponibilidad de modelos sigue el soporte de Microsoft Foundry Model Router. El modo de enrutamiento y el subconjunto de modelos seleccionado determinan qué modelos son elegibles para cada solicitud.

Todos los modelos en un solo lugar

Compare proveedores, regiones y capacidades del modelo para su caso de uso.

Estos modelos son elegibles para Microsoft Foundry Model Router, por lo que Siesta AI puede enrutar cada solicitud dinámicamente según el modo de enrutamiento y el subconjunto de modelos seleccionado.

Modelo Regiones Ventana de contexto Mejor para
OpenAI
GPT-4o Siesta AI recomienda para multimodal
globe eu
128 000 Multimodal
GPT-4o Mini
globe eu
128 000 Velocidad y eficiencia
GPT-4.1
globe eu
1 047 576 Programación
GPT-4.1 Mini
globe eu
1 047 576 Velocidad y eficiencia
GPT-4.1 Nano
globe eu
1 047 576 Velocidad y eficiencia
o4-mini
globe eu
200 000 Razonamiento
GPT-5 Nano
globe eu
400 000 Velocidad y eficiencia
GPT-5 Mini
globe eu
400 000 Velocidad y eficiencia
GPT-5
globe eu
400 000 Propósito general
GPT-5 Chat
globe
128 000 Conversaciones
GPT-5.2
globe eu
400 000 Razonamiento
GPT-5.2 Chat
globe
128 000 Conversaciones
GPT-5.3 Chat Siesta AI recomienda para conversaciones
globe
128 000 Conversaciones
GPT-5.4 Nano Siesta AI recomienda para velocidad y eficiencia
globe eu
400 000 Velocidad y eficiencia
GPT-5.4 Mini
globe eu
400 000 Velocidad y eficiencia
GPT-5.4
globe eu
1 050 000 Propósito general
GPT-5.5 Siesta AI recomienda para propósito general
globe eu
1 050 000 Propósito general
GPT OSS 120B Siesta AI recomienda para flujos de trabajo empresariales
globe
131 072 Flujos de trabajo empresariales
Anthropic
Claude Haiku 4.5
eu
200 000 Velocidad y eficiencia
Claude Sonnet 4.5 Siesta AI recomienda para programación
eu
200 000 Programación
Claude Opus 4.1
eu
200 000 Investigación profunda
Claude Opus 4.6
eu
200 000 Razonamiento
Claude Opus 4.7 Siesta AI recomienda para investigación profunda Siesta AI recomienda para razonamiento
eu
200 000 Investigación profunda
DeepSeek
DeepSeek V3.1
globe
128 000 Análisis de datos
DeepSeek V3.2 Siesta AI recomienda para análisis de datos
globe
128 000 Análisis de datos
Meta
Llama 4 Maverick Siesta AI recomienda para contexto largo
globe
1 000 000 Contexto largo
xAI
Grok 4
globe
262 000 Razonamiento
Grok 4 Fast Reasoning Siesta AI recomienda para razonamiento
globe
128 000 Razonamiento

La elegibilidad del router sigue el soporte de Microsoft Foundry Model Router. El modo de enrutamiento y el subconjunto seleccionado determinan qué modelos pueden usarse para cada solicitud.

Modelos populares que Siesta AI puede desplegar o seleccionar directamente mediante Azure AI Foundry cuando un equipo quiere un modelo específico fuera del enrutamiento dinámico.

Modelo Regiones Ventana de contexto Mejor para
Google
Gemini 3.1 Pro Siesta AI recomienda para multimodal
globe
1 000 000 Multimodal
Gemini 3 Flash
globe
1 000 000 Velocidad y eficiencia
Gemini 3 Deep Think
globe
1 000 000 Razonamiento
Mistral
Mistral Large 3 Siesta AI recomienda para propósito general
globe eu
128 000 Propósito general
Mistral Medium 3.5
globe eu
128 000 Propósito general
Codestral 2501
globe eu
256 000 Programación
Anthropic
Claude Sonnet 5 Siesta AI recomienda para programación
eu
200 000 Programación
Claude Opus 4.8
eu
200 000 Razonamiento
Claude Sonnet 4.6
eu
200 000 Propósito general
DeepSeek
DeepSeek V4 Pro Siesta AI recomienda para razonamiento
globe
128 000 Razonamiento
DeepSeek V4 Flash
globe
128 000 Velocidad y eficiencia
DeepSeek V3.2-Speciale
globe
128 000 Análisis de datos
xAI
Grok 4.3
globe
262 000 Razonamiento
Grok 4 20 Reasoning
globe
128 000 Razonamiento
Grok 4.1 Fast Non-Reasoning
globe
128 000 Velocidad y eficiencia
Meta
Llama 4 Scout Siesta AI recomienda para contexto largo
globe
10 000 000 Contexto largo
Llama 3.3 70B
globe
128 000 Propósito general
Moonshot AI
Kimi-K2.7-Code
globe
256 000 Programación
Kimi-K2.6
globe
256 000 Propósito general
Kimi-K2.5
globe
256 000 Contexto largo
Microsoft
Phi-4
globe
16 000 Velocidad y eficiencia
Phi-4-mini-instruct
globe
128 000 Velocidad y eficiencia
Cohere
Cohere Command A Siesta AI recomienda para flujos de trabajo empresariales
globe
256 000 Flujos de trabajo empresariales

Los modelos directos son opciones curadas del catálogo. Se pueden desplegar o seleccionar directamente, pero no se presentan como parte de la selección dinámica de Model Router.

Empiece a construir con Siesta AI

Vea cómo Siesta AI puede impulsar su caso de uso con el modelo adecuado.

Reservar una demo