Saltearse al contenido

El campo model

El campo model de tu petición le dice a Semantara cómo resolverla. Tienes dos modos.

Enrutamiento automático

{ "model": "proxy/auto" }

Con proxy/auto (o su alias auto), Semantara elige el modelo por ti. Cómo lo elige depende de cómo tengas configurada tu API key:

  • Una key con un solo proveedor conectado (OpenAI o Anthropic) usa un modelo base fijo y aprobado para ese proveedor. Es una decisión estable y predecible: la misma key recibe siempre el mismo modelo, sin un paso de análisis previo que añada latencia ni costo.
  • Una key con proveedor principal y de respaldo usa el enrutamiento clásico, que clasifica cada petición y elige dentro del catálogo de tu proveedor.

En ambos casos no tienes que elegir a mano. Si necesitas un modelo concreto, fíjalo por nombre (abajo) y se respeta exactamente.

Un modelo específico

Si prefieres control total, pasa el nombre del modelo tal como lo nombra tu proveedor:

{ "model": "gpt-4o" }
{ "model": "claude-sonnet-4-6" }

Semantara lo respeta y omite el enrutamiento: la petición va al modelo que pediste, sin sustituirlo. El modelo debe pertenecer a un proveedor que hayas conectado en la Consola (BYOK). Si el modelo o el proveedor no están soportados, recibes LLM_004.

¿Hay un límite o “modelo tope”?

No existe un parámetro de “modelo tope” por key, y no hace falta: el enrutamiento automático no escala de un modelo a otro dentro de una misma petición. O bien sirve el modelo base fijo de tu proveedor, o bien —en el enrutamiento clásico— elige uno del catálogo de tu proveedor al resolver la petición. Un modelo fijado por nombre se respeta tal cual, siempre.

Cuál usar

  • Quieres ahorrar sin pensarloproxy/auto.
  • Necesitas un modelo exacto (reproducibilidad estricta, una capacidad puntual) → fíjalo por nombre.

Puedes mezclar: usa proxy/auto en la mayoría de tus llamadas y fija un modelo solo donde lo necesites.