Modelos con structured outputs / JSON mode

Si tu backend espera JSON, el modelo no puede “improvisar prosa”. Esta colección prioriza modelos con buen structured outputs / JSON mode para APIs, extractors y tool loops.

8 modelosActualizado 2026-08-27

Modelos en esta colección

ModeloTipoContextoPrecio
GPT-5.4 miniOpenAIChat272k tokens$0.8175/M in · $4.9053/M out
GPT-4.1 mini (legacy)OpenAIChat1M tokens$0.436/M in · $1.7441/M out
Claude Sonnet 5AnthropicChat1M tokens$3.2702/M in · $16.3509/M out
Gemini 2.5 FlashGoogleChat1M tokens$0.327/M in · $2.7251/M out
GPT-5.5OpenAIChat272k tokens$5.4503/M in · $32.7018/M out
Claude Haiku 4.5AnthropicChat200k tokens$1.0901/M in · $5.4503/M out
Mistral LargeMistralChat128k tokens$2.1801/M in · $6.5404/M out
Gemini 2.5 ProGoogleChat2M tokens$1.3626/M in · $10.9006/M out

Por qué estos modelos

GPT mini/4.1-mini son el estándar de JSON mode; Claude y Gemini para schemas + tools; Mistral Large como alternativa; Haiku/Flash para volumen.

Úsalos con Geek Hub

Una base URL compatible con OpenAI y una API key. Cambia cualquier model id de esta lista sin reescribir tu cliente.

Consigue tu API key

Preguntas frecuentes

¿JSON mode = tools?
No. JSON mode fija el shape de la respuesta; tools llaman funciones. Muchos modelos aquí hacen ambos.
¿Qué pasa si el JSON falla?
Reintenta con el mismo schema, baja temperatura, o valida y re-prompt. Usa evals en CI (colección Testing).
¿OpenAI response_format?
Si tu cliente usa el SDK OpenAI, apunta base URL a Geek Hub y usa el model id de esta lista.

Más colecciones