Modelos para testing y CI: rápidos y baratos

En desarrollo y CI quieres respuestas rápidas y costo predecible, no el modelo más caro. Esta colección reúne opciones flash/lite y mini pensadas para smoke tests de prompts, evals automáticos y sandboxes de equipo.

7 modelosActualizado 2026-08-27

Modelos en esta colección

ModeloTipoContextoPrecio
Gemini 2.5 Flash-LiteGoogleChat1M tokens$0.109/M in · $0.436/M out
DeepSeek V4 FlashDeepSeekChat1M tokens$0.1526/M in · $0.3052/M out
Ministral 8BMistralChat128k tokens$0.109/M in · $0.109/M out
GPT-4.1 mini (legacy)OpenAIChat1M tokens$0.436/M in · $1.7441/M out
Gemini 3.1 Flash-LiteGoogleChat1M tokens$0.2725/M in · $1.6351/M out
Claude Haiku 4.5AnthropicChat200k tokens$1.0901/M in · $5.4503/M out
Gemini 2.5 FlashGoogleChat1M tokens$0.327/M in · $2.7251/M out

Por qué estos modelos

Baja latencia + bajo precio + calidad suficiente para asserts. Evitamos flagships caros: en CI el modelo debe fallar barato y rápido cuando el prompt o el contrato JSON se rompe.

Úsalos con Geek Hub

Una base URL compatible con OpenAI y una API key. Cambia cualquier model id de esta lista sin reescribir tu cliente.

Consigue tu API key

Preguntas frecuentes

¿Qué modelo usar en CI?
Gemini Flash Lite o DeepSeek Flash suelen bastar para smoke tests. Si validas structured outputs o tool calling, GPT-4.1-mini o Haiku dan más estabilidad.
¿Debo usar el mismo modelo en test y producción?
No necesariamente. Testea con uno barato y fija el de producción por env. Lo importante es que el contrato (JSON, tools) sea el mismo.
¿Cómo limito gasto en testing?
Usa una API key de Geek Hub solo para CI con presupuesto bajo, y modelos de esta lista. Cambia el model id por variable de entorno.

Más colecciones