Modelos de IA baratos: bajo costo por token

Si el presupuesto manda, estos modelos dan calidad usable a precio agresivo. Útiles para pipelines de alto volumen, clasificación, extracción y drafts donde no necesitas el flagship. Todos pasan por la misma API OpenAI-compatible de Geek Hub.

8 modelosActualizado 2026-08-27

Modelos en esta colección

ModeloTipoContextoPrecio
DeepSeek V4 FlashDeepSeekChat1M tokens$0.1526/M in · $0.3052/M out
Gemini 2.5 Flash-LiteGoogleChat1M tokens$0.109/M in · $0.436/M out
Gemini 3.5 Flash-LiteGoogleChat1M tokens$0.327/M in · $2.7251/M out
Ministral 8BMistralChat128k tokens$0.109/M in · $0.109/M out
GPT-4.1 mini (legacy)OpenAIChat1M tokens$0.436/M in · $1.7441/M out
Gemini 2.5 FlashGoogleChat1M tokens$0.327/M in · $2.7251/M out
Claude Haiku 4.5AnthropicChat200k tokens$1.0901/M in · $5.4503/M out
DeepSeek V4 ProDeepSeekChat1M tokens$0.4742/M in · $0.9484/M out

Por qué estos modelos

Priorizamos input/output barato y latencia decente: Flash/lite, mini y open-weight chinos. DeepSeek Flash y Gemini Flash Lite lideran el piso de precio; Haiku y GPT-4.1-mini suben un escalón cuando quieres más confiabilidad.

Úsalos con Geek Hub

Una base URL compatible con OpenAI y una API key. Cambia cualquier model id de esta lista sin reescribir tu cliente.

Consigue tu API key

Preguntas frecuentes

¿Cuál es el modelo más barato en Geek Hub?
Depende del momento y del tipo (chat vs embedding). En chat, mira DeepSeek Flash y Gemini Flash Lite primero; la tabla de esta página muestra el precio por 1M tokens de cada uno.
¿Los modelos baratos sirven para producción?
Sí para tareas acotadas: clasificación, resumen corto, routing, tests. Para razonamiento largo o código crítico conviene un escalón arriba (Sonnet, Pro, DeepSeek Pro).
¿Puedo cambiar de modelo barato a uno premium sin reescribir?
Sí. Misma base URL y API key; solo cambias el model id en el request.

Más colecciones