Modelos de IA baratos: bajo costo por token
Si el presupuesto manda, estos modelos dan calidad usable a precio agresivo. Útiles para pipelines de alto volumen, clasificación, extracción y drafts donde no necesitas el flagship. Todos pasan por la misma API OpenAI-compatible de Geek Hub.
Modelos en esta colección
| Modelo | Tipo | Contexto | Precio |
|---|---|---|---|
| Chat | 1M tokens | $0.1526/M in · $0.3052/M out | |
| Chat | 1M tokens | $0.109/M in · $0.436/M out | |
| Chat | 1M tokens | $0.327/M in · $2.7251/M out | |
| Chat | 128k tokens | $0.109/M in · $0.109/M out | |
| Chat | 1M tokens | $0.436/M in · $1.7441/M out | |
| Chat | 1M tokens | $0.327/M in · $2.7251/M out | |
| Chat | 200k tokens | $1.0901/M in · $5.4503/M out | |
| Chat | 1M tokens | $0.4742/M in · $0.9484/M out |
Por qué estos modelos
Priorizamos input/output barato y latencia decente: Flash/lite, mini y open-weight chinos. DeepSeek Flash y Gemini Flash Lite lideran el piso de precio; Haiku y GPT-4.1-mini suben un escalón cuando quieres más confiabilidad.
Úsalos con Geek Hub
Una base URL compatible con OpenAI y una API key. Cambia cualquier model id de esta lista sin reescribir tu cliente.
Consigue tu API keyPreguntas frecuentes
- ¿Cuál es el modelo más barato en Geek Hub?
- Depende del momento y del tipo (chat vs embedding). En chat, mira DeepSeek Flash y Gemini Flash Lite primero; la tabla de esta página muestra el precio por 1M tokens de cada uno.
- ¿Los modelos baratos sirven para producción?
- Sí para tareas acotadas: clasificación, resumen corto, routing, tests. Para razonamiento largo o código crítico conviene un escalón arriba (Sonnet, Pro, DeepSeek Pro).
- ¿Puedo cambiar de modelo barato a uno premium sin reescribir?
- Sí. Misma base URL y API key; solo cambias el model id en el request.