Modelos de contexto largo: 200k a 1M tokens
Cuando el prompt es un repo, un contrato o un PDF enorme, el contexto es el producto. Esta colección reúne modelos con 200k–1M de ventana disponibles en Geek Hub para análisis largo y agentes con memoria extendida.
Modelos en esta colección
| Modelo | Tipo | Contexto | Precio |
|---|---|---|---|
| Chat | 1M tokens | $10.9006/M in · $54.503/M out | |
| Chat | 1M tokens | $5.4503/M in · $27.2515/M out | |
| Chat | 1M tokens | $3.2702/M in · $16.3509/M out | |
| Chat | 1M tokens | $3.2702/M in · $16.3509/M out | |
| Chat | 2M tokens | $2.1801/M in · $13.0807/M out | |
| Chat | 2M tokens | $1.3626/M in · $10.9006/M out | |
| Chat | 1M tokens | $0.327/M in · $2.7251/M out | |
| Chat | 262k tokens | $1.0356/M in · $4.3602/M out |
Por qué estos modelos
Claude 5 family y Kimi K3 ofrecen 1M; Gemini Pro/Flash cubren contexto largo a distinto precio; Kimi Code aporta 262k enfocado a código.
Úsalos con Geek Hub
Una base URL compatible con OpenAI y una API key. Cambia cualquier model id de esta lista sin reescribir tu cliente.
Consigue tu API keyPreguntas frecuentes
- ¿1M de contexto cuesta más?
- Pagas por tokens usados, no por el máximo. Un contexto grande te deja meter más input; el flagship suele costar más por millón.
- ¿Cuándo necesito contexto largo de verdad?
- Codebases enteros, due diligence, libros, logs largos, multi-doc RAG sin chunking agresivo. Si cabe en 32k, no pagues de más.
- ¿Flash con contexto largo alcanza?
- Gemini Flash con ventana grande es excelente para costo. Para razonamiento denso sobre ese contexto, Pro/Sonnet/Opus suelen ir mejor.