DeepSeek V4 Flash

V4 Flash open-weight, precio agresivo con 1M de contexto. Cache hit baja input a $0.0028. Reemplaza a DeepSeek Chat V3.

ChatDeepSeek1M tokens$0.1526 / $0.3052 · 1M

deepseek/deepseek-v4-flash

Contexto
1M tokens
Máx. completion
384,000
Tools
JSON
Lanzamiento
2026-04-24

Llámalo desde Geek Hub

El mismo SDK de OpenAI. Cambia el base URL y el id del modelo.

curl https://api.geekhub.mx/v1/chat/completions \
  -H "Authorization: Bearer $GEEKHUB_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek/deepseek-v4-flash",
    "messages": [{"role": "user", "content": "Hola"}]
  }'
Consigue tu API key

Preguntas frecuentes

¿Qué es DeepSeek V4 Flash?
V4 Flash open-weight, precio agresivo con 1M de contexto. Cache hit baja input a $0.0028. Reemplaza a DeepSeek Chat V3. DeepSeek V4 Flash corre en el API de Geek Hub (compatible con OpenAI). Id: deepseek/deepseek-v4-flash.
¿DeepSeek V4 Flash es gratis?
No. El input cuesta $0.1526 / 1M tokens y el output $0.3052 / 1M tokens en Geek Hub (markup incluido).
¿Cuál es el contexto de DeepSeek V4 Flash?
DeepSeek V4 Flash tiene una ventana de 1M tokens. Soporta hasta 384,000 tokens de completion.
¿DeepSeek V4 Flash soporta tool calling y structured outputs?
DeepSeek V4 Flash acepta tools y tool_choice para function calling. También soporta structured outputs con un JSON schema en response_format.
¿Cuándo se lanzó DeepSeek V4 Flash?
DeepSeek V4 Flash se lanzó el 24 de abril de 2026.

Más modelos de DeepSeek