Precios de DeepSeek API: guía independiente y calculadora
Última verificación documental: 29 de julio de 2026. Precios expresados en dólares estadounidenses (USD). Revisión basada en la documentación operativa oficial; no se ejecutó una solicitud facturable.
La API de DeepSeek no tiene una cuota mensual única: descuenta del saldo el coste de los tokens de entrada y salida realmente procesados. Desde el 24 de abril de 2026, los identificadores publicados para DeepSeek V4 Preview son deepseek-v4-flash y deepseek-v4-pro. Ambos admiten modos de pensamiento y no pensamiento, un contexto de 1 millón de tokens y una salida máxima de 384.000 tokens, pero tienen tarifas y límites de concurrencia diferentes.
Respuesta rápida
- V4 Flash: $0.14 por 1M tokens de entrada sin acierto de caché y $0.28 por 1M tokens de salida.
- V4 Pro: $0.435 por 1M tokens de entrada sin acierto de caché y $0.87 por 1M tokens de salida.
- Entrada con cache hit: $0.0028 por 1M en Flash y $0.003625 por 1M en Pro.
- Web, app y API no son el mismo producto de facturación: usar una interfaz de chat sin pagar una tarifa por token no convierte la API en gratuita.
¿DeepSeek es gratis o de pago?
Chat independiente de este sitio
El chat en español de este sitio se ofrece al visitante sin coste y sin crear una cuenta. La interfaz utiliza la API de DeepSeek en el servidor; el visitante no recibe una clave ni saldo API propios. El acceso gratuito puede estar sujeto a la disponibilidad y a las medidas operativas del sitio.
Web y aplicación de DeepSeek
DeepSeek presentó su aplicación de consumo como gratuita, sin anuncios ni compras dentro de la aplicación. Esa descripción corresponde a la experiencia de usuario de la app y no es una promesa de llamadas API gratuitas. Las funciones, el acceso y los límites operativos de la web o la app pueden cambiar independientemente de la tabla de precios para desarrolladores. Consulta nuestra guía de descarga de la aplicación para identificar los canales correctos.
API para desarrolladores y empresas
La API se factura por uso y descuenta los cargos del saldo disponible en la cuenta de la plataforma. Si una cuenta muestra saldo concedido, DeepSeek indica que lo utiliza antes que el saldo recargado; no debe darse por hecho que todas las cuentas recibirán créditos promocionales. Para integrar los modelos correctamente, utiliza nuestra guía de la API de DeepSeek.
Tabla de precios de DeepSeek V4
DeepSeek publica las tarifas por 1 millón de tokens. La tabla conserva el punto decimal empleado por la documentación del proveedor para evitar errores al copiar los valores.
| Concepto | deepseek-v4-flash | deepseek-v4-pro |
|---|---|---|
| 1M tokens de entrada, cache hit | $0.0028 | $0.003625 |
| 1M tokens de entrada, cache miss | $0.14 | $0.435 |
| 1M tokens de salida | $0.28 | $0.87 |
| Longitud de contexto | 1M | 1M |
| Salida máxima | 384K | 384K |
| Límite de concurrencia por cuenta | 2.500 | 500 |
Precio equivalente por 1.000 tokens
La API factura según el número real de tokens, aunque la documentación muestre la unidad de 1 millón. Dividir cada tarifa entre 1.000 permite obtener la equivalencia por 1.000 tokens:
| Concepto por 1K tokens | V4 Flash | V4 Pro |
|---|---|---|
| Entrada, cache hit | $0.0000028 | $0.000003625 |
| Entrada, cache miss | $0.00014 | $0.000435 |
| Salida | $0.00028 | $0.00087 |
Importante: no multipliques las tarifas por 1.000 dos veces. Si introduces tokens en una calculadora basada en la unidad de 1 millón, divide la cantidad de tokens entre 1.000.000 y después multiplícala por el precio correspondiente.
Cómo calcula DeepSeek el coste
Un token es una unidad de texto reconocida por el modelo; no equivale de forma fija a una palabra. La tokenización depende del contenido y del modelo, por lo que una estimación basada únicamente en palabras puede desviarse. Para una medición final, utiliza los valores devueltos en el objeto usage de la respuesta.
Separa los tokens de entrada en dos grupos: los que obtienen un acierto de caché y los que no. Los tokens generados por el modelo se cobran siempre a la tarifa de salida.
Coste = (tokens de entrada con hit ÷ 1.000.000 × precio hit)
+ (tokens de entrada con miss ÷ 1.000.000 × precio miss)
+ (tokens de salida ÷ 1.000.000 × precio de salida)
- Selecciona V4 Flash o V4 Pro.
- Obtén de
usagelos tokens de entrada con cache hit, entrada con cache miss y salida. - Aplica a cada grupo su tarifa y suma los tres importes.
- Redondea solo el total mostrado; conserva toda la precisión decimal durante el cálculo.
Qué significa cache hit y cuánto puede ahorrar
El almacenamiento en caché de contexto en disco está habilitado de forma predeterminada en la API. Si una petición posterior reutiliza por completo una unidad de prefijo que ya se ha guardado, esa parte de la entrada puede contabilizarse como cache hit. Las partes que no coinciden se contabilizan como cache miss.
- La tarifa hit de Flash es 50 veces menor que su tarifa miss de entrada.
- La tarifa hit de Pro es 120 veces menor que su tarifa miss de entrada.
- El descuento solo se aplica a los tokens de entrada que realmente obtienen un hit; no reduce la tarifa de salida.
- La caché funciona mediante el principio de mejor esfuerzo y no garantiza una tasa de aciertos del 100 %.
- La respuesta informa de los resultados mediante
prompt_cache_hit_tokensyprompt_cache_miss_tokens.
Para mejorar la posibilidad de reutilización, mantén estable al comienzo de las solicitudes el contenido repetido —por ejemplo, instrucciones de sistema, políticas o un documento común— y añade después la pregunta variable. No presupuestes un ahorro antes de medir el patrón real de uso.
Nota de privacidad: se trata de una caché en disco del proveedor, no de una caché local del navegador. DeepSeek indica que los prefijos no utilizados suelen eliminarse automáticamente en un periodo de unas horas a unos días. Evita enviar secretos o datos personales innecesarios y revisa nuestra Política de privacidad y la guía de seguridad.
Calculadora de costes de DeepSeek API
Introduce por separado los tokens de entrada con hit, los tokens de entrada con miss y los tokens de salida. Si solo dispones del total de entrada y una tasa estimada de caché, el estimador puede dividirlo en ambos grupos, pero el resultado seguirá siendo una previsión hasta comprobar el objeto usage.
Estima el coste de una solicitud o periodo
Escribe cantidades de tokens no negativas. El cálculo usa USD y las tarifas verificadas documentalmente el 29 de julio de 2026.
Coste estimado: $0.168
Entrada hit: $0 · Entrada miss: $0.14 · Salida: $0.028
Ejemplos de coste
Ejemplo 1: una prueba pequeña sin cache hit
Una solicitud o conjunto de solicitudes procesa 250.000 tokens de entrada sin hit y genera 50.000 tokens de salida.
| Modelo | Entrada | Salida | Total |
|---|---|---|---|
| V4 Flash | 0.25 × $0.14 = $0.035 | 0.05 × $0.28 = $0.014 | $0.049 |
| V4 Pro | 0.25 × $0.435 = $0.10875 | 0.05 × $0.87 = $0.0435 | $0.15225 |
Ejemplo 2: un millón de tokens de entrada con un 20 % de hit
El trabajo procesa 200.000 tokens de entrada con hit, 800.000 con miss y 100.000 tokens de salida.
| Modelo | Cálculo | Total |
|---|---|---|
| V4 Flash | (0.2 × $0.0028) + (0.8 × $0.14) + (0.1 × $0.28) | $0.14056 |
| V4 Pro | (0.2 × $0.003625) + (0.8 × $0.435) + (0.1 × $0.87) | $0.435725 |
Ejemplo 3: presupuesto mensual
Una aplicación procesa 150 millones de tokens de entrada y 80 millones de salida al mes. Si el 30 % de la entrada obtiene hit, hay 45 millones de tokens hit y 105 millones miss.
| Modelo | Sin hits de caché | Con 30 % de hits | Diferencia estimada |
|---|---|---|---|
| V4 Flash | $43.40 | $37.23 | $6.17 menos |
| V4 Pro | $134.85 | $115.44 | $19.41 menos |
V4 Flash o V4 Pro: cómo decidir por coste
DeepSeek presenta V4 Flash como la opción rápida, eficiente y económica, y V4 Pro como la variante de mayor capacidad. No es necesario enviar todo el tráfico a un único modelo. Una arquitectura puede usar Flash para tareas rutinarias y reservar Pro para solicitudes que justifiquen el coste adicional, siempre que las pruebas con datos representativos confirmen la calidad necesaria.
| Criterio | V4 Flash | V4 Pro |
|---|---|---|
| Prioridad | Velocidad y coste reducido | Mayor capacidad del modelo |
| Entrada miss frente a Flash | Base: $0.14/1M | Aproximadamente 3,11 veces el precio de Flash |
| Salida frente a Flash | Base: $0.28/1M | Aproximadamente 3,11 veces el precio de Flash |
| Contexto y salida máxima | 1M / 384K | 1M / 384K |
| Paso recomendado | Evaluar calidad, latencia y tokens de salida con el mismo conjunto de pruebas antes de decidir. | |
Ambos modelos tienen una única tarifa publicada para sus modos de pensamiento y no pensamiento. No aparece un recargo separado por activar el pensamiento; sin embargo, una respuesta con razonamiento más largo puede generar más tokens de salida y aumentar el importe total. Consulta las diferencias técnicas en nuestra guía de DeepSeek V4.
Cómo controlar el presupuesto
- Mide tokens reales: registra los campos de
usagepor modelo, función y cliente, sin guardar el contenido sensible de los mensajes. - Separa hit, miss y salida: una media total de tokens no permite aplicar correctamente las tres tarifas.
- Limita la salida: configura un máximo coherente con la tarea; 384K es una capacidad máxima, no un objetivo de generación.
- Reutiliza prefijos estables: coloca instrucciones y contexto repetido antes de la parte variable, pero mide los hits en lugar de asumirlos.
- Enruta por complejidad: prueba Flash como opción inicial y eleva a Pro solo cuando una regla o evaluación lo justifique.
- Vigila el saldo: establece alertas internas y evita depender de créditos concedidos que quizá no existan o puedan caducar.
- Comprueba cambios: DeepSeek se reserva el derecho a modificar precios. Guarda la fecha y la fuente usada en cada presupuesto.
Los importes de esta página no incluyen posibles costes de infraestructura propia, bases de datos, búsqueda, herramientas externas, observabilidad, procesamiento de pagos o conversión de divisas. Para escenarios de despliegue, consulta nuestras soluciones con DeepSeek.
Retirada de deepseek-chat y deepseek-reasoner
Estado documental a 29 de julio de 2026: DeepSeek anunció la retirada de deepseek-chat y deepseek-reasoner para el 24 de julio de 2026 a las 15:59 UTC. Las páginas operativas actuales solo enumeran deepseek-v4-flash y deepseek-v4-pro. No realizamos una llamada autenticada a los aliases antiguos, por lo que no afirmamos qué respuesta o código de error devuelven hoy.
No construyas una integración nueva con esos nombres ni los presentes como V3.2 o R1. Migra explícitamente a deepseek-v4-flash o deepseek-v4-pro, declara el modo de pensamiento en la solicitud y valida la aplicación con un conjunto de pruebas propio antes de producción.
Acceder a la API
La creación de claves, la consulta del saldo y la recarga se realizan en la plataforma del proveedor. No introduzcas tu clave secreta en formularios de terceros ni en código enviado al navegador.
Preguntas frecuentes sobre el precio de DeepSeek
¿La API de DeepSeek es gratuita?
No existe una promesa general de uso ilimitado y gratuito de la API. Las llamadas se descuentan del saldo conforme a los tokens de entrada y salida. Algunas cuentas pueden mostrar saldo concedido, pero no debe asumirse como una oferta permanente ni disponible para todos.
¿Por qué puedo usar un chat gratis si la API cuesta dinero?
Porque el operador de una interfaz puede asumir el coste de la API, limitar el uso o financiar el servicio por otros medios. El acceso gratuito a una web o aplicación no entrega al usuario saldo API para emplearlo en proyectos propios.
¿Cuál es el modelo más barato?
V4 Flash tiene las tarifas de entrada y salida más bajas de los dos modelos V4 publicados. La elección final debe considerar también calidad, latencia, longitud de respuesta y cantidad de solicitudes.
¿Se cobra un millón de tokens por usar el contexto de 1M?
No. Un millón es la longitud máxima de contexto publicada. El coste se calcula con los tokens realmente procesados en cada solicitud y respuesta.
¿El modo de pensamiento tiene una tarifa diferente?
DeepSeek publica una tarifa por modelo y no una tabla separada por modo. El pensamiento puede producir una salida más larga, por lo que el coste total puede aumentar aunque el precio unitario del modelo no cambie.
¿La caché reduce todo el coste?
No. Solo reduce el precio de los tokens de entrada que coinciden con un prefijo almacenado y se informan como cache hit. Los misses y todos los tokens de salida conservan sus tarifas correspondientes.
¿Puedo calcular el precio a partir del número de palabras?
Solo de forma aproximada, porque palabra y token no son unidades equivalentes. Para facturación o presupuestos fiables, utiliza los contadores de usage devueltos por la API y conserva margen para variaciones.
¿Los precios están disponibles en euros?
La documentación consultada publica las tarifas en USD. Para presupuestar en EUR u otra moneda, aplica un tipo de cambio fechado y añade margen para variaciones o cargos del medio de pago. No fijamos un tipo de cambio en esta página porque dejaría de ser preciso rápidamente.
¿Seguirán funcionando deepseek-chat y deepseek-reasoner?
DeepSeek anunció su retirada para el 24 de julio de 2026 a las 15:59 UTC. A 29 de julio, la documentación operativa solo enumera los identificadores V4 explícitos. Migra a ellos; el comportamiento actual de los aliases no se verificó con una clave válida.
Fuentes oficiales consultadas
La página utiliza únicamente documentación de DeepSeek para cifras, identificadores, fechas y comportamiento de la caché. Las operaciones aritméticas y recomendaciones de presupuesto son elaboración independiente.
- Models & Pricing: tarifas por 1M tokens, contexto, salida máxima, concurrencia y correspondencia temporal de los alias.
- DeepSeek V4 Preview Release: lanzamiento, identificadores V4 y retirada completa de los alias.
- Token & Token Usage: definición de token y medición mediante la respuesta del modelo.
- Context Caching: persistencia, reglas de hit, campos de uso, mejor esfuerzo y eliminación habitual.
- Get User Balance: composición y disponibilidad del saldo de la API.
- Introducing DeepSeek App: descripción publicada de la aplicación de consumo como gratuita.
Registro de actualización
| Fecha | Cambio editorial |
|---|---|
| 29 de julio de 2026 | Revisión de precios y documentación operativa; actualización del estado de los aliases tras la fecha anunciada y declaración explícita de que no se realizó una llamada autenticada. |
| 16 de julio de 2026 | Reescritura completa con tarifas corregidas de V4 Flash y V4 Pro, equivalencias por 1K, fórmula, ejemplos recalculados, caché en disco, límites de concurrencia y fecha exacta de retirada de los alias. |
| Próxima revisión obligatoria | Cuando se disponga de una clave válida y saldo: registrar GET /models y probar los aliases antiguos en el endpoint OpenAI-compatible sin ocultar respuestas fallidas. |
Correcciones: si detectas una diferencia entre esta guía y la documentación enlazada, utiliza la documentación del proveedor para tomar decisiones de facturación y comunícanos el cambio mediante la página de contacto. Las cifras de esta página son una referencia independiente, no una oferta comercial ni una garantía de precio.