Precios de DeepSeek API: guía independiente y calculadora

Última verificación documental: 29 de julio de 2026. Precios expresados en dólares estadounidenses (USD). Revisión basada en la documentación operativa oficial; no se ejecutó una solicitud facturable.

La API de DeepSeek no tiene una cuota mensual única: descuenta del saldo el coste de los tokens de entrada y salida realmente procesados. Desde el 24 de abril de 2026, los identificadores publicados para DeepSeek V4 Preview son deepseek-v4-flash y deepseek-v4-pro. Ambos admiten modos de pensamiento y no pensamiento, un contexto de 1 millón de tokens y una salida máxima de 384.000 tokens, pero tienen tarifas y límites de concurrencia diferentes.

Respuesta rápida

  • V4 Flash: $0.14 por 1M tokens de entrada sin acierto de caché y $0.28 por 1M tokens de salida.
  • V4 Pro: $0.435 por 1M tokens de entrada sin acierto de caché y $0.87 por 1M tokens de salida.
  • Entrada con cache hit: $0.0028 por 1M en Flash y $0.003625 por 1M en Pro.
  • Web, app y API no son el mismo producto de facturación: usar una interfaz de chat sin pagar una tarifa por token no convierte la API en gratuita.

¿DeepSeek es gratis o de pago?

Chat independiente de este sitio

El chat en español de este sitio se ofrece al visitante sin coste y sin crear una cuenta. La interfaz utiliza la API de DeepSeek en el servidor; el visitante no recibe una clave ni saldo API propios. El acceso gratuito puede estar sujeto a la disponibilidad y a las medidas operativas del sitio.

Web y aplicación de DeepSeek

DeepSeek presentó su aplicación de consumo como gratuita, sin anuncios ni compras dentro de la aplicación. Esa descripción corresponde a la experiencia de usuario de la app y no es una promesa de llamadas API gratuitas. Las funciones, el acceso y los límites operativos de la web o la app pueden cambiar independientemente de la tabla de precios para desarrolladores. Consulta nuestra guía de descarga de la aplicación para identificar los canales correctos.

API para desarrolladores y empresas

La API se factura por uso y descuenta los cargos del saldo disponible en la cuenta de la plataforma. Si una cuenta muestra saldo concedido, DeepSeek indica que lo utiliza antes que el saldo recargado; no debe darse por hecho que todas las cuentas recibirán créditos promocionales. Para integrar los modelos correctamente, utiliza nuestra guía de la API de DeepSeek.

Tabla de precios de DeepSeek V4

DeepSeek publica las tarifas por 1 millón de tokens. La tabla conserva el punto decimal empleado por la documentación del proveedor para evitar errores al copiar los valores.

Conceptodeepseek-v4-flashdeepseek-v4-pro
1M tokens de entrada, cache hit$0.0028$0.003625
1M tokens de entrada, cache miss$0.14$0.435
1M tokens de salida$0.28$0.87
Longitud de contexto1M1M
Salida máxima384K384K
Límite de concurrencia por cuenta2.500500
Tarifas por 1 millón de tokens verificadas documentalmente el 29 de julio de 2026. El contexto máximo no se cobra automáticamente: se factura la cantidad realmente procesada.

Precio equivalente por 1.000 tokens

La API factura según el número real de tokens, aunque la documentación muestre la unidad de 1 millón. Dividir cada tarifa entre 1.000 permite obtener la equivalencia por 1.000 tokens:

Concepto por 1K tokensV4 FlashV4 Pro
Entrada, cache hit$0.0000028$0.000003625
Entrada, cache miss$0.00014$0.000435
Salida$0.00028$0.00087

Importante: no multipliques las tarifas por 1.000 dos veces. Si introduces tokens en una calculadora basada en la unidad de 1 millón, divide la cantidad de tokens entre 1.000.000 y después multiplícala por el precio correspondiente.

Cómo calcula DeepSeek el coste

Un token es una unidad de texto reconocida por el modelo; no equivale de forma fija a una palabra. La tokenización depende del contenido y del modelo, por lo que una estimación basada únicamente en palabras puede desviarse. Para una medición final, utiliza los valores devueltos en el objeto usage de la respuesta.

Separa los tokens de entrada en dos grupos: los que obtienen un acierto de caché y los que no. Los tokens generados por el modelo se cobran siempre a la tarifa de salida.

Coste = (tokens de entrada con hit ÷ 1.000.000 × precio hit)
      + (tokens de entrada con miss ÷ 1.000.000 × precio miss)
      + (tokens de salida ÷ 1.000.000 × precio de salida)
  1. Selecciona V4 Flash o V4 Pro.
  2. Obtén de usage los tokens de entrada con cache hit, entrada con cache miss y salida.
  3. Aplica a cada grupo su tarifa y suma los tres importes.
  4. Redondea solo el total mostrado; conserva toda la precisión decimal durante el cálculo.

Qué significa cache hit y cuánto puede ahorrar

El almacenamiento en caché de contexto en disco está habilitado de forma predeterminada en la API. Si una petición posterior reutiliza por completo una unidad de prefijo que ya se ha guardado, esa parte de la entrada puede contabilizarse como cache hit. Las partes que no coinciden se contabilizan como cache miss.

  • La tarifa hit de Flash es 50 veces menor que su tarifa miss de entrada.
  • La tarifa hit de Pro es 120 veces menor que su tarifa miss de entrada.
  • El descuento solo se aplica a los tokens de entrada que realmente obtienen un hit; no reduce la tarifa de salida.
  • La caché funciona mediante el principio de mejor esfuerzo y no garantiza una tasa de aciertos del 100 %.
  • La respuesta informa de los resultados mediante prompt_cache_hit_tokens y prompt_cache_miss_tokens.

Para mejorar la posibilidad de reutilización, mantén estable al comienzo de las solicitudes el contenido repetido —por ejemplo, instrucciones de sistema, políticas o un documento común— y añade después la pregunta variable. No presupuestes un ahorro antes de medir el patrón real de uso.

Nota de privacidad: se trata de una caché en disco del proveedor, no de una caché local del navegador. DeepSeek indica que los prefijos no utilizados suelen eliminarse automáticamente en un periodo de unas horas a unos días. Evita enviar secretos o datos personales innecesarios y revisa nuestra Política de privacidad y la guía de seguridad.

Calculadora de costes de DeepSeek API

Introduce por separado los tokens de entrada con hit, los tokens de entrada con miss y los tokens de salida. Si solo dispones del total de entrada y una tasa estimada de caché, el estimador puede dividirlo en ambos grupos, pero el resultado seguirá siendo una previsión hasta comprobar el objeto usage.

Estima el coste de una solicitud o periodo

Escribe cantidades de tokens no negativas. El cálculo usa USD y las tarifas verificadas documentalmente el 29 de julio de 2026.





Coste estimado: $0.168

Entrada hit: $0 · Entrada miss: $0.14 · Salida: $0.028

Ejemplos de coste

Ejemplo 1: una prueba pequeña sin cache hit

Una solicitud o conjunto de solicitudes procesa 250.000 tokens de entrada sin hit y genera 50.000 tokens de salida.

ModeloEntradaSalidaTotal
V4 Flash0.25 × $0.14 = $0.0350.05 × $0.28 = $0.014$0.049
V4 Pro0.25 × $0.435 = $0.108750.05 × $0.87 = $0.0435$0.15225

Ejemplo 2: un millón de tokens de entrada con un 20 % de hit

El trabajo procesa 200.000 tokens de entrada con hit, 800.000 con miss y 100.000 tokens de salida.

ModeloCálculoTotal
V4 Flash(0.2 × $0.0028) + (0.8 × $0.14) + (0.1 × $0.28)$0.14056
V4 Pro(0.2 × $0.003625) + (0.8 × $0.435) + (0.1 × $0.87)$0.435725

Ejemplo 3: presupuesto mensual

Una aplicación procesa 150 millones de tokens de entrada y 80 millones de salida al mes. Si el 30 % de la entrada obtiene hit, hay 45 millones de tokens hit y 105 millones miss.

ModeloSin hits de cachéCon 30 % de hitsDiferencia estimada
V4 Flash$43.40$37.23$6.17 menos
V4 Pro$134.85$115.44$19.41 menos
Resultados ilustrativos redondeados a dos decimales. El cargo real depende de los tokens informados por la API.

V4 Flash o V4 Pro: cómo decidir por coste

DeepSeek presenta V4 Flash como la opción rápida, eficiente y económica, y V4 Pro como la variante de mayor capacidad. No es necesario enviar todo el tráfico a un único modelo. Una arquitectura puede usar Flash para tareas rutinarias y reservar Pro para solicitudes que justifiquen el coste adicional, siempre que las pruebas con datos representativos confirmen la calidad necesaria.

CriterioV4 FlashV4 Pro
PrioridadVelocidad y coste reducidoMayor capacidad del modelo
Entrada miss frente a FlashBase: $0.14/1MAproximadamente 3,11 veces el precio de Flash
Salida frente a FlashBase: $0.28/1MAproximadamente 3,11 veces el precio de Flash
Contexto y salida máxima1M / 384K1M / 384K
Paso recomendadoEvaluar calidad, latencia y tokens de salida con el mismo conjunto de pruebas antes de decidir.

Ambos modelos tienen una única tarifa publicada para sus modos de pensamiento y no pensamiento. No aparece un recargo separado por activar el pensamiento; sin embargo, una respuesta con razonamiento más largo puede generar más tokens de salida y aumentar el importe total. Consulta las diferencias técnicas en nuestra guía de DeepSeek V4.

Cómo controlar el presupuesto

  • Mide tokens reales: registra los campos de usage por modelo, función y cliente, sin guardar el contenido sensible de los mensajes.
  • Separa hit, miss y salida: una media total de tokens no permite aplicar correctamente las tres tarifas.
  • Limita la salida: configura un máximo coherente con la tarea; 384K es una capacidad máxima, no un objetivo de generación.
  • Reutiliza prefijos estables: coloca instrucciones y contexto repetido antes de la parte variable, pero mide los hits en lugar de asumirlos.
  • Enruta por complejidad: prueba Flash como opción inicial y eleva a Pro solo cuando una regla o evaluación lo justifique.
  • Vigila el saldo: establece alertas internas y evita depender de créditos concedidos que quizá no existan o puedan caducar.
  • Comprueba cambios: DeepSeek se reserva el derecho a modificar precios. Guarda la fecha y la fuente usada en cada presupuesto.

Los importes de esta página no incluyen posibles costes de infraestructura propia, bases de datos, búsqueda, herramientas externas, observabilidad, procesamiento de pagos o conversión de divisas. Para escenarios de despliegue, consulta nuestras soluciones con DeepSeek.

Retirada de deepseek-chat y deepseek-reasoner

Estado documental a 29 de julio de 2026: DeepSeek anunció la retirada de deepseek-chat y deepseek-reasoner para el 24 de julio de 2026 a las 15:59 UTC. Las páginas operativas actuales solo enumeran deepseek-v4-flash y deepseek-v4-pro. No realizamos una llamada autenticada a los aliases antiguos, por lo que no afirmamos qué respuesta o código de error devuelven hoy.

No construyas una integración nueva con esos nombres ni los presentes como V3.2 o R1. Migra explícitamente a deepseek-v4-flash o deepseek-v4-pro, declara el modo de pensamiento en la solicitud y valida la aplicación con un conjunto de pruebas propio antes de producción.

Acceder a la API

La creación de claves, la consulta del saldo y la recarga se realizan en la plataforma del proveedor. No introduzcas tu clave secreta en formularios de terceros ni en código enviado al navegador.

Preguntas frecuentes sobre el precio de DeepSeek

¿La API de DeepSeek es gratuita?

No existe una promesa general de uso ilimitado y gratuito de la API. Las llamadas se descuentan del saldo conforme a los tokens de entrada y salida. Algunas cuentas pueden mostrar saldo concedido, pero no debe asumirse como una oferta permanente ni disponible para todos.

¿Por qué puedo usar un chat gratis si la API cuesta dinero?

Porque el operador de una interfaz puede asumir el coste de la API, limitar el uso o financiar el servicio por otros medios. El acceso gratuito a una web o aplicación no entrega al usuario saldo API para emplearlo en proyectos propios.

¿Cuál es el modelo más barato?

V4 Flash tiene las tarifas de entrada y salida más bajas de los dos modelos V4 publicados. La elección final debe considerar también calidad, latencia, longitud de respuesta y cantidad de solicitudes.

¿Se cobra un millón de tokens por usar el contexto de 1M?

No. Un millón es la longitud máxima de contexto publicada. El coste se calcula con los tokens realmente procesados en cada solicitud y respuesta.

¿El modo de pensamiento tiene una tarifa diferente?

DeepSeek publica una tarifa por modelo y no una tabla separada por modo. El pensamiento puede producir una salida más larga, por lo que el coste total puede aumentar aunque el precio unitario del modelo no cambie.

¿La caché reduce todo el coste?

No. Solo reduce el precio de los tokens de entrada que coinciden con un prefijo almacenado y se informan como cache hit. Los misses y todos los tokens de salida conservan sus tarifas correspondientes.

¿Puedo calcular el precio a partir del número de palabras?

Solo de forma aproximada, porque palabra y token no son unidades equivalentes. Para facturación o presupuestos fiables, utiliza los contadores de usage devueltos por la API y conserva margen para variaciones.

¿Los precios están disponibles en euros?

La documentación consultada publica las tarifas en USD. Para presupuestar en EUR u otra moneda, aplica un tipo de cambio fechado y añade margen para variaciones o cargos del medio de pago. No fijamos un tipo de cambio en esta página porque dejaría de ser preciso rápidamente.

¿Seguirán funcionando deepseek-chat y deepseek-reasoner?

DeepSeek anunció su retirada para el 24 de julio de 2026 a las 15:59 UTC. A 29 de julio, la documentación operativa solo enumera los identificadores V4 explícitos. Migra a ellos; el comportamiento actual de los aliases no se verificó con una clave válida.

Fuentes oficiales consultadas

La página utiliza únicamente documentación de DeepSeek para cifras, identificadores, fechas y comportamiento de la caché. Las operaciones aritméticas y recomendaciones de presupuesto son elaboración independiente.

Registro de actualización

FechaCambio editorial
29 de julio de 2026Revisión de precios y documentación operativa; actualización del estado de los aliases tras la fecha anunciada y declaración explícita de que no se realizó una llamada autenticada.
16 de julio de 2026Reescritura completa con tarifas corregidas de V4 Flash y V4 Pro, equivalencias por 1K, fórmula, ejemplos recalculados, caché en disco, límites de concurrencia y fecha exacta de retirada de los alias.
Próxima revisión obligatoriaCuando se disponga de una clave válida y saldo: registrar GET /models y probar los aliases antiguos en el endpoint OpenAI-compatible sin ocultar respuestas fallidas.

Correcciones: si detectas una diferencia entre esta guía y la documentación enlazada, utiliza la documentación del proveedor para tomar decisiones de facturación y comunícanos el cambio mediante la página de contacto. Las cifras de esta página son una referencia independiente, no una oferta comercial ni una garantía de precio.