DeepSeek ha lanzado V4-Flash versión 0731, manteniendo la política de precios agresiva por la que se conoce a la línea — y añadiendo una advertencia inusual.

Las cifras

V4-Flash cuesta $0.14 por millón de tokens de entrada en caso de fallo de caché y $0.28 por millón de tokens de salida. Un acierto de caché reduce el coste de entrada a $0.0028 por millón — cincuenta veces más barato, lo que convierte la estructura del prompt en una decisión de coste de primer orden y no en un simple detalle de optimización.

El modelo más grande, V4-Pro, se sitúa en $0.435 de entrada y $0.87 de salida por millón, con aciertos de caché a $0.003625. Ambos modelos ofrecen una ventana de contexto de 1M de tokens y admiten modos de pensamiento y sin pensamiento.

La advertencia

La documentación de precios indica claramente que DeepSeek planea subir el precio general de la API en el futuro próximo, con un aumento significativo previsto. Los proveedores rara vez anuncian por adelantado sus propias subidas de precio. Publicarlo implica que las tarifas actuales deben interpretarse como promocionales y no como estructurales.

Por qué importa

A $0.14 por millón de entradas, DeepSeek es la opción creíble más barata en el nivel cercano a la frontera, por debajo del recién reducido Luna de OpenAI, a $0.20. Esa diferencia vale algo — pero solo mientras dure, y el proveedor ha dicho que no durará.

La lección práctica tiene que ver con la dependencia del proveedor ("lock-in") más que con el precio. Construir un pipeline de gran volumen alrededor de quien sea más barato este trimestre está bien si los costes de cambio son casi nulos. Resulta caro si la integración es profunda. El descuento por acierto de caché juega en ambos sentidos: diseñar prompts en torno al comportamiento de caché de un proveedor concreto es exactamente el tipo de trabajo que no se traslada a otro.

Cómo interpretar el precio de la caché

La diferencia de cincuenta veces entre acierto y fallo de caché es el dato más útil aquí. Significa que la forma del prompt — qué permanece constante entre llamadas y qué varía — determina el coste más que la elección del modelo. Los sistemas que colocan un preámbulo grande y estable al principio y solo varían la parte final obtienen la mayoría de sus tokens de entrada a $0.0028 por millón.

Eso supone dinero real a gran volumen, y también es una forma sutil de dependencia del proveedor: los prompts diseñados en torno al comportamiento de caché de un proveedor no se trasladan de forma limpia a otro.

Qué prever

Conviene tratar los precios actuales de DeepSeek como temporales, porque el propio proveedor ha dicho que lo son. Si una carga de trabajo se está dimensionando con estas tarifas, hay que modelar qué ocurre al doble o al triple del precio antes de comprometerse. Un pipeline que solo funciona a $0.14 por millón es un pipeline con cuenta atrás.