
En este artículo (4)
Precios de DeepSeek V4 Pro: análisis de horas punta y valle cuadruplicadas
Puntos Clave
- Los presupuestos de API de modelos necesitan seguimiento a nivel de tokens, no estimaciones mensuales.
- Las tarifas de horas pico y horas valle pueden orientar la demanda sin bloquear a los usuarios.
- Los aciertos de caché, los fallos de caché y la longitud de salida ahora son variables de diseño de producto.
La medida de V4 Pro muestra cómo el acceso barato a la IA puede evolucionar hacia una tarificación consciente de los recursos cuando el uso se topa con cómputo escaso.
La medida de V4 Pro muestra cómo el acceso barato a la IA puede evolucionar hacia precios conscientes de los recursos una vez que el uso se encuentra con una capacidad de cómputo escasa.
Los precios baratos de API son una táctica maravillosa para adquirir clientes, hasta que la factura empieza a sonar como una alarma de humo. DeepSeek V4 Pro ha llegado a ese momento incómodo de adultez: la API ya no se vende solo como acceso barato a un modelo capaz, sino que se está cobrando como infraestructura compartida en hora pico. El aumento de cuatro veces es el titular. La división entre horas pico y horas valle es la lección de producto.
El lanzamiento es una arquitectura de precios
Reuters informó que DeepSeek aumentó los precios de la API para sus modelos V4, y Channel Insider describió el aumento de la API V4 como superior a cuatro veces. Según DeepSeek API Docs, los precios de V4 Pro ahora se dividen entre tarifas de horas valle y horas pico, con las horas valle costando la mitad del precio de las horas pico.
DeepSeek lista V4 Pro a $0.022 por entrada con acierto de caché, $0.66 por entrada con fallo de caché y $1.98 por salida por cada 1M de tokens en precios de horas valle, subiendo a $0.044, $1.32 y $3.96 en precios de horas pico. V4 Flash sigue la misma estructura a $0.007, $0.22 y $0.66 en horas valle, y luego $0.014, $0.44 y $1.32 en horas pico.
DeepSeek API Docs también nombra dos modelos de API V4: deepseek-v4-flash, que sirve DeepSeek-V4-Flash-0731, y deepseek-v4-pro, que sirve DeepSeek-V4-Pro-0813. Ambos usan una longitud de contexto de 1M y una salida máxima de 384K, según la misma documentación. La división interesante es la concurrencia: DeepSeek lista un límite de concurrencia de 2500 para V4 Flash y 500 para V4 Pro. Esa es la línea de productos en miniatura: un carril para rendimiento, otro para capacidad más pesada.
Esa brecha de concurrencia es la pista. Las páginas de precios suelen fingir que son documentos contables, pero las buenas son sistemas de control de tráfico. Esta les dice a los desarrolladores que la capacidad premium no es infinita y que la empresa quiere mover el uso hacia horas más baratas cuando sea posible.
Por qué V4 Pro puede pedir más
Artificial Analysis describe DeepSeek V4 Pro (Reasoning, Max Effort) como un modelo de pesos abiertos lanzado en abril de 2026. El modelo obtuvo 45 en el Artificial Analysis Intelligence Index, frente a una mediana de 26 entre modelos comparables, y el sitio dice que admite entrada de texto, salida de texto y una ventana de contexto de 1M de tokens.
Eso ayuda a explicar por qué DeepSeek puede probar un techo de precio más alto sin abandonar por completo su postura de retador. Si el modelo es materialmente más fuerte, la conversación sobre precios pasa del token más barato al token útil.
El problema es la verbosidad. Artificial Analysis dice que DeepSeek V4 Pro generó 180M de tokens en su evaluación del Intelligence Index, frente a una mediana de 99M, y etiqueta el modelo como muy verboso. En la economía de las API, eso no es una nota al pie: es el contador girando. Un modelo que razona bien pero habla mucho puede convertir límites de salida generosos en una sorpresa de costos para clientes que no instrumentan prompts, respuestas y reintentos.
El efecto de segundo orden es conductual
DeepSeek API Docs dice que la facturación se basa en el número total de tokens de entrada y salida, con la entrada dividida en categorías de acierto de caché y fallo de caché. Esa distinción importa más bajo la nueva estructura porque la ruta cara no es solo usar V4 Pro; es usar V4 Pro en hora pico, fallar la caché y generar respuestas largas. Esta página de precios es un Elige tu propia aventura donde los finales costosos empiezan con prompts no almacenados en caché y salidas verbosas.
La decisión inteligente para los creadores es tratar el almacenamiento en caché y la longitud de respuesta como requisitos de producto, no como tareas de limpieza. Los precios de horas pico y horas valle también cambian la conversación con el cliente. Un precio de API plano invita a los equipos a preguntar si un modelo es lo bastante barato. Un precio basado en el tiempo pregunta si la carga de trabajo es lo bastante urgente. Las evaluaciones por lotes, el análisis interno y los trabajos no interactivos a menudo pueden moverse a ventanas más baratas, mientras que los flujos orientados al usuario pueden justificar tarifas de hora pico si la latencia importa. Ese es un modelo más honesto para infraestructura escasa que fingir que cada token llega con el mismo perfil de costo.
Qué deberían copiar los creadores y
qué deberían vigilar los clientes Reuters y Channel Insider presentan el cambio como un aumento de precio, lo cual es cierto, pero la lectura más útil es que DeepSeek está pasando de precios de adopción a precios conscientes de los recursos. Para fundadores y líderes de producto, la lección es simple: si el precio bajo es tu cuña de entrada, decide pronto qué pasa cuando el uso se vuelve real. Si la respuesta es un shock repentino de factura cuatro veces mayor, los clientes se sentirán emboscados. Si la respuesta es una escalera visible de caché, horarios y controles de salida, los clientes pueden planificar.
Para los clientes, el próximo sprint debería incluir observabilidad de costos a nivel de token. Haz seguimiento de las tasas de acierto de caché, las tasas de fallo de caché, la longitud de salida, el uso en horas pico y qué funciones realmente necesitan V4 Pro en lugar de V4 Flash. El siguiente movimiento lógico de DeepSeek no es necesariamente otro cambio de precio. Observa si la documentación oficial evoluciona hacia controles de presupuesto más claros, orientación sobre caché y patrones de programación que hagan más fácil poner en práctica la nueva arquitectura de precios.