
En este artículo (4)
Análisis del aumento de precios de la API de DeepSeek: la IA barata muestra grietas
Puntos Clave
- Trata las API de IA baratas como costos variables, no como infraestructura permanente.
- Somete a prueba los niveles de precios frente a costos de tokens más altos antes de que cambie la factura.
- Crea enrutamiento de modelos y controles de uso antes de que la dependencia del proveedor se convierta en un problema de márgenes.
Los desarrolladores deberían tratar los costos de modelos subsidiados como precios de lanzamiento, no como infraestructura permanente.
Los desarrolladores deberían tratar los costos subvencionados de los modelos como precios de lanzamiento, no como infraestructura permanente.
El puesto más barato del bazar de desarrolladores acaba de poner un nuevo cartel: disfruta del menú actual mientras dure. DeepSeek, una empresa estrechamente asociada con modelos de IA de bajo coste, ha advertido a los desarrolladores que los precios de su API van a subir. Esto no es solo un cambio en una línea de gasto para quienes vigilan las facturas de inferencia. Es un recordatorio de que, cuando el margen de tu producto depende del descuento de otra persona, tu hoja de ruta tiene casero.
El susto del precio es la señal estratégica The Next Web describió
la advertencia de DeepSeek como un giro para el laboratorio chino que convirtió los modelos baratos en su carta de presentación y ayudó a iniciar la carrera hacia el fondo en los precios de los modelos. Ese enfoque importa porque DeepSeek no era simplemente otro proveedor en el pasillo de la inferencia. Para muchos creadores, los bajos costes de API se convirtieron en la suposición de la hoja de cálculo que hacía que una función de IA pareciera viable dentro de un plan de suscripción. SCMP informó que DeepSeek dijo que los precios generales de sus servicios de API se elevarían "en un futuro cercano", con planes específicos que se comunicarían más adelante. AI Weekly informó que DeepSeek dijo a los desarrolladores que los precios subirían "significativamente" a corto plazo, sin indicar un porcentaje ni una fecha de entrada en vigor. El detalle de producto más importante es el espacio en blanco donde debería estar la nueva tabla de tarifas. Cuando un proveedor te dice que la factura va a subir pero no cuánto, tu backlog de pronto recibe un sprint oculto llamado supervivencia del margen.
La base que los creadores trataron como infraestructura
La tabla actual de AI Pricing Guru lista DeepSeek V4 Flash 0731 a $0.14 por millón de tokens de entrada, $0.0028 por millón de tokens en caché y $0.28 por millón de tokens de salida. La misma tabla lista DeepSeek V4 Pro a $0.435 por millón de tokens de entrada, $0.0036 por millón de tokens en caché y $0.87 por millón de tokens de salida. Esos no son solo precios. Son arquitectura de producto disfrazada. Una vez que el coste de un modelo baja lo suficiente, los equipos dejan de tratarlo como un coste variable y empiezan a tratarlo como electricidad. Así es como la ampliación gradual del alcance se cuela en los productos de IA con bata de laboratorio. Añades ventanas de contexto más largas, más reintentos, resúmenes más ricos, agentes en segundo plano y un nivel gratuito generoso porque la economía unitaria parece amigable. Luego el proveedor aguas arriba cambia el menú y, de repente, tu página de precios es un Elige tu propia aventura donde todos los finales son caros.
Las API baratas crean supuestos caros
SCMP informó que el aviso de precios llegó en medio de una demanda global creciente de modelos de IA de bajo coste. También dijo que el aviso llegó una semana después de que DeepSeek lanzara DeepSeek-V4-Flash-0731, una versión ligera de 284 mil millones de parámetros de la serie V4. Esa secuencia es la parte interesante para la gente de producto. La demanda demuestra que el gancho funcionó, pero la demanda también pone a prueba si el gancho puede financiarse a sí mismo. El efecto de segundo orden es la dependencia del proveedor. Si el flujo de trabajo central de tu aplicación solo funciona con la economía promocional de un proveedor, no tienes un foso defensivo, tienes un cupón. El mejor patrón es aburrido pero duradero: medir las acciones caras, separar el uso casual del uso intensivo, almacenar en caché de forma agresiva y convertir el enrutamiento de modelos en una capacidad de producto en lugar de un proyecto de migración de emergencia. La inferencia barata puede acelerar un lanzamiento, pero no debería ser el muro de carga.
El siguiente movimiento lógico para los creadores
El informe de AI Weekly de que DeepSeek no ha revelado el porcentaje ni la fecha de entrada en vigor da a los creadores una tarea inmediata: ejecutar los escenarios dolorosos antes de que lo haga la factura. Los líderes de producto deberían modelar costes de tokens más altos frente a sus planes más generosos, sus usuarios más intensivos y sus tareas en segundo plano menos evidentes. Si un solo cambio aguas arriba puede convertir una cohorte de rentable a subvencionada, el producto está infravalorado o demasiado expuesto. La lección para fundadores no es evitar DeepSeek, ni a ningún proveedor de bajo coste. La lección es diseñar para el movimiento de precios como una condición normal de la pila de IA. Observa la tabla de tarifas real, observa si los competidores igualan o mantienen precios, y observa con qué rapidez las aplicaciones de IA reescriben sus paquetes alrededor del uso. Las empresas que sobrevivan a esta fase serán las que traten los costes de modelos como el clima: útiles cuando son favorables, peligrosos cuando se ignoran y nunca completamente bajo tu control.