DeepSeek lanza V4 Pro y aumenta el precio de la API hasta un 1,100%, con enfoque en agente

La startup china formalizó el V4-Pro-0813 con contexto de 1 millón de tokens y reajusta la API a partir del 16 de agosto, finalizando la fase de precios agresivos que la colocó en el mapa en 2025.
DeepSeek lanzó este jueves la versión de producción del V4-Pro-0813, su modelo más avanzado, y en el mismo comunicado avisó que la tabla de precios de la API aumentará hasta un 1,100% a partir de las 16h UTC del 16 de agosto. Es la primera vez que la startup china admite abiertamente que el modelo de precios agresivo que la posicionó en el mapa en 2025 se había vuelto insostenible.
El V4-Pro-0813 ofrece una ventana de contexto de 1 millón de tokens y permite salidas de hasta 384 mil tokens, con opción de operar en modo thinking o directo. El enfoque declarado es agente: uso de herramientas, ejecución de código y orquestación de tareas de varios pasos sin supervisión humana. Esto posiciona el producto contra el Claude Opus 4.7 de Anthropic y la familia Fable 5, los modelos que han dominado el vertical de agentes empresariales en los últimos meses.
El precio cambia la conversación
Según Caixin Global, el token de entrada cache-miss del V4-Pro pasa de US$ 0.435 por millón a US$ 1.32 por millón en horarios pico, un salto del 200%. En algunos pares de rango, la variación llega a 1,100%. DeepSeek dividió el día en ventanas: pico entre 01h-04h y 06h-10h UTC; fuera del pico, el cliente paga la mitad del precio pico. Es la misma lógica de tarifa dinámica que utilizan las operadoras de nube para aplanar picos de GPU.
Para el CIO europeo que realizó una POC en verano con la promesa de un costo diez veces menor que la competencia americana, el cálculo ha cambiado. La distancia entre el V4-Pro en horario pico y un Claude Fable 5 en el volumen equivalente ya no es un abismo, es un descuento marginal. Para el hyperscaler chino que revendió tokens de DeepSeek, la compresión de margen es inmediata.
Avance superado por el Flash
El detalle embarazoso, que la compañía no ocultó en el material de prensa, es que el V4-Flash lanzado en julio superó la versión preview del V4-Pro en varios benchmarks independientes desde abril. DeepSeek pasó tres meses ajustando el V4-Pro sobre un Flash que ya producía resultados. El 0813 corrige la discrepancia, pero la lectura en el mercado es otra: la curva de retorno en capex de entrenamiento se ha vuelto más superficial incluso internamente.
Nada de esto es abstracto para bancos y consultorías. JPMorgan divulgó esta semana la proyección de US$ 1.2 billones en capex de IA hasta finales de 2027 y la mayor parte de esa cifra se basa en la tesis de que el costo por token seguiría disminuyendo. DeepSeek acaba de introducir una discrepancia pública con esa curva.
Lecturas por mercado
En Estados Unidos, el reajuste de precios legitima el argumento de OpenAI y Anthropic de que el precio mínimo de la inferencia no es cero. Las dos empresas han estado tratando durante meses de convencer a los inversores de que el margen bruto en producción es defendible, y han pasado esta semana promoviendo una nueva métrica de costo, según Bloomberg. Un competidor chino validando el piso ayuda al discurso.
En India, epicentro del offshoring de desarrollo y donde DeepSeek se convirtió en la opción predeterminada en varios equipos de POC por la combinación de precio y latencia, el traspaso afectará al P&L de fábricas de software. TCS, Infosys, Wipro y una serie de nuevas empresas nativas de IA han estructurado propuestas comerciales en las dos últimas rondas asumiendo el precio de julio. Los contratos plurianuales firmados sobre esta base quedarán con márgenes presionados hasta la próxima renegociación.
Para las Big 4 y MBB, el traspaso es aún más directo. Accenture, que anunció en mayo la reducción de 11,000 puestos de trabajo dentro de una reestructuración de US$ 865 millones atribuida a IA, ha creado en los últimos meses ofertas de agentes empresariales con precios de lista apoyados en el costo del V4-Pro al lanzamiento. Deloitte y Bain han seguido el mismo camino. Si el traspaso se mantiene en 200% incluso fuera del pico, el margen contractual de estas líneas caerá antes del próximo cierre fiscal, y ninguna de ellas tiene espacio para renegociar cliente por cliente en un corto período.
En Brasil, el efecto es indirecto: las empresas que realizaron pruebas de concepto con V4-Pro debido al costo ahora necesitan rehacer la hoja de TCO para decidir si migran carga a un proveedor local, permanecen en DeepSeek fuera del pico, o cierran contratos de volumen con Anthropic o OpenAI. Itaú y Bradesco, que abrieron RFP para el uso de LLM en atención y crédito, probablemente pedirán nuevas condiciones comerciales en las próximas semanas.
DeepSeek no ha anunciado un aumento equivalente en el V4-Flash en la misma proporción. La compañía parece separar el Pro como producto premium y reservar el Flash para la retención de volumen. Si la estrategia funciona, es una señal de que el mercado chino está siguiendo el mismo camino de segmentación por niveles que el estadounidense ha recorrido en los últimos dos años.