DeepSeek ha actualizado la versión del modelo deepseek-v4-pro a DeepSeek-V4-Pro-0813. Según la información publicada hasta ahora, esta actualización no ha venido acompañada de un ajuste de precios. Aunque DeepSeek había anunciado previamente su intención de aumentar los precios de los servicios de API en general, los precios actuales en todos los niveles se mantienen consistentes con los anteriores.
Mejoras en las especificaciones clave de DeepSeek-V4-Pro-0813
En términos de especificaciones clave, el deepseek-v4-pro admite una longitud de contexto de 1M, con una longitud máxima de salida de hasta 384K Tokens, y soporta tanto el modo de no pensamiento como el modo de pensamiento, siendo este último el predeterminado. Para el procesamiento de grandes bibliotecas de código, el análisis de documentos a gran escala y tareas de Agente que requieren la ejecución continua de numerosos pasos, una ventana de contexto de 1M y una salida máxima de 384K significan que una sola llamada puede manejar y generar una cantidad considerable de contenido, reduciendo así el costo de múltiples divisiones y uniones.
En cuanto a las capacidades complementarias, el deepseek-v4-pro cubre prácticamente todas las necesidades de desarrollo de Agentes actuales. Este modelo admite JSON Output, Tool Calls, Responses API y Anthropic API, y también soporta la función de continuación de prefijos de conversación en fase Beta y la función de completado FIM, que solo se puede utilizar en modo de no pensamiento.
En cuanto a la forma de acceso a la API, el deepseek-v4-pro es compatible con los formatos de OpenAI y Anthropic, permitiendo a los desarrolladores elegir de manera flexible el camino de acceso según su stack tecnológico. En términos de precios, el deepseek-v4-pro actualmente tiene una tarifa de 0.025 yuanes por cada millón de Tokens para entradas de caché hit, 3 yuanes para entradas de caché miss y 6 yuanes para salidas.
Comparación de precios y rendimiento de la versión Pro de DeepSeek
Como comparación, el deepseek-v4-flash de la misma serie tiene precios de 0.02 yuanes por cada millón de Tokens para entradas de caché hit, 1 yuan para entradas de caché miss y 2 yuanes para salidas. Esto significa que, en los dos principales elementos de facturación, las entradas de caché miss y las salidas, el precio de la versión Pro es 3 veces el de la versión Flash. Aunque el precio absoluto de Pro es más alto que el de Flash, considerando su mayor ventana de contexto y capacidad de salida, la relación calidad-precio por Token sigue siendo competitiva.
Los dos versiones también difieren en los límites de concurrencia. El límite de concurrencia del deepseek-v4-flash es de 2500, mientras que el del deepseek-v4-pro es de 500. Desde esta diferencia de configuración, Flash está claramente orientado a escenarios de llamadas de alta frecuencia y gran escala, adecuado para aplicaciones que requieren respuestas rápidas y numerosas solicitudes paralelas; mientras que Pro concentra los recursos en tareas de mayor especificación, priorizando la profundidad y complejidad de cada llamada individual.

