Por Redacción Pangea IA · 10 de septiembre de 2026
DeepSeek ha activado V4.1‑Flash en su API con una propuesta difícil de ignorar: un millón de tokens de contexto, entrada de imágenes, hasta 384.000 tokens de salida y precios muy inferiores a V4 Pro. La comparación, sin embargo, tiene una particularidad decisiva: la propia compañía prevé retirar V4 Pro y redirigir sus peticiones a V4.1‑Flash desde el 14 de septiembre. Para un proyecto nuevo, Flash es la elección lógica; para uno existente, la prioridad es comprobar compatibilidad y calidad antes del cambio automático.
El lanzamiento se hizo público este 10 de septiembre. Reuters lo sitúa a las 06:32 UTC —08:32 en la España peninsular— y la documentación oficial de DeepSeek ya identifica deepseek-flash como V4.1‑Flash. Este análisis compara los datos de producto disponibles, los costes y las consecuencias prácticas. No reproduce como hechos independientes las afirmaciones de rendimiento del fabricante: DeepSeek aún no ha publicado en su documentación abierta una ficha completa con parámetros ni una batería detallada y reproducible de pruebas para V4.1.
DeepSeek V4.1‑Flash vs V4 Pro: comparación rápida
| Criterio | V4.1‑Flash | V4 Pro |
|---|---|---|
| Nombre en la API | deepseek-flash | deepseek-v4-pro |
| Contexto | 1 millón de tokens | 1 millón de tokens |
| Salida máxima | 384.000 tokens | 384.000 tokens |
| Razonamiento | Sí, además de modo sin razonamiento | Sí, además de modo sin razonamiento |
| Entrada de imágenes | Sí | No |
| JSON, herramientas y Responses API | Sí | Sí |
| Concurrencia por cuenta | 2.500 solicitudes | 500 solicitudes |
| Entrada sin caché, valle | 0,15 $ / millón de tokens | 0,66 $ / millón |
| Salida, valle | 0,60 $ / millón | 1,98 $ / millón |
| Disponibilidad futura | Modelo principal de la gama Flash | Redirección anunciada a Flash desde el 14 de septiembre |
La tabla muestra por qué esta no es una comparación convencional entre dos alternativas estables. V4 Pro todavía aparece en la API, pero DeepSeek afirma que V4.1‑Flash lo ha superado en rendimiento, coste, velocidad y tiempo total, y anuncia su retirada ordenada. Esa valoración procede de la empresa; sin resultados independientes equivalentes, debe tratarse como una afirmación comercial. Lo verificable hoy es la diferencia de funciones, tarifas, límites y calendario.
Qué cambia realmente con V4.1‑Flash
Visión dentro del modelo económico
La novedad funcional más clara frente a V4 Pro es la entrada de imágenes. V4.1‑Flash acepta JPEG, PNG, GIF y WebP mediante URL, datos codificados o archivos subidos. La documentación fija, entre otros límites, 32 MiB para una imagen incrustada, 64 MiB por archivo y hasta 600 imágenes por petición. Esto permite analizar fotografías, diagramas o capturas aportadas por el usuario, aunque no convierte al modelo en un generador de imágenes.
Para una empresa, esta diferencia puede simplificar arquitecturas que antes enviaban el texto a V4 Pro y las imágenes a otro servicio. Aun así, conviene comprobar tareas representativas: lectura de facturas, extracción de tablas, revisión de producto o clasificación visual. Que la API acepte imágenes no garantiza la precisión necesaria en cada sector ni elimina la obligación de validar los resultados.
Más concurrencia para cargas de producción
El límite publicado pasa de 500 conexiones concurrentes para V4 Pro a 2.500 para deepseek-flash. Son solicitudes simultáneas, no peticiones por minuto: cada conexión cuenta desde que se envía hasta que termina la respuesta. Superar el límite provoca un error HTTP 429. La cifra es relevante para lotes, agentes y aplicaciones con muchos usuarios, pero no equivale a una garantía contractual de latencia o disponibilidad.
DeepSeek también permite separar usuarios con un identificador para aislar la caché, la programación y ciertos controles de seguridad. La compañía advierte que ese identificador no debe contener información personal. Este detalle es útil para servicios multiusuario, aunque no sustituye una evaluación de privacidad, tratamiento de datos y transferencias internacionales antes de usar la API con información sensible.
Mismo contexto, salida muy larga
Ambos modelos anuncian un contexto de un millón de tokens y una salida máxima de 384.000. Son techos técnicos, no una recomendación para llenar cada petición. Las entradas largas aumentan el coste, la espera y el riesgo de que información relevante quede diluida. En recuperación documental suele ser preferible seleccionar fragmentos pertinentes, medir la tasa de acierto y reservar el contexto masivo para casos que realmente lo requieran.
Cuánto cuesta: un ejemplo reproducible
DeepSeek distingue horas punta y valle. De lunes a viernes, las franjas punta son 01:00–04:00 y 06:00–10:00 UTC; en la España peninsular durante el horario de verano corresponden a 03:00–06:00 y 08:00–12:00. El resto se factura a la mitad. La zona horaria cambia con el horario de invierno, por lo que no conviene codificar estas conversiones de manera permanente.
| Precio por millón de tokens | V4.1‑Flash valle | V4.1‑Flash punta | V4 Pro valle | V4 Pro punta |
|---|---|---|---|---|
| Entrada con caché | 0,003 $ | 0,006 $ | 0,022 $ | 0,044 $ |
| Entrada sin caché | 0,15 $ | 0,30 $ | 0,66 $ | 1,32 $ |
| Salida | 0,60 $ | 1,20 $ | 1,98 $ | 3,96 $ |
Supongamos un servicio que consume 10 millones de tokens de entrada sin caché y genera 2 millones de salida. En valle, V4.1‑Flash costaría 2,70 dólares: 1,50 por la entrada y 1,20 por la salida. V4 Pro costaría 10,56 dólares. En punta, serían 5,40 frente a 21,12 dólares. El ahorro ronda el 74 % en este ejemplo, pero variará según la proporción entre entrada, salida y caché.
La caché puede abaratar mucho las instrucciones repetidas, aunque no debe presupuestarse un porcentaje de aciertos sin medirlo. Tampoco basta con comparar el precio por token: un modelo que necesite más reintentos, produzca respuestas más largas o exija supervisión adicional puede resultar más caro por tarea completada. Esta es la misma cautela que explicamos al analizar cuánto cuesta automatizar una pyme con IA.
Metodología y límites de la comparación
- Mismos criterios: contexto, salida, modalidades, compatibilidad de API, concurrencia y tarifa oficial.
- Sin pruebas inventadas: no hemos ejecutado una batería propia ni afirmamos que Flash sea más preciso basándonos solo en el anuncio.
- Fabricante frente a evidencia: la superioridad de rendimiento es una afirmación de DeepSeek; las funciones y precios sí están publicados en su documentación.
- Producto API: estas condiciones no describen necesariamente la aplicación web o móvil de DeepSeek.
- Foto temporal: los precios y el enrutamiento pueden cambiar. Deben revisarse antes de tomar una decisión contractual.
También falta un dato importante para quienes buscan ejecutar el modelo por su cuenta: en el momento de la consulta no hay una ficha oficial específica de V4.1‑Flash con número de parámetros, pesos descargables y licencia. La versión anterior V4‑Flash sí tuvo pesos y licencia MIT, pero no debe extrapolarse esa condición al nuevo modelo. Para despliegues locales siguen siendo útiles referencias como nuestro análisis de los requisitos de Qwen 3.8 en local, que trata una decisión distinta de consumir una API alojada.
Ventajas e inconvenientes de cada opción
V4.1‑Flash
- A favor: precio muy inferior, visión, mayor concurrencia, contexto amplio y compatibilidad con formatos OpenAI, Anthropic y Responses.
- En contra: lanzamiento muy reciente, escasa evaluación independiente pública, precios variables por horario y ausencia inicial de una ficha abierta completa de arquitectura y licencia.
V4 Pro
- A favor: continuidad temporal para sistemas ya validados y las mismas funciones esenciales de texto, razonamiento, JSON y herramientas.
- En contra: cuesta varias veces más, no acepta imágenes, tiene una quinta parte de concurrencia y su retirada ya está anunciada.
El principal argumento a favor de V4 Pro no es que sea mejor, sino que una aplicación concreta ya lo tenga evaluado. Esa ventaja desaparecerá cuando las peticiones sean redirigidas. Quien dependa de su comportamiento debe tratar el cambio como una migración, aunque la URL y el nombre del modelo sigan funcionando.
Qué modelo elegir según el caso
- Proyecto nuevo de texto o visión: V4.1‑Flash. Es más barato, admite imágenes y tiene más capacidad concurrente.
- Aplicación ya desplegada con V4 Pro: probar V4.1‑Flash inmediatamente con una muestra representativa y preparar el cambio antes del 14 de septiembre.
- Procesamiento por lotes: Flash encaja mejor por precio y concurrencia, pero debe incorporar reintentos y control de errores 429.
- Datos sensibles o sectores regulados: no elegir solo por coste. Revisar contratos, ubicación y conservación de datos, controles humanos y normativa aplicable.
- Despliegue local u on‑premise: esperar una publicación oficial específica de pesos y licencia de V4.1 o comparar modelos realmente descargables.
Para evaluar el cambio, conviene reunir entre 100 y 500 casos reales, ocultar datos personales, fijar una rúbrica y comparar exactitud, formato, latencia, tokens, reintentos y coste por resultado válido. Un conjunto pequeño pero representativo suele ser más útil que una clasificación genérica. También hay que comprobar funciones de herramientas y JSON, porque los fallos de formato pueden romper un flujo aunque la respuesta parezca correcta.
Un cambio de nombre que exige atención
La documentación recomienda usar deepseek-flash. Los identificadores antiguos deepseek-v4-flash y deepseek-v4-flash-vision-exp todavía se aceptan, pero ya sirven V4.1‑Flash y se facturan a su tarifa. Por su parte, deepseek-v4-pro seguirá siendo el nombre visible hasta la redirección prevista. Registrar en cada respuesta el modelo servido, el consumo y la fecha facilita detectar cambios inesperados.
La compatibilidad con la Responses API tampoco es total. DeepSeek admite texto, imágenes, funciones y parte de los parámetros de razonamiento, pero no soporta almacenamiento, conversaciones persistentes, ejecución en segundo plano ni herramientas integradas como búsqueda web o intérprete de código. Algunos parámetros no compatibles se ignoran silenciosamente. Una integración que migre desde otro proveedor debe validar el comportamiento, no limitarse a cambiar la URL.
Veredicto
V4.1‑Flash gana la comparación práctica por precio, visión y concurrencia, y porque V4 Pro tiene fecha de salida. No hay una razón sólida para comenzar un proyecto nuevo con Pro. La decisión prudente para sistemas existentes es validar Flash antes de que el proveedor realice la redirección, medir coste por tarea resuelta y mantener una alternativa por si cambia la calidad o la disponibilidad.
El lanzamiento llega además un día después de que Estados Unidos acusara a varias empresas chinas de destilar tecnología de rivales estadounidenses. Esa historia, explicada en nuestro análisis sobre DeepSeek, Alibaba y la destilación de modelos, es un contexto geopolítico relevante, pero no demuestra ni refuta la calidad técnica de V4.1‑Flash.
Lecturas relacionadas
Fuentes consultadas
- Reuters: lanzamiento de DeepSeek V4.1‑Flash, publicado el 10 de septiembre de 2026 a las 06:32 UTC.
- DeepSeek API: modelos y precios, consultado el 10 de septiembre de 2026.
- DeepSeek API: concurrencia y aislamiento, consultado el 10 de septiembre de 2026.
- DeepSeek API: compatibilidad con Responses e imágenes, consultado el 10 de septiembre de 2026.
- IT之家: aviso previo de la plataforma abierta de DeepSeek, publicado el 9 de septiembre de 2026. Cuando difiere el calendario, se prioriza la documentación oficial vigente.


Deja una respuesta