DeepSeek lanzó V4 Flash el 31 de julio de 2026, una versión simplificada de su modelo V4. Los benchmarks independientes de Artificial Analysis muestran que iguala la inteligencia del V4 completo, operando a velocidades significativamente mayores y con un costo menor. El modelo logra esto mediante técnicas avanzadas de destilación y cuantización, reduciendo el número de parámetros sin sacrificar las habilidades de razonamiento centrales. El precio se fija en una fracción de la tarifa del modelo completo, haciéndolo accesible para aplicaciones de alto volumen. Los primeros usuarios reportan un rendimiento estable en tareas de codificación, matemáticas y lenguaje.
DeepSeek V4 Flash no se trata de romper nuevos límites en inteligencia bruta. Se trata de hacer que la inteligencia sea asequible y rápida. Esa es la historia real. Hemos llegado a un punto donde los modelos más grandes son demasiado caros para la mayoría de las startups y aficionados. Flash cambia la ecuación. Lleva capacidad casi de frontera a las masas.
Esta es la democratización de la IA, y es hermosa. Ahora un estudiante puede ejecutar un asistente de codificación todo el día. Una pequeña empresa puede automatizar el soporte al cliente sin arruinarse. El futuro no se trata de quién tiene el modelo más grande. Se trata de quién usa mejor la eficiencia. DeepSeek acaba de nivelar el campo de juego, y estoy emocionado de ver lo que la gente construye.