DeepSeek mató su modelo más caro: V4.1 Flash cuesta 4× menos
André De Mori | AI Engineering
0:00 / 0:00
DeepSeek mató su modelo más caro: V4.1 Flash cuesta 4× menos
123 просмотра · 4 дня назад
André De Mori | AI Engineering
5 подписчиков
123 просмотра · 4 дня назад
Análisis técnico del DeepSeek V4.1 Flash: el modelo que reemplazó al V4 Pro costando 4 veces menos.
DeepSeek retiró su modelo más caro el 14 de septiembre y lo reemplazó por el V4.1 Flash, que cuesta $0.32 por millón de tokens de entrada contra los $1.32 del V4 Pro.
En este video revisamos:
· La arquitectura MoE asimétrica: 8 mil millones activos leyendo, 16 escribiendo, de 552 mil millones totales
· El módulo Engram y la búsqueda directa
· La KV cache de 890 bytes por token, que hace posible el precio
· Dónde gana en benchmarks y dónde NO compite
· Pruebas reales: SVG, cubo Rubik, dibujo y escena 3D
———
📚 Recursos y fuentes
🔹 Anuncio oficial de DeepSeek V4.1-Flash
https://www.deepseek.com/en/
news/deepseek-v4-1-flash/
🔹 Technical Report — DeepSeek V4.1-Flash
https://huggingface.co/deepseek-ai/
DeepSeek-V4.1-Flash/blob/main/
DeepSeek_V41_Tech_Report.pdf
🔹 Modelo oficial — Hugging Face
https://huggingface.co/deepseek-ai/
DeepSeek-V4.1-Flash
🔹 Engram — implementación oficial de DeepSeek
https://github.com/deepseek-ai/Engram
🔹 DeepSeek API — lanzamiento y benchmarks
https://api-docs.deepseek.com/updates/
———
#DeepSeek #AI #LLM #InteligenciaArtificial #AIAgents