Перейти к содержимому

DeepSeek mató su modelo más caro: V4.1 Flash cuesta 4× menos

André De Mori | AI Engineering

0:00 / 0:00

DeepSeek mató su modelo más caro: V4.1 Flash cuesta 4× menos

123 просмотра · 4 дня назад
André De Mori | AI Engineering
5 подписчиков
123 просмотра · 4 дня назад
Análisis técnico del DeepSeek V4.1 Flash: el modelo que reemplazó al V4 Pro costando 4 veces menos. DeepSeek retiró su modelo más caro el 14 de septiembre y lo reemplazó por el V4.1 Flash, que cuesta $0.32 por millón de tokens de entrada contra los $1.32 del V4 Pro. En este video revisamos: · La arquitectura MoE asimétrica: 8 mil millones activos leyendo, 16 escribiendo, de 552 mil millones totales · El módulo Engram y la búsqueda directa · La KV cache de 890 bytes por token, que hace posible el precio · Dónde gana en benchmarks y dónde NO compite · Pruebas reales: SVG, cubo Rubik, dibujo y escena 3D ——— 📚 Recursos y fuentes 🔹 Anuncio oficial de DeepSeek V4.1-Flash https://www.deepseek.com/en/ news/deepseek-v4-1-flash/ 🔹 Technical Report — DeepSeek V4.1-Flash https://huggingface.co/deepseek-ai/ DeepSeek-V4.1-Flash/blob/main/ DeepSeek_V41_Tech_Report.pdf 🔹 Modelo oficial — Hugging Face https://huggingface.co/deepseek-ai/ DeepSeek-V4.1-Flash 🔹 Engram — implementación oficial de DeepSeek https://github.com/deepseek-ai/Engram 🔹 DeepSeek API — lanzamiento y benchmarks https://api-docs.deepseek.com/updates/ ——— #DeepSeek #AI #LLM #InteligenciaArtificial #AIAgents