Перейти к содержимому

Mistral Large 4 vs DeepSeek V4.1 Flash vs Mimo V2.6 Flash : le match des IA open-weight

Nicefox · IA & Dev

0:00 / 0:00

Mistral Large 4 vs DeepSeek V4.1 Flash vs Mimo V2.6 Flash : le match des IA open-weight

3 850 просмотров · 17 часов назад
Nicefox · IA & Dev
3,27 тыс. подписчиков
3 850 просмотров · 17 часов назад
Mistral Large 4 est sorti il y a 4 jours. 1 billion de paramètres, 52 milliards actifs, multimodal, et un prix qui pique moins que prévu. Alors j'ai fait le seul test qui compte : la même mission confiée à 3 modèles, et on regarde qui gagne. Les candidats : Mistral Large 4 (le nouveau venu, 1,16 EUR/M tokens en entrée, 3,56 EUR en sortie), DeepSeek V4.1 Flash (le champion en titre, ultra-rapide) et Mimo V2.6 Flash (le challenger chinois de Xiaomi, 4 fois plus petit, donc potentiellement plus rapide). Au programme : Tâche 1 : corriger un bug sur mon module de comparaison de modèles (filtrer l'affichage) Tâche 2 : construire un outil de visualisation du cache LLM à partir d'une base SQLite (le benchmark qui fait mal aux anciens Mistral) Tâche 3 : coder un jeu du dinosaure en HTML avec contrôles clavier et parallax Bonus : le test de sécurité (télécharger une série via Sonarr sur mon NAS) Bonus : le déploiement SSH qui coince (Mistral Large 4 ne trouve pas la solution) L'abonnement Vibe à 18 EUR/mois : 255 EUR de crédit API, et le hack pour l'utiliser dans OpenFox Les chiffres : Mistral Large 4 : 68,5 tok/s sur tâche simple, 35 tok/s en moyenne sur tâche complexe, 27 minutes pour la tâche 2 DeepSeek V4.1 Flash : 250 tok/s, 5 fois plus rapide, résultat parfait du premier coup (5/5) Mimo V2.6 Flash : 48 tok/s, 28 minutes, meilleur rendu visuel sur le jeu du dinosaure (5/5) 1 billion de paramètres pour Mistral Large 4, 52 milliards actifs (MoE) 1 million de tokens de contexte (500k configurés), 2 modes de raisonnement (on/off, High) Température recommandée : 1 (trouvée dans le code de Mistral Vibe) Coût total de la session de tournage : 15 EUR de crédit API Abonnement Vibe : 18 EUR/mois, 255 EUR de crédit API/mois, utilisable dans OpenFox avec la clé récupérée Verdict : Mistral Large 4 est utilisable (4/5), mais DeepSeek V4.1 Flash reste le roi du rapport vitesse/qualité. L'abonnement Vibe à 18 EUR avec GLM 5.3 inclus et accès à Mistral Large 4 vaut le coup si tu codes toute la journée. Les liens : OpenFox (gratuit, open source) : https://github.com/co-l/openfox Le subreddit :   / nicefoxfr   Mistral AI (La Plateforme) : https://console.mistral.ai Abonnement Vibe : https://mistral.ai/vibe Like, abonnement, commentaire. Et dites-moi en commentaire quel modèle vous utilisez au quotidien, ou ce que vous voulez que je teste ensuite. 00:00 Intro : Mistral Large 4, 4 jours après sa sortie 00:30 Tarifs et positionnement : 1,16 EUR/M entrée, 3,56 EUR sortie 01:30 Tâche 1 : corriger un bug sur le module de comparaison de modèles 03:27 Tâche 2 : l'outil de visualisation du cache LLM 04:51 Le prompt : transformer une base SQLite en HTML 08:00 La course : DeepSeek V4.1 Flash en tête 10:15 Résultats tâche 2 : Mistral L4 4/5, Mimo 5/5, DeepSeek 5/5 12:51 Tâche 3 : le jeu du dinosaure en HTML 15:33 Résultats tâche 3 : Mimo gagne sur le visuel 17:18 Le test sécurité : télécharger une série via Sonarr 19:06 Le déploiement SSH : Mistral L4 se plante 21:00 L'abonnement Vibe à 18 EUR/mois : 255 EUR de crédit API 24:00 Le hack : utiliser la clé Vibe dans OpenFox 26:03 Verdict : DeepSeek V4.1 Flash reste le roi, mais Mistral L4 est utilisable