[Débutant] DeepMind révèle le futur de la vision par ordinateur avec Veo 3 en modèle de fondation
Dr. Deep Réflections
0:00 / 0:00
[Débutant] DeepMind révèle le futur de la vision par ordinateur avec Veo 3 en modèle de fondation
245 просмотров · 1 г. назад
Dr. Deep Réflections
1,04 тыс. подписчиков
245 просмотров · 1 г. назад
DeepMind présente Veo 3 en modèle de fondation pour la computer vision, et présente un moment GPT-3 pour la vision. Les implications sur le futur de la recherche et de l'industrie en vision sont énormes.
https://arxiv.org/abs/2509.20328 Video models are zero-shot learners and reasoners
https://arxiv.org/abs/2005.14165 GPT-3 "few shot learners"
https://arxiv.org/abs/2205.11916 Chain of Thoughts "zero-shot reasoners"
https://arxiv.org/abs/2303.12712 GPT-4 "Sparks of general intelligence"
00:00:00 Introduction à Veo 3 et aux modèles de fondation en vision par ordinateur
00:01:55 Le parallèle entre Veo 3 et GPT-3
00:07:59 Analyse des tâches de Veo 3 : Percevoir, Modéliser, Manipuler, Raisonner
00:10:10 Exemples de tâches qualitatives
00:21:07 Résultats quantitatifs et limites actuelles
00:26:08 Discussion : défis et avenir des modèles de fondation en vision
00:32:25 Conclusion et positionnement de DeepMind