Перейти к содержимому

Дообучение визуально-языковых моделей (VLM) — HuggingFace, PyTorch, LoRA, квантование, TRL

Uygar Kurt

0:00 / 0:00

Дообучение визуально-языковых моделей (VLM) — HuggingFace, PyTorch, LoRA, квантование, TRL

22 242 просмотра · 1 год назад
Uygar Kurt
4,09 тыс. подписчиков
22 242 просмотра · 1 год назад
Мы будем дорабатывать VLM-модели для общения с изображениями с помощью Python! В частности, мы доработаем модель Qwen2-VL-7B-Instruct, используя LoRA и 4-битное квантование. Ссылка на GitHub ниже ↓ Хотите поддержать канал? Нажмите кнопку «Нравится» и подпишитесь! Ссылка на код на GitHub: https://github.com/uygarkurt/Fine-Tun... Модель Qwen2-VL-7B https://huggingface.co/Qwen/Qwen2-VL-... Набор данных: https://huggingface.co/datasets/Huggi... Что мне следует реализовать дальше? Дайте знать в комментариях! 00:00 Введение 00:50 Установка необходимых библиотек 01:49 Импорт 03:40 Определение гиперпараметров 08:12 Подготовка набора данных 22:38 Загрузка модели VL и процессора 25:06 Вывод примеров 32:18 Настройка LoRA 34:05 Настройка аргументов обучения 35:42 Сборщик данных 39:03 Настройка тренера 39:55 Запуск обучения VLM 40:42 Вывод и оценка после обучения Ссылки https://huggingface.co/learn/cookbook... https://huggingface.co/docs/trl/en/sf... https://huggingface.co/docs/transform... Купите мне кофе! ☕️ https://ko-fi.com/uygarkurt