AI-продукт выполняет все шаги, но качество падает: как я это исправил
Classic AI Lab
0:00 / 0:00
AI-продукт выполняет все шаги, но качество падает: как я это исправил
48 просмотров · 8 дн. назад
Classic AI Lab
28 подписчиков
48 просмотров · 8 дн. назад
👉 Telegram-канал с разборами AI-автоматизаций: https://t.me/Classic_Ai_Lab
Создай песню за 5 шагов: https://t.me/songgiftme_bot
Я собрал телеграм-бот Songift на n8n, который превращает ответы пользователей в персональные песни. Технически всё работало без ошибок, но результат часто был слабым и непредсказуемым. В этом видео показываю, почему успешное выполнение всех шагов ещё не означает, что продукт работает, и как я нашел проблему.
Оказалось, что правки одного промта - это ловушка. Одна удачная генерация создает ощущение, что последняя правка сработала, хотя это может быть случайным совпадением. Я разделил роли: первый агент пишет текст песни, второй оценивает его по критериям и возвращает конкретные рекомендации для перегенерации. Если текст слабый, цикл повторяется.
Результат: без проверки текст получал 78 баллов, после внедрения оценщика - 90 баллов. Максимум 2 цикла доработки, и текст достигает нужного качества перед генерацией музыки.
В видео показываю обе схемы в n8n, сравниваю результаты реальных запусков и объясняю 4 шага, которые я использую, когда AI-продукт выполняет весь сценарий, но результат не устраивает.
Больше про AI-автоматизации в Telegram: https://t.me/Classic_Ai_Lab - подписывайся, там выходит раньше и я показываю схемы, промежуточные тесты и ошибки, которые не всегда попадают в видео.
Таймкоды:
00:00 — Введение: бот работает, но результат слабый
00:38 — Почему с AI иначе: успешное выполнение ≠ хороший результат
01:19 — Первая версия Songift и ловушка правок промта
02:34 — Решение: добавляем отдельного оценщика
03:23 — Показываю старую схему в n8n и результат
04:32 — Новая схема с контролем качества
05:07 — Сравнение: реальные запуски обеих версий
06:14 — 4 шага для диагностики слабого результата
07:20 — Как разделение ролей изменило механизм
07:57 — Проверка ChatGPT: 78 баллов vs 90 баллов
08:32 — Итоги и рекомендация