Перейти к содержимому

Я создал полноценную обвязку для агентов: Jev защищает вызовы инструментов

Syed Humair

0:00 / 0:00

Я создал полноценную обвязку для агентов: Jev защищает вызовы инструментов

246 просмотров · 1 день назад
Syed Humair
1,92 тыс. подписчиков
246 просмотров · 1 день назад
В этом видео мы создаём с нуля тестовый стенд для агентов в 11 лабораториях на основе Strands Harness, открытого программного обеспечения для агентов от AWS. Агент задаёт вопросы перед тем, как сделать предположение, запоминает вас и использует модели System 1 (Jev, Kev и Laya) для проверки своей работы за миллисекунды. Я также доработал Laya на своем Mac, чтобы она соответствовала Kev с результатом 19 мс вместо 117. 👉 Код для всех 11 лабораторных работ: https://github.com/syedair/strands-ha... Что вы узнаете: • Что такое агентский хардмауэр (модель — это двигатель, хардмауэр — это остальная часть автомобиля) • Почему хардмауэр важен: результат LangChain Terminal Bench 2.0, та же модель, от результатов за пределами топ-30 до топ-5 • Модели System 1 против System 2 и золотое правило: System 1 дает вероятность, ваш код решает • Шлюз вызова инструмента, который запрашивает информацию у пользователя вместо угадывания, проверка завершения и маршрутизатор модели • Сравнение моделей System 1 (Jev, Kev, Laya и Qwen 3.5 в качестве замены небольшой модели), оценка по шкале Бриера • Доработка Laya на Mac с Kev в роли учителя • Полноценное приложение с видимой памятью Главы 0:00 Что вы будете создавать 0:33 Агент, который задает вопросы, а не гадает 2:00 Что такое агентская платформа? (машина) 6:13 Та же модель, улучшенная система: тест LangChain 10:47 Ландшафт систем агентов 13:04 Модели Системы 1 против Системы 2 17:55 Золотое правило: Система 1 никогда не принимает решения 18:19 Настройка: репозиторий, модели и .env 23:21 Лабораторная работа 01: Первая система 25:11 Лабораторная работа 02: Встроенные инструменты 26:35 Лабораторная работа 03: Сессии и память 29:42 Лабораторная работа 04: Навыки 31:25 Лабораторная работа 05: Вмешательства 35:08 Лабораторная работа 6A: Джев 39:21 Лабораторная работа 6B: Кев 41:48 Лабораторная работа 6C: Лая 44:03 Лабораторная работа 6D: Замена Квена 46:25 Лабораторная работа 6E: Стандартизация 46:59 Лабораторная работа 07: Вызов инструмента ворота 54:47 Лабораторная работа 08: Проверка завершения 56:48 Лабораторная работа 09: Переключение моделей 59:42 Лабораторная работа 10: Противостояние систем 1 1:04:04 Лабораторная работа 10B: Тонкая настройка Laya 1:05:37 Лабораторная работа 11: Приложение 1:09:37 Краткий обзор и 3 вывода Источники и ссылки • Код для всех 11 лабораторных работ: https://github.com/syedair/strands-ha... • LangChain, "Улучшение глубоких агентов с помощью инженерии ремешков": https://blog.langchain.com/improving-... • Jev (TypeSafe AI): https://typesafe.ai • Kev: https://github.com/jaredpalmer/kev • Laya: https://github.com/NandhaKishorM/laya • Strands Agents: https://strandsagents.com · Strands Harness SDK: https://github.com/strands-agents/har... Если вы создадите свой собственный халзер на основе этого, расскажите мне об этом в комментариях. Мне бы хотелось это увидеть. #AIAgents #AgentHarness #StrandsAgents