Я создал полноценную обвязку для агентов: Jev защищает вызовы инструментов
Syed Humair
0:00 / 0:00
Я создал полноценную обвязку для агентов: Jev защищает вызовы инструментов
246 просмотров · 1 день назад
Syed Humair
1,92 тыс. подписчиков
246 просмотров · 1 день назад
В этом видео мы создаём с нуля тестовый стенд для агентов в 11 лабораториях на основе Strands Harness, открытого программного обеспечения для агентов от AWS. Агент задаёт вопросы перед тем, как сделать предположение, запоминает вас и использует модели System 1 (Jev, Kev и Laya) для проверки своей работы за миллисекунды. Я также доработал Laya на своем Mac, чтобы она соответствовала Kev с результатом 19 мс вместо 117.
👉 Код для всех 11 лабораторных работ: https://github.com/syedair/strands-ha...
Что вы узнаете:
• Что такое агентский хардмауэр (модель — это двигатель, хардмауэр — это остальная часть автомобиля)
• Почему хардмауэр важен: результат LangChain Terminal Bench 2.0, та же модель, от результатов за пределами топ-30 до топ-5
• Модели System 1 против System 2 и золотое правило: System 1 дает вероятность, ваш код решает
• Шлюз вызова инструмента, который запрашивает информацию у пользователя вместо угадывания, проверка завершения и маршрутизатор модели
• Сравнение моделей System 1 (Jev, Kev, Laya и Qwen 3.5 в качестве замены небольшой модели), оценка по шкале Бриера
• Доработка Laya на Mac с Kev в роли учителя
• Полноценное приложение с видимой памятью
Главы
0:00 Что вы будете создавать
0:33 Агент, который задает вопросы, а не гадает
2:00 Что такое агентская платформа? (машина)
6:13 Та же модель, улучшенная система: тест LangChain
10:47 Ландшафт систем агентов
13:04 Модели Системы 1 против Системы 2
17:55 Золотое правило: Система 1 никогда не принимает решения
18:19 Настройка: репозиторий, модели и .env
23:21 Лабораторная работа 01: Первая система
25:11 Лабораторная работа 02: Встроенные инструменты
26:35 Лабораторная работа 03: Сессии и память
29:42 Лабораторная работа 04: Навыки
31:25 Лабораторная работа 05: Вмешательства
35:08 Лабораторная работа 6A: Джев
39:21 Лабораторная работа 6B: Кев
41:48 Лабораторная работа 6C: Лая
44:03 Лабораторная работа 6D: Замена Квена
46:25 Лабораторная работа 6E: Стандартизация
46:59 Лабораторная работа 07: Вызов инструмента ворота
54:47 Лабораторная работа 08: Проверка завершения
56:48 Лабораторная работа 09: Переключение моделей
59:42 Лабораторная работа 10: Противостояние систем 1
1:04:04 Лабораторная работа 10B: Тонкая настройка Laya
1:05:37 Лабораторная работа 11: Приложение
1:09:37 Краткий обзор и 3 вывода
Источники и ссылки
• Код для всех 11 лабораторных работ: https://github.com/syedair/strands-ha...
• LangChain, "Улучшение глубоких агентов с помощью инженерии ремешков": https://blog.langchain.com/improving-...
• Jev (TypeSafe AI): https://typesafe.ai
• Kev: https://github.com/jaredpalmer/kev
• Laya: https://github.com/NandhaKishorM/laya
• Strands Agents: https://strandsagents.com · Strands Harness SDK: https://github.com/strands-agents/har...
Если вы создадите свой собственный халзер на основе этого, расскажите мне об этом в комментариях. Мне бы хотелось это увидеть.
#AIAgents #AgentHarness #StrandsAgents