Навык управления проектами с помощью ИИ, который мгновенно приносит предложения о работе | Апарна...
Aakash Gupta
0:00 / 0:00
Навык управления проектами с помощью ИИ, который мгновенно приносит предложения о работе | Апарна...
9 915 просмотров · 3 месяца назад
Aakash Gupta
46 тыс. подписчиков
9 915 просмотров · 3 месяца назад
Апарна Дхинакаран, директор по продуктам Arize AI (привлечено 131 млн долларов), в одном прямом эфире демонстрирует, как создать агента управления проектами в Claude Code, оснастить его средствами мониторинга, проводить оценки и замыкать цикл самосовершенствования. Если вы хотите понять, как выглядит серьезная практика оценки ИИ в 2025 году, этот эпизод для вас.
Полный текст статьи: https://www.news.aakashg.com/p/aparna...
Транскрипт: https://www.aakashg.com/how-to-build-...
---
Временные метки:
00:00 - Вступление
01:34 - Что делают неправильно менеджеры проектов
04:35 - Почему вкус продукта - это альфа-фактор
06:30 - Фреймворк build-trace-eval-loop
08:04 - Реклама
09:28 - Создание агента в Claude Code
19:00 - Инструментация одной командой
22:00 - Потоковая передача трассировок в Arize Live
28:00 - Запрос к Клоду на предложения по оценке
31:13 - Реклама
33:58 - Оценка Vibe против аксиального кодирования
48:50 - Цикл автоматическое улучшение
01:06:00 - Разблокировка контекстного графа
01:18:55 - Заключение
---
Благодарим наших спонсоров:
1. Superhuman - Зарегистрируйтесь и получите 1 месяц бесплатной рассылки Superhuman Mail по моей ссылке: superhuman.com/akash
2. Land PM Job - Получите свою следующую должность менеджера проектов быстрее - https://landpmjob.com
3. Vanta - Автоматизируйте соответствие требованиям - http://vanta.com/aakash
4. Product Faculty - Получите скидку 550 долларов на сертификацию AI PM с кодом AAKASH550C7 - https://maven.com/product-faculty/ai-...
5. Bolt - Выпускайте продукты на основе ИИ в 10 раз быстрее - https://bolt.new
---
Ключевые выводы:
1. Проводите трассировку перед оценкой - Трассировка — это полный 1. Пошаговое воспроизведение действий вашего агента. Без этого у вас нет доказательной базы для оценок. Каждый вызов LLM, каждый вызов инструмента, каждый промежуточный результат должны быть видны, прежде чем вы напишете хотя бы одну оценку.
2. Стоп — это ваша единица оценки. Стоп — это один дискретный шаг внутри трассировки. Оценки выполняются на уровне стопа, а не на уровне трассировки. «Правильно ли этот конкретный этап оценки определил приоритет?» — более полезный вопрос, чем «был ли весь запуск удачным?».
3. Инструментарий теперь выполняется одной командой — навыки инструментирования Claude Code могут автоматически настроить наблюдаемость для вашего агента. Навык Arize Phoenix анализирует ваш код, идентифицирует вызовы LLM и вызовы инструментов и связывает их со слоем трассировки. Инженерная поддержка не требуется.
4. Оценка vibe — это черновик, а не вердикт — LLM может подсказать, что следует проверить в ваших оценках, проанализировав ваши трассировки. Это предложение не будет учитывать вашу политику приоритета ошибок, вашу логику оценки или ваше определение «критического». Рассматривайте его как версию 0 и уточняйте, основываясь на вашем реальном мнении.
5. Когда срабатывают оценки, могут быть две причины: агент выдал некорректный результат или оценка неправильно откалибрована. Только самостоятельное прочтение отмеченного фрагмента может помочь определить, что именно нуждается в исправлении. Оба варианта нормальны. Оба – хорошие новости.
6. Оценки смещаются и требуют регулярной корректировки: ваши приоритеты меняются, ваша политика в отношении ошибок меняется, ваш продукт меняется. Оценка, откалиброванная по данным прошлого квартала, начнет давать сбои в этом квартале. Регулярная корректировка с учетом обратной связи от пользователей – это техническое обслуживание, а не сбой.
7. Цикл самосовершенствования уже работает в лучших командах: получите все фрагменты, где сработали оценки. Сгруппируйте по категориям сбоев. Предложите конкретное решение проблемы. Просмотрите и утвердите. Выпустите новую версию. Этот цикл работает по расписанию и требует участия человека на этапе утверждения.
8. Менеджеры проектов в крупных компаниях: начните с одного внутреннего агента — не продукта, ориентированного на клиента. Внутреннего инструмента, который сэкономит вам четыре часа в неделю. Как только вы его получите, вы, естественно, захотите отслеживать его работу. Именно тогда для вас лично начнет иметь значение наблюдаемость.
9. Граф контекста — это ключ к успеху в крупных компаниях — агенты полезны только в той мере, в какой у них есть контекст. Корпоративные данные хранятся в разрозненных хранилищах. Команды, которые прорываются в эту область, создают унифицированные слои контекста, которые предоставляют одному агенту доступ к CRM, Gong, аналитике, GitHub и Slack.
10. Вкус продукта по-прежнему имеет решающее значение — код сейчас дешев. Скорость выпуска — это базовое требование. Менеджеры проектов, которые вырываются вперед, — это те, кто обладает наиболее четким пониманием того, что нужно создавать, и кто налаживает циклы, которые делают их агентов лучше с каждым днем.
---
Где найти Апарну Дхинакаран:
LinkedIn: / aparnadhinakara. .