Перейти к содержимому

Reducir el coste de tus agentes de IA sin perder calidad

Iñaki Tajes

0:00 / 0:00

Reducir el coste de tus agentes de IA sin perder calidad

45 просмотров · 1 месяц назад
Iñaki Tajes
94 подписчика
45 просмотров · 1 месяц назад
La mayoría de las arquitecturas de agentes que veo siguen el mismo patrón: un modelo SOTA planifica, un modelo barato ejecuta y el modelo SOTA vuelve al final para revisar. En este vídeo explico por qué creo que ese enfoque no es el más eficiente y cómo estoy experimentando con una arquitectura diferente en Convoy. La idea es sencilla: en lugar de usar el modelo más potente para todo, utilizarlo como un advisor al que el agente ejecutor consulta únicamente cuando realmente lo necesita. Así consigues mantener gran parte de la calidad, reduciendo de forma significativa el coste y el consumo de tokens. Todavía estoy validando este patrón en proyectos reales, pero los primeros resultados son muy prometedores. Si estás construyendo agentes de IA, probablemente te interese. ⸻ 🧠 X: https://x.com/Inakitajes 💻 GitHub: https://github.com/Inakitajes 🚀 Convoy: https://convoy.inaki.cc/