Перейти к содержимому

E201|从Manus到ChatGPT Agent:底层技术架构有何不同?(上)

硅谷101播客

0:00 / 0:00

E201|从Manus到ChatGPT Agent:底层技术架构有何不同?(上)

93 863 просмотра · 1 год назад
硅谷101播客
77,7 тыс. подписчиков
93 863 просмотра · 1 год назад
美国时间7月17日,OpenAI终于迎来了它的“Agent时刻”——通用型ChatGPT Agent正式发布。它整合了深度研究工具Deep Research与执行工具Operator,可一站式完成复杂任务,但仍存在速度慢、个性化不足等短板。 ChatGPT Agent的技术本质是“浏览器+沙盒”的混合架构,与Manus、Genspark形成技术路线差异。在底层架构层面,浏览器(Browser-based)代理虽堪称“万能”,但运行速度较慢;沙盒(Sandbox)代理高效,但无法联网操作、工具库受限;而工作流集成(Workflow API)速度快、结果精准。在训练方法层面,强化学习(RL)被视为AGI从“执行者”向“创新者”跨越的重要路径,但当前面临的验证泛化与训练不稳定难题,如同两道枷锁锁住了这扇进阶之门。 强化学习能否成为通用AI爆发的关键引擎?AGI实现技术跃迁的分水岭究竟在哪?在把Agent产品化和商业化的道路上,又如何平衡模型能力与用户体验?本期《硅谷101》将分成上下两集,本集主播泓君对话Pokee.ai创始人朱哲清,将多维度测评ChatGPT Agent使用体验,并深入拆解Agent的四大底层设计逻辑。 【主播】 泓君Jane,硅谷101创始人,播客主理人 【嘉宾】 朱哲清,Pokee.ai创始人,前MetaAI应用强化学习团队负责人,斯坦福强化学习博士 【你将听到】 ChatGPT Agent首发体验与技术拆解 00:21 拆解AI Agent技术路径:什么是“聪明机器的大脑”? 02:12 ChatGPT Agent一手实测:浏览器操作如超人 VS 速度慢如蜗牛 04:26 视觉能力加持:Action体验有提升,但仍需等待 05:45 旅行规划场景:支付环节仍需人类介入,信任门槛尚未跨越 08:11 “全部推翻重来”:缺乏个性化机制、记不住反馈细节 10:07 ChatGPT Agent“打通搜索与执行”的本质:Deep Research + Operator的“拼贴工程” 通用型Agent技术路径对比 12:31 通用Agent技术类比:Operator最早专注Browser操作,如今叠加Sandbox后,在通用Agent里表现最强 14:52 四大技术方向优劣势对比: 15:40 浏览器为主:通用性强,但速度慢、体验差、成本高 17:21 开放虚拟机:本地运行快,但访问互联网等外部服务不易 17:37 大模型+虚拟机:GensPark模式,相对环节更封闭 18:46 Workflow+工具集成:Pokee模式,交付好但不是所有任务都能做 20:23 Manus模式:Browser-based,Sandbox强,全能但慢 22:28 Genspark模式:标化工作流,牺牲通用性换取速度与稳定性 23:41 Pokee模式:速度快成本低,但范围受限 26:52 B端客户还是C端客户,适用场景与底层技术逻辑完全不同 29:36 Agent将重塑互联网入口,传统门户流量将大幅下滑 32:03 MCP无人维护:2万个协议中,真正可用的不到200个 33:47 Agent时代的广告逻辑大变:反而更有利于创作者? 【节目中提到的AI Agent】 OpenAI相关: ChatGPT Agent|Operator|Deep Research 其他: Manus|Genspark|Perplexity|Claude Agent|Fellou|Flowise|Zapier|UIPath|Replicate 【节目提到的相关术语】 MCP / Multi-Agent Capability Protocol协议(多智能体协作协议) A2A(Agent-to-Agent Protocol) SDK(软件开发工具包) API(应用程序接口) Vision Model Browser-based Agent Sandbox(沙盒环境) Virtual Machine (VM) Token Consumption(Token消耗) Tool Calling:调用第三方工具或API完成任务 Workflow-based Agent Reinforcement Learning / RL(强化学习) RL Fine-tuning / RLFT(强化学习微调) RL Pre-training(强化学习预训练) Verification(验证机制) Ground Truth(基准真值) Hallucination(幻觉) Human Feedback(人类反馈) Supervised Fine-tuning / SFT (监督式微调) Human Readability(可读性) Catastrophic Forgetting(灾难性遗忘) Benchmark Score(基准分数) ICML(International Conference on Machine Learning):机器学习顶级学术会议 【相关节目】    • E200|投资人视角深聊:AI Agent的核心壁垒与投资逻辑      • E195|从工具到伙伴:七位AI Agent深度使用者的思考      • E191|小而美的机会来了,聊聊这轮AI Agent进化新范式   【监制】 泓君 【后期】 AMEI 【Shownotes】 陈思扬 【运营】 王梓沁 【BGM】 Simple Pleasantries - Arthur Benson Anticipating a New Day - Stationary Sign 【在这里找到我们】 公众号:硅谷101 收听渠道:Apple Podcast|Spotify|小宇宙|喜马拉雅|蜻蜓FM|荔枝FM|网易云音乐|QQ音乐 其他平台:YouTube|Bilibili 搜索「硅谷101播客」 联系我们:podcast@sv101.net