如何从专有LLM API中窃取推理痕迹 | LLM安全 | 推理痕迹 | 大语言模型 | AI安全 | 越狱攻击 | 模型蒸馏 | 推理模型 | 加密推理 | 隐私泄露 | 提示注入
最佳拍档
0:00 / 0:00
如何从专有LLM API中窃取推理痕迹 | LLM安全 | 推理痕迹 | 大语言模型 | AI安全 | 越狱攻击 | 模型蒸馏 | 推理模型 | 加密推理 | 隐私泄露 | 提示注入
24 590 просмотров · 4 недели назад
最佳拍档
249 тыс. подписчиков
24 590 просмотров · 4 недели назад
本期深度解读论文《从专有LLM API中窃取推理痕迹》。前沿大模型的推理过程被加密后返回客户端,但研究者发现这些加密推理块可跨用户、跨模型移植,通过同家族小模型即可解码完整推理内容,涉及Anthropic、OpenAI、Google三家主流厂商。节目详细拆解攻击原理、隐私风险、安全隐忧、防御路径,以及AI安全研究应有的科学克制态度。
• Why Frontier AI Labs Fight to Hide Chain o...