Перейти к содержимому

APPO:注意力引導的感知策略最佳化|提升影片推理

Affective Vision Computing Lab

0:00 / 0:00

APPO:注意力引導的感知策略最佳化|提升影片推理

6 просмотров · 12 дней назад
Affective Vision Computing Lab
11 подписчиков
6 просмотров · 12 дней назад
解析複雜影片推理為何常受限於細粒度感知,而不只是推理模型規模;並介紹 APPO 如何以 token 級密集獎勵,最佳化同組回應中共同關注關鍵影格的感知 token,在不依賴昂貴逐影格標註的情況下提升影片理解。 論文:APPO: Attention-guided Perception Policy Optimization for Video Reasoning https://arxiv.org/abs/2602.23823