跳到正文
原文
X:AK (@_akhaliq)· X:AK (@_akhaliq)·· 3 天前AI 评分24

音视频扩散模型的自适应奖励路由

AI 导读

Adaptive Reward Routing 通过前向过程 RL 实现音视频联合扩散的动态多奖励优化 论文:https://huggingface.co/papers/2609.37200

来源:X:AK (@_akhaliq) · x.com