X:AK (@_akhaliq)· X:AK (@_akhaliq)·· 3 天前AI 评分24
音视频扩散模型的自适应奖励路由
AI 导读
Adaptive Reward Routing 通过前向过程 RL 实现音视频联合扩散的动态多奖励优化 论文:https://huggingface.co/papers/2609.37200
来源:X:AK (@_akhaliq) · x.com
Adaptive Reward Routing 通过前向过程 RL 实现音视频联合扩散的动态多奖励优化 论文:https://huggingface.co/papers/2609.37200
来源:X:AK (@_akhaliq) · x.com