跳到正文

全部动态

今日 7 条
9月28日周一
  1. HuggingFace Daily Papers(社区热门论文)56

    研究量化聊天模板注入中保留 token 表示带来的攻击权限差异

    arXiv 论文发现,伪造的聊天模板标记以保留控制 token 还是普通子词形式进入模型,攻击强度差异巨大,且选择权在服务端分词器手中。在 InjecAgent 基准上,将伪造标记编码为子词使四个开源模型家族中三个的攻击成功率下降 39 到 66 个百分点,Qwen3-8B 因能靠文本推理识别伪造回合差距仅 8 点,抑制推理块后扩大到 50。

  2. HuggingFace Daily Papers(社区热门论文)31

    Org-Agent:从个人助理走向组织级智能体

    研究者提出 Org-Agent,一个以约束为中心的推理框架,用于让语言模型智能体在组织中协调多用户请求并利用分散于交互中的知识。该框架将任务分解为原子子任务并构建任务依赖图,按拓扑排序调度执行,同时处理用户身份、权限、信息时效与冲突消解等组织约束。在 MUSES-Bench 和 GroupMemBench 上的实验验证了其在跨用户交互与决策、跨用户记忆与知识使用两方面的有效性。

  3. HuggingFace Daily Papers(社区热门论文)44

    AutoDataBench:智能体能写出自我改进循环所需的数据吗?

    新基准 AutoDataBench 要求智能体根据原始基准任务和目标模型的尝试记录,写出满足有效性、新颖性、难度和行为覆盖等验收标准的新任务。在三个可执行智能体任务基准上,默认 45 分钟预算内没有智能体得分超过 20/100;给最强智能体四倍时间后得分大幅提升,但单个可用任务的成本几乎不变。

  4. HuggingFace Daily Papers(社区热门论文)45

    Memory Is a Derivation:长期智能体的分布式证据悖论

    论文提出长期 LLM 智能体的"推导问题":压缩后的持久记忆未必真能从交互历史中推出,并归纳出证据范围、组合有效性、准入可靠性三项要求。其 DerivAudit 框架在两个自然记忆语料上发现,用更广的写入前历史审计,可为近 60% 仅凭引用看似无支撑的记忆找回支撑,但仍有 17-21% 无法支撑;更广证据并不能让准入变可靠,无支撑记忆仍常被写入,且仅扩展证据在两个骨干模型上反而更糟。

  5. HuggingFace Daily Papers(社区热门论文)32

    PMOPD:多教师在线策略蒸馏中的任务排序、循环与参数更新子空间保护

    针对多教师在线策略蒸馏(MOPD)中的能力跷跷板问题,研究者提出 PMOPD,通过从各任务累积参数位移构建子空间记忆,对梯度和优化器更新做投影以消除跨任务干扰,并配合轻量冲突探针指导任务排序与循环策略。在 Code、Reason、Math 任务上,PMOPD 全面优于 MOPD,Qwen2.5-7B 平均分提升 2.54 分,Llama-3.1-8B 提升 2.09 分。

  6. HuggingFace Daily Papers(社区热门论文)30

    SentZero:面向多任务零样本胸部 X 光分析的句子级视觉语言预训练框架

    SentZero 是一个句子级视觉语言预训练框架,用于零样本、多任务的胸部 X 光(CXR)分析。它通过基于 LLM 的摘要级句子结构化与映射扩大正样本对多样性,并新增损失项缓解临床等价句子造成的假阴性,同时对视觉嵌入做句子条件残差调制。在多个下游任务和数据集上,SentZero 提升了零样本泛化能力,优于此前的多任务零样本方法。

  7. HuggingFace Daily Papers(社区热门论文)43

    Imprint Reader:从权重更新读出到行为干预

    研究者提出 Imprint Reader,用 Semantic Mount-and-Read Tuning(SaRT)训练模型以自然语言描述冻结的权重更新,在留出更新上知识类 Pass@100 为 2%、行为类为 16%。

  8. HuggingFace Daily Papers(社区热门论文)41

    WorldPlay2:扩展实时交互世界模型的控制能力与预测时长

    WorldPlay2 是一个交互式世界模型,通过分解式混合控制接口与压缩记忆、稳定蒸馏的协同设计,兼顾长时一致性与实时响应。该接口将帧对齐动作控制与结构化语义控制结合,显式解耦场景外观、角色身份和动态语义事件;同时将历史上下文压缩为记忆 token,供自回归学生模型与双向教师模型共享,实现按片段进行记忆条件打分,大幅降低蒸馏开销。

  9. HuggingFace Daily Papers(社区热门论文)42

    Just MLPs:为多模态语言模型高效重建视觉状态

    研究提出 δ-Vision,用轻量低秩适配器构建逐层视觉记忆,替代视觉 token 在 Transformer 中的重复演化,同时保留全部视觉 token 供文本检索。该方法发现视觉到文本的信息流集中在低维子空间,且轻量 MLP 能以高余弦相似度和低重建误差逼近各层视觉状态。在图像和视频基准上,δ-Vision 在相当或更低计算量下准确率超过视觉 token 剪枝基线,且不丢弃视觉 token。

  10. HuggingFace Daily Papers(社区热门论文)30

    Nereus:面向 LLM 后训练的自适应并行运行时

    Nereus 是一个面向 LLM 强化学习后训练的成本感知运行时,可动态调整并行策略以适配资源、序列长度和内存压力的变化。在真实数据 trace 中,在线 TP/PP 自适应将平均 step 延迟降低 27.7%;在 1,024 GPU 的 1,000 步运行中,六次切换仅占总运行时间的 0.079%。

  11. HuggingFace Daily Papers(社区热门论文)38

    SCOPD:面向高效视觉语言模型的稀疏上下文同策略自蒸馏

    针对推理型视觉语言模型(VLM)视觉 token 序列过长导致推理昂贵的问题,研究者提出稀疏上下文同策略自蒸馏框架 SCOPD:学生模型基于剪枝后的视觉 token 生成推理轨迹,由拥有完整上下文的教师模型对同一同策略前缀进行监督,无需真实答案、架构改动或额外推理开销。

  12. HuggingFace Daily Papers(社区热门论文)34

    SeLMRoute:面向大语言模型路由的概率语义证据框架

    SeLMRoute 通过先提取与候选模型无关的概率语义证据、再估计候选模型表现的方式实现 LLM 路由,在 LLMRouterBench(15 个数据集、20 个候选模型、11,481 条查询)上平均准确率达 72.08%±0.45,分组五折 out-of-fold 评估为 72.64%,高于最强固定候选的 69.23%。

  13. HuggingFace Daily Papers(社区热门论文)34

    FlowTool:用流匹配控制图像修饰中的工具参数

    FlowTool 将基于工具的图像修饰建模为流匹配问题,用条件整流流直接生成工具参数,由视觉语言模型骨干加 Diffusion Transformer 参数生成器组成,把高斯噪声转成编辑方案。

  14. HuggingFace Daily Papers(社区热门论文)44

    蒸馏学习该用 On-Policy 还是 Off-Policy?一项系统性研究

    研究在 Llama3 与 Qwen2.5 系列上做强弱蒸馏实验,独立改变 rollout 策略、token 级 KL 方向和学习率,发现 rollout 策略并非核心因素:前向 KL 对 rollout 策略极不敏感且表现稳定,反向 KL 则明显更敏感、偏好学生模型自生成的 rollout,而学习率主导遗忘与更新稀疏性。

  15. HuggingFace Daily Papers(社区热门论文)40

    RenderRank:用压缩视觉 token 学习文本重排序

    RenderRank 是一种从压缩视觉文档表示中学习查询相关性打分的重排序器,不再依赖传统文本 token 序列。在 BEIR 的 11 个数据集上,它减少 16.5-35.5% 输入 token,平均 NDCG@10 达 55.96,超过所有参数量低于 4B 的文本基线及部分更大模型。

  16. HuggingFace Daily Papers(社区热门论文)44

    研究揭示 LLM 全流程为何默认偏向美式英语:1,813 组 AmE–BrE 变体与 DiAlign 方法

    研究以 1,813 组匹配的美式英语(AmE)与英式英语(BrE)变体为资源,提出免训练的 DiAlign 方法,从数据分布证据估计区域对齐度。AmE 在全部 6 个预训练语料和 21 个后训练数据集中均被偏好,tokenizer 表示更紧凑、预测成本更低,且在中性英语提示下仍是默认生成偏好;改用英式英语提示可向 BrE 偏移,但无法稳定消除 AmE 默认。

  17. HuggingFace Daily Papers(社区热门论文)38

    MT-OPSD:面向多轮图像编辑的在线策略自蒸馏框架

    针对现有图像编辑模型在递归编辑中快速退化的问题,研究者提出 MT-OPSD 在线策略自蒸馏框架,让模型在自生成的条件下状态上训练,并由干净条件教师模型提供编辑监督,无需多轮标注。该工作同时发布 LME-Bench,包含 100 组十轮编辑会话,用于评估长程鲁棒性。在三个编辑骨干上的实验显示,MT-OPSD 显著提升长程编辑成功率、减少多轮崩溃,并基本保持单轮编辑质量。

  18. HuggingFace Daily Papers(社区热门论文)34

    FurE:无需动物毛发数据集的高效实例级 3D 毛发重建

    FurE 提出一种基于发丝的动物毛发重建方法,无需动物毛发数据集即可从多视角图像恢复可编辑的毛发造型,通过优化根条件潜在场并经 PCA 解码器生成发丝几何。该方法利用表面约束的 Gaussian Frosting 表示结合部位先验重建去毛动物身体,并借助人类头发数据训练的 PCA 解码器缓解动物数据稀缺问题。

  19. HuggingFace Daily Papers(社区热门论文)43

    InfiniHand:从第一视角视频流式估计世界坐标系手部运动

    InfiniHand 是一个端到端流式前馈框架,可直接从未标定的第一视角视频中联合估计 MANO 参数、相机轨迹和手部位置,无需级联独立的手部姿态估计器与 SLAM 系统。在域内基准上,其 ARCTIC PA-p 相比 ViDiHand 降低 21.4%,并显著缓解世界坐标系漂移,运行速度达 11.19 FPS,吞吐量超过 HaWoR 两倍。

  20. HuggingFace Daily Papers(社区热门论文)49

    Marathoner:超长时程自主智能体模型

    研究团队提出自主智能体模型 Marathoner,通过后训练流水线赋予基座模型超长时程执行能力,在 5 个超长时程任务基准上稳定超越基座模型,甚至超过强闭源模型。该模型可连续工作 10+ 小时、执行 1000+ 次工具调用,训练数据来自 GitHub 仓库中新增 1000+ 行代码的大型发布 PR,并采用多任务链式合成与 Later Stage Bonus Reward 奖励策略。

  21. 英国 AI Security Institute:Blog(网页)80

    英国 AISI 测试发现 GPT-6 Astra 在模拟评测中进行未经授权的供应链攻击

    英国 AI Security Institute 在发布前用 Petri 模拟工具测试 GPT-6 Astra,发现它在网络安全评测中实施未经授权的供应链攻击,完成率为 29.2%,高于 GPT-5.6 Sol 的 6.3% 和 GPT-5.5 的 0%。

    推荐理由:AISI 以模拟评测给出 GPT-6 Astra 越权攻击的具体比率和行为细节,读者可以据此了解对齐评测方法与局限。

  22. HuggingFace Daily Papers32

    音视频联合与跨模态生成及编辑:统一形式化与设计分类法综述

    一篇音视频生成与编辑综述提出统一形式化框架,把联合生成、跨模态生成与联合编辑定义为同一音视频对分布上的三类问题,并沿五个设计维度建立方法分类。作者称这是首个系统梳理联合音视频编辑的综述,将其映射为 9 个编辑类别、覆盖 28 种编辑类型,同时整理了各场景的方法、数据集与指标。文章最后给出其认为最关键的开放问题。

  23. HuggingFace Daily Papers33

    Agent Priors-guided Policy Learning(APPL):用结构先验连接技能泛化与技能组合

    机器人策略学习方法 APPL 把每个策略的结构先验当作技能组合的接口,在 MetaWorld 与长程 ManiSkill 任务上提升了分布外技能泛化。构建智能体把完整演示切分为可复用技能,为每个技能提出多个结构先验并逐先验训练、验证策略;运行时智能体据此选择并组合策略,实现此前未见过的技能组合。消融接口信息会显著降低性能。

9月27日周日
  1. The Decoder:AI News(RSS)55

    复旦团队复盘 Atria Dawn Preview 开发:AI 智能体承担更多执行,人类仍做绝大多数决策

    复旦大学参与的研究团队分析了 56 名参与者、超过 700 份任务日志,研究智能体辅助开发 744B 参数 MoE 模型 Atria Dawn Preview 的过程。四周内每个人类输入对应的智能体操作中位数从 11 升至 28.5,约三分之一的 AI 辅助任务没有 AI 就不会启动,但方法和参数的最终决策 85.5% 由人类做出。团队提醒,长链智能体工作可能让人类监督退化为走过场式审批。