跳到正文

全部动态

今日 0 条
10月1日周四
  1. X:Krea AI (@krea_ai)37

    Ideogram 4.5 上线 Krea

    Ideogram 4.5 现已登陆 Krea。 重复编辑通常会产生伪影、像素偏移和色彩漂移——这个模型正是为解决可重复编辑而打造。 在下方试试 👇

  2. X:Elvis Saravia (@omarsar0, DAIR.AI)36

    Lucas 主动发消息的 AI 智能体

    我认为智能体的消费级突破,会出现在它们主动发起对话的时候。 Lucas 住在 iMessage 和 WhatsApp 里,有事需要处理时会先给你发消息,比如取消航班的退款,或者你一直拖着没订的预订。主动能力很棒。

  3. X:Thariq (@trq212)25

    Anthropic 员工用 AI 辅助做游戏原型

    作为一个个人副业项目,我一直在做一款电子游戏的原型。 作为一名前游戏创始人,做游戏的过程极具满足感和创造力,不要把这件事外包给 AI。用 AI 与你协作,把你的构想变为现实。 以下是我的尝试方式:

  4. X:ElevenLabs (@elevenlabs)69

    ElevenLabs 员工要约收购估值达 220 亿美元

    ElevenLabs 完成员工要约收购,估值达 220 亿美元,较 2 月 D 轮翻倍,该轮由 Wellington 和 T. Rowe Price 领投。官方博客链接 https://elevenlabs.io/blog/tender-22bn 说明了要约详情及增长驱动因素。

  5. The Decoder:AI News(RSS)82

    FTC 以消费者保护为由对 OpenAI、Anthropic 等 AI 实验室启动全面调查

    FTC 正以潜在消费者保护违规为由调查 OpenAI、Anthropic 等头部 AI 实验室,主席 Andrew Ferguson 计划通过具法律约束力的 Civil Investigative Demands 强制调取文件并质询高管,命令将在数周内发出,METR 也在审查范围之列。

    推荐理由:原文梳理了 FTC 调查的对象、法律手段和时间线,并提示这对 AI 实验室可能构成生存风险。

  6. X:Google (@Google)47

    Gemini Spark 技能将取代 Gems

    技能(Skills)已在 Gemini Spark 中上线,很快将取代 Gems,让构建自定义快捷方式更加简单。 但别担心——当 Gems 下线时,我们会自动将你的 Gems 迁移为技能。在未来几周内,技能将具备你在 Gems 中喜爱的所有功能,包括与他人分享以及添加 Google Drive 文件。 了解更多 ↓ http://goo.gle/4z0iO66

  7. X:Suno (@suno)22

    Suno 用 v6 助力 banoffeemusic 创作

    对 @banoffeemusic 来说,创新是本能。一首歌直到让她自己感到惊喜才算完成。 看她如何用 v6 从不寻常的影响中汲取灵感,融合多种流派,把她的声音带向新的地方。 创作打动你的东西。

  8. X:Gemini (@GeminiApp)54

    Gemini Skills 支持主动触发与多技能堆叠,可引用文件创建技能

    Google Gemini 宣布 Skills 现在具备主动触发和可堆叠能力:Gemini 可从聊天中帮助构建自定义技能,并在提示词匹配时自动调用已保存的技能;大任务中可同时叠加多个技能,如将个人写作风格技能与品牌规范技能搭配生成符合品牌调性的内容。即日起技能可包含纯文本文档、PDF 或图片等参考文件,后续还将支持与他人共享技能以及从 @GoogleDrive 添加文件。

  9. X:Gemini (@GeminiApp)46

    Gemini 将把 Gems 自动迁移为 Skills

    Gemini 宣布 Gems 将自动迁移为 Skills,并从 11 月起对个人账户用 Skills 取代 Gems 作为定制特定任务指令的工具,Workspace 企业版等客户分别在 2027 年 3 月和 6 月跟进。未来几周 Skills 将获得更多功能,Gems 下线时官方会自动完成迁移,帮助中心已提供过渡说明。

  10. X:Gemini (@GeminiApp)49

    Gemini 技能功能:可复用指令省时提效

    Gemini 推出可复用技能(skill)功能,创建一次即可反复调用。官方给出三类用法:准备演示时自动生成幻灯片大纲、讲稿要点与问答预案;结合 Google Workspace 上下文按个人语气起草邮件和文档;针对一个话题给出三到五个不同视角,辅助头脑风暴与决策。

  11. X:Microsoft Research (@MSFTResearch)34

    微软新ML系统提前30-60分钟预测太空天气

    极端太空天气事件可能损坏地球电力系统,并降低GPS精度和卫星运行。一个新的机器学习系统能在风暴到达前30-60分钟预测可能发生损害的位置:https://msft.it/6019aYXwh

  12. X:Gemini (@GeminiApp)40

    Gemini 推出技能功能

    跳过重复的提示词,用 Gemini 中的技能直接获得结果。 技能是为那些你反复执行的特定任务保存的指令集。把技能想象成一个快捷方式,随时待命。🧵

  13. X:Ethan Mollick (@emollick)43

    前沿模型实验室可发布半成品

    关于 AI 生意,有一件事需要知道:拥有前沿模型的实验室可以发布半成品,而它们的效果出奇地好,因为 AI 自己能搞明白并随机应变。这就像在产品里内置了一名前线部署工程师和客服人员。

  14. Anthropic:Research(发表成果 · 网页)69

    物理学者 Matthew Schwartz 分享用 Claude 与 BootLoops 做跨学科计算的经验

    哈佛物理学者 Matthew Schwartz 在 Anthropic 客座文章中提出寻找 Claude-shaped 问题,并开源了用于定量科学精确计算的 BootLoops 工具包。

    推荐理由:作者结合自身跨学科项目,说明如何让 Claude 承接适合其能力的问题,并总结了与专家协作及规避模型失败模式的经验。

  15. Stanford HAI News(网页)29

    Stanford HAI 迎来 15 位新数据科学学者

    Stanford HAI 任命 15 位新数据科学学者,入选者为该校七个学院的 PhD 学生,研究方向覆盖 AI 治理、网络冲突、蛋白质设计、放射学模型和宇宙结构等。该项目为两年期奖学金,支持在方法、模型与理论以及科学发现、健康、教育、艺术等领域推进数据科学与 AI 基础、应用及人文维度的研究。

  16. NVIDIA Technical Blog:Agentic AI / Generative AI42

    NVIDIA 发布 DOCA Agent Skills,加速 BlueField 上的应用开发

    NVIDIA 在 GitHub 上线 DOCA AI agent skills,为 AI 智能体提供经过验证的 API 签名、硬件能力要求和构建约束,覆盖 Flow、GPUNetIO、PCC 等 DOCA 库。在 65 条真实 DOCA 开发者提示词评测中,无 skills 时智能体仅满足 19% 的评分清单项,加载 skills 后达到 100%。

  17. Anthropic:Newsroom(网页)48

    Barclays 扩大与 Anthropic 合作,将 Claude 推广至全行

    Barclays 扩大与 Anthropic 的战略合作,在全行范围部署 Claude,用于加速软件开发、现代化遗留系统并提升运营效率,预计到 2026 年底 Claude Code 覆盖 50% 开发者,2027 年覆盖多数软件工程师。

  18. TechCrunch:AI(RSS)38

    Destro AI 获 800 万美元种子轮,用智能层让机器人与人类协同作业

    Destro 结束隐身状态并完成 800 万美元种子轮融资,由 Base10 Partners 和 Bonfire Ventures 领投。它不做机器人本体,而是用基于开放权重视觉-语言-动作模型的 Vision 操作系统和 Mothership 操作系统,统一调度机器人、货物与人工,已在 Yusen Logistics 落地试点,并计划扩展至 26 台机器人的完整部署。

  19. Claude:Blog(网页)76

    Claude Code 推出 mods,可用 TypeScript 函数改写提示词、替换内置功能

    Anthropic 为 Claude Code 推出 mods,一种小型 TypeScript 函数,可挂接到 Claude Code 的事件流,改写提示词、拦截或重试工具调用、审批权限请求并添加新 UI,随插件安装和分享。

    推荐理由:原文给出 mods 的事件机制、安全限制和企业管控细节,开发者可据此决定是否用它定制自己的 Claude Code 工作流。

  20. Artificial Intelligence News(网页)27

    AI 学习平台如何改变 L&D 团队的角色

    AI 驱动的学习平台正把 L&D 团队从课程制作、评估生成、翻译和进度追踪等重复事务中解放出来,转向技能发展战略与员工能力规划。LinkedIn 2025 职场学习报告显示,49% 的学习与人才发展从业者称高管担忧员工缺乏执行业务战略所需技能,71% 的 L&D 从业者已在探索、试验或整合这类技术。平台可基于角色、技能和学习活动数据推荐内容并个性化学习路径,但生成内容仍需人工审核把关。

  21. Manus:Blog(网页)63

    Manus 介绍 Game Dev 的调参与多人游戏工作流

    Manus 在 9 月 28 日发布 2.0 后,进一步介绍其中已有的 Game Dev:可在游玩时实时调整速度、重力等参数,管理和替换角色、画面及声音素材,并由平台承担多人游戏的服务器部署、网络与状态同步。本文是对既有能力和创作方式的说明,不是一次新的功能发布。

  22. Manus:Blog(网页)72

    Manus 分享视频生成与时间线编辑工作流

    Manus 分享使用既有视频能力的创作经验:先由 AI 搜索参考、制作镜头与代码视觉元素,再在 Manus Studio 的视频编辑器中逐轨调整画面、字幕、配乐和音效。教程还演示导入本地素材、自动转录与编排初剪,以及将长视频剪成短片;作者以 125 段旅行素材整理成约 11 分钟成片为例,说明如何把生成初稿继续打磨为可发布作品。

    推荐理由:作者结合真实项目,介绍从导入素材、转录和编排初剪,到逐轨调整字幕、画面与音频的工作流,读者可将这些方法用于自己的视频制作。

9月30日周三
  1. Hacker News:AI 热帖55

    The AI Race Just Got Awkward:西方模型悄然采用 DeepSeek 的 KV cache 优化

    作者认为西方实验室已悄然采用中国实验室公开的模型优化成果。DeepSeek 持续公开 KV cache 压缩技术,从 MLA 的约 15 倍压缩到 DeepSeek-V4.1-Flash 的 CSA2、跨层 cache 复用与 FP4 缓存,将全局 KV cache 降至每 token 890 字节,较 DeepSeek-V1 在长上下文编码场景降低约 437 倍。

  2. X:Testing Catalog (@testingcatalog)41

    Kled V3 发布:72 小时部署 AI 数据采集

    Kled 发布 V3。定制 AI 数据采集任务现可在 72 小时内部署给 500,000+ 贡献者。 108 个可配置任务模板,覆盖图像、视频、音频、文本和标注。从第一视角视频到稀有语言的对话语音,应有尽有。 每天采集 800 万个数据点。 现实世界正在变得可编程 🌍

  3. X:Nathan Lambert (@natolambert)20

    Nathan Lambert 谈 X 平台人机标注

    如果 X 允许使用 App 的人把他们的回复标记为人类撰写,或者你可以把回复限制为通过人类验证的用户,整个体验会好上 10 倍。 我不想不得不把回复限制在我关注网络内的账号。所有机器人也都是认证的。