跳到正文

全部动态

今日 0 条
6月10日周三
  1. Claude:Blog(网页)75

    智能体表面的演进:使用 Claude Managed Agents 构建

    Anthropic 推出 Claude Managed Agents,一套可组合 API 套件,用于构建和部署生产级智能体。该产品从早期简单 API 演进至 Claude Agent SDK,再到将智能体调度层与代码执行沙箱解耦的 Managed Agents。通过只追加日志的会话机制,Managed Agents 解决了托管伸缩、会话持久化、文件系统管理、执行隔离、凭证安全与可观测性等生产部署挑战。团队借助该方案可在数天内完成从原型到生产环境的转化,无需自建基础设施。

    推荐理由:Claude Managed Agents 把代理部署的复杂基础设施打包成了 API,让团队从原型到上线只需几天而不是几个月,尤其凭证隔离和延迟优化对生产环境很关键,想部署可靠代理的团队可以认真看看。

6月9日周二
  1. X:Boris Cherny (@bcherny)70

    Claude Code 支持嵌套子智能体

    刚刚在 Claude Code 中实现了嵌套子智能体支持。 开始更多实验智能体启动其他智能体,以便更好地管理上下文。初始深度上限为 5,将在今天的发布中推出。 欢迎反馈!

    推荐理由:Claude Code 这次的嵌套 agent 挺有意思,没有堆 token 窗口而是用 agent 拆任务,做复杂工程的可以试试今天更新的版本。

  2. 公众号:火山引擎70

    火山引擎TRAE Work企业版正式上线,面向全员提供AI办公平台

    火山引擎将TRAE Solo品牌升级为TRAE Work企业版,发布面向企业的AI办公平台。平台提供Work和Code两种模式:Work模式面向产品、运营、市场等非技术岗位,支持上传.pptx、.xlsx、图片等多种格式混合输入直接输出PPT或文档,支持语音讨论自动整理结构化纪要,支持按天或按周自动运行的数据整理和报告生成;Code模式面向开发者和业务同学,可用自然语言描述需求直接生成页面或小应用。桌面端、网页端和移动端多端同步。企业后台可统一配置模型、用量限额、上传内部文档,沙箱机制隔离执行,支持命令黑名单、MCP白名单、内容安全策略,关键操作可审计。同时发起TRAE Enterprise Fellow招募计划。

    推荐理由:火山引擎把 TRAE 从开发者工具升级成全员工 AI 协作平台,语音讨论和自动化任务直击非技术岗痛点,企业推 AI 落地又多了一个务实选择。

  3. X:Tibo (@thsottiaux)74

    ChatGPT上线交互图表、全屏编辑等多项新功能

    ChatGPT团队持续每周推进更新,最新一批功能已全部上线。新增内容包括:交互式漂亮图表、全屏写作编辑并保存至个人库、长对话自动生成目录、支持附带附件编辑消息。Plus/Pro用户现可长按发送键选择模型的智能/努力级别。iOS端聊天输入框响应速度也得到提升。团队表示将持续倾听用户反馈并快速迭代。

    推荐理由:ChatGPT 这波更新不震撼,但长按选模型、聊天目录和全屏编辑都打在日常痛点上,看得出团队在认真听反馈,值得点开用一下。

  4. xAI:News(网页)65

    Gopuff与SpaceXAI推出Go AI购物助手

    Gopuff与SpaceXAI合作推出Go智能购物助手,内置于Gopuff应用,由Grok文本、音频和图像模型驱动。Go结合Grok的推理、语音和图像生成能力与Gopuff的13年需求智能,利用X和网络实时信号。它可在用户打开应用前根据历史偏好和天气等信号构建个性化购物车,并包含基于Grok Imagine的超逼真视觉购物信息流。Go目前在美国iOS和Android端可用,随后在英国推出。

    推荐理由:Gopuff加SpaceXAI的组合给即时零售塞了个挺实在的AI购物助手,预判需求比我自己翻分类流畅,本地生活类工具团队该把它当个落地样本。

  5. Hacker News 热门(buzzing.cc 中文翻译)74

    Apple Core AI 框架

    一篇关于 Apple Core AI 框架的 Hacker News 帖子获得 109 个点赞。帖子内容包含一张苹果开发者 OG 图片和一个指向 Apple Core AI Framework 官方文档的链接(developer.apple.com)。该帖子由 buzzing.cc 中文翻译,发布于 2026 年 6 月 8 日 02:47(UTC)。

    推荐理由:Apple 在 WWDC 上发布的本地 AI 框架,统一了 CPU、GPU、Neural Engine 的推理接口,做 iOS/macOS AI 应用的开发者必看,提前适配就能低成本用上设备端能力。

  6. Claude Code:GitHub Releases(RSS)61

    Claude Code v2.1.169 发布

    Claude Code v2.1.169 新增 `--safe-mode` 标志及环境变量,用于禁用所有自定义配置以排查问题;新增 `/cd` 命令,可在不破坏提示词缓存的情况下切换工作目录;新增 `disableBundledSkills` 设置隐藏内置技能。修复了企业 MCP 策略在重连、IDE 配置及首次会话中不被强制的问题,以及 macOS 用户每轮约 30–50ms 的 UI 卡顿、Windows 下 `claude -p` 和 Git 凭证弹窗等多项 bug。改进了任务创建的可靠性,恢复 Vertex/Foundry 默认 5 分钟空闲超时,并降低 CPU 占用。

    推荐理由:全是修 bug 的版本里藏了两个实用命令,/cd 换目录不丢缓存和 safe-mode 跳过所有自定义直接排查,重度用户的小痛点被摸到了。

  7. X:Viggle AI (@ViggleAI)66

    Viggle API 上线:任意角色任意动作秒级生成

    推出 Viggle API。 给任意角色添加任意动作,一次 API 调用——数秒内即可激活。 可接入 Claude、Codex 或你正在构建的任何智能体。起价 $0.01/秒。 注册即获 100 次免费额度。 转发 + 关注 + 评论,10 位中奖者再获 100 次! 了解更多👇

    推荐理由:给角色加动作的API降到$0.01/秒,还能直接接进Claude和Codex,做视频Agent的开发者可以试试。但纯API发布,普通用户不用激动。

  8. TechCrunch:AI(RSS)73

    苹果刚刚教会你的iPhone补全句子、完善照片和简化工作流程

    Apple为Safari、Shortcuts和Password应用添加了AI驱动的新功能,让iPhone能够自动补全句子、完善照片和简化工作流程。

    推荐理由:WWDC 2026 的 Apple Intelligence 更新不是颠覆性突破,但 Safari 标签管理、跨应用上下文和 Shortcuts 的 AI 创建让 AI 真正渗透到日常使用中,是所有苹果用户都该看看的实用升级。

  9. Apple:Newsroom(RSS)66

    Apple 推出 Siri AI:由 Apple Intelligence 驱动的更强大、更个性化的个人助理

    Apple 发布了 Siri AI,一款由 Apple Intelligence 驱动的个人助理,具备个人上下文、世界知识和屏幕感知能力,能提供更强大、更个性化的交互体验。

    推荐理由:苹果对 Siri 的这次重构不是简单地换个模型,它把个人上下文、屏幕感知和视觉智能实际嵌进了系统,对普通用户来说日常交互方式可能要变。

  10. X:ChatGPT (@ChatGPT)67

    ChatGPT 新增数据图表生成功能

    将数据和比较转化为图表,直接在 ChatGPT 中完成。 现已支持移动端和网页端。

    推荐理由:ChatGPT终于内置了图表生成,不用再复制数据到其他工具了。这个功能的真正价值是让分析更快闭环,做数据简报的人可以试试。

  11. X:Gemini Notebook (@Gemini_Notebook)72

    NotebookLM重大升级:智能体能力与高级推理

    推出更强大的 NotebookLM 🚀 重大升级带来了对话中的智能体能力、更高级的推理以及一系列新的输出格式。处理复杂的多步骤研究问题从未如此简单。 现已面向 Google AI Ultra 订阅者推出。

    推荐理由:NotebookLM 这次升级把 agent 能力塞进聊天框,从被动答案变成能拆解多步研究,对深度资料整理的人是真迭代,但仅限 Google AI Ultra 订阅,门槛不低。

  12. Claude:Blog(网页)75

    Claude Managed Agents 新增定时运行和环境变量存储功能

    Claude Managed Agents 今日在 Claude Platform 公开测试两项新功能:代理可按 cron 计划自动执行周期性任务(如夜间数据同步、周度合规扫描、每日摘要),无需用户自建调度器,支持暂停、恢复、归档或按需触发;vaults 新增环境变量支持,允许代理通过 CLI 进行认证请求,真实密钥仅附加在网络边界,代理无法读取。已集成的 CLI 包括 Browserbase、KERNEL、Notion、Ramp 和 Sentry。Rakuten、Actively AI、Ando、Milana 等团队正在使用这些功能实现自动化数据报表、跨账户搜索、招聘提醒等场景。

    推荐理由:Claude Managed Agents 现在能定时跑任务和用 vault 安全连接 CLI 了,这基本解决了企业 agent 落地的两个最大痛点——自动化和凭证管理。做 agent 的团队应该仔细读。

6月8日周一
  1. X:Runway (@runwayml)79

    Runway Aleph 2.0 编辑模型:一键适配任意视频格式

    一个视频,现在可以为每个信息流和格式制作。上传你现有的视频,选择你想要的宽高比,然后观看我们的编辑模型 Aleph 2.0,填充场景的其余部分,就像你从一开始就这样制作一样。 在我们的桌面 Web 应用上尝试,链接如下。

    推荐理由:Runway 把视频重构图做成了上传即填充,Aleph 2.0 自动补全不同比例画面,对同时做横竖版内容的人太实用,省掉重新拍摄或手动裁剪的功夫。

  2. X:Kimi.ai (@Kimi_Moonshot)76

    Kimi Work:本地桌面AI智能体,支持300智能体并行

    Kimi发布Kimi Work,一款本地运行的桌面AI智能体。支持最多300个AI智能体同时在本地机器并行运行;配合WebBridge浏览器扩展,智能体可在浏览器中导航、搜索、点击、填写并完成任务;内置全球市场数据工具,可直接调用Yahoo Finance和世界银行数据,无需复杂API设置;记忆系统会记录用户偏好、过往决策和上下文。支持macOS(Apple Silicon)和Windows。

    推荐理由:这个产品把AI agent从聊天窗口搬到了桌面,300个并行agent和内置金融工具直接对标专业人群,如果它能稳定运行,个人AI助手的形态又要被重新定义了。

  3. 公众号:月之暗面(Kimi)76

    Kimi Code 焕新升级(附视频教程)

    Kimi Code 开源 Coding Agent 迎来大版本升级:一行命令安装,毫秒级启动;新增视频理解能力,支持提取视频风格生成 LUT 文件、长视频切片、根据录屏生成代码;集成同花顺、天眼查等权威数据源,可查询股票价格、财报、学术论文;支持 ACP 协议,可在 JetBrains、Zed 中使用;丰富 hook 生态方便集成其他工具。底层视觉推理由 Kimi K2.6 模型提供。

    推荐理由:Kimi Code 这次更新把安装和视频处理的门槛压到了最低,一行命令加拖拽视频就能用,开源 Agent 的体验终于开始反超商业版本。

  4. 公众号:月之暗面(Kimi)62

    Kimi Code 焕新升级(附视频教程)

    Kimi Code 开源 Coding Agent 大版本升级:一行命令安装,毫秒级启动;新增视频理解,可提取参考视频色调生成 LUT、将长视频切分为短视频、根据录屏生成代码;接入同花顺、天眼查等权威数据源,支持实时查询股票价格、财报和学术论文;兼容 ACP 协议,可在 JetBrains、Zed 等 IDE 使用;拓展 hook 生态方便集成。视频理解基于 Kimi K2.6 模型。通过 /plugins 安装 kimi-datasource 插件即可使用权威数据源。

    推荐理由:Kimi Code 这次把视频理解功能做进了编码工作流,一行安装和 ACP 协议接入让上手成本几乎为零,做视频剪辑和自动化开发的同好值得一试。

  5. IT之家(RSS)73

    微信AI官宣内测:两种接入模式供开发者选择

    微信开发者官方今日发布指引,确认微信AI正在内测阶段。开放平台提供两种接入模式:自动模式可授权平台读取小程序源码,无需额外开发即可让微信AI直接操作页面;开发模式下开发者可自主开发技能,审核后由微信AI调用。两种模式可同时开启。微信AI是微信内的AI助手,用户通过自然语言对话即可调用、访问和操作小程序。服务条款称“微信AI”可能非最终名称。接入与否不影响现有小程序服务。

    推荐理由:微信终于把AI塞进了自家生态,没做聊天机器人而是直接让AI操作小程序,这个方向比所有独立AI助手都更贴近普通人的真实需求,做小程序的得赶紧看了。

  6. Claude:Blog(网页)63

    Claude 支持 Apple Foundation Models 框架,推出新 Swift 包

    Anthropic 通过一个新 Swift 包,让 Apple 开发者能在 Foundation Models 框架中直接调用 Claude。开发者用 Apple 框架以原生 Swift 方式,仅需三行代码即可通过引导生成返回类型化 Swift 值。当请求涉及多步推理、代码生成、联网搜索或数据分析时,Claude 可接手处理,并将流式响应传回同一视图。该支持可在 iOS 27、iPadOS 27、macOS 27、visionOS 27 和 watchOS 27 上使用,开发者需添加包并配置 Anthropic API 密钥。

    推荐理由:Apple开发者福音,现在能用Swift原生调用Claude了。端侧模型处理简单任务,复杂推理交给Claude,这才是苹果AI的正确打开方式。

  7. Claude:Blog(网页)72

    Claude 为 Connector 开发者推出性能监控仪表盘

    Claude 为目录中已发布的 Connector 新增性能监控仪表盘(公开测试版)。所有者可追踪活跃用户、工具调用次数、目录排名、健康评分、错误率、延迟,并按工具细分错误归因;还能按 Claude、Claude Code、Cowork 等产品分解使用情况。访问需 Team 或 Enterprise 账号(Admin/Owner 权限或自定义角色)。基于 MCP 构建的 Connector 可直接在 Claude 应用内提交至目录,该目录已有超 300 个第三方 Connector,每日被数百万人使用。

    推荐理由:Claude给connector开发者加了仪表板,能跟踪用量和错误,还能直接提交到目录,做MCP集成的省了监控的麻烦,即开即用。

6月7日周日
  1. Hugging Face:Blog(RSS)70

    Her · हेर — Claude Code 会话分析工具

    Her(हेर)是专为 Claude Code 设计的会话分析工具。用户上传 `.jsonl` 文件后,Her 用自然语言重建每轮交互,标记部署、配置变更、秘密等高风险操作并定位到具体轮次。它展示 token 消耗、所用工具、子智能体、技能和 MCP 服务器,并结合 Anthropic 与社区最佳实践给出改进建议(仅在有明确可修复模式时)。内置“Ask Her”问答功能,支持单会话与跨会话项目分析。工具不调用第三方 AI API,使用 Nemotron-Mini-4B-Instruct 模型在 Hugging Face ZeroGPU 上运行,评估引擎完全确定,模型仅负责文本生成与建议。Her 内置 Homebrew、npm、PyPI 主流 CLI 工具数据库,自动识别会话中使用的工具,并对部署工具、数据库客户端等执行活动进行标记提醒。

    推荐理由:每次 Claude Code 跑完都留下一堆 JSON,没人看。Her 用一个本地小模型帮你分析会话,钱花在哪、有没有危险操作一目了然,还不把数据传出去,是个务实的小工具。

  2. MarkTechPost(RSS)74

    Google 发布 Colab CLI,开发者与 AI 智能体可在终端中远程调用 Colab GPU 与 TPU 运行 Python 代码

    Google 发布 Colab CLI,允许开发者和 AI 智能体在终端中直接运行本地 Python 代码,并利用远程 Colab 的 GPU 与 TPU 运行时进行加速。通过这一命令行工具,用户无需打开浏览器即可无缝连接 Colab 计算资源,为自动化和脚本化 AI 工作流提供了更便捷的接口。

    推荐理由:Colab CLI把远程GPU接入终端,且AI Agent可直接调用,让Colab从笔记本变成计算后端,个人开发者云端算力使用方式会被改变。

6月6日周六
  1. X:Rohan Paul (@rohanpaul_ai)80

    GitHub 开源 Spec Kit 工具包,用产品规范引导 AI 编码

    GitHub 发布开源工具包 Spec Kit,旨在解决 "vibe coding" 的最大弱点——AI 常在规则未明确时就开始编码。它把流程从 "让 AI 直接构建" 改为 "先写产品规范,再让 AI 根据规范实现"。当前 AI 编码模式常因松散提示直接跳入代码,导致需求薄弱、边界遗漏和反复返工。Spec Kit 推动反向流程:先定义产品功能,再澄清差距、制订技术计划、分解任务,最后让 agent 执行。规范成为可执行的开发合约,支持 Copilot、Claude Code、Codex、Gemini、Cursor、Qwen 等 30+ agent 集成。项目已获 109K+ 星标。

    推荐理由:GitHub亲自下场推spec-driven开发,把vibe coding的随意感压回“先写规约再写代码”的老派流程,但这次规约是给AI读的,做coding agent的团队应该认真研究一下。

  2. IT之家(RSS)70

    OpenCV 5 发布:升级全新 DNN 引擎、原生支持大模型

    OpenCV 5 正式发布,采用基于图的 DNN 引擎,ONNX 算子覆盖率从 4.x 的不到 23% 提升至超 80%,原生支持 Transformer、视觉语言模型(VLM)和大语言模型(LLM)。其他更新包括:更好的 Python 集成与命名参数、更紧凑核心代码、清晰硬件加速层、原生 FP16/BF16、规范化 0D/1D 张量、扩展 3D 视觉及现代化文档。该库 GitHub 拥有超 86,000 stars,每日安装量超一百万次。

    推荐理由:OpenCV 5 是一次架构级大更新,DNN 引擎重写、ONNX 覆盖率从 23% 跳到 80%,原生支持大模型推理,做模型部署的该关注了。

  3. Hugging Face:Blog(RSS)58

    Persona Atlas:Hugging Face 上的开源人物思维映射工具

    Persona Atlas 是一个运行在 Hugging Face Inference Providers 上的开源项目。它通过工具调用代理执行真实网络搜索,生成公众人物的资料、事实清单和风格假设,然后让该人物回答十个关于身份、伦理等开放式问题。每个回答被转化为嵌入向量,从而在向量空间中对不同人物进行距离比较,并基于十个特质锚点绘制热力图。前端采用 Gradio,提供研究、比较和检查代理完整追溯三个标签页,预设多个人物角色,无需 token 即可直接体验。

    推荐理由:把苏格拉底和乔布斯放在一起比思维方式,这个实验更像智力玩具,但背后用小模型跑 agent 搜索做嵌入比较的流程,做角色扮演的人可以学研究方法。

  4. Claude Code:GitHub Releases(RSS)64

    Claude Code v2.1.166 发布

    Claude Code v2.1.166 新增 fallbackModel 设置,最多配置三个后备模型在主模型过载或不可用时按序尝试;--fallback-model 现也适用于交互会话。deny rule 中工具名位置支持 glob 模式("*"拒绝所有工具),未知工具名启动时警告。跨会话消息中继不再携带用户权限,接收方拒绝被中继的权限请求。MAX_THINKING_TOKENS=0、--thinking disabled 及逐模型 thinking 开关可禁用默认开启思考的模型(仅 Claude API,第三方不变)。API 返回非预期不可重试错误时,在后备模型上重试一次。修复了图像处理失败、远程会话卡死、JetBrains IDE 终端闪烁、Kitty 键盘协议下 Shift+非 ASCII 字符丢失、PowerShell 命令验证挂起、macOS 后台进程孤儿化等问题。

    推荐理由:Claude Code 重度用户该升级了,fallbackModel 让你设三个备用模型防止高峰期罢工,跨会话安全加固也让自动模式更敢放任跑了。

  5. X:Greg Brockman (@gdb)72

    ChatGPT 网页端新增邮件发送功能

    ChatGPT 网页端现在支持直接从写作块中发送邮件,无需离开对话。主推文作者表示这是与 ChatGPT 的邮件集成。

    推荐理由:ChatGPT 现在能直接写邮件、改邮件、发邮件了,不用跳出对话,但本质是个 UI 集成,实用但不算大新闻。

  6. X:Tibo (@thsottiaux)77

    ChatGPT记忆升级:更好记忆更高效

    更好的记忆 = 更短的提示词 = 每个token更高效用

    推荐理由:ChatGPT 记忆系统这次升级不是小修小补,它把跨对话上下文真正做进了产品里,token 利用率直接提升,重度用户会明显感到助手变聪明了。

  7. X:Michael Truell (@mntruell)80

    智能体协作应如同事般对话和手势

    与 AI 智能体协作应感觉像与同事协作一样。你应能“与它们交谈”——不仅通过文本聊天,还能一起对着屏幕做手势、实时对话等。

    推荐理由:Cursor 新加的 Design Mode 让改 UI 像跟同事比划屏幕一样自然,手势、画框、说话都能驱动 agent,AI 编程工具第一次有了‘面对面’的感觉。

  8. X:ChatGPT (@ChatGPT)68

    ChatGPT 网页版支持从写作块发送邮件

    草拟。调整。发送。 现在你可以在网页版 ChatGPT 中直接从写作块发送邮件,无需离开对话。

    推荐理由:一个小但实用的更新,ChatGPT在写作块里直接发邮件,省掉复制粘贴的步骤,日常办公写邮件的人会立刻感觉到顺滑。

  9. X:Replit (@Replit)68

    Replit Canvas:AI设计UI并快速转应用

    你试过新的 Replit Canvas 了吗? - 用 AI 创建美观的 UI 设计 - 使用 GPT-Image 2 & Seedance 生成素材 - 几分钟内将你的设计转化为可发布的应用

    推荐理由:Replit Canvas 把 GPT-Image 2 和 Seedance 直接嵌进 UI 设计流程,让不会画图的开发者也能几分钟出一个看得过去的 App 原型,对非设计师的独立开发者是实打实的效率提升。

  10. X:Google AI (@GoogleAI)78

    Google AI 本周产品更新:Nano Banana 2、Co-Scientist、dreambeans、Gemma 4 等

    Google AI 本周发布多项更新:Nano Banana 2 及 Pro 正式 GA,可通过 Gemini Enterprise Agent Platform、Gemini API 和 Google AI Studio 获取;Co-Scientist 多智能体系统面向科研自动生成优化新假设;Google Labs 推出 dreambeans,根据用户 Google 应用数据每日生成个性化话题集;Gemma 4 12B 统一无编码器多模态模型可完全离线运行于笔记本;Gemma 4 系列及草稿模型引入 QAT 降低内存需求;Google Magenta RealTime 2 开源实时音乐模型,支持 MIDI 键盘、文本提示和手势演奏。

    推荐理由:周报里藏了个大号:Gemma 4 12B开源多模态且完全离线,开发者今天就能在自己笔记本上跑起来,Co-Scientist的多agent科学推理也有看头。

  11. X:Gemini (@GeminiApp)81

    Gemini Live 支持实时创建编辑图像

    你现可直接在 Gemini Live 中创建和编辑图像。 无论是测试房间装饰、解决数学问题,还是制作可分享的梗图,所有操作都实时完成。 只需打开 Gemini 应用,点击 Live 按钮,共享摄像头,告诉 Gemini 你想看到的。

    推荐理由:Gemini Live 终于能用嘴改图了,实时对话+图像生成让装修试色、数学解题变成「聊着天就把活干了」,产品人和普通用户都该试试这个新交互。

  12. X:Replit (@Replit)67

    Replit 推出 Shopify 集成与 SEO 智能体

    Replit 上的 Shopify 与新的 SEO Agent

    推荐理由:Replit直接瞄准电商卖家的痛点,推出Shopify集成和SEO Agent,让非技术店主也能用AI优化店铺,是个务实的生产力更新。

6月5日周五
  1. X:Viggle AI (@ViggleAI)65

    Viggle_PINOC 免费动捕测试开启

    Mocap 不需要套装、工作室或数千美元。 使用 @Viggle_PINOC,任何人都可以简单地拍摄自己,并将该视频转换为动作捕捉。 我们仍处于测试阶段,且对所有人完全免费。试试看,告诉我们你还想看什么!

    推荐理由:动作捕捉从动捕服变成手机自拍,Viggle 这个 Pinoc 工具把 mocap 的门槛从数千美元拉到零,做动画和 VTuber 的可以直接玩起来了。

  2. IT之家(RSS)72

    开源鸿蒙 OpenHarmony 具身智能版本 EmbodiedAI 1.0.1 发布

    6月5日,开源鸿蒙具身智能PMC(筹)发布EmbodiedAI 1.0.1版本。该版本聚焦机器人控制与智能体应用,升级导航规划、运动控制、仿真开发、硬件适配等核心能力,兼容ROS生态、机器人模拟器及多种本体形态。集成开源鸿蒙原生模拟器、MuJoCo、Gazebo三大仿真环境,打通从代码开发到真机验证的全流程链路。人形机器人、四足机器狗、商用服务机器人等已完成适配验证。目前具身智能方向已组建18个专项SIG工作组,版本源码已正式开放。

    推荐理由:开源鸿蒙的具身智能框架终于从概念走向工程交付,EmbodiedAI 1.0.1 打通仿真和真机,对于不想被ROS绑架的机器人团队是个新选择。

  3. X:面壁智能 OpenBMB (@OpenBMB)66

    社区基于MiniCPM-V 4.6打造财务分析工具AccountingLLM

    社区开发者使用面壁智能MiniCPM-V 4.6构建了AccountingLLM(quaesto.com),用于自动化财务文档分析。该工具可上传IPO招股书、年报或审计文件,自动从复杂PDF中提取财务表格、重建跨页表格、对照会计等式检查关键数据,并标记可疑条目供人工审核。开发者已将其商业化,成为实际可用的产品。

    推荐理由:这不是又一个AI读财报的demo,而是直接上线接客的商业产品。做财务、审计的可以试试它从招股书里自动扒表格和勾稽检查的实用性。

  4. 公众号:通义实验室(千问)70

    PawBench:给通用智能体一把可度量的尺

    通义实验室推出全新评测基准PawBench v1.0,面向个人助理与通用智能体场景,将底座模型与运行框架Harness纳入同一体系进行交叉评测。评测矩阵包含9个模型与3个Harness(Hermes、OpenClaw、QwenPaw),覆盖150道真实任务共4050个测试单元。结果显示,QwenPaw(76.4分)、OpenClaw(75.4分)、Hermes(70.4分)之间存在显著分差,Harness环境对表现的影响甚至大于模型本身。PawBench还通过切片分析揭示了Harness在产物校验、Skill主动发现和Web搜索默认可用性等方面的关键差距。项目已开源。

    推荐理由:PawBench 把 Harness 从‘看不见的手’变成可诊断的变量,好 Harness 能让弱模型以下克上,这份评测对 Agent 框架开发者是一份必读的校验清单。

  5. X:Elon Musk (@elonmusk, xAI)66

    Grok 推出 worktrees 并行智能体

    Grok 现已支持 worktrees。worktrees 是代码仓库的轻量级副本,允许在独立工作区中并行运行 AI 智能体,可通过主页或 `grok -w` 使用。

    推荐理由:Grok Build现在支持worktrees,一条命令`grok -w`就能给每个agent独立工作空间,并行开发现场感一下拉满。做复杂任务的可以立刻用起来。