跳到正文

全部动态

今日 0 条
5月22日周五
  1. Claude Code:GitHub Releases(RSS)73

    v2.1.147版本更新

    本次更新引入了`Workflow`工具,支持确定性多智能体编排(默认关闭)。将`/simplify`命令重命名为`/code-review`,现可报告代码正确性问题并支持生成GitHub PR内联评论。改进了自动更新器(增加重试与错误报告)、大文件diff渲染性能,并优化了提示历史记录以避免重复条目。修复了多个关键问题,包括企业登录限制未生效、Windows下的PowerShell工具与终端闪烁问题、插件系统及shell快照的bug,并增强了沙箱安全性与终端兼容性。

    推荐理由:Claude Code 这次更新不止修 bug,Workflow 工具让多 agent 编排有了确定性模式,虽然默认关闭但值得尝鲜,做复杂工程的开发者可以关注。

  2. X:ChatGPT (@ChatGPT)67

    ChatGPT现已支持在PowerPoint中直接创建编辑演示文稿

    你是否曾这样想过:我真的不想做这个PPT。 好消息:ChatGPT现在可以直接在PowerPoint中创建和编辑演示文稿。 在PowerPoint中直接构建、更新、理解和优化演示文稿,同时保持幻灯片可编辑。 目前处于测试阶段,我们期待您的反馈 👀

    推荐理由:打工人苦PPT久矣,ChatGPT这次直接在PowerPoint里给你搭好框架还让你随时修改,是从「帮你写」走到了「帮你做」。

  3. X:Sam Altman (@sama)73

    Codex今日更新,新增应用窗口截图功能

    新版Codex今日发布! [引用 @OpenAIDevs]:今天是Codex周四,我们带来了更新。 首先是Appshots,一种将你正在处理的应用上下文带入Codex的新方式。 在Mac上,按Command-Command键即可将应用窗口附加到Codex线程。Codex会获取窗口的截图和文本,包括屏幕上不可见的内容。 Appshots已在Mac的所有套餐中可用,企业版访问权限即将推出。

    推荐理由:Codex 这次更新的 Appshots 看似一个小功能,但把应用窗口上下文直接喂给 Agent 的思路是质的跳跃,Mac 开发者现在就能用,这个交互范式可能会被抄很久。

  4. X:Gemini (@GeminiApp)67

    Gemini扩展应用连接,支持更多服务

    Gemini现在可以连接更多应用,包括@OpenTable、@Canva和@Instacart。 无论您是预订餐厅、制作传单还是订购杂货,Gemini不仅能查找信息,还能通过连接的应用帮助您无缝采取行动。

    推荐理由:Gemini 开始连接 Canva 和 Instacart 了,从“查信息”到“帮干活”的边界又模糊了一点,这是智能助手变成真 Agent 的关键一步,用这些服务的人可以试试。

  5. Simon Willison 博客71

    Datasette Agent

    Datasette Agent是Datasette推出的首个可扩展AI助手,为用户提供对话式界面以查询数据,并支持通过插件生成图表。该工具基于其LLM Python库构建,是LLM与Datasette整合的重要成果。目前提供图表生成、AI图像创建和沙箱代码执行等官方插件。它既可运行于Gemini 3.1 Flash-Lite等云端模型,也支持通过LM Studio连接本地开源模型,具备可靠的工具调用与查询能力。

    推荐理由:Simon 终于把 Datasette 和 LLM 接上了,自然语言查 SQL 数据库有了现成方案,插件生态和本地模型支持让这工具的可玩性极高,做数据分析的值得试试。

  6. X:Viggle AI (@ViggleAI)66

    Viggle推出3D格斗派对游戏Fight Anyone 3D

    介绍Fight Anyone 3D🥊一款3D派对格斗游戏,可能是上班时玩起来最爽的游戏。 上传任何人的照片 → 一个可玩的3D格斗角色,带有语音、个性+招牌动作,由Viggle自研游戏引擎+模型打造。 公测期间100%免费+赠送20张礼品卡。玩得越多,赢得越多! 和同事对战。和朋友对战。和任何人对战。链接+教程+更多内容见下方推文串 ↓

    推荐理由:Viggle把「上传照片生成3D格斗角色」做成了免费派对游戏,有声音有个性,交互感拉满,是近期最适合摸鱼的产品,但AI含量主要在娱乐侧,别当生产力工具。

  7. X:OpenAI Developers (@OpenAIDevs)75

    Codex实现全天候跨设备安全操控Mac

    Codex随时随地,无处不在。 现在您的Mac无需解锁,Codex即可使用您的电脑。 通过手机,Codex可以安全地使用您Mac上的应用程序,即使屏幕关闭且处于锁定状态。 https://developers.openai.com/codex/app/computer-use#locked-use

    推荐理由:Codex 现在能在 Mac 锁屏甚至熄屏时远程操控应用,相当于给 AI Agent 装了个「开关机」,脚本和自动化任务终于不用等人在电脑前了。

  8. X:Replit (@Replit)73

    Replit企业版现已开放自助购买

    Replit Enterprise现已支持自助服务! 几分钟内即可: - 购买Replit Enterprise - 配置SSO + SCIM - 与团队开始协作开发 无需合同谈判,无需等待。

    推荐理由:Replit 企业版自助开通,几分钟完成 SSO 配置和团队搭建,中小团队不用再等采购流程,生产力上手速度直接拉满。

5月21日周四
  1. X:Krea AI (@krea_ai)69

    Krea 2 推出 LoRA 微调系统

    为 Krea 2(测试版)引入 LoRA。 我们迄今最强大的微调系统;现在你可以用惊人的精度,在 Krea 2 上训练你自己的特定风格、对象或角色。 了解其工作原理 👇

    推荐理由:Krea 2 把 LoRA 微调直接做进了产品,对需要固定角色或风格的设计师来说省事了,虽然不是新概念但低门槛就是好文明。

  2. X:Google DeepMind (@GoogleDeepMind)70

    为AI配备科学工具包加速研究工作流

    如何加速你的日常研究工作流? 通过为AI提供正确的科学工具包。 我们为Google @Antigravity推出了Science Skills,整合了来自30多个主要生命科学来源的洞见,包括UniProt和AlphaFold数据库。

    推荐理由:Google 把 AlphaFold 和 UniProt 变成 AI 的“科学技能”,这不是又一次数据库整合,而是让 AI 能直接查询实验知识的工具链,做生命科学的可以认真看看。

  3. xAI:News(网页)67

    在OpenCode中使用Grok

    xAI宣布,其SuperGrok或X Premium订阅用户现可在开源编程工具OpenCode中使用Grok模型。OpenCode提供终端或独立桌面应用两种形式,用户连接Grok账户后,即可调用驱动xAI终端编程代理的Grok Build模型进行开发。该集成通过xAI Grok OAuth实现认证接入,官方表示未来将推出更多开源代理及集成方案。

    推荐理由:把 Grok 搬进 OpenCode 不是啥大新闻,但如果你正好有 SuperGrok 或 X Premium,直接就能在终端里用,算是个挺干净的集成。

  4. IT之家(RSS)78

    腾讯张军官宣操作系统层级 AI 助手“马维斯”正式上工,Windows、Mac、安卓端同步上线

    腾讯于5月21日发布了操作系统层级AI助手“马维斯”,支持Windows、Mac和安卓平台同步上线。该助手具备文档归类解析、图片智能识别处理、系统维护等功能,并强调与操作系统深度集成,可调度不同模型处理任务,部分功能可在离线状态下使用。腾讯表示“马维斯”能完成市面主流Agent的大部分工作,并具备桌面操控手机应用等能力。这是继3月WorkBuddy和“龙虾”产品矩阵后,腾讯推出的又一AI助手产品。

    推荐理由:腾讯把 AI 助手压到系统层,预装本地模型、拔网线也能跑,不是又一个套壳工具,而是真正冲着‘电脑变成可对话对象’去的,值得装上看看实操体验。

  5. X:Google AI for Developers (@googleaidevs)74

    Google Stitch更新:AI设计助手实现全流程构建

    Google推出了其AI设计伙伴Stitch的多项重要更新。新功能支持实时流式构建设计,允许用户在不中断流程的情况下直接进行编辑和互动反馈。Stitch现已能够导入现有代码库或Design.md文件,基于实际生产组件进行设计以保持品牌一致性。同时,工具新增了动态界面生成功能,并可将设计项目直接导出为可分享的线上URL,简化了从原型到生产的部署流程。该工具现已面向全球用户开放。

    推荐理由:Stitch 这次更新把设计到生产流水线打通了,实时流加运动 UI 让原型更接近真产品,做移动端和 Web 的可以直接试试,比自己搭环境快太多。

  6. X:OpenClaw (@openclaw)66

    OpenClaw 2026.5.19版本发布

    OpenClaw 2026.5.19 🦞 📱 Android Talk Mode 实现实时化 🍎 Mac 设置界面更清爽 🔐 xAI 登录支持无头模式 🧵 Telegram 话题功能更稳定 大版本更新,简短公告。 https://github.com/openclaw/openclaw/releases/tag/v2026.5.19

    推荐理由:一堆小修小补但都很实用,尤其 Android 实时对话模式,开源 AI 客户端里难得把体验做到这个程度,值得更新。

  7. X:Midjourney (@midjourney)69

    V8.1新增反向提示功能

    今日小幅更新。许多用户要求为V8模型恢复“反向提示”功能(旧版本已有),我们称之为--no标志。该功能现已在V8.1中上线!如果您想从图像中排除某些元素(例如人物),可以尝试使用--no people。玩得开心!

    推荐理由:Midjourney 把老版本的反提示词带回到 V8.1 了,用 --no 就能剔除画面中不想要的东西,受够了多余路人甲的用户终于可以一键清场。

  8. Google Blog:AI(RSS)68

    我们在 I/O 2026 发布的 100 件事

    在 Google I/O 2026 开发者大会上,公司共发布了 100 项内容,重点介绍了 Gemini Omni、Google Antigravity 和 Universal Cart 等新产品的核心亮点。

    推荐理由:I/O 今年还是全场景轰炸,Gemini Omni 加一堆新产品,花十分钟扫一眼,未来半年 AI 要替你做哪块活就清楚了。

  9. X:ChatGPT (@ChatGPT)83

    GPT-5即将发布

    GPT-5即将发布 🚢

    推荐理由:OpenAI用“Gone shipping”这种推文通常宣告一个重要产品上线,除非是商城发货,否则大概率是个值得立刻去试试的新功能。

  10. X:Gemini (@GeminiApp)72

    Gemini Omni让视频创作编辑更轻松

    使用Gemini Omni创建、混剪和编辑视频比以往任何时候都更容易。 它提供了一种流畅的对话式创作和编辑方式。只需从相册上传视频,并让Gemini进行修改即可。

    推荐理由:Gemini Omni把视频编辑做成了对话,虽然不算革命性更新,但对随手剪片的普通人来说,不用学剪辑软件就是最大的可用性。

  11. X:OpenAI Developers (@OpenAIDevs)71

    ChatGPT移动端支持Codex,实现跨设备协作

    你的笔记本电脑可以留在家里。 通过ChatGPT移动应用使用Codex,随时随地回答问题,之后还能在电脑上继续同一对话。

    推荐理由:移动端能用 Codex 了,多设备无缝接续同一个会话,对随时要改代码的开发者来说是个实用更新,但普通用户可能感知不强。

  12. Google Developers Blog(RSS)63

    发布 Kotlin版ADK与Android版ADK 0.1.0:在Android及其他平台构建AI Agent

    Google发布了面向开发者的新工具包:Kotlin版ADK与Android版ADK 0.1.0。这两个工具包旨在帮助开发者构建AI Agent。其中,Kotlin版ADK将代理工作流引入后端项目开发;Android版ADK则专注于移动端应用,提供了构建AI代理所需的特定功能。此次发布为开发者提供了在Android生态及更广泛平台创建AI应用的官方工具基础。

    推荐理由:Google 首次为 Android 推出端侧多 agent 开发框架,虽然还只是 0.1 版,但端云混合编排的思路已清晰,移动开发者可以提前踩坑了,这是端侧 AI 应用爆发前的一个信号。

  13. Claude:Blog(网页)74

    合作伙伴如何运用Opus强化网络安全

    多家企业正利用Claude Opus模型强化网络安全防御。Wiz通过其Red Agent,每周对超过15万个生产资产进行持续渗透测试,发现数千个高风险漏洞且误报率为零。Palo Alto Networks在不到三周内完成了相当于一年的渗透测试工作量。埃森哲将安全测试覆盖率从约10%提升至80%以上,涉及1600个应用和50万+个API,扫描周期从3-5天缩短至1小时内。应用主要围绕三个方向:开展大规模攻击性测试、缩短漏洞发现与修复的间隔,以及将受控AI系统部署到生产环境。

    推荐理由:Wiz一周扫15万资产零误报,Palo Alto三周完成一年渗透测试量——这些不是蓝图,是Claude Opus正在真实防御中跑出的数字,安全团队值得逐字看完。

  14. Runway:News(网页)74

    Runway发布Aleph 2.0视频编辑模型及Edit Studio应用

    Runway于2026年5月21日发布了视频编辑模型Aleph 2.0及其新产品Edit Studio。Aleph 2.0支持编辑最长30秒的1080p视频,具备精准局部编辑能力,可只改变指定内容而完全保留原视频其余部分。该模型引入了基于单帧图像的精确控制,并支持一次性跨多个镜头应用编辑。Edit Studio是基于这些新能力构建的应用,旨在帮助用户高效地将现有视频素材转化为所需版本,例如更换产品、调整背景或修复拍摄瑕疵。该功能现已向所有付费Runway桌面网页端用户开放,使用优惠码可享受套餐折扣。

    推荐理由:精准局部编辑是过去一年 AI 视频工具最大的短板,Aleph 2.0 把这事做对了,预览控制加多镜头编辑让商业视频迭代成本大幅下降。

  15. Google Developers Blog(RSS)75

    推出 Gemini for Home 赋能服务提供商与硬件合作伙伴

    Google 通过推出全栈 Gemini AI 解决方案扩展其智能家居生态系统。该方案集成了先进的摄像头智能、自然语言查询功能和日常活动摘要能力。它为服务提供商和硬件制造商提供了现成的参考设计与API,使其无需大量研发投入即可构建主动式、品牌化的智能家居服务。该计划旨在超越基础设备控制,迈向能够理解情境并实时响应用户需求的AI原生智能家居。

    推荐理由:Google 把 Gemini 塞进智能家居,直接给硬件商和 ISP 提供交钥匙方案,这一步可能比 Nest 当年更有侵略性,做智能家居的得留意了。

  16. Claude:Blog(网页)65

    Claude现已支持更多安全合规工具

    Anthropic宣布为Claude企业版及平台新增28项安全与合规工具集成。这些集成均通过Claude Compliance API实现,允许企业安全团队统一获取Claude的对话内容与活动事件,从而将其纳入现有的DLP、SIEM等监控与合规流程。新增合作伙伴包括Cloudflare、CrowdStrike、Microsoft Purview等28家供应商,覆盖数据安全、身份验证等多个关键领域,帮助企业快速将Claude接入现有安全平台,实现跨组织工具的统一治理与可视化监控。

    推荐理由:企业安全团队终于能像治理其他SaaS一样治理Claude了,28个主流安全工具集成,说明Anthropic认真在打企业牌,CSO们可以打开文档了。

5月20日周三
  1. X:Google AI (@GoogleAI)69

    谷歌发布多款AI创意工具新功能

    谷歌与创作者合作推出系列AI工具更新。Google Workspace新增图像创作编辑工具Pics;Google Flow支持Gemini Omni Flash模型,并推出Flow Agent作为多步骤创作伙伴;设计工具StitchbyGoogle支持实时文字或语音编辑布局并导出代码;音乐工具Google FlowMusic增加分段编辑、风格混音及视频生成功能。

    推荐理由:Google这次更新的不是单点工具,而是把AI能力像乐高一样嵌入到创意工作流的每一步,Flow Agent的多步骤推理尤其值得做设计的人试试看。

  2. X:Google AI for Developers (@googleaidevs)73

    Ramp利用Gemini API构建高级财务代理

    通过使用Gemini API中的新托管代理功能,@Ramp在无需接触后端基础设施的情况下构建了其高级财务代理。 了解更多 ↓

    推荐理由:Google把agent构建的后端复杂度藏起来了,Ramp没碰基础设施就上了金融agent,这对所有想做agent的产品团队都是个明确信号,门槛降了不少。

  3. Claude Code:GitHub Releases(RSS)64

    Claude Code v2.1.145版本更新

    本次更新为Claude Code工具带来了多项功能增强与问题修复。新功能包括:新增JSON格式的会话列表命令以便脚本化操作,并在OTEL追踪中完善了Agent父子关系。插件浏览界面现可预览详细信息。在稳定性方面,修复了权限提示被绕过的安全问题、MCP参数校验错误、终端窗口调整后的显示冻结,以及非ASCII名称导致的API调用失败等问题。同时改进了Read工具的文件超限处理,并优化了任务列表排序和状态栏信息显示等交互细节,整体提升了工具的易用性与可靠性。

    推荐理由:Claude Code 这次版本把可编程性和可观测性提升了一大截,尤其 `claude agents --json` 和 OTEL 改进,做自动化脚本和监控的可以直接更新了。

  4. X:Google AI (@GoogleAI)83

    谷歌推出全新AI智能搜索框,支持多模态交互

    谷歌宣布推出基于Gemini 3.5模型的全新智能搜索框。该更新将AI Overviews与AI Mode整合为统一的AI搜索体验,支持对文本、图像、文件及视频进行跨模态推理查询。用户可进行多轮对话,搜索将结合上下文提供更个性化、定制化的回答。该新功能已在全球桌面和移动设备端同步上线。

    推荐理由:Google搜索史上最大一次交互变革,Gemini 3.5加持的搜索框能理解文本、图片、视频,AI Overviews和对话模式彻底融合,搜索终于变成真正的对话助手。

  5. X:OpenAI (@OpenAI)67

    OpenAI推出长期算力保障服务

    推出 OpenAI Guaranteed Capacity:一项新服务,让客户能够保障长期获取 OpenAI 算力。 我们已在基础设施、合作伙伴关系和容量规划方面进行了长期投资,以帮助客户可靠地扩展。 现在,Guaranteed Capacity 帮助客户在算力受限的环境中提前规划关键工作负载。 http://openai.com/guaranteed-capacity

    推荐理由:OpenAI 开始卖「算力期货」了,在 GPU 抢破头的当下,能锁定长期计算容量对做模型服务的公司是定心丸。

  6. X:Gemini (@GeminiApp)68

    GoogleIO发布多项Gemini更新

    我们在#GoogleIO上宣布了多项Gemini更新,包括: - 采用神经表达技术的全新Gemini体验设计 - 即将推出的Gemini智能体功能,含每日简报与Gemini Spark - Gemini Omni与3.5 Flash模型 - 以及更多内容! 详情请见此线程🧵

    推荐理由:Google IO上Gemini这波更新,从Neural Expressive到代理体验,是在把AI助手往主动帮你做事的方向推,产品人和开发者该认真看看。

  7. X:Google DeepMind (@GoogleDeepMind)72

    Gemini Omni助力Google Flow创作电影级故事

    Google Flow 🤝 Gemini Omni 使用我们的最新模型创作更具电影感的故事,它带来了批量编辑、改进的角色一致性等功能。以下是@FlowbyGoogle的其他新功能 → https://goo.gle/42K2nge #GoogleIO

    推荐理由:Google Flow 终于把批量编辑和角色一致性拉上来了,对做视频内容的人能省不少事,虽然不算颠覆性的代际更新,但实用度提升明显。

  8. X:Gemini (@GeminiApp)72

    Google推出每日简报个性化摘要功能

    Daily Brief是一项新的个性化摘要功能,旨在成为您每天早晨的首选信息来源。 它从您的收件箱、日历和任务中收集信息,进行优先级排序、整理,并在专为快速浏览设计的超简洁晨间摘要中为您建议下一步行动。#GoogleIO

    推荐理由:Google 终于把 Gemini 往真正的个人助理方向推了一步,整合邮件、日历、任务的每日摘要,如果执行到位会抢掉很多人的早晨首页。

  9. Google Blog:AI(RSS)74

    Google AI 订阅服务全新内容,源自 I/O 2026 大会

    Google 在 I/O 2026 大会上宣布更新其 AI 订阅服务,推出了全新的 100 美元“AI Ultra”计划。同时,面向 Google AI Plus、Pro 和 Ultra 三个层级的现有订阅者,服务均增加了新的功能和权益。此次更新标志着 Google 在 AI 付费订阅领域推出了更高端的选项并强化了现有套餐的价值。

    推荐理由:Google 在 I/O 上推出 $100 的 AI Ultra 计划,这是大厂把 AI 订阅当成‘基础套餐’来卖的信号,虽然细节还不算多,但想知道 Google AI 付费版最新整合的可以进去看一眼。

  10. Google Blog:AI(RSS)75

    Google Workspace 推出全新创建方式与高效工作功能

    Google 在最新更新中为 Gmail、Docs 和 Keep 增添了新的语音功能,并推出了一款名为 Google Pics 的全新设计工具。同时,其 AI Inbox 功能也得到了升级与优化。这些更新旨在进一步提升用户在工作场景中的协作效率与创作体验,通过集成更智能的工具和交互方式,帮助用户更便捷地完成多项任务。

    推荐理由:Google Workspace 直接植入了语音操作和设计工具 Pics,这波更新对办公效率很实在,做产品和运营的可以关注一下实际落地效果。

  11. Google Blog:AI(RSS)70

    AI搜索的新时代

    谷歌宣布了其搜索引擎与AI技术融合的最新进展,标志着AI搜索进入新阶段。此次更新旨在将搜索引擎的广度与AI的深度理解能力相结合,目标是提供更智能、更直观的搜索体验,推动搜索技术的下一代演进。

    推荐理由:Google搜索宣称开启AI新纪元,但这次官宣只放了张图没给干货,搜索入口的任何变动都牵动流量,值得跟踪但别急着判断。

  12. X:Gemini (@GeminiApp)67

    Google AI Ultra套餐降价并新增档位

    我们将顶级Google AI Ultra套餐的价格从每月250美元降至200美元,并推出新的每月100美元Ultra套餐档位。 这个新套餐解锁了比Pro套餐高5倍的Gemini应用使用限额,助您加速编程与创作。它还包括新功能抢先体验、20TB存储空间、@YouTube Premium等更多权益。适用条款。https://goo.gle/4wEuFGK #GoogleIO

    推荐理由:Google 把顶级 AI 订阅门槛压到 $100/月,还捆着 YouTube Premium 和 20TB 云存储,这是用互联网式捆绑法打 AI 价格战,对重度用户吸引力不小。

  13. X:Gemini (@GeminiApp)74

    Gemini Spark:全天候自主AI助手

    Gemini Spark 是你的新全天候个人AI代理。 给它一个任务,它会在后台自主工作,即使你的手机和笔记本电脑已关机。你选择启用它,它被设计为在执行重大操作前会先征询你的意见。#GoogleIO

    推荐理由:Google把AI代理做成了24/7在线的背景进程,手机关机也不停,这是从对话助手到自主执行的一步大跨越,对普通人来说,真正的虚拟助理可能要来了。

  14. X:Krea AI (@krea_ai)73

    Krea 2深度解析与使用指南

    Krea 2深度解析。 学习如何使用风格参考、情绪板,以及如何用Krea 2进行提示。

    推荐理由:Krea 2 正式全量发布,这个 deep dive 把风格参考和情绪板玩法讲得很透,做视觉内容的朋友今天就能用上。

5月19日周二
  1. X:OpenRouter (@OpenRouter)68

    OpenRouter工具调用模型现可自主进行网络搜索

    OpenRouter上的任何工具调用模型现在都可以自主调用网络搜索和网页抓取功能。 模型可以自行决定何时搜索、搜索什么以及搜索次数。 我们新增了@p0作为新的网络搜索提供商。了解更多:https://openrouter.ai/announcements/agentic-web-tools

    推荐理由:OpenRouter 把 agentic web search 变成了开关,模型决定何时搜索。对于还在自己搭搜索管道的开发者,这是官方偷懒答案。

  2. Apple:Newsroom(RSS)57

    苹果发布全新辅助功能,并引入Apple Intelligence进行更新

    苹果公司宣布推出由Apple Intelligence驱动的重大辅助功能更新。此次更新为VoiceOver、放大镜(Magnifier)和语音控制(Voice Control)功能引入了新的能力,旨在提升残障用户设备的可用性。这是苹果首次将Apple Intelligence应用于其辅助功能技术组合。

    推荐理由:Apple Intelligence为无障碍功能带来自然语言交互和更智能的视觉辅助,是不错的方向,但全是远期承诺,现在还不能上手。