跳到正文

全部动态

今日 0 条
6月3日周三
  1. X:OpenRouter (@OpenRouter)68

    DigitalOcean AI云服务上线OpenRouter

    ⚡ 新增服务商:DigitalOcean 的 AI-Native Cloud 现已在 OpenRouter 上线。 提供高性能推理,覆盖热门开源权重模型。在 DeepSeek V3.2 的输出速度和延迟方面排名第一(数据来自 @ArtificialAnlys)。 查看其数据并试用模型:https://openrouter.ai/provider/digitalocean

    推荐理由:OpenRouter 新上线的 DigitalOcean 推理服务,把 DeepSeek V3.2 的延迟压到了全场最低,比官方还快,做实时应用的值得立刻切过去试一下。

6月2日周二
  1. X:面壁智能 OpenBMB (@OpenBMB)67

    MiniCPM-V 4.6 现已支持 vLLM v0.22.0

    MiniCPM-V 4.6 现已完全支持 vLLM v0.22.0! 无需自定义分支,无需额外编译。 只需拉取预构建包即可运行。 非常感谢 @vllm_project 的顺畅集成! 🤝 🤗 http://huggingface.co/openbmb/MiniCPM-V-4.6

    推荐理由:MiniCPM-V 4.6 现在 vLLM 原生支持,不用自己折腾编译和环境了,做多模态部署的可以无痛接入,国产端侧模型生态又往前走了一步。

  2. X:ChatGPT (@ChatGPT)71

    ChatGPT 新增长文编辑与保存功能

    长文写作需要更多空间。 现在你可以在全屏模式下编辑更长的文章,并将其保存到你的资料库中,以便稍后继续。

    推荐理由:ChatGPT 终于给了长文用户一个全屏编辑和保存库,这功能不性感但实打实解决痛點,写过万字稿的人都知道多重要。

  3. X:Logan Kilpatrick (@OfficialLoganK)79

    Google AI Studio 新增 Gmail 等应用构建能力

    我们刚刚上线了在 @GoogleAIStudio 内直接构建连接 Gmail、Drive、Sheets 等应用的功能,无需跳转其他网站,你可以直接在 AI Studio 内添加测试人员,完整的公开分享功能即将推出!!

    推荐理由:Google AI Studio 直接打通 Gmail、Drive 和 Sheets,不用跳出就能构建应用并邀请测试者,对习惯 Google 生态的开发者来说省了一大截时间,下次做原型可以试试。

  4. X:Replit (@Replit)73

    Replit 用单个提示词构建完整业务

    你能用单个提示词免费构建一个真实的业务吗? 从今天起,在 Replit 上,答案是肯定的。 从一个提示词开始,获得一个网站、移动应用、幻灯片和发布视频。 此外,还能解锁使用 @stripe @atlas, @QuickBooks, @mercury & @doolaHQ 运营业务的福利。

    推荐理由:Replit 从写代码进化到了‘一个提示生成网站+App+PPT+视频’,还串起了 Stripe 和 QuickBooks,‘建个生意玩玩’的成本降到史低,产品人和独立开发者值得试。

  5. X:Perplexity (@perplexity_ai)70

    Perplexity发布Search as Code搜索架构

    推出Search as Code,我们为AI智能体打造的全新搜索架构。 它直接编写Python代码调用我们的搜索栈,而非逐个循环函数调用。 现已在Perplexity Agent API中提供,并成为Computer的默认选项。 https://research.perplexity.ai/articles/rethinking-search-as-code-generation

    推荐理由:Perplexity这次更新把Agent搜索从函数调用链改成直接生成Python代码,思路简洁有效,API开发者应该能立刻感受到token和延迟的下降,可以在Computer里试一下默认效果。

  6. Claude:Blog(网页)77

    Claude Code 新增动态工作流功能

    Claude Code 新增动态工作流功能,允许模型在运行时即兴创建和协调多智能体框架来处理复杂任务。该功能通过执行特定的 JavaScript 文件来生成和协调拥有独立上下文窗口的子代理,可解决单一上下文窗口中长时间执行任务可能出现的智能惰性等问题。工作流适用于研究、安全分析、代码审查等场景,通常消耗更多 token,更适合高价值复杂任务,其最佳实践仍在发展中。

    推荐理由:Claude Code 现在能自己动态生成多代理协调器,这在调试、审查、研究等复杂任务上是个真正的生产力跃迁,但普通编码工作用它反而是杀鸡用牛刀。

  7. Cognition 模型 / Devin 博客(网页)65

    Cognition 推出 Devin Desktop,作为 Windsurf 的下一代产品

    Cognition 宣布推出 Devin Desktop,定位为 Windsurf 的下一代产品,将 Agent Command Center 设为 IDE 默认界面,可在一处管理本地和云端智能体、PR 和上下文。

    推荐理由:官方说明把 Agent Command Center 设为默认界面并开放 ACP,读者可以判断团队向智能体管理迁移时的具体工作流变化。

6月1日周一
  1. X:OpenRouter (@OpenRouter)77

    Auto Router 新增成本质量权衡参数

    Auto Router 现在允许你调整其在成本与质量之间的权衡。 新增 `cost_quality_tradeoff` 参数,范围 0 到 10: 设为 0 时,它总是选择最强大的模型,无论价格如何。设为 10 时,最便宜的模型胜出。

    推荐理由:OpenRouter 给 Auto Router 加了成本质量权衡参数,0 到 10,0 是最强模型不管价格,10 是便宜模型优先。做 AI 产品想自己控制成本线,这个参数比只靠自动判断实用很多,值得细调。

  2. X:面壁智能 OpenBMB (@OpenBMB)78

    OpenBMB发布UltraData两大开源数据集,登顶HuggingFace趋势榜

    OpenBMB联合清华NLP与Modelbest发布两个开源数据集:Ultra-FineWeb-L3(预训练合成数据)包含600B+ tokens(超400B英文、200B+中文),是迄今最大开源中文预训练合成数据集;UltraData-SFT-2605(后训练SFT数据)包含15M+样本,是中国首个开源且包含思考与非思考标注的大规模SFT数据集,覆盖数学、代码、知识和指令遵循。两者均基于UltraData L0-L4框架构建,并在MiniCPM5-1B训练中完成验证。数据集已在HuggingFace免费开放。

    推荐理由:面壁开源了两个王炸数据集,预训练的 600B+ token 中文合成数据史上最大,SFT 那边 1500 万条带思考链的指令更是头一回见,做中文基础模型的可以无脑下载了。

  3. X:腾讯混元 (@TencentHunyuan)73

    腾讯混元发布智能体长期记忆插件Hy-Memory

    腾讯混元正式发布专为OpenClaw等长期协作智能体(Agent)设计的记忆插件 Hy-Memory。它基于6层记忆框架、System1/System2双系统与三层进化链构建,旨在成为智能体的“第二大脑”。该插件解决了记忆碎片化问题,实现了显著性能提升:记忆数量减少70%以上,单条记忆信息密度提升45%以上,在超长上下文场景中token消耗降低35%,记忆更新速度提升20%。

    推荐理由:腾讯混元给Agent做了个记忆插件,声称能减少70%冗余记忆并提升密度,还直接支持OpenClaw,对正在踩坑Agent长期记忆的团队是个现成的实验品。

  4. Cursor Blog64

    Cursor Teams计划定价方案更新

    Cursor Teams计划推出三项更新:增加Composer特定使用池,将第一方模型(Composer和Auto)与第三方API的使用额度分开计费;推出Premium席位,提供5倍于标准席位($40/月)的使用量,价格为$96/月(年付);仪表盘现可实时显示用户额度使用情况,管理员可通过Slack或邮件配置智能提醒。

    推荐理由:Cursor这个定价更新把「用不用得起第三方模型」的问题从团队开支里切出去了,标准席位加量不加价,重度用户直接上Premium可能比现在更划算,做Agent开发的团队不妨算算账。

  5. X:Satya Nadella (@satyanadella)65

    微软携手NVIDIA发布RTX Spark加速Windows智能

    我们的目标是通过Windows,为每个家庭和每张办公桌提供无限制的智能。 NVIDIA RTX Spark 标志着朝着这一愿景迈出的真正突破。 期待在本周的Build大会上,与从台湾现场连线的黄仁勋分享更多内容!

    推荐理由:微软+NVIDIA 的 RTX Spark 合作,把无计量智能塞进 PC,AI 从云到桌面的实质性一步,Build 大会值得蹲。

  6. OpenRouter:Announcements(RSS)71

    OpenRouter 5月发布亮点:语音与转录API、模型融合及20款新模型

    OpenRouter 发布5月更新,推出语音与转录API、模型融合功能、私有模型支持和企业工作区控制,并新增20款模型,包括Gemini 3.5 Flash和Claude Opus 4.8。

    推荐理由:OpenRouter 这次月度发布把安全护栏、多模型融合和语音 API 全补上了,Model Fusion 和 Pareto Code Router 对做 agent 的团队尤其实用,成本控制与质量权衡变得更直接。

  7. OpenRouter:Announcements(RSS)77

    OpenRouter 5月发布亮点

    OpenRouter 发布5月更新,推出语音与转录API、模型融合(Model Fusion)功能,并为平台添加了私有模型和企业工作区管控能力。此次更新共上线20个新模型,其中包括 Gemini 3.5 Flash 和 Claude Opus 4.8。

    推荐理由:OpenRouter 五月交付了一整套平台级能力,从安全护栏到语音 API 再到模型融合,Pareto Code Router 按质量阈值选廉价模型这个思路,对 coding agent 的成本控制很实用。如果你重度依赖 OpenRouter,这次更新值得细读。

5月31日周日
  1. X:Tibo (@thsottiaux)65

    Codex用量限制已重置,可尽情使用

    所有付费ChatGPT订阅用户的Codex使用限制已重置。您现在应恢复至每周100%和每小时100%的限额。 让token今天创造不可思议的事,玩得开心。

    推荐理由:Codex 额度重置对重度用户是刚需信号,之前频繁撞墙的痛点被解决,今天可以放心跑长任务。虽然只是策略调整,但比多数模型更新更实在。

  2. X:Sam Altman (@sama)75

    OpenAI发布生物防御AI工具Rosalind

    我们希望帮助世界在生物防御领域抢占先机:

    推荐理由:OpenAI 跨入生物防御,用 AI 提前预警和应对疫情威胁,这不只是技术问题,更关乎社会韧性,值得每个关注 AI 安全的人认真读一下。

5月30日周六
  1. X:OpenRouter (@OpenRouter)72

    ComfyUI现已支持OpenRouter模型直接调用

    现在你可以直接在ComfyUI工作流中使用你的OpenRouter模型了! [引用 @ComfyUI]:ComfyUI刚刚添加了@OpenRouter支持。 你不再局限于单一的大语言模型,现在可以直接在Comfy中访问20多个模型。 更多灵活性,更少摩擦,同样的工作流。 工作流链接在下方👇

    推荐理由:ComfyUI 首次直接集成 LLM 路由服务,等于给图像管线加了个「外挂大脑」,做自动化工作流的人可以直接在节点里调用 20+ 模型,省掉一堆 API tinker 环节。

  2. X:Greg Brockman (@gdb)75

    Codex可自主管理对话线程与并行任务

    Codex用于管理Codex界面: [引用 @guinnesschen]:如果你厌倦了管理Codex对话线程,就让Codex自己管理自己吧!Codex现在可以创建对话线程、搜索它们、整理它们、固定重要的线程,并为并行任务启动工作树。

    推荐理由:Codex 能自己管理线程、搜索、组织了,长期在终端里干活的开发者会明显减少上下文切换,这是把 AI 助手往主动管理推了一步。

  3. X:Greg Brockman (@gdb)72

    ChatGPT长对话新增目录导航功能

    为每个始于“就问一句”却演成长篇大论的ChatGPT对话:目录功能现已上线。 适用于包含5条以上回复的对话。

    推荐理由:看似微型更新,但所有在ChatGPT里做过复杂项目的用户都懂,长对话的‘搜索靠翻’终于有了一个省心解法。

  4. X:ChatGPT (@ChatGPT)69

    ChatGPT对话目录功能现已上线

    对于每个始于“就问一件事”却演变成完整长篇的ChatGPT对话:目录功能现已推出。 适用于包含5条以上回复的对话。

    推荐理由:ChatGPT 终于给长对话加了目录,这个功能早该有了。如果你经常跟 ChatGPT 拉扯几十轮,现在可以不用疯狂滚屏了,直接跳转关键节点。

  5. Claude Code:GitHub Releases(RSS)67

    v2.1.157 更新

    此版本主要改进了插件系统,现可自动加载 `.claude/skills` 目录中的插件,并通过 `claude plugin init` 创建;`/plugin` 命令增加了自动补全。`claude agents` 现在会应用 `settings.json` 中的 `agent` 字段,并支持 `--agent` 参数覆盖。更新修复了多个具体问题,包括处理不可用图片导致的崩溃、在 tmux 中的剪贴板复制失效(2.1.153 回归)、后台会话恢复后日期不正确等。此外,优化了长对话及恢复对话的性能,并改进了在 VS Code、Cursor 和 Windsurf 等 IDE 中的体验。

    推荐理由:Claude Code 这个版本把插件从市场限制中解放出来,自动加载本地 skills 目录,对喜欢自己鼓捣定制工作流的开发者是个实实在在的便利。

  6. X:Runway (@runwayml)72

    Runway API持续扩展模型与端点支持

    我们持续为 Runway API 添加新模型和端点,以便您能将最佳生成能力直接集成到应用、产品和平台中。通过 Runway API,您可以在一个地方获得所需的所有模型,包括 Seedance 2.0、GPT Image 2、HappyHorse 1.0、Nano Banana Pro、Magnific Precision Upscaler V2 等更多内容。请通过下方链接开始使用。

    推荐理由:Runway API 这次集中上新,Seedance 2.0 加入虽然方便了开发者,但没有模型能力的质变,更像是生态补全。

  7. X:Gemini (@GeminiApp)74

    Gemini Omni可将草图变为现实

    Gemini Omni甚至能将简单的草图变为新的现实。 在Gemini应用中亲自尝试。上传一段有人画圆的视频,然后输入这个提示词:当我画完这个圆时,它变成了___。

    推荐理由:Google 把「画个圈然后说变什么」做成了真功能,创意交互的门槛又低了,普通用户随手就能玩,但本质是锦上添花,不是核心能力跃迁。

  8. X:Claude Devs (@ClaudeDevs)68

    Opus 4.8支持对话中途添加系统指令

    使用 Opus 4.8,您可以在对话中途添加系统指令,而不会破坏提示词缓存。 更多缓存命中意味着您的 API 请求成本更低、延迟更小。

    推荐理由:一个小而实用的缓存优化,中途加系统指令不再清空上下文,用 Claude API 的开发者直接省下一大笔 token 开销。

  9. X:Greg Brockman (@gdb)71

    Codex Windows端重大升级,支持计算机操作与移动端协同

    Codex 用户在 Windows 上迎来重大升级: 现在计算机操作功能已在 Windows 上可用,Codex 可以在你的 Windows 电脑上执行操作。 同时,ChatGPT 移动应用中的 Codex 也支持 Windows,让你可以随时随地启动、审查和引导任务,而工作则在你的 Windows 机器上继续进行。 这是一次早期体验,但我们正在努力提供更多方式,让你无论身在何处都能保持工作推进。

    推荐理由:Codex终于能在Windows上操控电脑了,搭配手机App就能远程指挥任务,这对用Windows写代码的开发者是个实用升级,虽然还是早期体验,但跨设备协同的雏形已经出来了。

  10. X:OpenAI (@OpenAI)73

    Codex现已支持Windows端计算机使用功能

    Windows用户,这条消息是给你的。 计算机使用功能现已在Windows上可用,因此Codex可以在你的Windows电脑上执行操作。 通过ChatGPT移动应用中Codex的Windows支持,你可以在工作继续在Windows电脑上进行时,随时随地启动、审查和引导任务。 这是一项早期体验,但我们正在努力提供更多方式,让你的工作无论身在何处都能持续进行。

    推荐理由:Windows 用户终于等到 Codex 能直接操控电脑了,配合手机端协同一气呵成,虽然还早期,但已经把 AI 真正带进日常工作流里。

  11. OpenRouter:Announcements(RSS)77

    OpenRouter融合预算模型性能超越GPT-5.5与Claude Opus 4.7

    一组预算模型通过OpenRouter平台进行模型融合,在包含100个复杂研究任务的评估中,得分超过了GPT-5.5与Claude Opus 4.7。

    推荐理由:OpenRouter 的 Fusion 功能把模型融合做成了 API 调用,实测用便宜模型组合就能逼近 Fable 5 的性能,成本却只有一半,这对做复杂推理和深度研究的开发者来说是个很实用的新工具。

  12. X:Replit (@Replit)73

    Replit Canvas:对话式设计与原型生成工具

    你试过新的 Replit Canvas 了吗? - 探索多种设计方向 - 通过与设计框架对话来调整设计 - 设计 UI 原型并将其转换为应用 - 为社交媒体创建营销素材

    推荐理由:Replit 这次把设计到代码的链条打通了,虽然不是革命性突破,但对用 Replit 做产品的开发者来说,省掉了从 Figma 到代码的来回折腾,可以试试。

  13. X:OpenRouter (@OpenRouter)72

    OpenRouter支持模型生成文件补丁

    OpenRouter 现已支持 "apply_patch",这是一个服务器工具,允许任何模型通过 Responses API 使用 V4A diffs 提出文件编辑建议。 模型生成一个补丁(创建、更新或删除文件)。OpenRouter 在服务器端验证 diff 语法。

    推荐理由:OpenRouter 这个 apply_patch 解决了多模型文件编辑的碎片化,任何模型接上就能出 diff,做 coding agent 的可以少写一堆适配代码。

5月29日周五
  1. OpenRouter:Announcements(RSS)70

    OpenRouter Guardrails 发布:可配置安全与治理工具,保护 AI 智能体、数据与成本

    OpenRouter 推出 Guardrails,一套可配置的安全与治理工具,支持预算执行、零数据保留、模型与提供商限制、提示词注入防御及数据丢失防护等策略,用于保护 AI 智能体、数据和成本。

    推荐理由:OpenRouter 这波补上了 API 代理的安全短板,提示注入防御和 DLP 直接堵住了企业用户最担心的两个口子,配置方式也足够灵活,做 agent 的团队值得立刻上。

  2. OpenRouter:Announcements(RSS)69

    Guardrails:保护你的智能体、数据与成本

    Guardrails 是一套可配置的安全与治理工具,提供预算执行、零数据保留、模型与提供商限制、提示词注入防御及数据丢失预防等功能,旨在保护智能体(Agents)、数据与控制成本。

    推荐理由:OpenRouter 把预算管控、注入防御和敏感信息脱敏打包成一套 guardrail 配置,让投喂给 Agent 的流量有了护栏,用 OpenRouter 做生产级应用的团队可以立刻用上,不用自己搞中间件。

  3. IT之家(RSS)70

    阿里云开源百炼 CLI,Agent 可调用全套模型和应用能力

    阿里云宣布百炼核心能力已 CLI 化,仅需一行命令即可让 Agent 接入百炼的 150 多款模型、十多款应用及知识库、记忆、联网搜索等能力。该 CLI 专为 Agent 设计,原生支持 Claude Code、Qoder 等主流框架,已在 GitHub 开源,支持多模态模型调用、Workflow 调用与结构化输出。

    推荐理由:阿里云把百炼的全套能力打包成 CLI,Agent 开发终于不用再一个个接 API 了,做企业智能助手的可以试试。

  4. Simon Willison 博客72

    llm-anthropic 0.25.1

    llm-anthropic 发布 0.25.1 版本。主要更新包括:新增 Claude Opus 4.8 (`claude-opus-4.8`) 模型;为账户启用了该功能的组织新增了 `-o fast 1` 选项以使用快速模式;调整了各模型的默认 `max_tokens` 值,使其直接使用模型的最大输出长度,而非固定的 8,192。

    推荐理由:Simon 的 llm 插件第一时间支持了 Claude Opus 4.8,如果你用他的 CLI 工具切换模型,这次更新能让你马上用到新模型和 fast mode。

  5. X:OpenRouter (@OpenRouter)68

    别只看基准测试,要看全面表现

    不要只依赖基准测试;要看全面情况! 试试我们的新比较页面,它还能让你可视化模型性能:https://openrouter.ai/compare/openai/gpt-5.5/anthropic/claude-opus-4.7/anthropic/claude-opus-4.8

    推荐理由:OpenRouter 这个对比页把 GPT-5.5 和 Claude Opus 4.8 的胜负判断从 benchmark 拉到实际测试,对选型的人很有用。

  6. X:Replit (@Replit)74

    Replit Canvas:智能体设计工具发布

    最好的设计工作不会在聊天框里发生。你需要空间来探索想法、创建变体并进行迭代。 认识新的 Replit Canvas。 你的智能体设计工具,用于构建精美的网站、应用、营销资产等。

    推荐理由:Replit 终于在对话之外给了设计师一个能迭代的画布,把 Agent 直接塞进设计工具里,对用 AI 做 UI 的人来说比聊天框强太多了。

  7. X:MiniMax (@MiniMax_AI)76

    MiniMax M2.7 免费智能体编程限时开放

    在 @OpenHandsDev 上使用 MiniMax M2.7 进行免费智能体编程? 是的,请给我!限时提供 ⚡👀

    推荐理由:MiniMax把M2.7免费接到OpenHands里跑Agent编码,而且限时,这对个人开发者是实打实的免费用机会,不妨上去跑几个任务体验下性价比。

  8. Claude Code:GitHub Releases(RSS)73

    Claude Code v2.1.154 发布:新增 Opus 4.8 与动态工作流

    Claude Code 更新至 v2.1.154 版本,正式引入 Opus 4.8 模型。新功能包括“动态工作流”,可通过 `/workflows` 指令让 Claude 在后台编排数十到数百个 AI 智能体协同处理复杂任务。Opus 4.8 的快速模式现已可用,成本降低为 2 倍标准费率可实现 2.5 倍速度提升。其他更新有:精简系统提示词成为默认设置(除 Haiku、Sonnet 及 Opus 4.7 及更早版本外),优化多选题决策逻辑,简化 `/simplify` 命令。此次更新修复了包括后台会话管理、终端渲染在内的多个 bug,并增强了自动模式对数据外泄的检测能力。

    推荐理由:Claude Code 这版把多 agent 编排做成了产品功能,动态工作流让一个 prompt 能调度上百个 agent,再加上 Opus 4.8 快速模式只要 2 倍价格,做复杂任务的开发者可以试一下。

5月28日周四
  1. TechCrunch:AI(RSS)72

    Sesame,这家由Oculus创始人创办的对话式AI初创公司,发布其iOS应用

    由Oculus创始人创办的AI初创公司Sesame发布了其iOS应用,该应用将对话式AI智能体带给公众。应用提供更自然的来回交互体验,设计上区别于传统聊天机器人,旨在让用户感觉更像在和真人对话。

    推荐理由:Oculus创始人做的对话AI,交互设计大概率能看到一些VR时代的人机直觉。虽不是大模型层创新,但产品体验可能重新定义什么样的对话才叫自然。