跳到正文

全部动态

今日 29 条
8月18日周二
  1. Replit:Blog(RSS)60

    Replit 推出黑盒渗透测试功能

    Replit 推出黑盒渗透测试(black-box pen tests),像外部攻击者一样通过网络和浏览器测试应用,不接触源代码,与现有白盒扫描互补。Level 3 扫描会在私有沙箱中并行运行两种扫描,黑盒代理先无账号访问,再以普通登录用户身份越权尝试。官方称两类扫描发现的问题很少重叠,例如白盒发现被吊销权限的用户仍可操作,黑盒则发现无登录的猜得到地址的管理后台。

    推荐理由:原文给出黑白盒扫描的实测分工差异和入口,读者可以据此判断自己的应用适合哪种安全检查方式。

8月17日周一
  1. 蚂蚁 inclusionAI:GitHub 新仓库64

    inclusionAI 开源 ConceptEdit:基于概念缩放与密集监督的图像编辑数据生成管线

    蚂蚁集团 inclusionAI 开源 ConceptEdit,一个基于概念缩放与密集监督的图像编辑数据生成管线。该管线通过三阶段流程(VLM 生成指令、FLUX 执行编辑、VQA 评估筛选)构建大规模、基于分类法的图像编辑数据集,并提供单概念与多概念两种变体。项目采用 MIT 许可证,支持断点续跑,需 OpenAI 兼容 VLM 端点与本地 FLUX 检查点。

    推荐理由:流水线把图像编辑数据生成拆为指令生成、FLUX 编辑、VLM 评判三步,多概念版本将多个并行编辑合并为一条指令并支持断点续跑,为构建带质检的编辑训练数据提供可复用框架。

8月14日周五
  1. Google Blog:AI(RSS)61

    Google Sheets 推出 Sheets canvas:用 Gemini 将表格数据变为交互式迷你应用

    Google Sheets 发布新功能 Sheets canvas,基于 Gemini 构建,用户只需用自然语言提示词即可将表格数据转化为交互式仪表盘、学习追踪器、座位表等“迷你应用”。

    推荐理由:与单独 BI 工具不同,Sheets canvas 直接在原表上生成可读写界面,临时仪表盘能沿用表格的共享和权限体系,降低轻量场景的搭建成本。

8月13日周四
  1. X:硅基流动 SiliconFlow (@SiliconFlowAI)67

    Qwen3.8-2.4T-A95B 开源,硅基流动即日上线

    阿里开源 Qwen3.8-2.4T-A95B,硅基流动已提供 Day-0 支持。该模型拥有 2.4T 参数、95B 激活参数,主打自主编码、深度研究与端到端智能体执行。API 定价为输入 $2.00/百万 token,输出 $6.00/百万 token,缓存输入 $0.25/百万 token。

    推荐理由:缓存输入每百万 token 0.25 美元,让需要反复读取长上下文的 agent 工作流更接近可长期运行,而非只看单次生成价格。

  2. X:DeepSeek (@deepseek_ai)66

    DeepSeek Harness v0.1 开发者预览版发布

    DeepSeek Harness v0.1 现已推出开发者预览版,并以 MIT 许可证开源。该智能体框架基于 Cordis 元框架构建,核心设计为“一切皆插件”,模型、工具、技能、会话、沙箱、文件系统、循环、编排及 UI 均可自由组合、替换和扩展。

    推荐理由:插件化把模型、工具、会话拆成可替换单元,影响在于选择智能体框架时可以从整体选型转为逐组件比较,降低被单一编排方案绑定的迁移成本。

  3. Cursor Blog65

    Cursor 推出 builds:云智能体启动速度提升至 3 倍

    Cursor 推出 builds 功能,在后台持续准备就绪的开发环境副本,让云智能体启动时无需从零搭建,响应速度最高提升 3 倍。内部环境启动快 10 倍,首个 token 生成快 3 倍;智能体始终从最近一次成功的 build 启动,依赖更新或安装脚本出错时不会影响运行。8 月 17 日起所有环境默认启用 builds,无需额外费用。

    推荐理由:把环境准备从每次会话冷启动改为后台持续快照,云代理长任务的启动成本和中断风险降低,为把更多工程流程交给自动代理提供了更可靠的运行基础。

  4. 公众号:数字生命卡兹克65

    WorkBuddy上线远程控制,国内也有了最丝滑的Agent工作方式

    WorkBuddy更新上线远程控制功能,将PC、App和小程序打通,手机端可实时同步电脑端的任务、对话、工作空间和产物,支持一台手机连接多台电脑并随时切换。App需升级至1.2.0及以上,电脑端需升级至5.3.8及以上,连接无需扫码。本次更新还新增资料库(我的文档与团队空间)、Markdown多人共同编辑、AI原生审阅模式,以及将资料库内容生成可发布链接的HTML网站。

    推荐理由:远程控制把 Agent 任务从电脑旁解放到手机上,连接和多设备切换比 Codex 更省事,对国内依赖 Agent 处理长任务的用户直接降低了使用门槛。

  5. Artificial Analysis 完整文章(网页)66

    Artificial Analysis 发布 Optima 平台,支持为自有场景定制模型基准

    Artificial Analysis 发布 Optima 平台,让用户基于自己的工作负载为模型构建定制基准,并对比性能、速度与成本效率。

    推荐理由:官方介绍其自建基准平台的三种构建方式和成本时间对比维度,读者可据此评估能否用它为自己的工作流选模型。

8月12日周三
  1. Sierra Blog21

    Sierra Horizon 智能体:跟进就是成交

    Sierra 的 Horizon 智能体为每位潜在客户配备一名长时 AI 智能体,可跨数天、数周甚至数月持续跟进,直到客户购买或放弃。车险案例中,AI 智能体 Jamie 在第 1、4、7 天用短信和电话跟进 Anne,当晚促成投保。沟通内容(已批准报价、下一步、保障细节)由企业掌控,每次对话积累的客户上下文归企业独有。

  2. X:OpenRouter (@OpenRouter)72

    Meta 开源 Muse Glimmer 登陆 OpenRouter

    Meta AI 超级智能实验室的首个开放权重模型 Muse Glimmer 已在 OpenRouter 上线! 这是一款 30B 密集文本+图像模型,采用 Apache 2.0 许可证,旨在成为可靠的本地智能体,MCP Atlas 得分 75.5,SWE-Bench Pro 得分 51.2。 https://openrouter.ai/meta/muse-glimmer-30b

    推荐理由:Apache 2.0许可和两项代理基准得分,为评估30B规模本地开源模型是否达到生产可用提供了直接参照,分数分别指向工具调用和编码能力。

  3. Hacker News 热门(buzzing.cc 中文翻译)73

    Mojo 1.0 正式发布:为生态系统增长提供稳定基础

    Mojo 语言正式发布 1.0 版本,提供稳定、可用于生产环境的语言基础,自 2023 年首次发布以来已发展成通用语言。自开源标准库以来,近 200 名贡献者合入超 1,100 个拉取请求,改动超 200,000 行代码。

    推荐理由:稳定性承诺让 Mojo 成为 AI 基础设施可长期选用的语言基础,lambda 语法和内存安全诊断减少了日常开发阻力,对 MAX 生态项目直接降低维护成本。

  4. X:Runway (@runwayml)72

    Runway Seedance 2.5 上线,支持50角色参考

    完整阵容,完整曲目,一次生成一个。 Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以及最长 30 秒、与音乐同步的片段。点击下方链接即可开始使用。

    推荐理由:50个角色参考和音乐同步生成,让批量角色短视频可以一次性设定角色外观并自动配乐,减少了后期对位和角色风格统一的工作。

  5. X:OpenAI Developers (@OpenAIDevs)67

    ChatGPT 桌面端支持导入其他智能体工作数据

    你现在可以将其他智能体的工作内容与 ChatGPT Work 和 Codex 保持同步。 可导入项目、聊天记录、技能和插件,查看导入历史,并可在设置中选择开启自动更新。 现已在 ChatGPT 桌面应用中提供。

    推荐理由:导入外部 agent 项目与技能的功能,降低了在 ChatGPT 工作区集中管理多工具产出的切换成本。

  6. Claude:Blog(网页)65

    Claude in Chrome 侧边栏升级为 Claude Cowork 会话

    Claude in Chrome 浏览器扩展的侧边栏现已升级为 Claude Cowork 会话,对话会保存至历史记录,技能和连接器可在浏览器中工作,且任务可在桌面、网页和移动端应用间无缝切换。

    推荐理由:把浏览器扩展升级为与桌面、网页、移动共享的 Cowork 会话,解决以往侧边栏与主应用上下文割裂的问题,长流程任务可以在不同设备间接力。

  7. Google Cloud:Databases(RSS)72

    Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移

    Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。

    推荐理由:将AI编解能力直接嵌入数据库迁移流程,不同于通用聊天工具,它能感知全量Schema上下文,并保留审查与校验环节,更适合企业级迁移场景。

8月11日周二
  1. X:Unsloth (@UnslothAI)68

    Unsloth Desktop 发布:本地运行和训练模型的开源桌面应用

    Unsloth 发布开源桌面应用 Unsloth Desktop,支持在 Mac、Windows 和 Linux 本地运行和训练模型,已在官网和 GitHub 提供。支持 MLX、扩散图像/视频、音频、GGUF,可连接 Claude Code 和 Codex 到本地 LLM,宣称训练速度提升 2 倍、VRAM 降低 70%,并提供 RAG、MCP、OpenAI 兼容 API 和远程部署等能力。

    推荐理由:官方公布产品的主要能力清单和下载入口,读者可据此评估本地运行与训练模型的实际选项。

  2. 公众号:智谱(GLM)71

    ZCode全面升级:Goal、Subagents、Remote Control与闲时任务四大功能上线

    ZCode针对GLM深度优化,今日上线Goal、Subagents、Remote Control与闲时任务四大功能。在Z.ai Code Bench测试中,GLM-5.2搭配ZCode较搭配Claude Code任务整体通过率高2.39%;ZCode缓存命中率超98%,叠加1.5倍限时额度加成后,GLM Coding Plan整体使用量接近常规额度的1.8倍。

    推荐理由:Goal模式将复杂任务从需要开发者逐轮推动变为设定目标后自行迭代,搭配Subagents并行协作,适合跨文件重构和全栈开发的长流程任务。

  3. Ollama:Blog(RSS)68

    NVIDIA Nemotron 3.5 Lightning 上架 Ollama,可完全本地运行

    NVIDIA Nemotron 3.5 Lightning 现已登陆 Ollama,可完全在本地设备上运行。该模型为 30B 总参数、每 token 仅 3B 激活的混合 MoE 开放模型,面向需要持续运行的智能体任务,支持最高 1M token 上下文,借助 MTP、DFlash 或 DSpark 推测解码获得最高 4x 吞吐提升,并可比同类开源模型快 30% 完成任务。

    推荐理由:原文给出了参数结构、上下文长度、吞吐数据和本地运行入口,读者可以据此判断它是否适合长期运行的本地智能体工作流。

8月10日周一
  1. X:Claude Devs (@ClaudeDevs)69

    Claude Code 自动模式默认开启原理

    我们最近将自动模式设为 Claude Code 的默认选项,这意味着你不再需要批准每一个操作。 但什么决定某个操作是否可以安全运行?看看它是如何工作的:

    推荐理由:视频拆解了 auto mode 的安全判断逻辑,帮用户理解自动执行与仍需人工确认的边界,适合想更高效使用 Claude Code 的开发者校准信任预期。

  2. X:通义千问 / Qwen (@Alibaba_Qwen)71

    Qwen-MM-Plugins 让智能体原生支持多模态

    👀 看见只是开始。 借助 Qwen-MM-Plugins,让你的智能体原生支持多模态——读取图片、视频和文档,编辑视频,处理 3D/CAD,以及更多。 从多模态模型 → 多模态智能体。🚀 观看实际效果:https://github.com/QwenLM/Qwen-MM-Plugins

    推荐理由:让智能体直接获得视觉、文档和 3D 感知能力,把原本需要单独集成的工作流变成一组可调用的插件,原型开发速度可能因此加快。

  3. 公众号:千问APP(阿里)73

    千问开放平台上线:租房、寄快递、查理财等十余领域服务可对话办理

    千问开放平台今日上线,面向生态伙伴和开发者开放手机、PC和AI眼镜三类终端的服务接入,首批覆盖物流运输、房产居住、本地生活、理财、汽车等十多个领域。用户可在对话中@相关服务或点击“圆点角标”进入智能体,完成从咨询、推荐到下单的完整流程。平台支持标准化协议接入、一键授权与端到端调测,并提供账号、AI支付、订单接入等基础设施。

    推荐理由:把快递查询、租房比价、天气建议等高频生活服务接入对话窗口,用户从「问信息」到「下单」不再跳出应用,减少了多任务切换和重复输入的摩擦。

  4. 公众号:数字生命卡兹克61

    我花了54个小时,做了一个可能更公平的AI大模型排行榜。

    作者耗时54小时开发并免费开放了一个聚合多家可信榜单的AI大模型综合排行榜LatentRank。该榜单采用Bradley-Terry成对比较算法,并加入先验限制小样本结果,以解决不同榜单规模、领先幅度和模型缺失带来的评分偏差。目前榜单前五名中,Opus 5超过Fable 5位居前列。

    推荐理由:聚合榜单的难点在于不同榜的排名含金量不可比,作者用 Bradley-Terry 模型将问题转为成对比较,为评估模型综合能力提供了比简单平均更合理的框架。

  5. Hacker News 热门(buzzing.cc 中文翻译)70

    OpenChamber:一个基于代理的开发环境

    OpenChamber 是一个基于代理的开发环境,可跨桌面、浏览器、手机和 VS Code 使用,支持会话目标、多模型并行运行与融合、变更走查、从 issue 到 PR 的完整流程及定时任务。该工具基于 OpenCode SDK,完全开源且免费,代码和会话内容均保存在本地,远程访问可通过 UI 密码和端到端加密的 Private Relay 保护。

    推荐理由:将多模型并行、日程化任务和跨设备工作区整合到同一界面,减少了切工具的时间,适合需要在多个 AI 代理间协调的开发者。

  6. Ollama:Blog(RSS)78

    Meta Superintelligence Labs 首个开源模型 Muse Glimmer 上线 Ollama

    Meta Superintelligence Labs 首个开源模型 Muse Glimmer 现已在 Ollama 提供,为 30B 多模态模型,主打本地智能体工作负载,上下文长度 128K+,采用 Apache 2.0 许可。

    推荐理由:原文给出模型规格、本地接入命令和 Apple Silicon 性能数据,可帮助读者判断该开源模型能否承接本地编码与智能体工作流。

8月9日周日
  1. IT之家(RSS)72

    OpenAI 桌面端 ChatGPT 上线语音交互功能,可语音操控电脑执行多步骤任务

    OpenAI 更新 ChatGPT 桌面应用,新增对 ChatGPT Voice 的支持,用户可直接通过语音对话控制 AI 智能体并让其在电脑上执行任务。该功能基于全新语音模型系列 ChatGPT-Live,支持 ChatGPT Work 和 Codex,在 macOS 上还可借助 Appshots 访问屏幕内容。

    推荐理由:桌面端语音不再只是对话,演示中一条指令完成创建线程、提PR和定位Bug,语音开始成为开发者工作流中的可执行指令层。

  2. X:Elon Musk (@elonmusk, xAI)66

    Grok Imagine 图像编辑迎来重大升级

    Grok Imagine 图像编辑功能重大升级 [引用 @XFreeze]:你可以直接悬停在 Grok Imagine 中的任意特定区域,并即时进行编辑

    推荐理由:悬停选中并即时编辑把图层和遮罩等概念替换为手势,降低了图像修改的操作门槛。

8月8日周六
  1. IT之家(RSS)76

    苹果 Mac 简体中文支持文档更新,“Apple 智能”阿里千问扩展现身

    苹果官网 Mac 简体中文使用手册新增《在 Mac 上配合 Apple 智能使用千问》支持文档,明确 Apple 智能可配合阿里巴巴千问模型工作。千问扩展适用于 macOS 26.6 或更高版本,需中国大陆 Apple 账户及机型,支持写作工具与 Siri,用户需登录千问账户使用。

    推荐理由:苹果智能在中国大陆的落地路径终于清晰,支持文档揭示了写作工具和Siri集成千问的具体方式,Mac用户将能在系统级直接使用大模型能力。

  2. X:Greg Brockman (@gdb)71

    ChatGPT 发布 GPT 5.6 Sol 与 Luna 新模型

    ChatGPT 团队本周发布多项更新:付费用户将获得 GPT 5.6 Sol 模型,支持通过滑块调节推理深度;免费用户将获得 GPT 5.6 Luna 并享受无限文本消息。此外还改进了网页编辑器格式保留、Android 相机速度,并支持在语音体验中上传文件提问。

    推荐理由:推理深度滑块把算力分配交给用户,对需要精细控制推理时长与成本的流程更有用,免费无限消息则解除了日常对话量限制。

  3. X:Claude Devs (@ClaudeDevs)73

    Claude Code 会话间可互发消息

    Claude Code 新功能:你的会话现在可以互相发送消息了。 无需在另一个会话中重新解释自己,你现在可以让 Claude 代为传达。它会发送一份摘要(而非你的历史记录或文件),另一个会话会在任务进行中接收该摘要。

    推荐理由:跨会话传递上下文不再是复制粘贴,摘要消息让多个并行任务间保持连贯成为可能,降低了开发者维护长流程的心智负担。

  4. Hacker News 热门(buzzing.cc 中文翻译)77

    Kitesurf:一款在 V8 隔离环境中运行的“代理优先”浏览器

    Cloudflare 推出 Kitesurf,一款专为 AI 智能体设计的浏览器,完全运行在 Workers 上,基于 V8 隔离环境,现已在 Browser Run 中免费开放测试。

    推荐理由:Kitesurf 将浏览器重新设计为无状态、隔离的 Agent 引擎,CPU 和内存占用仅为 Chromium 的 1/3 到 1/7,这对大规模自动化任务的成本结构可能产生实质影响。

  5. X:Claude Devs (@ClaudeDevs)57

    Claude Code 八月起默认自动模式

    自 8 月 14 日起,自动模式将成为 Claude Code 中 Pro、Max 和 Team 用户的默认权限模式。 自动模式使用独立的分类器审查 shell 命令和操作。在测试中,它捕获了 89% 的危险命令。手动审批仅捕获了 14%。

    推荐理由:将默认模式从手动批准改为自动分类器,给出 89% 的危险命令捕获率,意味着降低使用摩擦的同时把安全基线从 14% 拉到了接近九成。

  6. Sierra Blog40

    Sierra 推出 Voice Personas

    Sierra 推出 Voice Personas,让同一个 AI 智能体可针对不同品牌、市场和场景使用不同声音与性格,把智能体「做什么」与「如何表达」分离开来。新功能由 Sierra Agent SDK 支持,可调节语速、应对打断并中途切换声音或语言。Sierra 称某智能体搭配自然声音与 Persona 后解决率提升近 50%,该功能现已上线。

  7. LangChain:Blog(RSS)62

    LangChain 推出 Managed Deep Agents 公开测试版

    LangChain 的 Managed Deep Agents 进入公开测试版,可将 Deep Agents 部署到托管的 LangSmith 运行时。该服务提供持久化执行、记忆、沙箱、通道、评估(evals)及生产级基础设施。

    推荐理由:托管执行、内存和沙箱等基础能力被封装成生产化服务,让 Agent 从原型到上线不再需要单独搭建这些工程设施。

8月7日周五
  1. X:Suno (@suno)65

    Suno移动端上线Voices功能

    Voices 功能已在 Suno 移动应用 iOS 和 Android 版正式上线!📱✨ 现在你可以直接在手机上录制人声,并将其用于你的歌曲中。只需在创作界面点击“+ Voice”按钮,录制至少一分钟,然后让音乐流淌起来。(Pro 和 Premier 套餐可无限使用,免费套餐可体验有限版本!) 打开应用,录制你的声音,并在评论区告诉我们你的使用体验!

    推荐理由:移动端录制与生成流程打通,创作者用手机采集声音即可快速应用到曲目中,省去了跨工具处理音色的步骤。

  2. X:Runway (@runwayml)75

    Runway 上线 Seedance 2.5,支持 50 个角色参考

    Seedance 2.5 现已登陆 Runway。每次生成最多可引用 50 个角色参考,构建充满角色的完整世界;可创作最长 30 秒、带完整音效与对白的片段,再按你的故事需求随意剪辑与延展。 点击下方链接立即开始。

    推荐理由:支持最多50个角色引用和30秒带对话的片段,从单镜头生成迈向构建完整场景,更适合需要连贯叙事的视频创意。

  3. 通义 QwenAudio:原创语音项目62

    QwenAudio Toolkits 发布公开预览,打造 Agent 驱动的本地音视频创作工作台

    QwenAudio Toolkits 是一款本地优先的桌面工作台,定位为对话式 Agent 驱动的音视频创作 IDE,首个公开预览支持 Apple Silicon、macOS 14.2 及以上版本。

    推荐理由:官方文档给出了能力清单、支持范围和隐私边界,读者可以据此评估这款本地音频 AI 工作台是否适合自己的创作流程。

  4. X:Krea AI (@krea_ai)72

    Krea 推出 Seedance 2.5 视频模型

    推出 Seedance 2.5。 30 秒连续视频、完整多镜头序列,以及最多 50 个参考。 立即试用 👇

    推荐理由:连续30秒生成与多镜头序列支持,将视频创作从单次短片段推向长故事板,对需要连贯叙事的创作者更实用。

  5. 公众号:火山引擎81

    Seedance 2.5 API上线,视频生成开启「电影级长叙事」

    火山引擎正式上线 Seedance 2.5 API,将单次视频生成时长从15秒提升至30秒,并支持最高50个全模态素材参考。模型在指令遵循、长叙事、真人感及声画质感上大幅提升,能稳定保持多角色外形与场景关系,兼容十余种语言。

    推荐理由:原生30秒时长和秒级时间戳控制,把长叙事视频从靠抽卡变为导演级调度;角色与光影的稳定提升让广告、影视等商业场景更接近实际生产标准。