跳到正文

全部动态

今日 29 条
7月21日周二
  1. X:Replit (@Replit)65

    Replit 新统一工具栏集成数据库与双因素认证

    需要数据库?双因素认证?SEO 扫描器? 你的项目所需的一切现在都可以通过我们新的统一工具栏触手可及。

    推荐理由:Replit 把数据库、2FA 和 SEO 扫描都塞进一个工具栏,对用它快速出活的开发者是实打实的效率提升,但也就是一次整齐的功能聚合,算不上行业事件。

  2. xAI:News(网页)63

    xAI 推出 Grok for Outlook 加载项

    xAI 今日推出 Grok for Outlook,一个 Microsoft 365 加载项,可将 Grok 智能体嵌入邮箱,用于总结长邮件线程、以用户风格起草回复并整理收件箱。该工具即日起对所有付费 X 和 SuperGrok 用户开放,可从 Microsoft Marketplace 添加。

    推荐理由:xAI 这次把 Grok 直接嵌进了 Outlook,读附件加联网搜索能让邮件处理少跳转几次应用,虽然类似功能很多助手都有,但紧贴收件箱的体验值得 Outlook 重度用户一试。

  3. Google Developers Blog(RSS)63

    Google 推出 Tunix:基于 JAX 的高吞吐智能体后训练库

    Google 发布 Tunix,一个基于 JAX 的原生后训练库,旨在消除多轮、使用工具的 LLM 推理智能体训练中的 TPU 闲置瓶颈。Tunix 通过高并发异步 rollout 与解耦的生产者-消费者流水线最大化硬件吞吐量,确保训练器持续获得数据。该库提供即插即用抽象和持续宏观级性能分析,便于集成自定义环境。

    推荐理由:Google 这个训练库直接解决 agent 训练中 TPU 空转的隐性成本,对做后训练的团队可能是基础设施级改进,值得跟进。

7月20日周一
  1. Hacker News 热门(buzzing.cc 中文翻译)70

    LoRA Speedrun 公开排行榜:6分05秒微调Qwen2.5-1.5B达GSM8K 61.1%准确率

    LoRA Speedrun项目推出公开排行榜,在固定硬件(单张L40S)上比拼Qwen2.5-1.5B的微调运行时间。当前纪录由@Saivineeth147以6分05秒保持,采用序列打包与仅完成损失掩码技术,相比基线11分57秒提速约2倍且准确率更高(61.1%)。项目提供免费Modal沙箱验证,任何提交需经3次独立复现确认。

    推荐理由:LoRA 微调领域的 nanoGPT speedrun,在固定硬件和任务上比墙钟时间,公开透明且可复现,做微调的开发者可以下场试试。

  2. Cursor Blog64

    Cursor 测试新型 AI 智能体集群:规划者+执行者分工,4小时通过80% SQL测试

    Cursor 测试了新型 AI 智能体集群,将任务分解为规划者(使用最强模型)和执行者(使用快速廉价模型)。使用 Grok 4.5 时,新集群在 4 小时内通过了 80% 的 SQL 测试套件,而旧集群在第二小时前失败。该系统已用于构建浏览器、修复漏洞和生成数十亿 token 合成训练数据。

    推荐理由:Cursor首次公开agent swarm的内部架构和协调失败模式,把835页规格文档变成可运行的SQLite数据库并开源,对做AI编程工具的团队和agent架构师来说,这些细节是金矿。

  3. 公众号:小红书技术(dots.llm)76

    小红书、北大开源 UltraEP:面向大规模 MoE 训推的「最优」负载均衡方案

    小红书与北大开源 UltraEP,首次将基于精确路由信息的实时负载均衡引入生产系统,在每个 microbatch 和每一层动态复制热点专家,平均达到理想性能的 94.3%,相比业界 SOTA 训推框架提升 1.49 倍。该方案已在 288B 参数 MoE 模型的完整预训练中部署,保持不低于理想性能 92% 的水平。

    推荐理由:动态复制热点专家替代了基于历史窗口的重排,将MoE训推吞吐从理想的一半拉至90%以上,对自研大规模模型的团队而言,是一套可落地的负载均衡方案。

  4. 公众号:小红书技术(dots.llm)68

    小红书与北大开源 UltraEP:面向大规模 MoE 训推的实时负载均衡方案

    小红书与北大提出 UltraEP,首次将基于精确路由信息的实时负载均衡引入生产系统,在每个 microbatch 和每一层动态复制热点专家。在 Qwen3-235B 等模型上,训练吞吐平均达到理想性能的 94.6%,相比 Megatron-LM 提升 42%;推理 prefill 吞吐相比 SGLang 提升 1.56 倍。

    推荐理由:MoE 训练推理的负载不均是个老痛点,UltraEP 用实时复制热专家的方式把 GPU 利用率拉到 94% 的理想线,代码和论文都开源了,做大规模分布式训练的团队可以直接参考。

  5. OpenAI Developers:Blog(网页)63

    Codex Code Review 支持在 AGENTS.md 中编写自定义仓库审查规则

    OpenAI 为 Codex Code Review 推出自定义仓库规则功能,可在 AGENTS.md 中写明审查指导,Codex 在审查时应用相关规则并在 finding 中引用依据。官方测试显示规则引导下可找回 98% 的应报告问题,基线为 58.3%;文中还给出规则应小范围划分、写明不变量和安全路径、机械检查留给 CI 等撰写建议。

    推荐理由:官方给出规则写法与实测数据,团队可以照着把反复口述的审查经验沉淀进 AGENTS.md 交给 Codex。

  6. 字节 Seed:Research Feed(网页内嵌数据)79

    字节跳动发布 Seed Audio 1.0 音频创作模型,统一建模人声与音效实现端到端影视级音频生成

    字节跳动 Seed 团队发布音频创作模型 Seed Audio 1.0,在统一框架下联合建模人声、音效和环境声,支持 100ms 间隔精度的时间控制、单次约 2 分钟音频的延展生成及 20+ 语种自然生成。该模型已在火山方舟体验中心上线,多数场景音频可用率达 90% 以上,多语言音频自然度 MOS 超 4 分。

    推荐理由:字节这次发布的 Seed Audio 1.0 不是又一个 TTS 模型,它把台词、音效、氛围统一编排,并支持百毫秒级时间线控制,对做视频和出海内容的团队是个立刻能用的创作升级。

  7. xAI:News(网页)69

    Grok for Excel 发布:在 Microsoft Excel 中用自然语言提问、写公式和运行场景

    xAI 将 Grok 引入 Microsoft Excel,推出免费 Microsoft 365 加载项。用户可在工作表中用自然语言提问、根据描述编写公式或运行场景,答案会引用具体单元格,图表可直接插入工作表。该加载项还支持连接 SharePoint 或 Google Drive 获取上下文,并已同步支持 Word 和 PowerPoint。

    推荐理由:Grok 终于杀进格子间了,这个插件把大模型嵌进 Excel,写公式、问数据直接对话,对天天做表的人是个实在的效率提升。

7月19日周日
  1. X:Tibo (@thsottiaux)75

    ChatGPT Work 功能:建站、邮件、文档处理

    ChatGPT Work 适用于 ✅ 创建和托管网站 ✅ 为你管理电子邮件 ✅ 总结海量文档 ✅ 制作一流的文档、表格和幻灯片 已在你的移动应用或 http://chatgpt.com 上提供,包含在 Plus、Pro、Business 和 Enterprise 套餐中。

    推荐理由:OpenAI把AI代理能力直接做进了ChatGPT主产品,能托管网站管邮件做文档,这对普通用户和轻团队是个巨大的效率杠杆,但能否真正代替这些常用工具还有待观察。

  2. Hacker News 热门(buzzing.cc 中文翻译)78

    transcribe.cpp 发布:基于 ggml 的跨平台语音转录库,支持 16 个 ASR 模型族

    transcribe.cpp v0.1.0 发布,一个基于 ggml 的语音转录库,支持 16 个 ASR 模型族(60+ 模型),并通过 Vulkan、Metal、CUDA 和 TinyBLAS 实现 GPU 加速。

    推荐理由:本地语音转录一直缺一个好用的跨平台引擎,transcribe.cpp 不仅支持 60+ 模型、跑在 GPU 上,还带了 Python/JS/Rust/Swift 绑定,想把语音功能嵌进应用的开发者可以直接拿来用。

7月17日周五
  1. LangChain:Blog(RSS)67

    LangChain Fleet 新增一键部署 AI 智能体到 Slack 功能

    LangChain Fleet 允许用户在无代码环境下构建自定义 AI 智能体,并一键部署到 Slack。这些智能体可设置自定义身份,在频道和线程中使用,让团队在现有协作平台上直接完成工作。

    推荐理由:LangSmith Fleet 把无代码构建 agent 和 Slack 打通了,内部工具和团队协作场景的 AI 落地门槛又降了一截,做自动化流程的可以直接试试。

  2. X:ChatGPT (@ChatGPT)68

    ChatGPT 工作区支持文档表格幻灯片编辑

    在 ChatGPT 工作区中创建和编辑精美的文档、电子表格和幻灯片。 @nickbaumann_ 为你演示操作。

    推荐理由:ChatGPT 终于内置文档、表格和幻灯片,不是插件而是原生工作区,对轻办公需求的人来说,可能直接替代掉打开 Google Docs 的习惯。

  3. Hacker News 热门(buzzing.cc 中文翻译)70

    Decoy 字体:用空间频率混淆让 AI 看不清你输入的文字

    Decoy Font 是一款 TTF 字体,通过在同一字符中叠加不同空间频率的图形(前景细轮廓与背景低频模糊块),使近距离观看时 AI 读到“诱饵”字母,而人眼远距离或眯眼时才能看到真实隐藏信息。

    推荐理由:这是一个用视错觉对抗 AI 文字抓取的巧妙工具,虽然不能保证绝对安全,但只需安装字体就能用,门槛极低,发私密消息可以试试。

  4. Google Blog:AI(RSS)60

    Google Vids 上线 Gemini Omni 与个人数字分身功能

    Google Vids 推出两项更新:Gemini Omni 支持用户通过自然语言提示词和图片参考生成、逐步编辑高质量视频片段;个人数字分身功能允许用户上传自拍和语音录制后,输入文字即可让数字分身出镜。两项功能面向 Google AI Pro 和 Ultra 订阅者及 Google Workspace 商业客户开放,所有生成内容均含不可见的 SynthID 数字水印。

    推荐理由:如果你已经在用 Google Workspace,这两个更新让 Vids 的可用性提升了一档,但对于外部的 AI 视频生成,没带来新变量。

7月16日周四
  1. Claude:Blog(网页)64

    在 Claude Cowork 中使用 Claude Fable 5

    Anthropic 发布最强通用模型 Claude Fable 5,专为长时间、多步骤的复杂异步工作设计,可在 Claude Cowork 中自主执行深度研究、尽职调查等任务。该模型需手动选择,默认模型为 Claude Sonnet 5。

    推荐理由:Anthropic 终于把最强大模型放进 Cowork,这篇指南不只是功能说明,更是一套'把 AI 当同事'的工作方法,开发者看完就能上手。

  2. X:面壁智能 OpenBMB (@OpenBMB)66

    面壁智能开源企业AI数字员工平台StaffDeck

    面壁智能联合多团队开源StaffDeck,一个用于构建与管理数字员工的企业平台。该平台旨在将专业知识、标准作业程序(SOP)和决策规则转化为持续工作、改进并保留组织知识的数字员工,而非传统聊天机器人。项目代码已发布于GitHub。

    推荐理由:OpenBMB 开源了一个把组织经验、SOP 和决策规则变成持续运行的「数字员工」平台,不是又一层聊天机器人皮,做企业 AI 落地的可以看看。

  3. 公众号:百度智能云(文心)67

    秒哒 3.5 全球首发 iOS App,无代码开发与多端共享后端能力升级

    百度智能云在 WAIC2026 发布秒哒 3.5,新增 iOS 打包能力,用户无需 Mac 或 Xcode 即可将应用打包为 IPA 文件或上架 App Store。3.5 版本还内置 SEO Agent 实现搜索优化自动化,支持多应用共享同一后端数据库,并推出数据库多环境隔离与后端资源分级功能。秒哒累计服务超 3500 万用户,已创造 350 万个商业应用。

    推荐理由:秒哒3.5把无代码开发推到了iOS端,一键打包、多端共享后端这些能力对非技术创业者是真降门槛。但百度生态外的吸引力有限,适合已有秒哒应用的人直接升级。

  4. Google Developers Blog(RSS)60

    Gemini Enterprise Agent Platform 新增 Parallel Web Search 网络接地提供商

    Google Cloud 与 Parallel Web Systems 合作,将 Parallel 的搜索基础设施作为新的网络接地提供商原生集成到 Gemini Enterprise Agent Platform 中。该集成使开发者能将 AI 智能体锚定在可验证的实时网络结果上,以提升企业工作流的事实准确性。用户还可编程提取、永久缓存并与其他大语言模型一起处理网络数据。

    推荐理由:为 Gemini Agent 平台引入第三方搜索 grounding,企业开发者多了一个直接可用的实时事实核查选项,虽非重大突破,但对做合规和知识库场景的团队是个实用更新。

  5. 公众号:昆仑万维(天工)68

    天工短剧工作台发布“Agent智能分镜+无限画布”双轨创作模式

    天工短剧工作台推出双轨创作模式,通过导演Agent自动解析剧本、规划站位与机位,并支持多视细节图生成,解决AI短剧角色变脸和站位漂移问题。该工具内置影视级提示词模板、720°全景图及3D导演台,实现可控生产。已有三部作品上线DramaWave 7天实现百万美元级营收。

    推荐理由:天工短剧工作台把导演思维实打实地做进了产品,站位置图和3D导演台专门根治角色乱变脸的痼疾,是短剧工具从随机抽卡迈向可控生产的关键一步,创作者值得细看。

  6. 公众号:昆仑万维(天工)66

    天工短剧工作台推出“Agent智能分镜+无限画布”双轨创作模式,告别AI短剧“随机抽卡”

    天工短剧工作台(SkyProduction)推出“Agent智能分镜+无限画布”双轨创作模式,将导演思维拆解为六个可干预环节,通过站位图锁定和多视细节图生成解决角色漂移、变脸问题。该工作台支持720°全景图、3D导演台、多账号分级管理及数据中心,并原生支持英文短剧全流程处理。其三部精品短剧上线DramaWave仅7天,均实现百万美元级营收。

    推荐理由:天工短剧工作台把导演思维拆解成可干预的站位、光影和调度环节,降低了从单镜头到连续叙事的落差,适合需要稳定产出精品短剧的团队。

  7. 公众号:MiniMax(稀宇科技)66

    MiniMax Code 2.0 桌面端焕新:底层架构全面升级,金融模块即将上线

    MiniMax Code 2.0 桌面端发布,基于 Pi Agent 框架重构底层架构,显著提升会话启动速度与长程复杂任务的执行稳定性。新版本优化了图表加载与文件预览框选编辑功能,并已与恒生金融数据库、企查查 MCP 打通,金融模块即将上线,支持多源数据实时检索与专业报告生成。桌面端现已开放下载,本月还将上线远程控制、浏览器操控等功能。

    推荐理由:MiniMax Code 2.0 把底层推倒重来,金融模块直接打通恒生和企查查,从写代码变成能出分析报告,做二级市场的可以认真看看。

  8. Hacker News 热门(buzzing.cc 中文翻译)76

    开源编程智能体内存方案发布,通过 SSH 同步

    一个面向编程 AI 智能体的开源内存项目在 GitHub 发布,支持通过 SSH 同步记忆数据。该项目允许智能体跨会话保留上下文,无需依赖特定云服务,用户可自托管。代码已开源,便于开发者集成与定制。

    推荐理由:给Claude Code、Cursor这些编程代理加了个可同步的持久内存,通过SSH就能跨机器共享上下文,做多机协作开发的可以试试。

  9. X:Elon Musk (@elonmusk, xAI)76

    Grok Build 现已开源

    Grok Build 现已开源

    推荐理由:xAI 把 Grok Build 直接开源了,虽然还没说明详细功能,但代码已经能看,做 AI 编程的开发者可以提前摸一摸架构。

  10. X:Claude Devs (@ClaudeDevs)65

    Claude Code 新增 MCP 连接器调用功能

    Claude Code 的 artifacts 现在可以调用 MCP 连接器,让你构建能够按需为每位查看者获取信息并执行操作的仪表盘和应用。 适用于 Pro、Max、Team 和 Enterprise 计划。不适用于公开共享的 artifacts。

    推荐理由:Claude Code 的 artifacts 现在能直接调用 MCP 服务,做数据看板和交互应用方便了不少,对于已经在用 MCP 的团队来说是个省时的小升级。

  11. xAI:News(网页)85

    Grok 推出 Automations 功能:定时或邮件触发,自动执行任务并汇报结果

    xAI 为 Grok 引入 Automations 功能,用户可描述一次任务,让 Grok 按计划(一次/每日/工作日/每周/每月/每年)或邮件触发(按发件人、收件人或主题过滤)自动运行。每次执行都是一次完整对话,结果保存至运行历史,支持邮件或应用内通知。定时自动化对所有用户开放,邮件触发需 SuperGrok 订阅。

    推荐理由:xAI 把自动化做进了 Grok,定时和邮件触发让 AI 从被动问答变成主动干活,尤其是邮件触发可以直接处理收件箱,对于需要自动化工作流的用户来说,这是一次真正的实用性升级。

7月15日周三
  1. Hacker News 热门(buzzing.cc 中文翻译)77

    Telegram 无服务器架构

    Telegram Serverless 允许开发者直接在 Telegram 基础设施上运行 Bot 和 Mini App 的后端代码,无需配置服务器或容器。开发者编写普通 JavaScript 模块,通过 `npx tgcloud push` 单命令部署,代码在靠近 Bot API 和内建数据库的轻量级 V8 隔离沙箱中执行。

    推荐理由:Telegram 给机器人开发搭了一套完整的无服务器后端,内置数据库和 CLI,从写代码到部署都在一个文件夹里完成。做 Telegram 机器人的开发者可以彻底扔掉 VPS 和云函数了。

  2. 公众号:火山引擎69

    Doubao-Seed-Evolving 升级:支持 1M 上下文,长程任务能力超越 Doubao-Seed-2.1-pro

    火山引擎升级 Doubao-Seed-Evolving,新增 1M 超长上下文支持,可单次处理大型代码仓库、长篇文档等大规模信息。该模型在长程任务中表现更稳定,开发者众测质量评分超越 Doubao-Seed-2.1-pro,且消耗 tokens 更少、工具调用轮次更简洁。现已上线火山 Agent Plan,单月套餐限时 9.9 元起,参与体验奖励计划可享调用成本立减 20%。

    推荐理由:1M上下文将大型代码仓库和长文档纳入单次处理范围,长程任务稳定性的提升更直接地影响智能体复杂步骤的可靠性,统一ID则省去了频繁切换模型版本的工程开销。

  3. 公众号:京东JoyAI67

    全国首个“模型券”即时补贴平台上线京东云

    北京经开区在全国率先试点运行“模型券”即时补贴平台,由京东科技集团提供技术支持。企业购买模型服务时可在京东云优惠价基础上叠加补贴,以1000元券包为例实际支付最低可降至350元,补贴比例最高达65%。平台支持多模型调用,企业完成四项线上流程即可即时抵扣,算力券补贴功能也将加快上线。

    推荐理由:补贴从事后申报变为消费时自动抵扣,对现金流敏感的中小企业,降低初次调用门槛的意义大于折扣比例本身。

  4. IT之家(RSS)70

    金山办公推出 WPS Comate AI 办公客户端

    金山办公在2026 AI生产力大会上推出面向员工的AI办公客户端WPS Comate,可连接组织数据与流程。该产品提供AI岗位专家、Skill技能生态、自动化任务等六大模块,并支持云端与本地双任务模式,个人用户可直接下载体验。

    推荐理由:金山办公把WPS Comate从聊天工具升级成能连接组织数据、自动执行任务的AI办公平台,对国内WPS用户群是个实际提效选项,但具体落地效果和第三方集成深度还有待验证。

  5. vLLM 官方博客(RSS)74

    vLLM 实现 TML Inkling Day-0 支持并完成推理性能优化

    vLLM 宣布对 Thinking Machines Lab 的 1T 参数多模态模型 TML Inkling 提供 Day-0 支持,覆盖 thinkingmachines/Inkling-NVFP4 和 BF16 两个版本,支持文本、图像、音频输入和最长 1M token 上下文。

    推荐理由:原文给出 Day-0 支持的具体性能数字、架构优化细节和精度对比,读者可以评估该模型在自己的推理工作流中的可用性。

  6. X:OpenAI Developers (@OpenAIDevs)74

    Codex 周活超700万,两月更新150+项

    7M+ 周活跃 Codex 用户。两月内 150+ 项更新。 @romainhuet 为你梳理 Codex 新动态:GPT‑5.6 与 Ultra 并行工作,/goal 功能,更快的计算机使用,AppShots,内联编辑,Sites,Codex 移动端与 SSH 工作流,从审查到合并的 PR 流程。

    推荐理由:Codex两个月150+项更新,GPT-5.6模型和自动化PR合并是亮点,这波更新让日常开发更像在与智能助手协作而非仅是写代码,开发者可以赶紧体验。

  7. xAI:News(网页)77

    xAI 开源 Grok Build 编程智能体与终端界面

    xAI 已将 Grok Build 的源代码在 GitHub 上开源。Grok Build 是 SpaceXAI 的编程智能体与终端用户界面(TUI),开源后用户可自行编译并完全本地运行,指向本地推理引擎并通过 `config.toml` 配置。

    推荐理由:Grok Build 开源让 xAI 的编码智能体变成完全可定制、可本地运行的套件,对想自己拼装开发环境的工程师是个实锤福利,但社区能玩多大还得看后续。

7月14日周二
  1. X:Google AI for Developers (@googleaidevs)70

    Google AI 发布 Gemini 3.5 Live Translate,支持 70+ 语言近实时语音到语音翻译

    Google AI 发布 Gemini 3.5 Live Translate,支持 70+ 语言、近实时延迟的语音到语音翻译。该模型直接处理原始音频流,保留说话者语调、节奏和音高。东南亚超级应用 Grab 正探索将其用于司机与乘客间的跨语言沟通,其用户每月发起超 1000 万次语音通话。开发者可通过 Gemini Live API 集成 LiveKit、Fishjam、Pipecat 或 Vision Agents 构建应用。LiveKit 已实现虚拟会议室多语言即时理解;Software Mansion 结合 MoQ 协议突破流媒体瓶颈;VisionAgents AI 展示了动态多语言切换能力。开发者可在 Google AI Studio 试用并获取 Cookbook 示例代码。

    推荐理由:Google把Gemini 3.5的语音翻译做到了近实时、保持语调,这对出海产品是个很实际的升级,实时通话翻译终于从demo走向可用。

  2. Anthropic:Newsroom(网页)66

    Anthropic 推出 Claude for Teachers

    Anthropic 发布 Claude for Teachers,为美国认证的 K-12 教师免费提供高级 Claude 功能、教学技能库及对接全美 50 州学术标准的课程资源。该工具连接 Learning Commons,可调用 OpenSciEd、IM v.360 等课程资源,并集成 ASSISTments、Brisk Teaching、Canva Education 等第三方工具。教师可基于高质量教材规划课程、为不同水平学生差异化教学,还能通过 Claude Code 和 Cowork 自动分析班级数据、安排重复任务。教师数据不用于模型训练,学生信息受 FERPA 合规的 K-12 数据处理附录保护。Anthropic 同时发布与 Teach for America 及美国教师联合会共创的 AI 素养课程。

    推荐理由:Anthropic把Claude塞进教师工具箱,免费加课标对齐,这一步比单纯降价聪明,它押的是教育场景的底层重构。

  3. X:Claude (@claudeai)67

    Claude 为美国K-12教师推出免费教育版

    我们推出Claude for Teachers:为美国认证的K-12教育工作者免费提供高级Claude功能,附带教学技能库,并直接连接循证课程,覆盖全美50个州的学术标准。 https://claude.com/solutions/teachers

    推荐理由:Anthropic免费向教师提供Claude高级功能,还带课程标准对齐,这招对打入美国公立学校很聪明,做教育产品的可以观望一下实际落地效果。

  4. 公众号:腾讯混元78

    腾讯混元将Hy3旗舰模型量化至1bit与4bit,单卡即可部署

    腾讯混元将295B参数的Hy3旗舰模型权重量化至1bit与4bit并打包成GGUF,配合llama.cpp生态,使原本需多卡集群部署的模型最少一张96GB推理显卡即可运行。1bit版将权重从598GB压缩至85.5GiB,4bit版体积169.9GiB,两张显卡可承载;量化版在长文理解、Agent与代码任务上贴近满血效果,开启MTP后解码速度提升约50%-60%。

    推荐理由:将 295B 旗舰模型量化至单卡部署,1bit 版本在长文理解上仍接近满血,且提供 MTP 加速,改变了本地运行大模型的门槛与成本考量。

  5. IT之家(RSS)72

    高德发布通用世界模型工坊 ABot-WorldStudio,已开放测试

    阿里巴巴旗下高德发布通用世界模型工坊 ABot-WorldStudio,并开放测试。该产品将交互式视频生成与 3DGS 场景生成统一,用户输入文字或图片即可生成可实时交互、可分享的 AI 世界。工坊内置“时空任意门”,穿越后可跃迁至另一完整 3D 世界。官方实测单次连续推理稳定运行超1小时,无崩溃、无质量衰减。底层模型 ABot-World0 与 ABot-3DWorld0 均可在单张 5090 上本地部署,已全面开源。

    推荐理由:把世界模型从一分钟短片推进到小时级稳定探索,还支持本地一张消费级显卡跑,这对做具身智能和边界探索的团队是个值得上手的信号。

7月13日周一
  1. X:Tibo (@thsottiaux)65

    OpenAI 为 50 万 ChatGPT Work 和 Codex 用户增加“banked reset”功能

    OpenAI 为 50 万 ChatGPT Work 和 Codex 用户增加了“banked reset”功能,现已支持网页和移动端使用,此前仅限桌面端。期间曾出现 2 小时窗口内不到 10% 用户重置未生效的问题,OpenAI 为所有在该窗口内点击重置按钮的用户补发了重置额度。明天将庆祝 700 万活跃用户里程碑,并向所有 ChatGPT Work 和 Codex 用户发放首次重置额度,同时发布桌面端多项更新。

    推荐理由:ChatGPT Work 和 Codex 的 banked reset 终于能在网页和移动端用了,修复了一个只有 10% 用户成功重置的 bug,明天还会给 700 万用户每人送一次免费重置,用这两个工具的人可以直接去试试。