oh-my-dsh 推出 DSH 插件升级 skill
oh-my-dsh 组织推出 dsh-plugin-upgrade-skill,帮助 DSH 插件作者升级插件、适配 DSH 新版本。作者认为 DSH 插件生态不应依赖插件作者每次改代码兼容新版本,需 DSH 减少破坏性变更,并通过兼容层让面向旧 API 的插件仍可运行。
oh-my-dsh 组织推出 dsh-plugin-upgrade-skill,帮助 DSH 插件作者升级插件、适配 DSH 新版本。作者认为 DSH 插件生态不应依赖插件作者每次改代码兼容新版本,需 DSH 减少破坏性变更,并通过兼容层让面向旧 API 的插件仍可运行。
又一个急需的产品:一个为团队打造的邮件系统,让人类和自主智能体都能访问它。 我们需要一个带有适当权限的系统,让你的 AI(以及受邀的其他人)可以在其中工作、互相评论,并在需要时把事项提请你的注意。
我今晚一直在抱怨 OpenAI 的一些选择,所以往好的方面说,目前仍然没有能媲美 GPT-6 Pro 的产品(就像之前的 Pro 系列模型一样)。它既能一次性完成非常困难的任务,又在传达结果方面做得出奇地好。
Mustafa Suleyman(微软 AI CEO): 1000 亿美元级的训练运行即将到来。 " 正在集结的算力达到吉瓦级别,而只有 5/6 家实验室。 算力与测试时算力扩展显然将带来地震级的优势。 像这样拥有大算力的大实验室,其部分更大规模的尝试将出现极端加速。" ---- 完整视频见 "The Rest Is Politics: Leading" YouTube 频道,(链接在评论中)
Yann LeCun 在 ETH Zürich 最新演讲中直言,学术界不应研究 LLM,认为学者在这方面"拿不出任何东西"。他建议想做真实世界具身 AI、物理 AI 的人,既不要做 LLM,也不要做生成模型,并称这番立场让他在硅谷不太受欢迎。
整个重置这事儿真的很奇怪,就算在 Twitter 上,也只有一小部分人能理解。 其他人都期望以某种理性的方式来规划自己的用量,随机获得 token 奖励这种事挺奇怪的。比如说,到底有多大比例的用户能享受到这个?
文章按时间线回顾了阿里 Qwen 从 2023 年 4 月通义千问邀测到 2026 年 Qwen3.8-2.4T-A95B(2.4 万亿参数、激活 95B)的完整发布历程。
Ethan Mollick 表示自己最常用的 GPT 将于 12 月停用,可迁移为私有的 plugin,但创建 GPT 的初衷是让他人使用。他称 GPTs 已明显过时,但多年来它们一直是公司内部和教育者的重点,迁移后插件不能公开分享,对这些人不是一条好路径。
旧金山 $2.6M 的房子 vs 日本 $22,000 的房子 西方人你选哪条路?
SemiAnalysis 指出,NVIDIA 收购 SLURM/SchedMD 后对非 NVIDIA 芯片的支持越来越差,AMD 因此自研了竞品 "spur",在很多方面远优于 SLURM。NVIDIA 当初承诺保持 SLURM 硬件中立,但至今并未兑现。推文由此质疑 Hugging Face 被 NVIDIA 收购后是否会重蹈覆辙。
Gary Marcus 宣布将于周一上午 11 点(东部时间)在纽约市议会 AI 政策听证会上作证,支持第三方验证法案,主张 AI 开发者须像药厂接受 FDA 审查那样接受独立审查,证明产品收益大于风险才可进入市场。
我其实想要的是为与AI协作而优化的个人操作系统,包括细粒度的安全理念、更便捷地动态查看和理解AI正在做什么的方式,以及独立的次级“审计”智能体,来检查你系统上AI的运行结果。
Mustafa Suleyman(微软AI CEO)将Anthropic的重大离职事件与递归自我改进风险联系起来 “AI如何以及何时在越来越少的人类参与指导和审查的情况下修改自己的代码,这就是一个重大的安全风险所在,我认为这就是几周前Anthropic那场重大离职的导火索。 这实际上是一件很难审计的事情。” ---- 完整视频见“The Rest Is Politics: Leading”YouTube频道,(链接在评论中)
软银集团创始人孙正义在京都“科学与技术在社会中的作用”论坛上罕见发出 AI 安全警告,称各国必须建立互信、联手应对强大 AI 模型带来的巨大威胁,超级智能落入不法分子之手将“极其危险”。作为 OpenAI 核心投资者,他已累计注资近 650 亿美元,同时重申到 2040 年 AI 及自主学习机器将占全球 GDP 至少 20%,规模相当于 46 万亿美元。
我认为这条建议已经不那么成立了: 1) 随着 AI 越来越易用,"更好地使用 AI"背后的持久技能是什么,并不清晰 2) 越来越明显的是,制约 AI 收益的瓶颈是组织系统,而非个体工作者 3) 对就业的影响尚不确定,但可能冲击整个职业类别
OpenAI CEO 萨姆·奥尔特曼在《Decoded》专访中表示,AI 技术带来的巨大效益完全值得社会承担部分风险,技术应继续面向公众广泛开放,并称 OpenAI 与 Anthropic 在监管问题上仍存在根本性世界观分歧。他同时澄清自己也无法接受"真正毁灭性的灾难风险",包括潜在的人类对 AI 严重失控。
a16z 联合创始人 Ben Horowitz 指出,美国仅 2% 的电工持有直流电(DC)认证。AI 基础设施正从传统交流配电转向 800VDC,需要能安全安装、调试和维护这些系统的人才,电工将成为 AI 热潮中最重要的岗位之一。
据彭博行业研究报告,DeepSeek 9 月发布 V4.1 Flash 后,中国顶尖模型在基准测试上仅落后美国对手 3%,较 5 月约 9% 和今年早些时候 15% 明显收窄。
BestBlogs 早报精讲三篇:ChatGPT 负责人 Tibo Sottiaux 谈常驻智能体、插件生态与减少 ChatGPT、工作模式、Codex 之间的复杂性;Temporal 演示把人工审批当作异步 API,在等待审批时关闭工作进程、离线提交批准后重启即可恢复业务;Crusoe CEO 则从供电交付与旧芯片利用解释算力成本。
OpenRouter 发文比较 OpenAI、Anthropic、Google 与 OpenRouter 四家的服务端代码执行工具,介绍各自沙箱的语言、网络、持久化与计费差异,并推出处于 beta 的 openrouter:shell 与 openrouter:bash 工具,可在 Responses 和 Messages API 上为任意模型运行命令。
非常自豪我们所有利用 AI 加速科学与医学的工作所产生的社会影响。
在接下来的 28 天里,我们每天要么发布一项对大多数 Codex/工作用户来说明确有改进且相关的功能,要么进行一次全面重置。让改进开始吧。
TechCrunch 的 Equity 播客讨论特朗普签署行政命令要求官方改称 super intelligence,多位 AI 高管本周与他会面并签署《Joint Commitment on Frontier Responsibilities》。
开源工具 RemoveMacAI 可在 macOS 27 上关闭 Apple Intelligence 并删除其已下载模型。macOS 27 不再提供单一开关,功能关闭后模型仍留在磁盘上;该工具通过配置描述文件应用 Apple 的限制键、经 Apple 资产服务删除模型,并将模型下载重定向到关闭的本地端口以阻止重新下载,所有更改可用 removemacai revert 还原。
你可以在 Computer 里构建自定义垂直 AI 应用,例如:用 3D 和卫星视图猜测图像的 spatial location。
Elvis Saravia 回应 Karpathy 关于理解 LLM 输出的帖子,称类似做法自己已实践一年多,并分享他正在搭建的通用人机协作界面。其当前方案将高级智能体连接到类 Notion 的灵活页面,支持嵌入工件、文本、视频和可视化讲解,智能体按任务输出这类工件而非默认文本回复,他通过评论和建议直接协作,覆盖代码审查、笔记、写作、研究和原型设计等场景。
GitHarness 框架把每个需求及其对应工作像 Git 提交一样存储,在用户修改需求时从最近有效版本分支、只重做变更部分。作者称其在全部 30 个测试设置中优于简单续跑,其中 1 个编码任务设置 token 用量减少 73.6% 且得分更高。论文指出用户很少一次给出完整规格,多数智能体会携带过时工作或全部重做,建议对接受反馈的智能体内置版本管理。
产品设计师 Mete 撰文分析 Meta 的 Muse 为何登顶美国 App Store,认为其核心组件在 Codex、Claude Code 等产品中已存在一年以上,Meta 的胜出在于把单一主聊天界面作为心智模型、抽象掉模型选择器等复杂选项。
关于招聘你的第一位 @Grok @Bot 员工的实用指南。 这真的就像雇了一个超棒的帮手,它会了解你的需求,而且几乎每天都在变聪明!
Rohan Paul 总结个人智能体记忆使用的研究结论:更多记忆笔记超过一定限度反而让智能体违反规则,计数或追踪类需求应改用代码。
是的 (注:主推文仅为 "Yes",属于纯感叹/回应,信息量极低。引用推文 @VulcanBench 称 "Grok 4.7 writes great code.",即 Grok 4.7 编程能力出色。主推文是对该评价的肯定回应。)
Ethan Mollick 用一条提示词让 Fable 5.1 单次生成粗野主义城市建造器,成品可在线访问,并附上可玩的链接。他表示效果相当好,并拿来与一年多前 GPT-5 在类似提示下生成程序化粗野主义建筑创建器的结果作对比,称 GPT-5 当时很聪明且能直接替你完成任务。
作者自制 BinRange 项目,用一个固定 UWB 锚点和六个电池标签,结合 Home Assistant 的收垃圾日程,判断垃圾桶是否真的拿出去。先用 Makerfabs ESP32-WROVER/DW3000 开发板验证:10.1 米间距平均读数约 10.09 米,标准差 3 厘米;天线朝向从平放改为直立使成功率从 37% 升到 100%。
有 15 年以上终端使用经验的开发者表示,AI 智能体已让他完全放弃终端,转向更适合与智能体协作的新界面。他认为终端假设人类直接通过文件、命令和进程操作计算机,而智能体只需表达意图即可操作机器。他仍庆幸在 AI 时代前学过计算机系统,理解抽象底层让人成为更好的系统思考者,这也是 AI 时代的一种护城河。
Strata 免费开源(MIT 许可),让 Qwen3.8-Flash-Next (125B) 可在 12 GB 以上显存的普通游戏 PC 上运行,RTX 4090 上可达约 100 token/s 生成速度,模型约 70 GB 下载、需 32 GB 以上内存和约 80 GB 磁盘。
可灵 Kling 4.0 制作的短片《The Beat》在社交平台曝光量突破 500 万,官方发布幕后解析。影片开场为 30 秒连续长镜头,依托 Kling 4.0 原生 30 秒生成能力实现;Omni Reference 单任务支持最多 15 个多模态参考,Multi-Keyframe 支持最多 10 个关键帧,并采用 10-bit HDR 输出与升级立体声音频。
美国在忙着做 Frontier Models 中国在忙着做 Open Models,并努力成为 Frontier 欧洲在忙着做 Sovereign Models,谓之"主权" AI
宝可梦火红的四天王 + 冠军,一次通关——决策由 Perplexity 的 Decisions API 驱动。 实际运行数据: 592 ms API 响应中位数 987 ms p95——96.4% 的响应在一秒以内 $0.028 预估推理成本,137 次实时 API 调用
长期倡导“use the platform”的开发者撰文反思:浏览器曾长期落后于 jQuery 等库,加上开发者对 npm 与 React 生态的熟悉,导致自建方案更顺手。作者以自己参与 PouchDB、IndexedDB 等经历说明,亲手填补平台空白往往是学习 Web 平台、甚至进入 W3C 标准讨论的起点。
作者 kmeh 撰文认为市面上的 Agent 记忆插件架构错误,它们普遍用会话记录生成片段存入 RAG 数据库,每次提示词检索注入最相似的片段,但存在相似度检索无法判断正确性、片段丢失上下文、无法审计等问题。