跳到正文

全部动态

今日 30 条
今天10月5日周一
  1. X:Tianyi Cui(@tianyi)30

    oh-my-dsh 推出 DSH 插件升级 skill

    oh-my-dsh 组织推出 dsh-plugin-upgrade-skill,帮助 DSH 插件作者升级插件、适配 DSH 新版本。作者认为 DSH 插件生态不应依赖插件作者每次改代码兼容新版本,需 DSH 减少破坏性变更,并通过兼容层让面向旧 API 的插件仍可运行。

  2. X:Ethan Mollick (@emollick)22

    为人类与AI智能体共用的团队邮箱系统

    又一个急需的产品:一个为团队打造的邮件系统,让人类和自主智能体都能访问它。 我们需要一个带有适当权限的系统,让你的 AI(以及受邀的其他人)可以在其中工作、互相评论,并在需要时把事项提请你的注意。

  3. X:Ethan Mollick (@emollick)26

    GPT-6 Pro 仍无同类竞品

    我今晚一直在抱怨 OpenAI 的一些选择,所以往好的方面说,目前仍然没有能媲美 GPT-6 Pro 的产品(就像之前的 Pro 系列模型一样)。它既能一次性完成非常困难的任务,又在传达结果方面做得出奇地好。

  4. X:Rohan Paul (@rohanpaul_ai)37

    Mustafa Suleyman 称千亿美元级训练将至

    Mustafa Suleyman(微软 AI CEO): 1000 亿美元级的训练运行即将到来。 " 正在集结的算力达到吉瓦级别,而只有 5/6 家实验室。 算力与测试时算力扩展显然将带来地震级的优势。 像这样拥有大算力的大实验室,其部分更大规模的尝试将出现极端加速。" ---- 完整视频见 "The Rest Is Politics: Leading" YouTube 频道,(链接在评论中)

  5. X:Rohan Paul (@rohanpaul_ai)47

    Yann LeCun 劝学术界别碰 LLM

    Yann LeCun 在 ETH Zürich 最新演讲中直言,学术界不应研究 LLM,认为学者在这方面"拿不出任何东西"。他建议想做真实世界具身 AI、物理 AI 的人,既不要做 LLM,也不要做生成模型,并称这番立场让他在硅谷不太受欢迎。

  6. X:Ethan Mollick (@emollick)24

    ChatGPT Pro 用量重置机制引困惑

    整个重置这事儿真的很奇怪,就算在 Twitter 上,也只有一小部分人能理解。 其他人都期望以某种理性的方式来规划自己的用量,随机获得 token 奖励这种事挺奇怪的。比如说,到底有多大比例的用户能享受到这个?

  7. X:SemiAnalysis (@SemiAnalysis_)33

    NVIDIA 收购后 SLURM 对非 NVIDIA 芯片支持变差

    SemiAnalysis 指出,NVIDIA 收购 SLURM/SchedMD 后对非 NVIDIA 芯片的支持越来越差,AMD 因此自研了竞品 "spur",在很多方面远优于 SLURM。NVIDIA 当初承诺保持 SLURM 硬件中立,但至今并未兑现。推文由此质疑 Hugging Face 被 NVIDIA 收购后是否会重蹈覆辙。

  8. X:Ethan Mollick (@emollick)28

    为与AI协作打造个人操作系统

    我其实想要的是为与AI协作而优化的个人操作系统,包括细粒度的安全理念、更便捷地动态查看和理解AI正在做什么的方式,以及独立的次级“审计”智能体,来检查你系统上AI的运行结果。

  9. X:Rohan Paul (@rohanpaul_ai)42

    微软AI CEO谈Anthropic离职潮

    Mustafa Suleyman(微软AI CEO)将Anthropic的重大离职事件与递归自我改进风险联系起来 “AI如何以及何时在越来越少的人类参与指导和审查的情况下修改自己的代码,这就是一个重大的安全风险所在,我认为这就是几周前Anthropic那场重大离职的导火索。 这实际上是一件很难审计的事情。” ---- 完整视频见“The Rest Is Politics: Leading”YouTube频道,(链接在评论中)

  10. IT之家(RSS)48

    软银孙正义罕见警告 AI 安全风险,呼吁各国联手应对超级智能威胁

    软银集团创始人孙正义在京都“科学与技术在社会中的作用”论坛上罕见发出 AI 安全警告,称各国必须建立互信、联手应对强大 AI 模型带来的巨大威胁,超级智能落入不法分子之手将“极其危险”。作为 OpenAI 核心投资者,他已累计注资近 650 亿美元,同时重申到 2040 年 AI 及自主学习机器将占全球 GDP 至少 20%,规模相当于 46 万亿美元。

  11. X:Ethan Mollick (@emollick)33

    AI 时代"善用 AI"建议已过时

    我认为这条建议已经不那么成立了: 1) 随着 AI 越来越易用,"更好地使用 AI"背后的持久技能是什么,并不清晰 2) 越来越明显的是,制约 AI 收益的瓶颈是组织系统,而非个体工作者 3) 对就业的影响尚不确定,但可能冲击整个职业类别

  12. IT之家(RSS)35

    OpenAI 奥尔特曼:AI 巨大效益值得承担部分风险,与 Anthropic 监管分歧仍存

    OpenAI CEO 萨姆·奥尔特曼在《Decoded》专访中表示,AI 技术带来的巨大效益完全值得社会承担部分风险,技术应继续面向公众广泛开放,并称 OpenAI 与 Anthropic 在监管问题上仍存在根本性世界观分歧。他同时澄清自己也无法接受"真正毁灭性的灾难风险",包括潜在的人类对 AI 严重失控。

  13. X:洪明 (@hongming731)42

    BestBlogs早报:ChatGPT常驻智能体与Temporal故障恢复

    BestBlogs 早报精讲三篇:ChatGPT 负责人 Tibo Sottiaux 谈常驻智能体、插件生态与减少 ChatGPT、工作模式、Codex 之间的复杂性;Temporal 演示把人工审批当作异步 API,在等待审批时关闭工作进程、离线提交批准后重启即可恢复业务;Crusoe CEO 则从供电交付与旧芯片利用解释算力成本。

  14. OpenRouter:Announcements(RSS)59

    OpenRouter 对比四家 AI Agent 服务端代码执行沙箱工具

    OpenRouter 发文比较 OpenAI、Anthropic、Google 与 OpenRouter 四家的服务端代码执行工具,介绍各自沙箱的语言、网络、持久化与计费差异,并推出处于 beta 的 openrouter:shell 与 openrouter:bash 工具,可在 Responses 和 Messages API 上为任意模型运行命令。

  15. X:Tibo (@thsottiaux)28

    OpenAI Codex 未来 28 天每日更新

    在接下来的 28 天里,我们每天要么发布一项对大多数 Codex/工作用户来说明确有改进且相关的功能,要么进行一次全面重置。让改进开始吧。

  16. Hacker News:AI 热帖57

    RemoveMacAI 开源工具:关闭 macOS 27 的 Apple Intelligence 并释放磁盘空间

    开源工具 RemoveMacAI 可在 macOS 27 上关闭 Apple Intelligence 并删除其已下载模型。macOS 27 不再提供单一开关,功能关闭后模型仍留在磁盘上;该工具通过配置描述文件应用 Apple 的限制键、经 Apple 资产服务删除模型,并将模型下载重定向到关闭的本地端口以阻止重新下载,所有更改可用 removemacai revert 还原。

  17. X:Elvis Saravia (@omarsar0, DAIR.AI)74

    Elvis Saravia 分享通用智能体协作界面的个人实践

    Elvis Saravia 回应 Karpathy 关于理解 LLM 输出的帖子,称类似做法自己已实践一年多,并分享他正在搭建的通用人机协作界面。其当前方案将高级智能体连接到类 Notion 的灵活页面,支持嵌入工件、文本、视频和可视化讲解,智能体按任务输出这类工件而非默认文本回复,他通过评论和建议直接协作,覆盖代码审查、笔记、写作、研究和原型设计等场景。

  18. X:Rohan Paul (@rohanpaul_ai)53

    GitHarness 论文提出用 Git 式提交和分支管理智能体记忆以应对需求变更

    GitHarness 框架把每个需求及其对应工作像 Git 提交一样存储,在用户修改需求时从最近有效版本分支、只重做变更部分。作者称其在全部 30 个测试设置中优于简单续跑,其中 1 个编码任务设置 token 用量减少 73.6% 且得分更高。论文指出用户很少一次给出完整规格,多数智能体会携带过时工作或全部重做,建议对接受反馈的智能体内置版本管理。

  19. X:Elon Musk (@elonmusk, xAI)33

    马斯克分享 Grok Bot 招聘指南

    关于招聘你的第一位 @Grok @Bot 员工的实用指南。 这真的就像雇了一个超棒的帮手,它会了解你的需求,而且几乎每天都在变聪明!

10月4日周日
  1. X:Elon Musk (@elonmusk, xAI)15

    Elon Musk 认可 Grok 4.7 编程能力

    是的 (注:主推文仅为 "Yes",属于纯感叹/回应,信息量极低。引用推文 @VulcanBench 称 "Grok 4.7 writes great code.",即 Grok 4.7 编程能力出色。主推文是对该评价的肯定回应。)

  2. X:Ethan Mollick (@emollick)59

    Ethan Mollick 用单条提示词实测 Fable 5.1 生成粗野主义城市建造器

    Ethan Mollick 用一条提示词让 Fable 5.1 单次生成粗野主义城市建造器,成品可在线访问,并附上可玩的链接。他表示效果相当好,并拿来与一年多前 GPT-5 在类似提示下生成程序化粗野主义建筑创建器的结果作对比,称 GPT-5 当时很聪明且能直接替你完成任务。

  3. Hacker News 热门(buzzing.cc 中文翻译)51

    BinRange:用 UWB 无线电和 Home Assistant 判断垃圾桶是否已拿出去

    作者自制 BinRange 项目,用一个固定 UWB 锚点和六个电池标签,结合 Home Assistant 的收垃圾日程,判断垃圾桶是否真的拿出去。先用 Makerfabs ESP32-WROVER/DW3000 开发板验证:10.1 米间距平均读数约 10.09 米,标准差 3 厘米;天线朝向从平放改为直立使成功率从 37% 升到 100%。

  4. X:Elvis Saravia (@omarsar0, DAIR.AI)33

    资深开发者:AI 智能体让我彻底告别终端

    有 15 年以上终端使用经验的开发者表示,AI 智能体已让他完全放弃终端,转向更适合与智能体协作的新界面。他认为终端假设人类直接通过文件、命令和进程操作计算机,而智能体只需表达意图即可操作机器。他仍庆幸在 AI 时代前学过计算机系统,理解抽象底层让人成为更好的系统思考者,这也是 AI 时代的一种护城河。

  5. X:可灵 Kling AI (@Kling_ai)48

    可灵 4.0 短片《The Beat》播放破 500 万幕后解析

    可灵 Kling 4.0 制作的短片《The Beat》在社交平台曝光量突破 500 万,官方发布幕后解析。影片开场为 30 秒连续长镜头,依托 Kling 4.0 原生 30 秒生成能力实现;Omni Reference 单任务支持最多 15 个多模态参考,Multi-Keyframe 支持最多 10 个关键帧,并采用 10-bit HDR 输出与升级立体声音频。

  6. X:马东锡 NLP (@dongxi_nlp)38

    中美欧 AI 路线各不同

    美国在忙着做 Frontier Models 中国在忙着做 Open Models,并努力成为 Frontier 欧洲在忙着做 Sovereign Models,谓之"主权" AI

  7. X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)33

    Perplexity Decisions API 通关宝可梦

    宝可梦火红的四天王 + 冠军,一次通关——决策由 Perplexity 的 Decisions API 驱动。 实际运行数据: 592 ms API 响应中位数 987 ms p95——96.4% 的响应在一秒以内 $0.028 预估推理成本,137 次实时 API 调用

  8. Hacker News 热门(buzzing.cc 中文翻译)34

    为什么没有更多开发者“利用这个平台”?

    长期倡导“use the platform”的开发者撰文反思:浏览器曾长期落后于 jQuery 等库,加上开发者对 npm 与 React 生态的熟悉,导致自建方案更顺手。作者以自己参与 PouchDB、IndexedDB 等经历说明,亲手填补平台空白往往是学习 Web 平台、甚至进入 W3C 标准讨论的起点。

  9. Hacker News 热门(buzzing.cc 中文翻译)61

    Agent 不需要记忆插件,需要文档式记忆

    作者 kmeh 撰文认为市面上的 Agent 记忆插件架构错误,它们普遍用会话记录生成片段存入 RAG 数据库,每次提示词检索注入最相似的片段,但存在相似度检索无法判断正确性、片段丢失上下文、无法审计等问题。