跳到正文

全部动态

今日 0 条
10月1日周四
  1. X:Google DeepMind (@GoogleDeepMind)43

    Google DeepMind 开源生物设计安全验证工具

    随着 AI 加速科学发现,我们正在帮助研究人员快速验证生物设计是否内置了安全防护,同时不耽误关键工作。🔬 我们以开放方式发布这些工具供研究使用,以加强安全防护 → https://goo.gle/3VmICLk

  2. X:Google DeepMind (@GoogleDeepMind)47

    Google DeepMind 推出 SynthID Bio 水印

    SynthID Bio 是我们全新的水印方法系列,专为 AI 生成的生物设计打造。 这是全球首创,我们现在可以将一种无法察觉的签名直接嵌入蛋白质序列,而不影响其生物功能。🧵

  3. X:Google DeepMind (@GoogleDeepMind)36

    Google DeepMind 推出蛋白质水印技术

    水印就像数字身份证,可以帮助 DNA 实验室验证合成蛋白质,并保持序列数据库的准确性。 随着这些请求规模日益扩大,验证设计是否来自带有内置防护措施的 AI,将有助于实验室实现自动化并加强生物安全。🛡️

  4. X:Testing Catalog (@testingcatalog)25

    Grok Bot 将推出 Primary Bot 主助手

    Grok Bot 正在加入 Primary Bot(又称 Bot Prime),定位为可管理其他 bot 并主动执行任务的主 AI 助手,该功能已出现在最新 iOS 应用中。推文称这是 SpaceXAI 进军私人助理领域、与 Muse 竞争的动作,并认为当前是 Grok Bot 抢占美国以外全球市场的好时机。

  5. X:Ethan Mollick (@emollick)37

    AI 自组织能力与 Muse、Dots 智能体

    我写了一篇关于 AI 进步中最被我低估的一点:它自我组织以完成任务的能力。另外,还谈了这对 Muse 和 Dots 这类智能体意味着什么,并附上一支音乐视频,解释为什么我们一再重新领悟 The Bitter Lesson。https://open.substack.com/pub/oneusefulthing/p/the-dot-and-the-swarm?r=i5f7&utm_medium=ios

  6. X:Rohan Paul (@rohanpaul_ai)44

    Adobe 提出基于技能的智能体实时评测方法

    Adobe 提出把标准答案写成每次运行都重新取数的代码,再由 AI 评分器对照检查智能体回答。在 53 个测试用例上,这种做法的 AI 评分与人类专家的一致率比文字描述答案高 29%,且少用 16% token;若没有可对照的答案,AI 评分器表现还不如随机。论文题为《Skill-based Agentic Evaluation for Real-time Data Science Tasks》。

  7. Ethan Mollick:One Useful Thing(RSS)64

    Ethan Mollick 谈点与群:智能体自组织为何让管理假设失效

    Ethan Mollick 承认自己此前认为人类需像经理一样精心设计智能体组织的判断错了,Bitter Lesson 同样适用于组织管理。

    推荐理由:作者复盘了自己此前的误判,用 Navier-Stokes 群体智能体等案例说明智能体自组织比预想容易,管理原理值得重估。

  8. X:Meshy (@MeshyAI)17

    Meshy 亮相科隆游戏展周

    回顾 gamescom 那一周,Meshy 的身影遍布科隆。🎮 科隆中央车站、Lanxess Arena、全城海报、驶过大教堂的 LED 卡车,还有天黑后的投影。全都在问同一个问题:1200 万 3D 创作者在哪里? 答案在 bio 里。😉 非常感谢我们的合作伙伴 @meyrismarketing 让它成真。

  9. Hacker News 热门(buzzing.cc 中文翻译)48

    在日本工作期间攻读机器学习博士:一位 Google 工程师的 MEXT 奖学金经历

    美国工程师 Marco Cognetta 在 Google 任职期间,通过 MEXT 奖学金在东京工业大学(现 Institute of Science Tokyo)完成计算机科学博士,研究面向键盘的端侧语言模型。日本学生签证允许入学首日即申请打工许可,学期内每周上限 28 小时、长假期间每天 8 小时,且日本博士制度通常三年毕业。

  10. X:Rohan Paul (@rohanpaul_ai)41

    Google DeepMind 等论文:AI 抢工作后政府该怎么保民生

    Google DeepMind 联合牛津、芝加哥大学论文探讨 AI 大量取代工作后政府应如何保障民众,结论是没有任何单一政策在所有情景下都有效。再培训等最受欢迎的思路只在 AI 持续创造新岗位时有用,否则只是重新分配剩余岗位。作者建议现在扩大失业救济与低薪税收抵免,失业持续则把抵免转为收入下限,劳动者经济份额持续下降则让公民持有公共投资基金份额。

  11. Hacker News 热门(buzzing.cc 中文翻译)39

    Halfspace:基于距离场的实体建模实验性 IDE

    Halfspace 是一款基于距离场的实体建模实验性 IDE,作为 Fidget 几何内核的展示应用,可实时栅格化图像并将模型导出为图片或三角网格。它同时提供基础图元库与手写脚本两种建模方式,并将底层距离场置于前台以便诊断法线错误等问题。该项目自 2025 年 4 月起开发,作者强调并非 vibe-coded,目前仍属实验性、跨平台。

  12. IT之家(RSS)71

    OpenAI 称遭遇有组织对抗式蒸馏,指向开发 Kimi 的月之暗面

    OpenAI 于 9 月 30 日在官网发文,称遭遇一场始于 7 月第一周的有组织对抗式蒸馏活动。7 月 24 日至 25 日流量大幅增加,超 4000 名用户发起 1.6 万次请求,共发现超 1.5 万名用户有类似提示词活动,OpenAI 已于 7 月 28 日完全阻止,称其违反服务条款但未破解加密或入侵数据库。公司表示尚不清楚攻击实体,但认为核心活动群体与开发 Kimi 模型的月之暗面有关。

  13. X:Rohan Paul (@rohanpaul_ai)57

    Rohan Paul:SpaceX 算力预计 11 月底达约 2.3 GW

    Rohan Paul 引用 Musk 的说法估计,SpaceX 算力到 11 月底有望达约 2.3 GW。基础是 2Q26 底的 1.4 GW;本周 220k NVIDIA GB300 上线,11 月再加 220k,每批 220k 约合 440 MW,两批合计在 1.4 GW 之上新增接近 0.9 GW。Musk 还列出 Colossus 1 为 150k H100、50k H200 和 30k GB200,Colossus 2 为 110k GB200 和 440k GB300。

  14. X:Rohan Paul (@rohanpaul_ai)51

    Google 发布 RRSI 框架,围绕冻结模型自动进化 LLM Agent harness

    Google 发布 Regularized Recursive Self-Improvement of Agent Harnesses(RRSI),一个自动进化 LLM agent harness 的框架。RRSI 在冻结 LLM 周围自动演进 harness 的全部 prompt、控制流、工具和记忆组件。论文指出对固定演进集进化 harness 虽有效但会过拟合,分布内的大幅收益在分布外会缩水或消失,RRSI 通过保持编辑空间开放并对搜索轨迹加正则化来解决。项目页与论文已于 09/21/2026 发布。

  15. X:Rohan Paul (@rohanpaul_ai)43

    盖茨提议机器人应缴同等FICA税

    Bill Gates 表示,如果一家公司解雇了一名工人并用机器人顶替该岗位,机器人就应该缴纳与人类工人相同的 FICA 税。 在职劳动者供养退休人员,替换工人不应成为逃避养老金账单的方式。 “社会有权决定。经济信号显示用 AI 成本更低,并不意味着社会就必须这么做。” ---- 来自“The Ezra Klein Show and New York Times Opinion and New York Times Podcasts”YouTube 频道,(链接见评论)

  16. IT之家(RSS)70

    曝腾讯租用甲骨文东南亚数据中心:涉及约 10 万块先进 AI 芯片,交易估值约 70 亿美元

    据《金融时报》报道,腾讯与甲骨文签署其最大海外租赁协议,在东南亚多个甲骨文数据中心租用约 10 万块先进 AI 芯片,五年期交易估值约 70 亿美元,首付约 30%。算力将用于推进 AI 模型和智能体工具开发;腾讯第二季度资本支出同比增 176% 至 530 亿元人民币。双方均未回应置评请求。

  17. X:Rohan Paul (@rohanpaul_ai)49

    Meta 论文:给智能体配个"经理"管算力

    Meta 论文提出 Meta-Reasoning Agent,让 worker 执行任务、独立 controller 决定下一步,在最大预算下于全部 12 项对比测试中胜过无 manager 的同款智能体。用 GPT-5.5 跑代码基准时,预算增至 3 倍,得分从 64.1% 升至 71.5%,而对照智能体停滞在 64% 附近。

  18. IT之家(RSS)69

    韩国9月出口创历史新高,芯片出口同比猛增263%

    据彭博社报道,受AI需求拉动,韩国9月剔除工作日差异后出口同比增长104.9%,出口总额达1209亿美元创历史新高,其中芯片出口猛增263%至603亿美元。2026年前九个月出口首次突破8000亿美元关口,韩国央行已连续两次加息至3%,并将2026年经济增速预期由2.6%上调至3.3%。

  19. IT之家(RSS)51

    加州州长纽森签署行政令,州政府继续使用“AI”而非“SI”

    当地时间 9 月 30 日,加州州长纽森签署第 N-10-26 号行政令,要求加州州政府机构和部门在官方事务中继续使用“人工智能”及“AI”,不受联邦称谓影响。此前特朗普于 9 月 30 日前一日签署行政令,要求联邦行政部门在非法律文件中以“超级智能”和“SI”取代“人工智能”和“AI”。纽森表示改变名称并不能让人忽视已充分记录的新兴安全风险,并称“超级智能显然不会来自白宫”。

  20. X:Rohan Paul (@rohanpaul_ai)33

    Sam Altman 谈超快提示词体验

    Sam Altman 所有提示词都在"超快"模式下进行 他说:"创作者应该与他们正在创作的东西有即时的连接,速度和反馈循环非常重要。 我之前没有意识到,响应如此快速地返回,对我的迭代思考循环有这么大的影响,但就构建东西、思考问题而言,这简直是天壤之别。" --- 来自"Every" YouTube 频道(链接在评论中)

  21. IT之家(RSS)65

    软银完成对 OpenAI 最后一笔 100 亿美元投资,300 亿美元承诺全部到位

    软银通过软银愿景基金 2 完成对 OpenAI 的第三笔 100 亿美元投资,至此此前承诺的 300 亿美元全部到位,预计将持有 OpenAI 约 13% 股份。据彭博社报道,OpenAI 正寻求至少 300 亿美元的新一轮融资;路透社表示,此次投资所用的软银债券是全球迄今规模最大的企业高收益债券发行。

  22. IT之家(RSS)41

    谷歌高管称全美数十万个技术工种岗位空缺,数据中心建设催生庞大用工需求

    谷歌俄亥俄州和印第安纳州数据中心运营区域负责人蒂姆·查德威克称,全美有数十万个技术工种岗位空缺,高级电工、管道安装领班、项目经理等需求增长快。仲量联行报告援引美国教育部估算,到2030年美国约210万个技术工种岗位可能招不到人;麦肯锡预计到2030年全球数据中心需投入6.7万亿美元。

  23. X:Rohan Paul (@rohanpaul_ai)48

    Meta Muse 冲击流媒体、健身房与保险等订阅行业

    Meta 的 Muse 对特定卖家的威胁远大于对消费的威胁:受冲击品类仅占美国消费约 3.7%,但规模约每年 8300 亿美元,集中在流媒体、出版商、健身房、运营商和保险公司。Muse 省下的每一美元都归家庭,Meta 则按免费到每月 100 美元分档收费,并称正探索商业收入,可能对 Muse 将家庭切换到新运营商或保险公司时收费,这些切换费用由运营商和保险公司的获客预算支付。