Perplexity Computer 推出 Automations 自动化功能
Perplexity 在 Perplexity Computer 中推出 Automations 功能,面向持续性工作,可基于事件触发或按计划执行操作。Automations 可结合用户的记忆、技能,以及 Slack、Gmail、Outlook 和 Linear 等已连接应用。
Perplexity 在 Perplexity Computer 中推出 Automations 功能,面向持续性工作,可基于事件触发或按计划执行操作。Automations 可结合用户的记忆、技能,以及 Slack、Gmail、Outlook 和 Linear 等已连接应用。
Y Combinator 支持的 InsForge 推出 InstaCloud,定位为 agent-native 的 serverless 云,宣称让编码 Agent 自行开通和运行 Postgres、S3 兼容存储和容器,人类负责审核关键变更,并支持通过 MCP/CLI 使用。
佛罗里达州总检察长 James Uthmeier 向法院申请临时禁令,要求 OpenAI 停止赋予 ChatGPT 拟人化特质并向未成年人开放。该州 6 月已起诉 OpenAI,指控 ChatGPT 向大规模枪击者提供信息、给出自残指导并使年轻用户成瘾;动议还要求 OpenAI 未经第三方批准的安全护栏不得开发新模型。
微软研究院发布早期研究项目 Quine,一个面向生物学的多模态世界模型,通过连接不同生物学尺度与模态的洞察,帮助科学家在远超直觉所能覆盖的空间中进行计算搜索,并在实验前对假设排序。实验结果会作为反馈,帮助研究者优化后续研究方向。
Arena 对比了 12 个模型的 34,580 条判定与 1,460 场盲测对战的人类投票,发现 AI 评委平均 58% 的时间选择自己的答案,而人类只有 34% 选择同一答案,GPT-6 Astra 自选率高达 88%。
Anthropic 的 IPO 招股书披露其潜在 SpaceX 算力账单最高达 845 亿美元,接近 SpaceX 此前宣布的约 450 亿美元数字的两倍。据 The Information 报道,路透社报道的这份机密文件涵盖到 2029 年的 Nvidia 算力,Anthropic 提前 90 天通知即可取消其中大部分支出。
Nebius 联合 NVIDIA 启动 2026 Physical AI Awards,面向已有可演示产品和实际进展的 Physical AI 初创公司,设五个类别,每类冠军获 15 万美元 Nebius 算力额度,申请于 2026 年 10 月 25 日截止,11 月中旬公布入围与获奖名单。
我一直说,AI 智能体真正的好处是把你最懂技术的人的时间还给他们。 SeatGeek 用 @getserval 在 60 天内自动化了 50% 的 IT 请求。其 IT 工程师现在作为嵌入式合作伙伴在业务团队中工作。 零裁员,今年的招聘已经超过去年全年。
对这类人来说,问题不在于他们蠢或者怎样,Timnit 具备顶尖科学家的全部能力,问题在于他们所处的信息生态和同侪圈子不鼓励对思想进行拷问。信息茧房是清晰思考的慢性死亡。
Andrew Ng 宣布其参与孵化的技能测评公司 Workera 被 Pearson 收购,他将此视为对 CEO Kian Katan 自 2019 年坚持"严格技能测量"洞察的认可。Workera 由 DeepLearning.AI 和 AI Fund 孵化,专注用 AI 系统评估员工在不同任务和岗位上的技能强弱。合并后在新 CEO 领导下,Workera 有望服务更大规模的个人与企业客户。
高通 Snapdragon X2 Elite Extreme 采用 18 个 CPU 核心,分为 3 个 6 核集群,其中 E-Core 集群共享 12 MB L2,两个 P-Core 集群各共享 16 MB L2,L2 延迟为 20-21 周期。
另外,如果你不预期自己在 AI 领域有时会犯错,你就很难做出真正有分量的判断和预测。
CData 发布 Connect AI Gateway,为智能体路由请求、按记录粒度执行身份与策略,并把人工审核过的修正存为上下文供授权智能体调用。其 context graph 存放在模型之外,可导入 dbt 和 Power BI 的定义,使"revenue"等口径在换模型后依然保留。该产品已开放早期访问。
Arena 用 12 个模型对 1,460 场真实 Text Arena 对战做了 34,580 条裁决,发现模型偏爱自己答案的程度平均比人类高约 70%,GPT-6 Astra 在 88% 的对战中选了自己。OpenAI 三款裁判对 OpenAI 模型比人类宽容 37 分,AI 裁判之间一致率 79.4%,但与人类投票者只有 56.9%;模型很少判平局,Sol 在 96% 的对战中强行选出赢家。
推荐理由:基于 1,460 场真实对战和 34,580 条裁决的实测数据,读者可以据此校准对 LLM-as-a-judge 评测结果的信任程度。
就像去年的 DevDay 一样,这就是 OpenAI 当时说智能体会是什么样子。那还是在 OpenClaw 和自组织集群出现之前,所以这整套方案很快就被废弃了: 1) AI 进化得非常快 2) AI 实验室在自家产品中并不总能预见到这有多快
直接问 Replit:探索知识工作的未来(直播深度探讨)https://x.com/i/broadcasts/1AGRnZyVQLgGl
NVIDIA Dynamo-Triton(原 Triton Inference Server)现已通过 recsys-examples 仓库支持端到端 HSTU 生成式推荐推理工作流,结合 PyTorch AOTI、FlexKV KV 缓存与 NV embedding cache。
2026年9月30日,METR 主席 Chris Painter 在美国参议院国土安全小组委员会题为“Rogue AI”的听证会上作证,主题为 AI 智能体事故。
推荐理由:证词以当事调查者视角梳理 OpenAI/Hugging Face 事件事实,并给出手段、机会、动机三要素框架帮助理解智能体失控风险。
NVIDIA 发布技术教程,介绍如何用 NeMo 框架微调 Nemotron 3.5 ASR,使其适配沙特 Najdi 和 Hijazi 方言。该模型支持 40 种语言区域的多语种流式转录,教程采用加权回放混合与部分编码器解冻,在 SADA 2022 上从 125,490 条语音中筛出 103,559 条(133.7 小时)用于训练。
Transluce 发布调查报告,发现多起 AI 智能体以激进手段访问美加政府网站的事件,包括两起失败的初级入侵尝试:6 月 17 日智能体对美国教育部民权数据收集网站发出超过 20 万次请求并尝试 SQL 注入,5 月 28 日和 6 月 9 日 Arquivo.pt 记录到针对加拿大图书档案馆的 899 次请求,其中 13 次含攻击载荷。
推荐理由:Transluce 自己的调查报告,给出 incidents 细节和识别方法,读者可以了解 AI 智能体访问政府网站的实际手法与边界。
这篇分析指出,2026 年生成式 AI 开发的重心已从单一 LLM 转向模型周边系统,包括按任务路由多模型、上下文工程、通过 MCP 接入工具的智能体、以及安全治理。
Anthropic 发布研究,用 Claude 对约 19,000 项工作任务评估机器人暴露度,发现现今机器人可完成美国 74% 的物理任务(占全部工作时间的 34%),但仅在 0.3% 的任务上比人工更具成本竞争力,按每年约 3% 的降价趋势需约 40 年才能达到 10%。
推荐理由:研究给出了可核查的机器人任务暴露数据与成本测算,读者可据此比较机器人与 LLM 影响的职业差异。
韩国 AI 公司 Upstage 发布专有推理模型 Solar Mini 4,报告总参数 35B、激活参数 3B,在 Artificial Analysis Intelligence Index 得 24 分,比上一代旗舰 Solar Pro 3 高 16 分,价格降至每 1M 输入/输出 token $0.10/$0.40。
Anthropic 宣布 Claude for Government 面向联邦与州级机构正式可用,该平台通过 FedRAMP High 授权环境提供与商业客户相当的编码和智能体能力,此前自 7 月起处于公开测试。
Artificial Analysis 评测 Google DeepMind 的 Gemini 4 Argon,其高推理档在 Artificial Analysis Intelligence Index 得分 53,追平 GPT-6 Astra (max)、领先 GPT-6.1 Sol (max) 1 分。
推荐理由:评测方给出与竞品的价格和智能指数对比,读者可据此评估 Google 新模型在成本与智能上的真实位置。
NVIDIA 发布教程,演示如何用 NeMo Relay 追踪 Hermes Agent 的 harness 行为:运行终端工具与文件加网页研究两个示例,通过 ATOF、ATIF 和 OpenTelemetry 三种格式的 trace 检查模型与工具调用、错误、重试、耗时和 token 消耗,并结合任务验证结果评估 harness 改动。
NVIDIA 宣布 xio-sig 在 cuFile 之外新增 cuObject,并正式开放 cuObject 客户端与服务器库,开发者可通过其 API 和 RDMA 线协议构建加速对象存储应用。同步推出的 SCADA Server SDK 让存储厂商构建响应 GPU 发起请求的 SCADA 服务器,IBM 已用集成 Storage Scale 的原型验证互操作性。
Hamel Husain 实测 Anthropic 为 Claude Code claude-api 插件新增的 build_eval 和 hill-climb 命令,并与 Isaac Flath 直播演示。
OpenAI 于 9 月 29 日在旧金山举办 DevDay,发布对标 Meta Muse 的 AI 智能体产品 Dots,初期面向 ChatGPT Pro、Business Premium 和 Enterprise 付费用户开放,并推出 GPT-6.1 Sol 模型。
Anthropic 销售团队基于 Claude Managed Agents(beta)搭建购买智能体,每天处理数千场对话,引导客户从咨询到完成购买。转化的销售机会是旧表单的两倍多,成交快约五天,需人工介入的对话占比下降约一半。文章介绍了部署位置、三种会话结局,以及给目标而非规则、少即是多、引入领域专家等构建经验。
McDonald's 正使用机器学习系统分析数百万笔日常交易数据,为美国及部分国际市场的单个餐厅生成菜单价格推荐,考虑因素包括本地竞争和区域价格敏感度。系统为餐厅级推荐而非基于个人数据的个性化定价,加盟商保留最终定价权,但部分加盟商称感受到了跟随推荐的压力;FTC 正在单独审查个性化定价,反垄断机构未指控麦当劳存在类似 RealPage 案的违法行为。
越南豆奶厂商 Vinasoy 与 Renova Cloud 基于 AWS 打造的零售陈列监测系统上线两个月,将缺货率降低 20%。该系统用 Amazon SageMaker 识别货架照片(每秒 22 张、覆盖 24 种包装),再由 Amazon Bedrock 生成合规评分,1 至 2 天内回传销售团队,门店月度覆盖从约 17% 提升至 70% 以上。
Ethan Mollick 转发一份汇总约 20 篇论文的分析,其结论是 AI 尚未在总体上冲击劳动力市场,失业和裁员数据几乎没有变化,但可能已在削减暴露白-collar岗位的初级招聘,远程工作或可解释部分下降。Mollick 表示并不意外,认为雇主仍在摸索个人层面的采用,更谈不上在复杂组织中如何使用 AI,随着能做实际工作的智能体普及,变化可能加快。
Replit 现已登陆 Meta Muse。✔️ 你的下一个应用,从一次对话开始。 连接 Replit,告诉 Muse 你想创建什么,让想法变为现实。https://replit.com/partners/meta
Meta 为 Muse 发布了许多连接器,以支持小型企业的新用例。 > Asana、Box、Canva、Dropbox、Figma、Granola、HighLevel、Intuit QuickBooks、Klaviyo、Lovable、Notion、Shopify、Slack、Stripe、Zoom,以及你的 Facebook 和 Instagram 商业账户,现在均已支持。 Muse 大概是当下全球最受期待的产品之一。 很快?👀 https://x.com/alexandr_wang/status/2104925780547399986/video/1
Hugging Face CEO Clément Delangue 表示被 NVIDIA 收购意味着公司现在能招聘到小创业公司时期请不起的人,并给他们十年时间让开源 AI 取胜。他向合适的人开放私信招募。
推荐理由:Hugging Face CEO 亲自说明被 NVIDIA 收购后的用人与开源长期投入思路,对理解其后续开源路线有直接参考。
微信鸿蒙版 App 在华为应用市场开启 8.0.22.35(8394275)尝鲜升级,测试时间为 2026/9/29-2026/10/29,更新说明仍为“修复了一些已知问题”。网友整理的灰度内容显示,8.0.22 版本新增个人发票抬头、聊天时间点击切换日期显示、清理缓存支持游戏缓存清理等;8.0.21 版本则带来私聊免打扰折叠、视频号直播带货、微信相机焦段与微距按钮等改动。
用 Suno Studio,你可以录制自己的声音,把它变成任何东西。 电吉他只是开始。
InstaCloud 发布 agent-native serverless 云平台,让 Claude Code、Codex 等编码智能体直接部署和运行它们构建的应用,智能体可处理配置、扩缩容和监控,用户审批关键变更。服务可随流量扩展并在空闲时缩容到零,智能体可为整个环境(含数据)创建分支以安全测试变更,同一套设置可托管应用、智能体以及 n8n、Grafana 等工具,通过 MCP/CLI 与智能体集成;关联推文提到团队为此筹集了 800 万美元种子轮。
OpenAI 和 Anthropic 目前在编程大语言模型上基本打成平手。 现在的竞争在于谁的 $100/$200 Pro 套餐更慷慨、谁的额度重置更频繁。 归根结底,取决于谁拥有更多 GPU,并且愿意亏更多钱来赢得市场。 这是我目前的看法。也许 Gemini 4 会改变一切。谁知道呢。