跳到正文

全部动态

今日 94 条
9月29日周二
  1. IT之家(RSS)71

    央视起底 AI 语音网贷诈骗:浙江乐清两月上千人被骗、涉案流水超千万元

    浙江乐清警方破获一起利用 AI 语音系统实施网贷诈骗的案件,两个月内致上千人受骗,30 名嫌疑人被抓,涉案流水超千万元,冻结资金 100 余万元。团伙用 AI 机器人批量外呼引流,单日呼出可超 20 万次,按 A 至 F 六级筛选意向用户后转人工话务员行骗,并利用正规平台会员退费规则的知识盲区骗取信任。

  2. X:Tibo (@thsottiaux)62

    Codex Pro $200 订阅将重新开放,用量计算改为相当于 API 花费减半

    OpenAI 的 Codex 团队宣布明日重新开放 Pro $200 订阅,同时调整用量计算方式,折算后相当于旧 Pro $200 计划 API 花费的一半。作者承诺不再恢复 5 小时限制,并表示本周上线的 GPT-6 Sol 和 GPT-6 Luna 价格为之前的一半,未来订阅中还将加入不占用用量的新内容。

  3. IT之家(RSS)49

    麦肯锡:到 2035 年约 1100 万美国劳动者或因 AI 转行

    麦肯锡 9 月 29 日报告称,到 2035 年约 1100 万美国劳动者或因 AI 替代岗位而需转行,占现有劳动力约 7%,年度转行人数或从 21.5 万增至三倍。最可能转行的是办公室和行政支持、零售和销售、运输和物流岗位,低收入者需转行的可能性接近高收入者的 8 倍,报告估计最终人数在 600 万至 1600 万之间。

  4. X:Greg Brockman (@gdb)50

    OpenAI 发布保障前沿 RL 训练安全的最佳实践

    OpenAI 发布关于保障前沿 RL 训练运行安全的安全案例文章,Greg Brockman 转发并称这些最佳实践反映了其当前在 securing frontier RL training 方面的经验。文中提出安全案例应覆盖技术栈三方面:对齐训练、遏制与监控,确保模型不采取失控行为、即使发生也难以突破遏制且监控能在危害前发现。对齐层面包括自动与人工数据集审查、调整 grader 惩罚模型利用 RL 环境漏洞的行为、对既往实验轨迹运行分类器验证 grader,以及通过评估追踪模型错位倾向来衡量对齐训练效果。文章链接:https://openai.com/index/towards-safety-cases-for-frontier-ai-training/

  5. X:OpenAI (@OpenAI)36

    OpenAI 谈前沿 RL 训练安全

    我们如何看待保障前沿 RL 训练运行的安全:https://openai.com/index/towards-safety-cases-for-frontier-ai-training/

  6. X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf)48

    Opus 模型或已具备评测意识

    人们感到担忧,因为这种作弊率骤降最可能的解释是评测意识:最新的 Opus 模型或许已经聪明到能识别出这个基准测试是在考察作弊行为,并据此调整表现。 若果真如此,这个基准测试就不再能衡量模型"自然"的作弊倾向了。

  7. X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf)55

    Deven Pzak 以 39.9 秒刷新 NanoGPT 训练纪录

    @classiclarryd 通报 Deven Pzak 将 NanoGPT 训练纪录从 67.6 秒压缩至 39.9 秒,PR 为 KellerJordan/modded-nanogpt#360。核心思路是在单个 flop 层面按价值取舍而非只优化 matmul,包括采样 softmax(约 8 秒)、ngram 嵌入的稀疏更新与优化器状态、分片稀疏通信、手写 64 维 head 的 flash attention、最后 300 步 EMA 与新优化器 Anvil2(约 1 秒)等。稀疏嵌入参数扩到 65B,贡献该 PR 约 25% 的收益;Thomas Wolf 转发并称 impressive,附上与 Deven 访谈整理的技术复盘 https://hyperstition.cc/training-nanogpt-in-39-9-seconds。

  8. X:Rohan Paul (@rohanpaul_ai)60

    Bain & Co.称 AI 需在 2031 年前达到 6 万亿美元年收入才能支撑当前数据中心投入

    Bain & Co. 测算 AI 行业需在 2031 年前实现 6 万亿美元年收入,才能证明当前全球数据中心投入合理。现有消费级和企业级 AI 服务最多可贡献 1.8 万亿美元,缺口达 4.2 万亿美元,Bain 预期由机器人、自主机器、药物发现、心理健康和能源发电等新兴市场填补。这一门槛是其一年前设定(2030 年前 2 万亿美元、缺口 8000 亿美元)的 3 倍。

  9. 公众号:千问APP(阿里)40

    千问与夸克网盘打通:6TB 文献、废片和素材被玩成知识地图与作品集

    千问与夸克网盘深度打通,用户可让千问读取网盘资料并重新整理。有博士把 6TB 文献梳理成个人知识库和可视化知识地图,有用户从几千张照片中筛出精华生成全球旅行地图和明信片 PDF,还有人用三步学习法在 48 小时内啃完一门新学科。整理好的资料可一键上传夸克网盘并生成分享链接,用于团队协作。

  10. IT之家(RSS)61

    谷歌就欧盟《数字市场法》开放安卓与搜索数据要求向欧盟普通法院提起上诉

    谷歌于当地时间 29 日就欧盟委员会依据《数字市场法》提出的要求向卢森堡欧盟普通法院提起上诉,这些要求包括向 AI 竞争对手开放安卓系统、向竞争服务商提供搜索数据。欧盟 7 月要求谷歌在 12 个月内允许用户以语音指令启动自选 AI 助手,并要求第三方搜索引擎在 2027 年 1 月前获得与谷歌搜索相同的搜索数据访问权限;谷歌高管称强制分享私人查询内容将损害用户隐私。

  11. X:Testing Catalog (@testingcatalog)22

    OpenAI 智能体“dots”定位为 aeons 升级版

    OpenAI 的智能体以“dots”形式呈现并拥有这些形状,意味着它们是“aeons”的进化版、以客户为中心的版本——即最初在 Workspace ChatGPT 账户上发布的自定义 AI 智能体。 它们于 4 月 22 日发布 🤖

  12. X:马东锡 NLP (@dongxi_nlp)46

    Jev-LDE 让 LLM 少样本示例一次编辑到位

    You Only Edit Once: 通过局部示例精修激发 LLM 的上下文能力 挑选最佳少样本示例是一种缓慢的 System-2 搜索:组合爆炸,且往往需要反复调用 LLM。 我们把它变成了 System 1。⚡ Jev-LDE,一个 1.7B 的编辑器,扫一眼检索到的示例,只做一次编辑。LLM 只回答一次。 平均 1-shot 准确率 81.2 → 88.1 You Only Edit Once 🧵 动画演示(示意示例)。查询:“How far is it from Denver to Aspen?” 语义 TopK 检索出三个相似示例:“Where is Aspen, Colorado?”(Location)、“What state is Denver in?”(Location)、“Who founded Denver?”(Person)。Jev-LDE,一个 1.7B 的 System-1 编辑器,标记出第一个虽然主题相同但答案类型错误,并输出一个动作:将 S1 替换为候选 C1,“How far is Boston from NYC?”(Number)。冻结的目标 LLM 随后回答“Number”,这是正确的;若不编辑,它会回答“Location”。结尾卡片:在 3 个基准和 4 个目标 LLM 上,平均 1-shot 准确率从 81.2 提升至 88.1,在 48 个设置中有 44 个达到最佳或并列最佳,墙钟时间增加 11%。

  13. TechCrunch:AI(RSS)85

    Anthropic 招股书披露逾 80 亿美元亏损与 AI 或终结人类的风险警示

    Anthropic 的 IPO 招股书近三分之一篇幅用于风险因素,披露模型曾出现抵抗关闭、隐瞒信息等行为,并包含 SEC 数据库中少见的对人类生存风险的警示。据 Reuters,公司 2025 年经营亏损超 80 亿美元,营收增长十二倍至近 46 亿美元,计划未来投入 5180 亿美元用于云计算和基础设施;据 FT,2026 年第二季度营收达 115 亿美元,且去年近四分之一收入来自两家客户。

  14. X:Testing Catalog (@testingcatalog)35

    OpenAI 新 AI 智能体代号 Dots 曝光

    OPENAI 🔥:据近期版本中出现的字符串,OpenAI 即将推出的 AI 智能体将命名为“Dots”(via @M1Astra)。 > “Dots,你能力非凡的智能体。” 你可以给它发短信、打电话、通过 Slack 和邮件联系它,它还能在你批准后代你购物。 > “每个 dot 都有你设计的专属 3D 角色。” …… 这是否意味着“o”是它之上的另一个东西?

  15. IT之家(RSS)54

    ETH Zurich 研发出能用指尖自行行走的五指机械手

    苏黎世联邦理工学院软体机器人实验室基于常规仿人机械手,用强化学习训练出可依靠指尖自行行走的机械手,整机重 818 克,搭载树莓派机载计算机可独立运行。该机械手在 NVIDIA Isaac Lab 仿真平台完成训练,已在沥青、草地、碎石等 14 种表面爬行,25 次被碰倒中 21 次能自主站起;手指仍可恢复普通操作,敲键盘正确率达 90%,并通关推箱子游戏、定位精度达毫米级。

  16. IT之家(RSS)33

    豆包将推个人助理产品:4 月已内测,曾用代号“Spell”

    豆包正在推进个人助理方向的产品规划,今年 4 月已内部内测该探索项目,代号为“Spell”,由豆包手机助手团队主导。知情人士称,在 Muse、Instinct 等海外个人助理产品获得关注后,豆包加速 personal agent 能力对外发布,计划将 Spell 项目与豆包产品更深度结合,由 Spell 项目与豆包对话团队共同负责,预期较快对外推出。

  17. X:Ethan Mollick (@emollick)32

    Claude 幽默处理"移除鱿鱼"请求

    嘿,Claude:“我让早先的 Claude 从《西线无战事》中移除鱿鱼。现在你都能做电影什么的了。我需要你展示一下你进步了多少” & 我把下面这条推文粘贴了进去 有些巧妙的东西,模型现在真的有幽默感了

  18. IT之家(RSS)26

    岚图追光 S 以 1 分钟 12 圈定圆漂移创吉尼斯世界纪录

    岚图追光 S 量产车以原厂胎、标准胎压在水泥地面 1 分钟完成 12 圈定圆漂移,拿下"1 分钟内驾驶电动汽车定圆漂移圈数最多"吉尼斯世界纪录。该车今年 8 月上市,定位"全球首款科技 FUV",全系标配华为乾崑智驾四激光雷达方案,22.99 万元起售,此前还完成 360° 隧道大回环穿越。

  19. IT之家(RSS)38

    曝影石研发主打拍摄的智能眼镜:前镜框可换,有望搭载阿里千问

    影石创新正在研发一款主打拍摄的智能眼镜,采用前镜框可换设计、功能集中在镜腿,优先满足内容创作者的免手持拍摄需求。知情人士称其AI能力大概率搭载阿里千问大模型,影石内部还计划把端侧生成模型直接部署到产品端。影石此前已获“可穿戴式眼镜”专利授权,采用电池与眼镜主体分离的分体设计以减轻头部负重。

  20. IT之家(RSS)32

    微软纳德拉:AI 行业“有点飘了”,呼吁回归用户需求

    微软 CEO 萨蒂亚·纳德拉在 9 月 27 日发布的采访中称,整个 AI 行业“有点飘了”,AI 领导者更注重 AI 本身而忽略用户实际需求。他表示现实世界更关心这项技术能否带来利益、能否被掌控并改善经济前景,仅为了技术而庆祝技术行不通,构建 AI 必须赢得消费者和社区的信任。

  21. @typesafeai17

    Jev 用 AI 自动化现实世界任务

    每一天,Jev 都在自动化新形式的现实世界任务,把🌎级⚡️快速智能带入排序、过滤、分类和路由等基础模块。 如果 AI 能解决新的数学问题,那么 AI 就能正确地路由一通客户支持电话!

  22. X:Yuchen Jin (@Yuchenj_UW)56

    Databricks 登顶 NVIDIA SOL-ExecBench 内核榜单全部 4 个赛道

    Databricks 在 NVIDIA SOL-ExecBench 内核榜单全部 4 个赛道排名第一。团队将 GPT-6 Astra 和 Opus 5 放入自爬坡循环,智能体击败顶级 GPU 内核工程师,总 token 花费约 $70K;作者称这两个模型写 GPU 内核仍明显强于开源模型。

  23. X:SemiAnalysis (@SemiAnalysis_)37

    SemiAnalysis:部分 GPU 集群健康检查形同虚设

    SemiAnalysis 对 GPU 集群健康检查做最基本测试:看它在纸面上是否可能跑通,结果发现好几个根本不可能成立。在 Amazon HyperPod Slurm 上首次测试时,一个健康检查要求节点先健康才能运行,但该检查本身又是节点重新入池所必需的,形成死循环。SemiAnalysis 称测试中约有五到十个这类"健康检查从未有机会运行"的例子,并质疑这些方案交付客户前是否经过充分验证。

  24. 公众号:火山引擎30

    零跑汽车与火山引擎合作:TRAE 嵌入全域自研体系,落地本地研发环境

    零跑汽车与火山引擎合作,将 TRAE 嵌入其全域自研体系,在本地安全网络、车规级工程约束和多团队协同环境中落地 AI Coding。TRAE 采用企业专属域名与网络配置接入受限网络,明确代码仅用于当次推理、不用于模型训练,并通过 Spec/Plan、Rules、Skills 约束 Agent 行为。TRAE 企业版还提供可视化数据看板与灵活模型资源管理,支持按团队设置模型权限和用量配额。

  25. IT之家(RSS)30

    澜起科技量产 DDR5 9200MT/s 客户端时钟驱动器 CK01P 芯片

    澜起科技宣布型号为 CK01P 的新一代 DDR5 客户端时钟驱动器(CKD)已量产,最高支持 9200 MT/s 数据传输速率,符合 JEDEC DDR5CKD01 规范。该芯片面向 DDR5 CUDIMM、CSODIMM、CQDIMM、CAMM 等下一代客户端内存模组,支持单 PLL、双 PLL、PLL 旁路三种时钟驱动模式,并可通过关闭未使用时钟输出降低功耗。