跳到正文

全部动态

今日 94 条
10月3日周六
  1. X:Francois Chollet (@fchollet)16

    Keras 社区会议本周五举行

    现在开始! (引用推文内容:欢迎参加本周五 10 月 2 日太平洋时间上午 10 点举行的 Keras 社区会议,届时将展示 Keras 生态系统的最新进展。会议对所有人开放,请通过此链接加入:https://meet.google.com/gva-bbpr-twe)

  2. TechCrunch:AI(RSS)39

    Circuit Breaker Labs 想用 AI 智能体让 AI 对儿童和成人更安全

    Circuit Breaker Labs 打造了一支"碰撞测试假人"式的 AI 智能体队伍,模拟不同年龄、背景、语言和文化的用户,对模型进行红队测试,每天运行数万至数十万次模拟交互,以检测危险的心理有害互动。这家仅有 5 名员工的公司目前作为 AI 安全测试实验室,服务 AI 教练、日记和心理健康支持等高风险应用,并采用专有评分方法生成可审计、可解释的分数。

  3. X:Elvis Saravia (@omarsar0, DAIR.AI)35

    Kled V3:72小时众包采集AI训练数据

    Kled V3 推出数据采集平台,实验室可指定所需数据,平台能在 72 小时内向 50 万+ 自愿贡献者网络部署采集任务。平台提供覆盖图像、视频、音频、文本和标注的 108 个可配置模板,贡献者用手机按指令和示例完成采集。其核心价值在于缩短反馈闭环:定位模型失败点、转化为采集任务、获取真实世界新样本、再训练评估。

  4. X:Runway (@runwayml)26

    Runway AI Summit 落幕,发布 Continuum

    Runway AI Summit 落幕,Runway 联合创始人兼联合 CEO Cristóbal Valenzuela 回顾了生成式视频的演进,并介绍了 Runway Labs 的最新项目 Continuum。 前往 https://summit.runway.com/talks 注册,即可在完整演讲上线时收到通知

  5. X:Dan Hendrycks (@hendrycks)41

    Dan Hendrycks 推出 AI 安全课程

    今天在 Coursera 上线了一门新课程。 课程包含 3 个部分: - AI 入门(驱动力、瓶颈、时间线) - AI 风险(恶意使用、失控、权力集中) - AI 治理(AI、企业、国家及国际层面的治理) https://www.coursera.org/learn/intro-to-ai-safety

  6. OpenAI:官网动态(RSS · 排除企业/客户案例)71

    OpenAI 发布 GPT-6 家族实用指南:选型、提示词与长任务管理

    OpenAI 发布 GPT-6 家族的实用指南,讲解如何按任务选择 GPT-6 Astra、GPT-6.1 Sol、GPT-6 Luna 及推理档位与速度模式。

    推荐理由:原文系统给出 GPT-6 家族的选型、缓存成本、长任务管理等可操作方法,读者可直接迁移到自己的生产工作流。

  7. X:ElevenLabs (@elevenlabs)42

    ElevenLabs 获 FedRAMP 20x Class A 认证

    ElevenLabs 宣布已获得 FedRAMP 20x Class A 认证,该认证覆盖 ElevenAgents 及文本转语音、语音转文本 API,需在 Zero Retention Mode 与美国数据驻留条件下运行。

  8. Hacker News 热门(buzzing.cc 中文翻译)48

    《冯·诺伊曼传奇》:Halmos 笔下的数学天才

    数学家 Paul Halmos 撰文回顾 John von Neumann 的一生,记述其从布达佩斯童年到量子物理、逻辑学、气象学、博弈论与高速计算机的广泛贡献。文中提到 von Neumann 6 岁能心算两个八位数相除,8 岁掌握微积分,12 岁读懂 Borel 的《函数论》,20 岁发表的序数定义被普遍采用。

  9. X:PixVerse (@PixVerse)28

    PixVerse 插件生成产品开箱视频

    用 PixVerse 插件把产品创意变成开箱视频 描述产品、场景和出镜者的反应。你的 AI 智能体用 PixVerse 生成视频!

  10. X:Replit (@Replit)15

    Replit 谈 AI 如何重塑销售角色

    Sales Is Shipping Software | Andrew Verrilli 谈 AI 以及它如何塑造销售角色 https://x.com/i/broadcasts/1mxPaZegOdqKN

  11. Google Cloud:Databases(RSS)57

    Google Cloud 发布 Spanner queues,为智能体工作负载提供原生事务性消息

    Google Cloud 宣布 Spanner queues 正式商用,将事务性消息直接嵌入 Spanner,使状态变更与下游动作在同一事务中原子提交或完全失败。它支持原子决定与入队、定时执行与取消、流式 SQL 消费与租约续期、记忆持久化与移交,通过 at-least-once 送达加 at-most-once ACK 实现恰好一次处理,也可用于社交、零售、金融等事件驱动架构。

10月2日周五
  1. X:Google AI (@GoogleAI)26

    Google 推出 Project Suncatcher

    了解更多 ↓ https://blog.google/innovation-and-ai/models-and-research/google-research/google-project-suncatcher-facts/?utm_source=tw&utm_medium=social&utm_campaign=og

  2. X:Google AI (@GoogleAI)66

    Google Project Suncatcher 首颗原型卫星发射入轨

    Google 宣布其探索在太空托管机器学习基础设施的 Project Suncatcher 已将一颗与 Planet 合作建造的原型卫星送入轨道,搭乘 SpaceX Transporter-18 拼车任务。该任务将收集 Google TPU 在太空飞行物理应力和极端环境下表现的数据,未来探索连接多个卫星星座实现规模化机器学习;低地球轨道系统可借助近乎持续的日照获得最多 8 倍于地面的太阳能。

    推荐理由:原文给出原型卫星、合作方和任务目的,读者可以了解 Google 太空算力设想的当前进展与验证路径。

  3. X:DAIR.AI (@dair_ai)48

    NVIDIA 论文:长时运行智能体可靠性测试

    NVIDIA 发布 Long-Transduction 测试框架,让模型在数千次输出中持续读取、更新并输出状态相关结果,分别变化三个因素。在七个开源权重模型上,上下文从 4K 增至 128K 时准确率下降 62.8%,仅改变输入格式下降 36.5%,单步操作变难下降 39.9%。

  4. IT之家(RSS)14

    焕新极氪 001 推出哑光岩灰车色与冰川灰内饰

    极氪汽车为焕新极氪 001 新增外饰色“哑光岩灰”和内饰色“冰川灰”,10 月 1 日至 10 月 31 日下定可享限时权益。该车于 2025 年 10 月 11 日上市,售价 26.98 万元起,全系标配 900V 全栈高压架构,CLTC 续航最长 810 公里,10%-80% 充电最快 7 分钟。极氪同时预告 2027 款极氪 001 计划于 2027 年第一季度上市。

  5. X:swyx (@swyx)22

    AI Security Summit 第二届回归,Snyk 继续任创始合作伙伴

    swyx 宣布第二届 AI Security Summit 回归,他继续以创始合作伙伴身份与 Snyk 合作,2025 年的所有合作伙伴均已回归。他表示自一年前创办以来,恶意智能体数量激增、数据泄露与 AI 驱动的攻击增多,安全必须成为 AI 讨论的核心,这些问题已不再是理论。

  6. X:Testing Catalog (@testingcatalog)50

    Gemini Desktop 将推完全访问权限

    Gemini Desktop 应用新增隐藏的"Additional sandbox options"设置,将提供"Full Access"权限,允许 Gemini 读取、创建、修改或删除 Mac 上任意文件,无需逐次授权即可联网收发数据,并与 Mail、Safari、Messages 等应用交互执行操作。

  7. Hacker News:AI 热帖57

    智能体编程的四大天启骑士:工程师与代码疏离、技能退化与团队纽带瓦解

    作者总结智能体编程带来的四个问题:LLM 生成代码带有让人难以亲近的 slop 风格,如 Claude 输出词 salad、Astra 写出代码高尔夫式风格;工程师因远离直接编码而失去掌控感与责任感;技能退化真实存在,长期使用 AI 后智力下滑,且 AI 使用几乎没有学习曲线;团队聊天被 agent 对话取代,人际交流与技能表达被削弱。作者自认对这些困境没有解决方案。

  8. X:Suno (@suno)23

    Suno 测试版输出异常

    测试版期间可能会出现一些奇怪的输出。你的反馈有助于让它变得更好。 https://suno.com/s/jx9kt9ovaezNzfJm

  9. Hacker News:AI 热帖35

    AI Makes Me Sad:一位开发者对 AI 时代的失落与期待

    一名开发者发文《AI Makes Me Sad》,坦言每次看到 AI 新进展都感到无望,不愿以给 Codex 或 Claude 写提示词为生,认为这意味手艺、控制力与创造力的丧失。他批评 X 上大量认证机器人用 LLM 生成无意义回复却无人治理,并指出数千亿甚至数万亿美元的 AI 投入对日常应用用户几乎没有带来实际收益。他仍抱有希望:科技行业变化极快,AI 在社会中的角色会在几年内定型。

  10. X:Runway (@runwayml)21

    Canva、ElevenLabs、Nebius 谈 AI 创意工具

    Canva AI 研究负责人 Stefano Corazza、ElevenLabs CRO Ashley Kramer 和 Nebius CMO Lindsey Irvine 探讨为创意人士打造 AI 工具、为何控制力与一致性最为重要,以及智能体如何改变营销团队的工作方式。

  11. X:SemiAnalysis (@SemiAnalysis_)29

    SemiAnalysis 评 Google GPU 集群体验达金牌级

    SemiAnalysis 将 Google GPU 集群体验评为金牌级,称 Google 团队不到两年从铜牌升至金牌。但 GCP 的 GPU 体验仍不如其白金级供应商 CoreWeave 和 Nebius,控制台相比新兴 neocloud 的简洁 UI 显得笨重,访问需依赖偶尔不配合的 Google Cloud CLI,有时被迫改用同样不可靠的浏览器连接。

  12. X:Mustafa Suleyman(Microsoft AI CEO) (@mustafasuleyman)37

    微软AI语音模型登陆Vercel

    用全球最好的语音和流式转录模型构建你的智能体……现在可以在 @vercel 上轻松使用了 质量和速度均排名第一……比任何其他超大规模云厂商都便宜……比 Eleven Labs 便宜高达 60%