跳到正文

全部动态

今日 94 条
10月2日周五
  1. X:SemiAnalysis (@SemiAnalysis_)31

    Nvidia Rubin 计算裸片 16% 用于 HBM4 接口

    计算裸片上的面积极其宝贵,但其中相当大一部分却仅用于与内存对接。我们估算,HBM4 控制器和 PHY 约占 Nvidia Rubin 计算裸片的 16%。这意味着大量先进制程硅片被用于与内存通信,而非执行计算。(1/3)🧵

  2. X:Krea AI (@krea_ai)69

    FLUX 3 Image 现已登陆 Krea,支持多轮编辑与 4K 生成

    Krea 宣布 FLUX 3 Image 已上线其平台。新能力包括多轮编辑且不改动其他像素、用 bounding box 排版图像、最高 4K 生成,以及组合最多 10 个参考图。

    推荐理由:官方宣布 FLUX 3 Image 上线 Krea,列出了多轮编辑、4K 生成等具体能力,读者可据此评估是否替换现有图像工作流。

  3. X:马东锡 NLP (@dongxi_nlp)51

    东锡 NLP 畅想用 Griffin 和 Agent 开咨询公司,又自问届时还需不需要人

    Tavus 发布 Griffin,称其为首个通过视频图灵测试的模型,48% 与其实时对话的人认为它是真人,此前系统通过率低于 3%,并在 NVIDIA 的全双工 AI 视频基准上排名第一。作者东锡 NLP 玩笑式畅想用 Agent 干活、让 Griffin 开会甚至面试来承接大量远程职位,又反问真发展到那一步还需要什么远程工程师和咨询公司。

  4. X:OpenAI Developers (@OpenAIDevs)28

    OpenAI DevDay 支线任务送 Chromatic

    听说你们喜欢 @modretro Chromatic。 所以我们往支线任务里加了一台。 还有 48 小时可以加入。 https://side-quests.openai.chatgpt.site/

  5. X:Replit (@Replit)23

    Replit 助你分析漏斗提升激活率

    用户在注册。帮更多人达成首次成功。 在 Replit 中分析你的漏斗数据,然后问:“我们在哪里可以提高激活率?” 接着追问:“把它做成一个仪表盘。” 你不需要在开始前就知道最终产出。一个问题可以带来一个洞察,然后变成有用的东西。

  6. X:马东锡 NLP (@dongxi_nlp)40

    arXiv 推出更严格投稿限流政策

    arXiv 更新了面向所有投稿者的 rate limiting 政策,称此举是为公平分配审核时间、支持其员工、志愿者、读者与作者社区。马东锡 NLP 评论称,Vibe research 时代有想法就大概率能变成成果,但判定成果的标准已落后于时代,新标准尚无答案。

  7. X:fal (@fal)51

    Grok Imagine Video 1.5 Lite 上线 fal 平台

    fal 宣布 Grok Imagine Video 1.5 Lite 上线,这是 Grok Imagine 视频家族中的轻量版模型。支持文生视频和图生视频并带原生音频,时长 1 到 15 秒;可输出 480p、720p 和 1080p,覆盖从 16:9 到 9:16 的 7 种画幅。

  8. X:OpenRouter (@OpenRouter)72

    FLUX 3 Image 上线 OpenRouter,支持原生 4K 生成与多参考编辑

    Black Forest Labs 的 FLUX 3 Image 现已上线 OpenRouter,是支持文生图与多参考编辑的旗舰图像模型,原生可渲染至 4K。原文提到可精确多轮编辑不动其他像素、用 bounding box 布局、最多用 10 个参考图合成,商业权重已开放,开放权重版将在未来数周发布。

    推荐理由:原文给出 FLUX 3 Image 的核心能力与开放权重计划,读者可据此评估是否接入工作流。

  9. Suno:Blog(网页)71

    Suno 推出 Speech beta:语音与背景音乐一体生成

    Suno 推出 Speech beta,称其为首个能把语音与原创背景音乐作为一条完整曲目生成的音频模型。用户输入文字并描述想要的声音和音乐风格即可创作,beta 已向所有用户开放,官方提示仍存在口音漂移、停顿过重等问题并将持续改进。

    推荐理由:官方介绍了 Speech 的玩法和 beta 限制,还附了官方博客链接,想试用或了解语音加音乐一体生成的可以看看。

  10. X:fal (@fal)58

    fal 发布 fal Recast,一键替换视频中的角色

    fal 发布 fal Recast,上传已有视频加一张新角色参考照,即可替换画面中的角色,同时保留原始动作、镜头运动、剪辑和音频。可用于制作角色变体、面向不同受众调整广告素材,无需重新拍摄;该功能由 H3 Max 驱动。

  11. X:Higgsfield AI (@higgsfield)59

    Higgsfield 上线 Black Forest Labs 的 FLUX 3 Image

    Higgsfield 宣布 FLUX 3 Image 已在其平台上线,该模型来自 Black Forest Labs。支持只改一处细节不动其余部分、用 bounding box 放置物体、最多组合 10 个参考图,以及生成最高 4K 分辨率图像。

  12. X:Boris Cherny (@bcherny)62

    Claude Code 推出 Mods,可通过提示词自定义行为与界面

    Claude Code 推出 Mods 功能,用户只需提示词即可自定义 Claude 的工作方式和界面外观,也可用几行 TypeScript 编写或让 Claude 代为构建。Mods 随插件分发,通过 /plugin 在 CLI 或桌面应用安装,并可作为插件分享给他人。

  13. X:Testing Catalog (@testingcatalog)64

    Claude Code 推出 Mods 功能,用户可修改构建并自定义 UI

    Anthropic 为 Claude Code 推出 Mods 功能,用户可以修改构建。Mods 本质上是 hook,随插件分发,每个是一个小型 JavaScript 或 TypeScript 模块,在会话内运行并能看到每个事件,可重写或替换 Claude Code 的行为,甚至绘制自定义 UI,还可通过 Claude Directory 与他人分享。

  14. Hacker News 热门(buzzing.cc 中文翻译)65

    Earendil 发布 Pi 1.0 稳定版及实验性包 Pi Durable

    Earendil 发布 Pi 1.0,一个稳定、极简、可扩展的智能体编码框架,每周有数十万人使用。1.0 新增 Codemode(原生支持 MCP 及 Jev、图像模型等非 LLM 模型)、虚拟模型扩展支持、延迟工具加载、Anthropic 模型缓存预热、会话中途系统消息、新 TUI 主题和默认全屏模式。

  15. X:Rohan Paul (@rohanpaul_ai)62

    Tavus 发布 Human Interaction Model Griffin,48% 真人误认其为人类

    Tavus 发布首个 Human Interaction Model(HIM)Griffin,称其为首个通过视频图灵测试的模型。48% 与其实时视频对话的人误以为对方是真人,此前系统通过率低于 3%,并位列 NVIDIA 全双工 AI 视频基准第一。作者 Rohan Paul 转引 Tavus 官方发布并补充演示视频中的表现。

  16. X:fal (@fal)62

    fal 上线 FLUX 3 文生图与图像编辑试用入口

    fal 宣布 Black Forest Labs 的 FLUX 3 可在其平台试用,提供文生图与图像编辑两个入口。链接为 https://fal.ai/models/blackforestlabs/flux-3/text-to-image 和 https://fal.ai/models/blackforestlabs/flux-3/edit-image。

  17. X:fal (@fal)63

    FLUX 3 Image 上线 fal 平台

    fal 宣布 FLUX 3 Image 已上线平台,主打精准图像编辑且保留未改动部分。该模型支持原生 2K 和 4K 图像生成、最多组合 10 张参考图、一次完成多个定点编辑,并可对布局和构图做细致控制。

  18. TechCrunch · AI61

    ChatGPT 上线虚拟试穿与收藏购物功能

    OpenAI 宣布 ChatGPT 全球上线两项购物功能,分别是虚拟试穿和收藏(Favorites)。用户在购物结果中点击新的 Try On 按钮并上传自拍或全身照,即可查看服装或配饰的上身效果,也可上传网页截图等商品图让 ChatGPT 代为试穿;Favorites 则把商品存入应用内的 Library 以便之后找回,并与试穿图片一起保存。

  19. X:ARC Prize (@arcprize)11

    ARC-AGI-3 相关 Kaggle 代码分享

    Lohit Siriki https://www.kaggle.com/code/sirikilohit/arc-agi-3-duck-18-1gc-submit https://www.linkedin.com/in/lohitsiriki/

  20. X:ARC Prize (@arcprize)11

    ARC Prize 分享 Kaggle 用户 Notebook

    Lord Han Solo https://www.kaggle.com/lordhansolo Notebook: https://www.kaggle.com/code/lordhansolo/built-on-tufa-labs-duck-harness-milestone-2

  21. X:ARC Prize (@arcprize)45

    ARC-AGI-3 里程碑2获奖者公布

    ARC Prize 2026:ARC-AGI-3 里程碑 #2 获奖者 恭喜三位获奖者开源了他们的高分 ARC-AGI-3 解决方案: 1. Daniel Franzen - 27.9%,$25K 2. Lord Han Solo - 23.8%,$7.5K 3. Lohit Siriki - 22.5%,$5K 了解更多关于每个提交方案的信息:

  22. X:ARC Prize (@arcprize)24

    ARC-AGI-3 里程碑2解法分享

    Daniel Franzen https://da-fr.github.io/ Notebook: https://www.kaggle.com/code/dfranzen/arc-agi-3-milestone-2-solution

  23. X:Rohan Paul (@rohanpaul_ai)51

    Grok 4.7 上线网页端

    Grok 4.7 已在网页端可用。截图显示 Expert 模式提示“Thinks hard Grok 4.7”,界面还提供 Auto、Fast、Build、Heavy 等模式选项。

  24. X:Elvis Saravia (@omarsar0, DAIR.AI)47

    Onepin 为 AI 语音加质检层

    我认为 AI 语音缺少一层质量检查。 在我构建的大多数应用中,语音听起来已经很棒了。但真正让生产环境出问题的,是模型把“Q3”、“v1.2”或品牌名读错。 这对人们感知语音智能体的方式影响巨大。 @OnepinAI 正在解决这个问题。在你听到之前,他们会检查每一行的自然度、清晰度和发音。 当一个词读错时,它会直接修复那个词,而不是重新生成整行。

  25. X:Karina Nguyen(@karinanguyen)30

    Fable 5.1 登顶 PostTrainBench

    一个有趣的结果:Fable 5.1 得分 44.6%,高于 Fable 5 的 37.3%,同时平均少用 33 分钟。这里的进步也意味着从每小时的自主工作中获得更多产出。 大多数智能体运行 8–10 小时,却取得显著不同的分数。下一个有趣的问题是,每多运行一小时,每个智能体能获得多少提升!

  26. X:Thariq (@trq212)35

    Claude 可为你制作 mods

    Claude 能为你制作 mods! 只需提示它,更多内容见 @addyosmani 的博客文章:https://claude.dev/blog/getting-started-with-claude-code-mods/