Epoch AI 收集 5000 名 ChatGPT 用户使用数据并推出 usage explorer
Epoch AI 收集了 5000 名 ChatGPT 用户的使用模式元数据,并在新的 ChatGPT usage explorer 中公开。数据历史覆盖 2022 年 12 月至 2025 年 12 月,显示该用户群体随时间推移对 ChatGPT 的使用强度不断提高。
Epoch AI 收集了 5000 名 ChatGPT 用户的使用模式元数据,并在新的 ChatGPT usage explorer 中公开。数据历史覆盖 2022 年 12 月至 2025 年 12 月,显示该用户群体随时间推移对 ChatGPT 的使用强度不断提高。
计算裸片上的面积极其宝贵,但其中相当大一部分却仅用于与内存对接。我们估算,HBM4 控制器和 PHY 约占 Nvidia Rubin 计算裸片的 16%。这意味着大量先进制程硅片被用于与内存通信,而非执行计算。(1/3)🧵
Krea 宣布 FLUX 3 Image 已上线其平台。新能力包括多轮编辑且不改动其他像素、用 bounding box 排版图像、最高 4K 生成,以及组合最多 10 个参考图。
推荐理由:官方宣布 FLUX 3 Image 上线 Krea,列出了多轮编辑、4K 生成等具体能力,读者可据此评估是否替换现有图像工作流。
Tavus 发布 Griffin,称其为首个通过视频图灵测试的模型,48% 与其实时对话的人认为它是真人,此前系统通过率低于 3%,并在 NVIDIA 的全双工 AI 视频基准上排名第一。作者东锡 NLP 玩笑式畅想用 Agent 干活、让 Griffin 开会甚至面试来承接大量远程职位,又反问真发展到那一步还需要什么远程工程师和咨询公司。
听说你们喜欢 @modretro Chromatic。 所以我们往支线任务里加了一台。 还有 48 小时可以加入。 https://side-quests.openai.chatgpt.site/
用户在注册。帮更多人达成首次成功。 在 Replit 中分析你的漏斗数据,然后问:“我们在哪里可以提高激活率?” 接着追问:“把它做成一个仪表盘。” 你不需要在开始前就知道最终产出。一个问题可以带来一个洞察,然后变成有用的东西。
arXiv 更新了面向所有投稿者的 rate limiting 政策,称此举是为公平分配审核时间、支持其员工、志愿者、读者与作者社区。马东锡 NLP 评论称,Vibe research 时代有想法就大概率能变成成果,但判定成果的标准已落后于时代,新标准尚无答案。
从一个想法到一款可以在 @modretro 上玩的游戏。 我们与 @Casey 聊了聊创意的未来:
fal 宣布 Grok Imagine Video v1.5 lite 已可在其平台试用,提供 Text-to-Video 和 Image-to-Video 两个入口。链接:https://fal.ai/models/xai/grok-imagine-video/v1.5/lite/text-to-video 与 https://fal.ai/models/xai/grok-imagine-video/v1.5/lite/image-to-video
fal 宣布 Grok Imagine Video 1.5 Lite 上线,这是 Grok Imagine 视频家族中的轻量版模型。支持文生视频和图生视频并带原生音频,时长 1 到 15 秒;可输出 480p、720p 和 1080p,覆盖从 16:9 到 9:16 的 7 种画幅。
OpenRouter 发帖介绍 FLUX 3 的参考图能力,用户可一次性提供最多 10 张参考图并在单个提示词中描述场景,由模型决定各参考图的位置并共同渲染出整幅画面。
Black Forest Labs 的 FLUX 3 Image 现已上线 OpenRouter,是支持文生图与多参考编辑的旗舰图像模型,原生可渲染至 4K。原文提到可精确多轮编辑不动其他像素、用 bounding box 布局、最多用 10 个参考图合成,商业权重已开放,开放权重版将在未来数周发布。
推荐理由:原文给出 FLUX 3 Image 的核心能力与开放权重计划,读者可据此评估是否接入工作流。
Apache Iceberg 社区为 Iceberg REST Catalog 推进两项新规范:read restrictions 与 catalog labels。
Suno 推出 Speech beta,称其为首个能把语音与原创背景音乐作为一条完整曲目生成的音频模型。用户输入文字并描述想要的声音和音乐风格即可创作,beta 已向所有用户开放,官方提示仍存在口音漂移、停顿过重等问题并将持续改进。
推荐理由:官方介绍了 Speech 的玩法和 beta 限制,还附了官方博客链接,想试用或了解语音加音乐一体生成的可以看看。
在 fal 上试试: https://fal.ai/models/minimax/h3-max/recast/
fal 发布 fal Recast,上传已有视频加一张新角色参考照,即可替换画面中的角色,同时保留原始动作、镜头运动、剪辑和音频。可用于制作角色变体、面向不同受众调整广告素材,无需重新拍摄;该功能由 H3 Max 驱动。
现在就在 Higgsfield 上试用 FLUX 3 Image: https://higgsfield.ai/ai/image?model=flux-3-image
Higgsfield 宣布 FLUX 3 Image 已在其平台上线,该模型来自 Black Forest Labs。支持只改一处细节不动其余部分、用 bounding box 放置物体、最多组合 10 个参考图,以及生成最高 4K 分辨率图像。
Claude Code 推出 Mods 功能,用户只需提示词即可自定义 Claude 的工作方式和界面外观,也可用几行 TypeScript 编写或让 Claude 代为构建。Mods 随插件分发,通过 /plugin 在 CLI 或桌面应用安装,并可作为插件分享给他人。
@Bot 速度大幅提升
Anthropic 为 Claude Code 推出 Mods 功能,用户可以修改构建。Mods 本质上是 hook,随插件分发,每个是一个小型 JavaScript 或 TypeScript 模块,在会话内运行并能看到每个事件,可重写或替换 Claude Code 的行为,甚至绘制自定义 UI,还可通过 Claude Directory 与他人分享。
美国联邦法官 Amit Mehta 驳回 Chegg 和 Penske Media 对 Google 的反垄断诉讼,认定 Google 在 AI 概览等产品中的行为不违反反垄断法。
Grok @Bot 是个了不起的助手
Earendil 发布 Pi 1.0,一个稳定、极简、可扩展的智能体编码框架,每周有数十万人使用。1.0 新增 Codemode(原生支持 MCP 及 Jev、图像模型等非 LLM 模型)、虚拟模型扩展支持、延迟工具加载、Anthropic 模型缓存预热、会话中途系统消息、新 TUI 主题和默认全屏模式。
多个项目独立发现部分 ESP32 芯片存在未公开功能,可绕过固定 WiFi/蓝牙电路直接采集原始 IQ 基带采样。
Tavus 发布首个 Human Interaction Model(HIM)Griffin,称其为首个通过视频图灵测试的模型。48% 与其实时视频对话的人误以为对方是真人,此前系统通过率低于 3%,并位列 NVIDIA 全双工 AI 视频基准第一。作者 Rohan Paul 转引 Tavus 官方发布并补充演示视频中的表现。
fal 宣布 Black Forest Labs 的 FLUX 3 可在其平台试用,提供文生图与图像编辑两个入口。链接为 https://fal.ai/models/blackforestlabs/flux-3/text-to-image 和 https://fal.ai/models/blackforestlabs/flux-3/edit-image。
fal 宣布 FLUX 3 Image 已上线平台,主打精准图像编辑且保留未改动部分。该模型支持原生 2K 和 4K 图像生成、最多组合 10 张参考图、一次完成多个定点编辑,并可对布局和构图做细致控制。
Cerebral Valley AI Summit 将于 11 月 12 日在旧金山举行,新增 Igor Babuschkin(River AI 创始人兼 CEO、xAI 联合创始人)以及 Legora、Fireworks AI、Etched、Factory、Crosby 的创始人共六位演讲嘉宾。
OpenAI 宣布 ChatGPT 全球上线两项购物功能,分别是虚拟试穿和收藏(Favorites)。用户在购物结果中点击新的 Try On 按钮并上传自拍或全身照,即可查看服装或配饰的上身效果,也可上传网页截图等商品图让 ChatGPT 代为试穿;Favorites 则把商品存入应用内的 Library 以便之后找回,并与试穿图片一起保存。
Lohit Siriki https://www.kaggle.com/code/sirikilohit/arc-agi-3-duck-18-1gc-submit https://www.linkedin.com/in/lohitsiriki/
Lord Han Solo https://www.kaggle.com/lordhansolo Notebook: https://www.kaggle.com/code/lordhansolo/built-on-tufa-labs-duck-harness-milestone-2
ARC Prize 2026:ARC-AGI-3 里程碑 #2 获奖者 恭喜三位获奖者开源了他们的高分 ARC-AGI-3 解决方案: 1. Daniel Franzen - 27.9%,$25K 2. Lord Han Solo - 23.8%,$7.5K 3. Lohit Siriki - 22.5%,$5K 了解更多关于每个提交方案的信息:
Daniel Franzen https://da-fr.github.io/ Notebook: https://www.kaggle.com/code/dfranzen/arc-agi-3-milestone-2-solution
Grok 4.7 已在网页端可用。截图显示 Expert 模式提示“Thinks hard Grok 4.7”,界面还提供 Auto、Fast、Build、Heavy 等模式选项。
我认为 AI 语音缺少一层质量检查。 在我构建的大多数应用中,语音听起来已经很棒了。但真正让生产环境出问题的,是模型把“Q3”、“v1.2”或品牌名读错。 这对人们感知语音智能体的方式影响巨大。 @OnepinAI 正在解决这个问题。在你听到之前,他们会检查每一行的自然度、清晰度和发音。 当一个词读错时,它会直接修复那个词,而不是重新生成整行。
一个有趣的结果:Fable 5.1 得分 44.6%,高于 Fable 5 的 37.3%,同时平均少用 33 分钟。这里的进步也意味着从每小时的自主工作中获得更多产出。 大多数智能体运行 8–10 小时,却取得显著不同的分数。下一个有趣的问题是,每多运行一小时,每个智能体能获得多少提升!
Grok Bot 无需你开口,就能完成有用的工作。
这段来自 @DSPyOSS 的 office hours 录像是一座金矿,里面有大量优秀的 Jev 用例和讲解!
Claude 能为你制作 mods! 只需提示它,更多内容见 @addyosmani 的博客文章:https://claude.dev/blog/getting-started-with-claude-code-mods/