跳到正文

全部动态

今日 0 条
10月2日周五
  1. X:Artificial Analysis (@ArtificialAnlys)69

    Artificial Analysis 评测:Qwen-Image-2.1 登顶两个 AA-Image 榜单的开源权重模型

    Artificial Analysis 自行本地部署评测了阿里 9 月 20 日以开源权重发布的 Qwen-Image-2.1,该模型在 AA-Image-T2I v2.0 和 AA-Image-Editing v2.0 上均排名第 18,为两个榜单上排名第一的开源权重模型,超过 Ideogram 4.0(Quality)和 HunyuanImage 3.0 Instruct。

    推荐理由:原文给出了自主评测的榜单排名、参数与授权细节,可与同类开源图像模型直接比较。

  2. X:小北 (@frxiaobei)49

    a16z 分析 AI 代点外卖:平台沦为基础设施

    a16z 分析了一种新购物流程:用户直接告诉 AI 预算、到家时间和忌口,由 AI 选餐厅下单,Toast 处理订单支付,DoorDash 负责配送。用户不再打开外卖平台 App,也不看推荐位和广告,订单仍在但客户关系被 AI 拿走。a16z 认为旧平台将继续提供商家网络、支付、履约等基础设施,而决定用户买什么、向谁买的流量与利润入口可能转移到 AI 手中。

  3. X:Cursor (@cursor_ai)35

    GLM 5.3 系列上线 Cursor

    GLM 5.3 和 GLM 5.3 Flash 现已在 Cursor 上线! GLM 5.3 Max 是 CursorBench 4.0 上得分最高的开放权重模型。

  4. X:OpenAI Developers (@OpenAIDevs)24

    OpenAI DevDay 支线任务送 Chromatic

    听说你们喜欢 @modretro Chromatic。 所以我们往支线任务里加了一台。 还有 48 小时可以加入。 https://side-quests.openai.chatgpt.site/

  5. X:Rohan Paul (@rohanpaul_ai)38

    Chamath:长周期任务与复杂问题仍不可用

    Chamath 在斯坦福 AI Club 直言长周期任务"根本不work",复杂问题同样没被解决好,并拒绝用评测或跑 48 小时的脚本作为反驳。他警告若 AI 无法进入高度复杂环境,行业将跌入"幻灭低谷",而当前已投入数千亿甚至上万亿美元。他给出的方向是:需要一个符号空间来引导嵌入空间。

  6. X:Peter Steinberger (@steipete)40

    Cloudflare 发布 Clef 决策模型

    "今天,我们发布两个由 Cloudflare 训练的决策模型,Clef 和 Clef-flash" https://blog.cloudflare.com/clef-decision-models/ 从没见过一个想法传播得如此之快。

  7. X:OpenRouter (@OpenRouter)32

    Seedream 5.0 Flash 上线 OpenRouter

    来自 @ByteDanceSeed_ 的 Seedream 5.0 Flash 现已在 OpenRouter 上线 Seedream 5.0 中快速、高性价比的档位,专为高吞吐量生成和低延迟交互式编辑打造 https://openrouter.ai/bytedance-seed/seedream-5-0-flash

  8. X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)59

    Perplexity 开源多模态决策模型 pplx-decider-27b 并推出 Decisions API

    Perplexity CEO Aravind Srinivas 宣布开源多模态决策模型 pplx-decider-27b,并通过新的 Decisions API 提供,输入 token 价格为 4 美分/百万,输出 token 免费,还表示未来几天会进一步降价。该模型(API 版本 pplx-decider-v1-27b)被训练为对固定答案集输出概率分布而非文本,在 7,210 行固定评测集的 11 个决策基准上总体准确率 85.71%,其中 RAGTruth 88.80%、TabFact 90.60%。

  9. X:Cohere(@cohere)8

    Cohere 七周年,三位联创谈未来方向

    今天是 Cohere 成立七周年。 公司成立于 2019 年,使命是打造赋能人们的 AI,七年后的今天,我们依然专注于这一使命。来听听三位联合创始人谈谈我们下一步的方向:

  10. X:Epoch AI (@EpochAIResearch)50

    Epoch AI 发布 ChatGPT 使用探索器

    这些趋势来自一个自我选择的用户样本。数据未经加权处理,不代表美国成年人或 ChatGPT 整体用户的人口结构。 阅读我们的完整报告:https://epoch.ai/latest/introducing-the-chatgpt-usage-explorer 自行探索数据:https://epoch.ai/data/chatgpt-usage

  11. X:Epoch AI (@EpochAIResearch)28

    Epoch AI:对话平均长度上升

    平均对话变得更长了,但典型对话并没有。除一个月外,中位数对话都只有两个提示词,而平均值从约 4 上升到 6。

  12. X:Epoch AI (@EpochAIResearch)40

    Epoch AI:ChatGPT 高频使用占比翻两番

    使用频率上升。在我们数据集中的活跃用户里,每月使用 ChatGPT 21 天以上的比例两年内翻了两番,从 2023 年 12 月的 2.6% 升至 2025 年 12 月的 10.5%。

  13. X:Epoch AI (@EpochAIResearch)35

    Epoch AI 分析 ChatGPT 用户数据

    元数据由 @YouGov 提供,后者从其美国小组成员中随机选取了 ChatGPT 用户。所有消息文本在共享前均已移除。 解读时有两个关键注意事项:用户是主动选择共享其历史记录的,且在样本抽取时,这些用户在 2026 年至少使用过一次 ChatGPT。

  14. X:SemiAnalysis (@SemiAnalysis_)31

    Nvidia Rubin 计算裸片 16% 用于 HBM4 接口

    计算裸片上的面积极其宝贵,但其中相当大一部分却仅用于与内存对接。我们估算,HBM4 控制器和 PHY 约占 Nvidia Rubin 计算裸片的 16%。这意味着大量先进制程硅片被用于与内存通信,而非执行计算。(1/3)🧵

  15. X:Krea AI (@krea_ai)69

    FLUX 3 Image 现已登陆 Krea,支持多轮编辑与 4K 生成

    Krea 宣布 FLUX 3 Image 已上线其平台。新能力包括多轮编辑且不改动其他像素、用 bounding box 排版图像、最高 4K 生成,以及组合最多 10 个参考图。

    推荐理由:官方宣布 FLUX 3 Image 上线 Krea,列出了多轮编辑、4K 生成等具体能力,读者可据此评估是否替换现有图像工作流。

  16. X:马东锡 NLP (@dongxi_nlp)51

    东锡 NLP 畅想用 Griffin 和 Agent 开咨询公司,又自问届时还需不需要人

    Tavus 发布 Griffin,称其为首个通过视频图灵测试的模型,48% 与其实时对话的人认为它是真人,此前系统通过率低于 3%,并在 NVIDIA 的全双工 AI 视频基准上排名第一。作者东锡 NLP 玩笑式畅想用 Agent 干活、让 Griffin 开会甚至面试来承接大量远程职位,又反问真发展到那一步还需要什么远程工程师和咨询公司。

  17. X:OpenAI Developers (@OpenAIDevs)28

    OpenAI DevDay 支线任务送 Chromatic

    听说你们喜欢 @modretro Chromatic。 所以我们往支线任务里加了一台。 还有 48 小时可以加入。 https://side-quests.openai.chatgpt.site/

  18. X:Replit (@Replit)23

    Replit 助你分析漏斗提升激活率

    用户在注册。帮更多人达成首次成功。 在 Replit 中分析你的漏斗数据,然后问:“我们在哪里可以提高激活率?” 接着追问:“把它做成一个仪表盘。” 你不需要在开始前就知道最终产出。一个问题可以带来一个洞察,然后变成有用的东西。

  19. X:马东锡 NLP (@dongxi_nlp)40

    arXiv 推出更严格投稿限流政策

    arXiv 更新了面向所有投稿者的 rate limiting 政策,称此举是为公平分配审核时间、支持其员工、志愿者、读者与作者社区。马东锡 NLP 评论称,Vibe research 时代有想法就大概率能变成成果,但判定成果的标准已落后于时代,新标准尚无答案。

  20. X:fal (@fal)51

    Grok Imagine Video 1.5 Lite 上线 fal 平台

    fal 宣布 Grok Imagine Video 1.5 Lite 上线,这是 Grok Imagine 视频家族中的轻量版模型。支持文生视频和图生视频并带原生音频,时长 1 到 15 秒;可输出 480p、720p 和 1080p,覆盖从 16:9 到 9:16 的 7 种画幅。

  21. X:OpenRouter (@OpenRouter)72

    FLUX 3 Image 上线 OpenRouter,支持原生 4K 生成与多参考编辑

    Black Forest Labs 的 FLUX 3 Image 现已上线 OpenRouter,是支持文生图与多参考编辑的旗舰图像模型,原生可渲染至 4K。原文提到可精确多轮编辑不动其他像素、用 bounding box 布局、最多用 10 个参考图合成,商业权重已开放,开放权重版将在未来数周发布。

    推荐理由:原文给出 FLUX 3 Image 的核心能力与开放权重计划,读者可据此评估是否接入工作流。

  22. Suno:Blog(网页)71

    Suno 推出 Speech beta:语音与背景音乐一体生成

    Suno 推出 Speech beta,称其为首个能把语音与原创背景音乐作为一条完整曲目生成的音频模型。用户输入文字并描述想要的声音和音乐风格即可创作,beta 已向所有用户开放,官方提示仍存在口音漂移、停顿过重等问题并将持续改进。

    推荐理由:官方介绍了 Speech 的玩法和 beta 限制,还附了官方博客链接,想试用或了解语音加音乐一体生成的可以看看。

  23. X:fal (@fal)58

    fal 发布 fal Recast,一键替换视频中的角色

    fal 发布 fal Recast,上传已有视频加一张新角色参考照,即可替换画面中的角色,同时保留原始动作、镜头运动、剪辑和音频。可用于制作角色变体、面向不同受众调整广告素材,无需重新拍摄;该功能由 H3 Max 驱动。