跳到正文

全部动态

今日 0 条
10月2日周五
  1. X:OpenRouter (@OpenRouter)45

    Liquid AI D1 上线 OpenRouter

    来自 @liquidai 的 D1 已在 OpenRouter 上线。 这是一个有竞争力的决策模型:发送你应用的状态以及 yes/no、选择或评分问题,就能得到带类型的答案,每个选项都附带概率。零数据保留。 $0.04/M 输入,$0 输出,65K 上下文 https://openrouter.ai/liquid/d1

  2. X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)54

    Perplexity 开源多模态决策模型 pplx-decider-v1-27b 并推出 Decisions API

    Perplexity CEO Aravind Srinivas 宣布开源其多模态决策模型 pplx-decider-v1-27b,并通过 Decisions API 提供。该模型输出固定答案集上的概率分布而非文本,价格为 $0.04/million input tokens,基准总分 85.71%,在 7,210 行评测面板上高于 Jev 的 84.51% 且价格仅为几分之一。

  3. X:Testing Catalog (@testingcatalog)58

    Tavus 推出实时视频对话模型 Griffin 研究预览版

    Tavus 发布 Griffin,一款面向实时面对面对话的视频到视频模型研究预览版,可在对话中观看和聆听并中途打断或对入镜者作出回应。Tavus 称 120 名参与者中 45% 认为其对话是真人,通过图灵测试;Griffin Lite 在 NVIDIA Video Full-Duplex Benchmark 上以 3.83 分(满分为 5,真人为 3.92)排名第一。

  4. X:Elvis Saravia (@omarsar0, DAIR.AI)56

    Tavus 发布 Griffin 视频对话模型,称其首个通过视频图灵测试

    Tavus 发布 Griffin,称其为首个通过视频图灵测试的 Human Interaction Model,48% 与其实时对话的人以为对方是真人,此前系统通过率低于 3%。作者获早期访问体验,称该视频到视频模型可边看边听、打断和被打断并反应房间内发生的事;在 NVIDIA Video Full-Duplex Benchmark 上生成得分 3.83/5,真人为 3.92。

  5. X:Rohan Paul (@rohanpaul_ai)67

    Trump 向 TIME 表示政府可能入股 OpenAI 和 Anthropic

    Trump 接受 TIME 采访时表示,可能会参照其 Intel 交易模式让政府入股 OpenAI 和 Anthropic,但排除了将前沿实验室国有化。他还称 Jensen Huang 只有让美国分成,才能出售受限芯片,并表示 Amodei 的观点与媒体呈现不同,但警告寻求监管的公司可能因此倒闭。

  6. X:Testing Catalog (@testingcatalog)48

    微软MAI语音转录与语音模型上新

    MICROSOFT 🔥:MAI-Transcribe-2-Streaming、MAI-Voice-2.1 和 MAI-Voice-2.1-Flash 模型即将登陆 MAI Playground 和 API! > "MAI-Transcribe 和 MAI-Voice 模型:准确、快速、低成本,在音频理解与生成方面名列前茅,助你构建最佳的对话式语音智能体。" MAI Playground 还新增了 "Chatter" 演示语音体验。 测试时间 👀

  7. X:Rohan Paul (@rohanpaul_ai)60

    Rohan Paul 转述 Anthropic 邀请宗教思想家为 Claude 提供道德指引的细节

    据《纽约时报》报道,Anthropic 邀请天主教、犹太教、锡克教、福音派等宗教思想家帮助其 AI 建立道德方向。作者补充细节称 Anthropic 曾飞请 Vedanta 僧人 Swami Sarvapriyananda 到旧金山总部,签署 NDA 的闭门会议中神学家与心理健康人士同席,且一位创始人全程在场;信息来自 Ramakrishna Vedanta Society of North Texas 的 YouTube 视频。

  8. X:Claude (@claudeai)21

    Claude 设计文档功能限时额度提升

    每次创建设计、演示文稿或文档时自动生效,活动持续至 10 月 15 日,适用于 Pro、Max 和 Team 套餐。 工作原理与完整条款:https://support.claude.com/en/articles/17274727

  9. X:Claude (@claudeai)48

    Claude 应用内设计文档限时五折用量

    为期两周,在 Claude 应用中开始一个设计、幻灯片或文档,该对话中后续的工作将只消耗你用量额度的 50%。 用 Claude Sonnet 5.5 试试吧。它对设计有很强的眼光,做出来的幻灯片几乎不需要修改。

  10. X:Claude Devs (@ClaudeDevs)27

    Claude Code Playground 新增示例 mod

    我们在 Claude Code Playground 仓库中添加了预构建的示例 mod,供你借鉴参考,如果你需要一些灵感的话。 更多内容请见我们的入门指南:https://claude.dev/blog/getting-started-with-claude-code-mods/

  11. X:Claude Devs (@ClaudeDevs)49

    Claude Code 模组安装需谨慎

    模组可以自己留着用,如果觉得对别人有用,也可以提交到 Claude 目录。模组运行时对机器的访问权限与 Claude Code 本身相同,所以请确保只从你信任的来源安装模组。 https://claude.ai/directory

  12. X:Runway (@runwayml)26

    Runway 探讨创意 AI 从实验到生产

    Gamma 首席 AI 官 Deeni Fatiha、Adobe 总监 Morgan Prygrocki 与 Salesforce 全球品牌营销的 Shane Tapp 共同探讨了创意 AI 从实验阶段走向生产阶段所带来的变化。

  13. Hacker News 热门(buzzing.cc 中文翻译)52

    turbopuffer v3 重构存储架构,让 ANN 索引降级为普通二级索引

    turbopuffer 宣布 v3 存储架构改版,放弃以 ANN 向量索引为主键的布局,把 ANN 降为二级索引,已实现 100% CI 通过。向量主索引造成存储放大、写放大和向量化受限三类问题,团队此前已把向量搜索做到单索引 100B+ 向量、200ms p99 读和 1k+ QPS,早期客户包括 Cursor 和 Notion;后续将公开基准测试,逐步推向生产。

  14. X:Testing Catalog (@testingcatalog)56

    Podonos 发布 Onepin:TTS 后检查并修复每行配音的语音生产 Agent

    Podonos 发布 Onepin,一个在配音交付前检查并修复每行语音的 AI 语音生产 Agent。它基于 400 万词发音词典核查人名、品牌名和技术词汇,按自然度、清晰度和字词准确度给每行打分,可在同一声音中修复单个错误词而无需重录,并支持 ElevenLabs、OpenAI、Google 等 30+ 语音服务,免费开始使用。

  15. X:Tibo (@thsottiaux)17

    OpenAI dots 演示 WiFi 升级

    这 WiFi 真是绝了 (引用推文 @OpenAIDevs:dots 演示。 现在……WiFi 更好了。)

  16. X:Rohan Paul (@rohanpaul_ai)49

    NVIDIA 论文:给 AI 智能体配个好裁判,成功率 50%→68%

    NVIDIA 新论文提出,与其给 AI 智能体更多选项,不如给它一个更好的裁判:让小型智能体每步生成 8 个候选命令,再由裁判模型挑选执行。用前沿强模型当裁判时,成功率从 50% 提升到 68%,且无需重新训练;若由小模型自评,提升则小得多。

  17. X:Rohan Paul (@rohanpaul_ai)64

    Tavus 发布 Griffin,48% 的人将其误认为真人

    Tavus 发布 Griffin,称其为首个通过视频图灵测试的人类交互模型(HIM),48% 与之实时对话的人认为它是真人,此前系统通过率低于 3%。Griffin 在 NVIDIA 全双工 AI 视频基准上得 3.83 分(真人为 3.92),次优系统为 2.80 分;它将听、想、说和面部动画整合在单一系统中,可在对话者仍在说话时读取表情、语气并实时反应。

  18. X:Odyssey (@odysseyml)31

    Odyssey 推出 PROWL-2 递归学习框架

    今天我们推出 PROWL-2,智能体及其世界模型通过递归学习实现共同提升。 智能体暴露想象中存在的错误,修复这些错误又能促成进一步的学习。 我们相信,这种开放式学习是迈向超级智能的关键一步。

  19. X:Replit (@Replit)33

    Replit 打造自驱动公司愿景

    按需构建,简单直接。 你获得能更好满足自身需求的自定义工具,无需在市场上购买通用方案。 这就是自驱动公司的愿景。 看看我们在 Replit 是如何实现的:https://replit.com/blog/self-driving-company

  20. X:Grok Bot (@bot)41

    Grok Bot 主动分担任务并逐步推送

    你的主 Bot 会发现它可以帮你分担的工作,并主动提出接手。 它将在接下来几小时内逐步推送,而且建议不会计入你的用量。 下载 Grok Bot:https://x.ai/bot

  21. The Decoder43

    Ideogram 称新模型 Ideogram 4.5 可局部编辑图像而不影响其余部分

    Ideogram 称新模型 Ideogram 4.5 只修改用户指定区域,其余部分保持不变,主打产品摄影、室内设计、照片修复和图内文字编辑。该模型提供 0.8 至 22 美分四档单图价格,均为原生 2K 分辨率,现已在 Ideogram 平台和 API 上线。合作方包括 Picsart、Runway、Pika 和 Leonardo AI,Ideogram 还表示将很快推出开放权重版本。

  22. X:Google DeepMind (@GoogleDeepMind)37

    Google DeepMind 播客探讨 AI 内容溯源与水印

    当 AI 生成内容变得如此逼真,我们如何验证哪些是人、机器或自然创造的? 我们在播客中探讨溯源的关键作用——以及不可感知的水印如何同时保护数字媒体和生物设计。↓ 时间轴: 00:00 介绍 00:34 什么是水印? 04:35 SynthID 15:16 图像与视频 19:28 SynthID Bio 28:00 韧性的未来

  23. X:Ethan Mollick (@emollick)23

    AI 让 PowerPoint 演示体验变好

    自从有了好用的 AI,坐着听 PowerPoint 演示变得好多了。当然,有些人干脆让 AI 替他们做思考工作,但这很明显(而且他们以前就用默认模板)。对于真正用心的人来说,他们现在有了有趣的排版、好笑的视觉梗和不错的图表。