Liquid AI D1 上线 OpenRouter
来自 @liquidai 的 D1 已在 OpenRouter 上线。 这是一个有竞争力的决策模型:发送你应用的状态以及 yes/no、选择或评分问题,就能得到带类型的答案,每个选项都附带概率。零数据保留。 $0.04/M 输入,$0 输出,65K 上下文 https://openrouter.ai/liquid/d1
来自 @liquidai 的 D1 已在 OpenRouter 上线。 这是一个有竞争力的决策模型:发送你应用的状态以及 yes/no、选择或评分问题,就能得到带类型的答案,每个选项都附带概率。零数据保留。 $0.04/M 输入,$0 输出,65K 上下文 https://openrouter.ai/liquid/d1
Perplexity CEO Aravind Srinivas 宣布开源其多模态决策模型 pplx-decider-v1-27b,并通过 Decisions API 提供。该模型输出固定答案集上的概率分布而非文本,价格为 $0.04/million input tokens,基准总分 85.71%,在 7,210 行评测面板上高于 Jev 的 84.51% 且价格仅为几分之一。
Tavus 发布 Griffin,一款面向实时面对面对话的视频到视频模型研究预览版,可在对话中观看和聆听并中途打断或对入镜者作出回应。Tavus 称 120 名参与者中 45% 认为其对话是真人,通过图灵测试;Griffin Lite 在 NVIDIA Video Full-Duplex Benchmark 上以 3.83 分(满分为 5,真人为 3.92)排名第一。
Microsoft 论文提出 Coding-Agent Skill Distillation(CASD),把 agent 的已有日志交给普通编码 agent 写代码做语料级统计,识别重复失败模式并生成优化后的系统提示词,无需迭代回滚。
Tavus 发布 Griffin,称其为首个通过视频图灵测试的 Human Interaction Model,48% 与其实时对话的人以为对方是真人,此前系统通过率低于 3%。作者获早期访问体验,称该视频到视频模型可边看边听、打断和被打断并反应房间内发生的事;在 NVIDIA Video Full-Duplex Benchmark 上生成得分 3.83/5,真人为 3.92。
Trump 接受 TIME 采访时表示,可能会参照其 Intel 交易模式让政府入股 OpenAI 和 Anthropic,但排除了将前沿实验室国有化。他还称 Jensen Huang 只有让美国分成,才能出售受限芯片,并表示 Amodei 的观点与媒体呈现不同,但警告寻求监管的公司可能因此倒闭。
MICROSOFT 🔥:MAI-Transcribe-2-Streaming、MAI-Voice-2.1 和 MAI-Voice-2.1-Flash 模型即将登陆 MAI Playground 和 API! > "MAI-Transcribe 和 MAI-Voice 模型:准确、快速、低成本,在音频理解与生成方面名列前茅,助你构建最佳的对话式语音智能体。" MAI Playground 还新增了 "Chatter" 演示语音体验。 测试时间 👀
据《纽约时报》报道,Anthropic 邀请天主教、犹太教、锡克教、福音派等宗教思想家帮助其 AI 建立道德方向。作者补充细节称 Anthropic 曾飞请 Vedanta 僧人 Swami Sarvapriyananda 到旧金山总部,签署 NDA 的闭门会议中神学家与心理健康人士同席,且一位创始人全程在场;信息来自 Ramakrishna Vedanta Society of North Texas 的 YouTube 视频。
每次创建设计、演示文稿或文档时自动生效,活动持续至 10 月 15 日,适用于 Pro、Max 和 Team 套餐。 工作原理与完整条款:https://support.claude.com/en/articles/17274727
为期两周,在 Claude 应用中开始一个设计、幻灯片或文档,该对话中后续的工作将只消耗你用量额度的 50%。 用 Claude Sonnet 5.5 试试吧。它对设计有很强的眼光,做出来的幻灯片几乎不需要修改。
Claude Code 团队宣布使用 mods 构建了 /diff 和 AGENTS.md 支持等功能,并邀请用户用 mods 构建自己的功能。详情见 https://claude.com/blog/claude-code-mods。
我们在 Claude Code Playground 仓库中添加了预构建的示例 mod,供你借鉴参考,如果你需要一些灵感的话。 更多内容请见我们的入门指南:https://claude.dev/blog/getting-started-with-claude-code-mods/
模组可以自己留着用,如果觉得对别人有用,也可以提交到 Claude 目录。模组运行时对机器的访问权限与 Claude Code 本身相同,所以请确保只从你信任的来源安装模组。 https://claude.ai/directory
Replay Theater 会记录 Claude 在一轮对话中进行的每一次文件编辑,用户可运行 /replay 在一个停靠面板中逐步查看各处 diff。
Blast Radius 能在 rm -rf、git reset --hard 或 force push 等高风险 shell 命令执行前将其拦截。它会在侧边栏中展示该命令会触及的内容。
Token Weather 新增上下文窗口预测:显示已用多少,外加最近 12 轮的迷你走势图。
Claude Code 推出 mods 功能,支持修改模型行为、自定义 UI 并替换自有功能。用几行 TypeScript 即可编写,也可由 Claude 代为构建;mods 随插件分发,可在 CLI 或桌面应用中通过 /plugin 安装。
Anthropic 设计师 Nate 演示了如何用 Claude Slides 将手机录制的语音备忘录转化为演示文稿。他在散步时口述想法,再与 Claude 协作把思路整理成 deck,从而减少排版时间、专注内容本身。
Claude 官方视频展示 Anthropic 设计师 Nate 如何使用 Claude Slides 制作演示文稿。他在散步时用手机录一段整理思路的语音备忘录,再与 Claude 一起把想法打磨成幻灯片,把时间花在想法本身而非排版上。
Grok Bot 主动为你提供有用的提醒和建议
Gamma 首席 AI 官 Deeni Fatiha、Adobe 总监 Morgan Prygrocki 与 Salesforce 全球品牌营销的 Shane Tapp 共同探讨了创意 AI 从实验阶段走向生产阶段所带来的变化。
turbopuffer 宣布 v3 存储架构改版,放弃以 ANN 向量索引为主键的布局,把 ANN 降为二级索引,已实现 100% CI 通过。向量主索引造成存储放大、写放大和向量化受限三类问题,团队此前已把向量搜索做到单索引 100B+ 向量、200ms p99 读和 1k+ QPS,早期客户包括 Cursor 和 Notion;后续将公开基准测试,逐步推向生产。
Claude Code v2.1.287 新增 Claude Mods,允许插件修改更深层行为,并加入可选插件 You should know,由侧边 agent 监控可能被忽略的问题,可用 /plugin enable cc-plugin-you-should-know@builtin 开启。
Podonos 发布 Onepin,一个在配音交付前检查并修复每行语音的 AI 语音生产 Agent。它基于 400 万词发音词典核查人名、品牌名和技术词汇,按自然度、清晰度和字词准确度给每行打分,可在同一声音中修复单个错误词而无需重录,并支持 ElevenLabs、OpenAI、Google 等 30+ 语音服务,免费开始使用。
试试 Grok @Bot!
这 WiFi 真是绝了 (引用推文 @OpenAIDevs:dots 演示。 现在……WiFi 更好了。)
NVIDIA 新论文提出,与其给 AI 智能体更多选项,不如给它一个更好的裁判:让小型智能体每步生成 8 个候选命令,再由裁判模型挑选执行。用前沿强模型当裁判时,成功率从 50% 提升到 68%,且无需重新训练;若由小模型自评,提升则小得多。
Tavus 发布 Griffin,称其为首个通过视频图灵测试的人类交互模型(HIM),48% 与之实时对话的人认为它是真人,此前系统通过率低于 3%。Griffin 在 NVIDIA 全双工 AI 视频基准上得 3.83 分(真人为 3.92),次优系统为 2.80 分;它将听、想、说和面部动画整合在单一系统中,可在对话者仍在说话时读取表情、语气并实时反应。
今天我们推出 PROWL-2,智能体及其世界模型通过递归学习实现共同提升。 智能体暴露想象中存在的错误,修复这些错误又能促成进一步的学习。 我们相信,这种开放式学习是迈向超级智能的关键一步。
按需构建,简单直接。 你获得能更好满足自身需求的自定义工具,无需在市场上购买通用方案。 这就是自驱动公司的愿景。 看看我们在 Replit 是如何实现的:https://replit.com/blog/self-driving-company
Grok Bot 现在无需你开口,就能主动给出帮助建议。
你的主 Bot 会发现它可以帮你分担的工作,并主动提出接手。 它将在接下来几小时内逐步推送,而且建议不会计入你的用量。 下载 Grok Bot:https://x.ai/bot
Ideogram 称新模型 Ideogram 4.5 只修改用户指定区域,其余部分保持不变,主打产品摄影、室内设计、照片修复和图内文字编辑。该模型提供 0.8 至 22 美分四档单图价格,均为原生 2K 分辨率,现已在 Ideogram 平台和 API 上线。合作方包括 Picsart、Runway、Pika 和 Leonardo AI,Ideogram 还表示将很快推出开放权重版本。
Cloudflare 发布两款决策模型 Clef 和 Clef-flash,托管在 Workers AI 上,并以 Apache 2.0 许可证在 Hugging Face 完全开源。
Figma 将 MCP 访问权限收紧至白名单客户端,Pi 不在其中。此举意味着非白名单客户端无法再通过 MCP 接入 Figma。
dots demo。 现在……WiFi 更好了。
Cohere 发布 Embed 5 嵌入模型家族,分 Pro 和 Fast 两档,均支持文本、图像及图文融合输入、100+ 语言和 128K token 上下文,两档共享同一向量空间,可用 Pro 建索引、Fast 查询。
美国联邦法官驳回 Chegg 与 Rolling Stone 母公司 Penske Media 针对 Google AI Overviews 的反垄断诉讼,认定其指控不符合反垄断法。
当 AI 生成内容变得如此逼真,我们如何验证哪些是人、机器或自然创造的? 我们在播客中探讨溯源的关键作用——以及不可感知的水印如何同时保护数字媒体和生物设计。↓ 时间轴: 00:00 介绍 00:34 什么是水印? 04:35 SynthID 15:16 图像与视频 19:28 SynthID Bio 28:00 韧性的未来
自从有了好用的 AI,坐着听 PowerPoint 演示变得好多了。当然,有些人干脆让 AI 替他们做思考工作,但这很明显(而且他们以前就用默认模板)。对于真正用心的人来说,他们现在有了有趣的排版、好笑的视觉梗和不错的图表。