MIT 推出 AI 青年创业平台 Dear Dreamer,目标 2030 年赋能 5 万名年轻创业者
MIT 马丁信托创业中心推出免费 AI 青年创业平台 Dear Dreamer,面向初高中学生,将 Bill Aulet 的《Disciplined Entrepreneurship》24 步框架改造为含短视频、互动练习和个性化反馈的自学体验。
MIT 马丁信托创业中心推出免费 AI 青年创业平台 Dear Dreamer,面向初高中学生,将 Bill Aulet 的《Disciplined Entrepreneurship》24 步框架改造为含短视频、互动练习和个性化反馈的自学体验。
腾讯 WorkBuddy 宣布将 Hy3 模型限免及 Hy4 preview 夜间限免均延期至 10 月 31 日,闲时夜间 23:00 至次日 8:00 继续提供 Hy4 preview 免费额度。
Google DeepMind 发布 SynthID Bio,一套面向 AI 生成生物设计的水印方法家族,可将不可察觉的签名直接嵌入蛋白质序列而不影响其生物功能。Sundar Pichai 转发该消息并称赞其对科学诚信与生物安全的推进。
索尼 PlayStation 为标准版 PS5 推出基于人工智能的超分辨率技术 QSSR,全称 Quick Spectral Super Resolution,是 PSSR 的快速演进版本,也是与 AMD 合作项目 Project Amethyst 的一部分。该技术采用精简神经网络架构,率先在《漫威金刚狼》《羊蹄山之魂》上获得支持,在 PS5 上显著提升图像细节和稳定性。
PixVerse 上无限使用 GPT Image 2.5!探索爆款预设 https://app.pixverse.ai/cli/gpt-image2-5?utm_source=X&utm_id=Social
Factory 推出重新设计的 Analytics,可按模型和用户查看 credits 消耗、模型占比与成本集中度,并展示日活、月活用户和会话数。Factory Router 自动为每个请求选择高效模型,生产环境总成本较前沿模型费率降低 63%,同时保持前沿级评测表现。
OpenRouter 推出 Model Router Benchmarks 页面,用质量、速度、成本三类基准比较 Auto Router、Free Models Router、Unbiased 的 Pareto、Sakana 的 Fugu、Jev Router、NVIDIA 的 Switchyard 等路由器,并以顶尖模型作基线。
OpenAI 于当地时间 1 日在全球推出 ChatGPT 两项购物新功能:虚拟试穿服装和配饰,以及可保存商品、与试穿图片放在一起的收藏功能。新功能基于 ChatGPT Images 2.5 模型,据称光线更自然、纹理更丰富、编辑指令更稳定且生成更快。用户可上传自拍照或全身照查看试穿效果,也可描述穿衣风格让 ChatGPT 挑单品,或上传名人穿搭照找可购买同款。
GLM 5.3 和 GLM 5.3 Flash 现已在 Cursor 上线! GLM 5.3 Max 是 CursorBench 4.0 上得分最高的开放权重模型。
Suno 宣布 Speech 功能进入 Beta,官方称这是首个能生成语音并配上匹配背景音乐的模型。用户需更新 App 获取最新版本,详情见 https://suno.com/blog/introducing-speech-beta。
Grok Build 上线新的 Agent Dashboard,用户通过 /dashboard 即可在同一屏幕查看所有 agent。作者 Andrew Milich 补充,该视图支持在单一 /dashboard 界面中同时管理多个 agent 和 worktree。
现已在 Grok Build 上线:全新的 Agent Dashboard。所有智能体尽在一屏。 用 /dashboard 试试
Earendil 与 Pi 社区发布 Pi 1.0,同时推出实验性新包 Pi Durable,一个面向长时运行、可持久化、可随处运行智能体的 harness 框架。
以 1K 或 2K 生成,支持从 21:9 到 9:21 的任意宽高比,也可用 auto 让它自动选择。
给它最多 14 张参考图,用一条提示词即可完成精准编辑。
每张图 $0.018,一口价。输出尺寸不影响价格,参考图免费。
来自 @ByteDanceSeed_ 的 Seedream 5.0 Flash 现已在 OpenRouter 上线 Seedream 5.0 中快速、高性价比的档位,专为高吞吐量生成和低延迟交互式编辑打造 https://openrouter.ai/bytedance-seed/seedream-5-0-flash
Perplexity CEO Aravind Srinivas 宣布开源多模态决策模型 pplx-decider-27b,并通过新的 Decisions API 提供,输入 token 价格为 4 美分/百万,输出 token 免费,还表示未来几天会进一步降价。该模型(API 版本 pplx-decider-v1-27b)被训练为对固定答案集输出概率分布而非文本,在 7,210 行固定评测集的 11 个决策基准上总体准确率 85.71%,其中 RAGTruth 88.80%、TabFact 90.60%。
Krea 宣布 FLUX 3 Image 已上线其平台。新能力包括多轮编辑且不改动其他像素、用 bounding box 排版图像、最高 4K 生成,以及组合最多 10 个参考图。
推荐理由:官方宣布 FLUX 3 Image 上线 Krea,列出了多轮编辑、4K 生成等具体能力,读者可据此评估是否替换现有图像工作流。
fal 宣布 Grok Imagine Video v1.5 lite 已可在其平台试用,提供 Text-to-Video 和 Image-to-Video 两个入口。链接:https://fal.ai/models/xai/grok-imagine-video/v1.5/lite/text-to-video 与 https://fal.ai/models/xai/grok-imagine-video/v1.5/lite/image-to-video
fal 宣布 Grok Imagine Video 1.5 Lite 上线,这是 Grok Imagine 视频家族中的轻量版模型。支持文生视频和图生视频并带原生音频,时长 1 到 15 秒;可输出 480p、720p 和 1080p,覆盖从 16:9 到 9:16 的 7 种画幅。
OpenRouter 发帖介绍 FLUX 3 的参考图能力,用户可一次性提供最多 10 张参考图并在单个提示词中描述场景,由模型决定各参考图的位置并共同渲染出整幅画面。
Black Forest Labs 的 FLUX 3 Image 现已上线 OpenRouter,是支持文生图与多参考编辑的旗舰图像模型,原生可渲染至 4K。原文提到可精确多轮编辑不动其他像素、用 bounding box 布局、最多用 10 个参考图合成,商业权重已开放,开放权重版将在未来数周发布。
推荐理由:原文给出 FLUX 3 Image 的核心能力与开放权重计划,读者可据此评估是否接入工作流。
Suno 推出 Speech beta,称其为首个能把语音与原创背景音乐作为一条完整曲目生成的音频模型。用户输入文字并描述想要的声音和音乐风格即可创作,beta 已向所有用户开放,官方提示仍存在口音漂移、停顿过重等问题并将持续改进。
推荐理由:官方介绍了 Speech 的玩法和 beta 限制,还附了官方博客链接,想试用或了解语音加音乐一体生成的可以看看。
在 fal 上试试: https://fal.ai/models/minimax/h3-max/recast/
fal 发布 fal Recast,上传已有视频加一张新角色参考照,即可替换画面中的角色,同时保留原始动作、镜头运动、剪辑和音频。可用于制作角色变体、面向不同受众调整广告素材,无需重新拍摄;该功能由 H3 Max 驱动。
现在就在 Higgsfield 上试用 FLUX 3 Image: https://higgsfield.ai/ai/image?model=flux-3-image
Higgsfield 宣布 FLUX 3 Image 已在其平台上线,该模型来自 Black Forest Labs。支持只改一处细节不动其余部分、用 bounding box 放置物体、最多组合 10 个参考图,以及生成最高 4K 分辨率图像。
Claude Code 推出 Mods 功能,用户只需提示词即可自定义 Claude 的工作方式和界面外观,也可用几行 TypeScript 编写或让 Claude 代为构建。Mods 随插件分发,通过 /plugin 在 CLI 或桌面应用安装,并可作为插件分享给他人。
@Bot 速度大幅提升
Anthropic 为 Claude Code 推出 Mods 功能,用户可以修改构建。Mods 本质上是 hook,随插件分发,每个是一个小型 JavaScript 或 TypeScript 模块,在会话内运行并能看到每个事件,可重写或替换 Claude Code 的行为,甚至绘制自定义 UI,还可通过 Claude Directory 与他人分享。
Earendil 发布 Pi 1.0,一个稳定、极简、可扩展的智能体编码框架,每周有数十万人使用。1.0 新增 Codemode(原生支持 MCP 及 Jev、图像模型等非 LLM 模型)、虚拟模型扩展支持、延迟工具加载、Anthropic 模型缓存预热、会话中途系统消息、新 TUI 主题和默认全屏模式。
fal 宣布 Black Forest Labs 的 FLUX 3 可在其平台试用,提供文生图与图像编辑两个入口。链接为 https://fal.ai/models/blackforestlabs/flux-3/text-to-image 和 https://fal.ai/models/blackforestlabs/flux-3/edit-image。
fal 宣布 FLUX 3 Image 已上线平台,主打精准图像编辑且保留未改动部分。该模型支持原生 2K 和 4K 图像生成、最多组合 10 张参考图、一次完成多个定点编辑,并可对布局和构图做细致控制。
OpenAI 宣布 ChatGPT 全球上线两项购物功能,分别是虚拟试穿和收藏(Favorites)。用户在购物结果中点击新的 Try On 按钮并上传自拍或全身照,即可查看服装或配饰的上身效果,也可上传网页截图等商品图让 ChatGPT 代为试穿;Favorites 则把商品存入应用内的 Library 以便之后找回,并与试穿图片一起保存。
Grok Bot 无需你开口,就能完成有用的工作。
Claude Code 推出 Mods 功能,用户可以修改其行为、自定义 UI 并替换自己的功能。Mod 可用几行 TypeScript 编写或让 Claude 代为构建,随插件分发,可在 CLI 或桌面应用中通过 /plugin 安装;作者称这是为了让软件可扩展成为一等公民。
Podonos 推出 Onepin,定位为文本转语音之后的生产校对步骤,在配音上线前逐行检查。它内置 400 万词发音词典校对人名和产品名,可先拼写价格和日期,为每行音频评分自然度、清晰度和词语准确度,并用同一声音修复错误单词而无需重录,兼容 ElevenLabs、OpenAI、Google 等 30 多家语音服务,免费开始且无需信用卡。作者引用示例指出语音模型读 "03/04/27" 时会静默决定是三月还是四月,而输出听起来同样自信。
SPACEXAI 🔥:Grok Bot 变得主动,现在可以自行建议有用的东西。 用户将被要求配置一个新的 Primary Bot,或选择一个已有的 Bot 作为 Primary(例如你的 Chief of Stuff)。 Primary Bot 功能正在逐步推送! https://x.com/bot/status/2105713240701538538/video/1
来自 @liquidai 的 D1 已在 OpenRouter 上线。 这是一个有竞争力的决策模型:发送你应用的状态以及 yes/no、选择或评分问题,就能得到带类型的答案,每个选项都附带概率。零数据保留。 $0.04/M 输入,$0 输出,65K 上下文 https://openrouter.ai/liquid/d1