xAI 分享工程团队 Bots 模板
我们也在分享工程团队的 Bots 作为可安装的模板。 每一个都自带技能、例程和连接器,帮你快速上手。 https://x.ai/bot/marketplace/engineering
我们也在分享工程团队的 Bots 作为可安装的模板。 每一个都自带技能、例程和连接器,帮你快速上手。 https://x.ai/bot/marketplace/engineering
Grok Bot 现在构建软件更强大。 Bot 可以将编码任务交给 Cursor,通过 GitHub 和 Origin 插件管理你的 PR,并分享它们所构建内容的视频演示。
小团队正借助 AI 承担更多工作——从寻找客户到打造产品、管理财务。 我们的新报告探讨了小企业如何让 AI 智能体投入实际工作。通过与 @ASBDC 的新合作,我们带来实操性 AI 培训和本地指导,帮助更多企业主上手。 https://openai.com/index/helping-small-businesses-put-ai-to-work/
OpenAI 官方首次指控一个与中国有关的 AI 实验室试图提取其模型的隐藏推理内容进行对抗性蒸馏。操作者未破解加密,而是通过操纵模型交互复制加密推理并让其他模型解密转写。
HeyGen 发布 HeyGen Video,面向需要高质量视频但想控制成本的企业,基于 MiniMax H3 并由 HeyGen 后训练。10 月前定价从 $0.01/s 起(5 折),详情见 https://developers.heygen.com/heygen-video-1.0-catalog。MiniMax 官方转发表示很高兴为该工作提供基础模型。
Claude 移动端聊天即将推出技能(Skills)作为独立的附件菜单。 这样操作起来就简单多了 👀
@letsfuseup 正在构建一个全球科学与工程社区,让人们在真实问题上组队,AI 帮助团队研究、设计与测试。赞助方和提供方可为入选团队提供资金、model-token 额度、算力、数据和实验室资源,成果由客户或问题方按约定要求验收。平台定于 2026 年 10 月 20 日开放。
旧金山站报名:https://www.anthropic.com/events/claude-founder-house-san-francisco 斯德哥尔摩站报名:https://www.anthropic.com/events/claude-founder-house-stockholm
Claude Founder House 即将登陆 SF Tech Week(10 月 6–8 日)和斯德哥尔摩(10 月 14 日)。 来参加我们团队的讲座、工作坊和 office hours,还有时间结识其他用 Claude 构建的人。无论你是创始人、CEO 还是构建者,都有适合你的环节。
每家公司的客服智能体即将被 Dots & Muses 等用语音/聊天来谈判争取更优惠价格的智能体淹没。人们把这类事情委托给自己的智能体、并因此省钱的报道正在不断涌现,而且只会越来越火。
Box CEO Aaron Levie 认为,无论 50 人小公司还是数十万人大企业,AI 转型都需要一支 FDE(前向部署工程师)队伍上门协助。Rohan Paul 判断,模型厂商的 FDE 初期会集中服务大客户,1 万人的银行足以支撑专职 FDE,50 人律所则多由独立顾问或小型集成商承接。
恭喜 @HoloworldAI 发布!
Perplexity 向所有人开放 Computer 的邮件委托功能,无需 Perplexity 账号,将转发或抄送 [email protected] 的任务限时免费运行。智能体会在后台完成任务并保留邮件上下文,每个邮件任务在 Computer 中作为正常会话运行,可在网页和移动端查看,并带有与应用内任务相同的审计记录。
推荐理由:原文给出开放入口和限时免费的接入方式,读者可以据此判断如何把邮件任务交给 Perplexity Computer 处理。
Arena 评测榜单显示,OpenAI 的 GPT-6.1 Sol (Max) 以 1759 分位列 Code Arena: WebDev 第 3 名,混合价格为 $8/MToken。相比 GPT-6 Sol (Max) 同价提升 70 分,排名上升 4 位,且在 Consumer Product 等所有类目均有提升。
推荐理由:评测方公布了 GPT-6.1 Sol (Max) 的排名和价格数据,读者可以据此比较它在成本与性能权衡中的位置。
这是当今时代最重要的问题之一:谁来决定AI的发展方向? Daron主张在AI决策过程中引入更多民主参与,尽管这伴随着诸多挑战。
附:如果你还没有体验过我们的场景探索工具,它提供了一种结构化的方式,来探索 AI 的不同发展路径可能如何塑造经济结果,请在这里查看:https://www.anthropic.com/institute/econ-scenarios
请阅读 @rclegateyang 和 Maxim 撰写的这份非常出色的报告:https://www.anthropic.com/research/what-work-can-robots-do
机器人技术在经济中的扩散,可能比 AI 的采用需要更长时间。 在近期的情景建模工作中,我们只考察了 AI 到 2030 年的影响。 若要展望更远的未来,则需要对机器人投资与采用的经济学进行更细致的建模。
与 AI 不同,机器人的相对成本非常高。他们估计,机器人仅在 0.3% 的工作任务上具备成本竞争力。 如果机器人价格下降遵循过去的趋势,这一比例需要 40 年才能达到 10%。
他们发现,对于美国经济中大多数体力任务,已存在能够执行这些任务的机器人——尽管是在有限场景下。总体而言,他们发现 34% 的工作时长面临机器人替代的暴露风险。
为什么这是一项有用的练习? 他们发现,过去 50 年里,基线机器人能力可以预测相关暴露工人随后的工资和就业下降。随着成本下降、采用率上升,这一过程在数十年间逐步显现。
如今机器人能完成哪些工作?这对未来数年的经济结构又意味着什么? @rclegateyang 和 Maxim Massenkoff 的新研究今日发布,探讨了这些问题。
他们构建了一个新的机器人暴露指数,基于现有机器人在日益通用和非结构化条件下完成各种工作任务的能力。
可分享的个人资料将你的 Sites 和插件整合在 ChatGPT 中,让他人能够找到并复用你的作品。 做好了?就秀出来。
在今天的 AI Summit 上,Runway CTO Kamil Sindi 分享了更多关于我们首个世界界面模型 Solaris 的内容。一种新型操作系统,随着你的交互而自我构建。每一帧都根据你的意图实时生成。 在主题演讲中,Kamil 分享了一个清晰的愿景:未来所有软件都是生成的。没有一行代码。 了解更多关于 Solaris:https://runway.com/news/research/introducing-solaris
Runway 发布 Runway Ads,一个面向效果营销的自主引擎,可连接广告账户和品牌套件,生成视频和图片创意并直接发布到 Meta、Google 和 TikTok,读取平台表现数据后生成下一轮创意。
The ClawCast — Jev & OpenClaw Enterprise(第12期)https://x.com/i/broadcasts/1mxPaZewLAmKN
X.PIN 转述 Artificial Analysis 文生视频排行榜:前四名均为中国模型或基于中国模型。阿里 Wan 3.0 以 Elo 1157 居首,Utopai X(1150)第二且基于 MiniMax H3,Dreamina Seedance 2.5(1143)和 MiniMax H3(1138)分列三四;Google 最好的 Gemini Omni Flash 11 排第六。
非营利组织 Legal Advocates for Safe Science & Technology(LASST)就 2026 年 7 月 OpenAI 攻击 Hugging Face 一事,在旧金山县高等法院起诉 OpenAI,要求其停止访问第三方计算机系统并停止可能危害公众的 AI 开发行为。
我越来越觉得聊天流里的智能体间通信很烦人。把 OC harness 里的可见性改成只显示一行,可以展开。 很确定其他人也会跟进。https://github.com/openclaw/openclaw/pull/161656
基于 MiniMax H3,@Creatify_Labs 的 Boreal-H3 是一款专为广告优化的视频模型,在遵循创意简报更准确的同时,保持产品和角色的一致性。 期待看到 MiniMax H3 成为更多面向特定行业的前沿模型的基础!✨
用 Manus Game Dev 把一个想法变成好玩的 3D 赛车游戏。🏎️ 赛车呢?由我们的合作伙伴 @tripoai 生成的 3D 模型。
rerank-3 针对质量优化,rerank-3-lite 则兼顾延迟与质量。 两者都遵循指令,因此你可以用自然语言提示词来引导相关性打分。 阅读 Voyage AI 的更多内容:https://blog.voyageai.com/2026/09/30/rerank-3/?utm_source=OpenRouter&utm_medium=referral
每百万 token 定价: rerank-3:$0.05 rerank-3-lite:$0.02 两者每个查询-文档对均支持 32K tokens。
来自 @VoyageAI 的 Voyage AI rerank-3 和 rerank-3-lite 现已上线 OpenRouter rerank-2.5 和 rerank-2.5-lite 的即插即用升级版,专为长文档和代码检索打造 https://openrouter.ai/voyageai
Sherpa 用分离的智能体分别负责创意、结构、研究、行文和审校,并以独立的“Narrative World Model”追踪故事历史,解决单个聊天窗口无法维持长篇连载一致性的问题。推文指出 AI 小说读起来像流水线产物,原因在于聊天机器人一次只回答一个提示词、上下文窗口有限,无法记住 40 集前埋下的伏笔,也难以持续抓住读者。
这是我一直在用的、用新模型构建游戏的技能 npx skills add ericzakariasson/skills --skill game-builder
Anthropic CFO Krishna Rao 谈 Anthropic 员工选拔流程中的文化面试环节。 “有人可能在其他所有方面都表现出色,确实是你在这个岗位上见过的最聪明的人。但如果他们过不了文化关,我们就不会录用。” ---- 来自 “Invest Like The Best”(@patrick_oshag)YouTube 频道,(链接见评论)
Runway 推出开放权重世界动作模型 Praxis-1,将视频预训练能力转化为机器人真实世界控制,定位为可跨任意具身形态与环境的策略模型。该模型基于其大规模视频预训练与实时基础设施构建,官方称机器人演示数据有限而视频数据无限。Runway 正与 Noble Machines、Standard Bots、Ultra 等早期伙伴测试,并将在未来数月公开权重。
很想看看 Microduck 的生产和组装线是什么样子! 我们的下一款机器人应该要有手臂,这样它就能参与 Microduck 的生产了 😅😅😅