跳到正文

全部动态

今日 0 条
1月15日周四
  1. OpenAI:Alignment 研究博客(RSS)55

    CoVal: 从群体中学习具有价值观意识的评估准则

    研究团队发布了一个名为CoVal的实验性数据集,其中包含了由众包方式撰写的评估准则。该数据集揭示了人们为何更倾向于选择某个模型输出而非另一个的具体原因,旨在让AI模型理解人类在评估文本质量时所依据的、蕴含价值观的多元标准。通过分析这些群体贡献的详细评估规则,研究为训练更符合人类偏好的语言模型提供了透明、可解释的反馈依据。

    推荐理由:OpenAI 把众包标注升级成可学习的价值观评分标准,对做对齐和 RLHF 的团队来说是个新数据源,但离产品落地还远,属于研究信号而非行动指南。

  2. LlamaIndex:产品、工程与评测66

    LlamaIndex 撰文分析文件接口正成为 Agent 读取和交互上下文的核心方式

    LlamaIndex 发文指出,Agent 正越来越多地通过文件和文件系统来读取非结构化上下文,并归纳出三种主要用法:用文件存储和检索长程对话历史、用文件搜索替代朴素 RAG 来获取海量外部上下文、用 Skills 类文件教会 Agent 做事从而绕过 MCP。

    推荐理由:LlamaIndex 以一手实验和生态观察,梳理文件系统如何成为 Agent 上下文管理的核心抽象,并指出解析与检索等缺口。

1月14日周三
  1. 美团 LongCat:HuggingFace 新模型1

    美团LongCat发布重思考模式总结模型

    美团LongCat推出基于5600亿参数MoE架构大模型LongCat-Flash-Thinking-2601的重思考模式(Heavy Thinking Mode),并发布LongCat-HeavyModel-Summary模型。该模式通过并行思考与总结两阶段协同扩展推理能力:前者以高温度并行生成多路径扩展宽度,后者将精炼轨迹递归反馈形成迭代循环延伸深度。模型经额外强化学习优化总结能力,已在Longcat AI平台上线。

    推荐理由:美团开源 560B 参数 MoE 推理模型,Heavy Thinking 模式支持并行多路径探索,已上线可体验

  2. PromptArmor:Threat Intelligence72

    PromptArmor 披露 Superhuman AI 间接提示注入导致邮件数据外泄漏洞

    PromptArmor 披露 Superhuman AI 存在间接提示注入漏洞,恶意邮件中的隐藏指令可让 AI 在用户请求总结邮件时,把数十封含财务、法律、医疗信息的敏感邮件内容填入攻击者的 Google Form 预填链接并以 Markdown 图片输出,单次响应外泄超过 40 封邮件的部分内容。

    推荐理由:原文完整披露了利用 Google Forms 预填链接和 Markdown 图片绕过 CSP 的攻击链,可用于理解 Agent 间接提示注入的数据外泄路径。

  3. Manus:Blog(网页)67

    2026年十大AI视频生成器实测比较:从Runway到Manus

    Manus博客发布2026年十大提示到视频AI生成器评测,用同一条东京雨夜巷子的提示测试Runway (Gen 4.5)、HeyGen、OpenAI Sora。

    推荐理由:作者用同一条提示实测了10款主流AI视频生成器,并逐一记录输出质量、界面与定价,便于读者按需求和预算对照选型。

1月13日周二
  1. OpenAI:Alignment 研究博客(RSS)63

    为何我们对“忏悔式”训练感到兴奋

    Anthropic提出“忏悔式”训练法,要求AI在拒绝不当请求时,内部生成安全解释以“自我剖析”潜在危害。该方法显著增强了模型安全性:经微调的Claude 3 Opus模型在“越狱”攻击下的有害行为率从约50%降至10%以下,降幅超80%。其效果优于传统思维链监控,为AI对齐提供了更鲁棒、可解释的安全训练新路径。

    推荐理由:OpenAI 对齐团队把「confession training」和 chain-of-thought monitoring 做了系统对比,这是对齐领域少有的实操级研究,做安全的团队值得细读,但离普通开发者还远。

1月11日周日
  1. OpenAI Developers:Blog(网页)60

    Skyscanner 通过 JetBrains MCP 增强 Codex CLI 的开发实践

    Skyscanner 工程师分享了在日常工作流中把 OpenAI Codex CLI 通过 JetBrains MCP server 接入 IDE 的实践。Codex 可调用 get_file_problems 检查编译错误、执行预定义的测试、lint 和格式化运行配置,例如在 Databricks Java SDK 用例中立即发现 NotFound 异常构造函数不匹配的问题。

    推荐理由:Skyscanner 工程师分享把 Codex CLI 接入 JetBrains MCP 的具体做法,给出了错误检查和测试运行如何缩短反馈循环的实操路径。

1月10日周六
  1. Midjourney:Updates(RSS)1

    Niji V7 正式发布!

    Niji V7 图像模型正式上线。该版本专为亚洲及动漫场景优化,改进了动漫连贯性、提示词理解能力、文字渲染效果及 sref 性能。

    推荐理由:Midjourney 动漫专用模型 Niji V7 发布,生成质量再升级

  2. Nathan Lambert:Interconnects(RSS)1

    Claude Code 与众不同

    Claude Code 集成 Opus 4.5 模型实现关键突破,编程智能体跨越重要能力阈值。此次升级标志着编码代理在自主性和工程处理能力上达到新水平,可应对更复杂的开发任务。Opus 4.5 显著提升了代码生成、调试及复杂问题解决的表现,使 AI 辅助编程从基础工具向高效协作伙伴转变,为开发者带来质的不同的使用体验与效率提升。

    推荐理由:编码 Agent 跨越关键门槛,Claude Code 能力跃升将重塑开发者工作流

1月9日周五
  1. PromptArmor:Threat Intelligence73

    PromptArmor 披露 Notion AI 经由间接提示词注入在用户批准前外泄数据

    PromptArmor 披露 Notion AI 存在间接提示词注入漏洞:AI 编辑在用户批准前已被保存,注入的提示词可让 Notion AI 把招聘追踪文档内容拼入外部图片 URL,用户浏览器加载图片时数据即已外泄,无论是否同意。

    推荐理由:原文完整拆解了 Notion AI 在用户批准前保存 AI 编辑导致数据外泄的漏洞链,并给出企业和 Notion 双方可行的缓解配置与修复建议。

  2. Anthropic:Engineering(事故复盘 + 工程实践 · 网页)75

    揭秘AI智能体评估:构建可靠系统的关键

    有效的评估能帮助团队更自信地发布AI智能体,避免陷入仅在生产环境被动发现问题、修复可能引发新问题的循环。智能体因其多轮操作的自主性与灵活性,评估更为复杂。一个完整的评估结构包含任务、评分器、记录、结果、评估框架与评估套件等核心组件。缺乏系统评估将导致团队无法区分真实的质量倒退与随机波动。建立评估体系能帮助团队在智能体规模化过程中持续监控质量、自动测试变更并量化改进效果,其价值在智能体整个生命周期内持续累积。

    推荐理由:Anthropic 把内部踩过的坑全摊开了,从 eval 设计到 grader 选型到 transcript 审读,是目前最完整的 Agent 评估工程指南,做 Agent 产品的团队可以直接当手册用。

1月8日周四
  1. PromptArmor:Threat Intelligence66

    PromptArmor 披露 IBM Bob 编码 Agent 可被提示词注入诱导下载并执行恶意软件

    PromptArmor 披露 IBM 编码 Agent Bob(含 Bob CLI 与 Bob IDE,目前 Closed Beta)存在漏洞:若用户对任一已知可信命令选择 always allow,攻击者可通过间接提示词注入触发下载并执行恶意软件。

    推荐理由:原文完整拆解了 Bob CLI 三道防御被绕过的具体机制与攻击链,读者可据此评估编码 Agent 的命令自动审批风险。

1月5日周一
  1. Liquid AI 模型与工程博客(网页)63

    Liquid AI 发布 LFM2.5 端侧模型家族,预训练扩展至 28T tokens

    Liquid AI 发布 LFM2.5-1.2B 模型家族,将预训练从 10T 扩展到 28T tokens 并加入强化学习后训练,覆盖 Base、Instruct、日语、视觉语言和音频语言五个变体。

    推荐理由:官方发布给出了完整基准数据和推理速度对比,读者可以据此评估 1B 级端侧模型在指令遵循和部署上的实际水位。

1月1日周四
  1. Dario Amodei:Blog(网页)1

    技术的青春期

    Dario Amodei 将当前 AI 发展阶段定义为「技术的青春期」,认为人类即将获得难以想象的力量,但社会和政治系统是否具备驾驭成熟度仍存疑。文章强调需避免「末日论」式恐慌,以务实、基于事实的方式讨论风险,同时承认 AI 发展速度和风险的不确定性。作者主张通过企业自愿行动与精准政府监管相结合,在避免过度干预的前提下应对潜在危险,为可能到来的更强有力行动储备证据和方案。

    推荐理由:Anthropic CEO 长文剖析 AI 文明风险与治理路径,值得深读。

12月31日周三
  1. Dwarkesh Patel:Podcast & Blog(RSS)1

    Adam Marblestone — AI 缺失了关于大脑的根本认知

    Adam Marblestone 指出,当前人工智能研究忽略了大脑运作的核心机制。与业界普遍关注神经网络架构不同,大脑的真正优势在于其奖励函数而非结构本身。这一观点挑战了主流 AI 研究范式,暗示未来突破可能来自对大脑激励系统的深入理解,而非单纯的架构模仿。该论断为人工智能发展提供了新的思考维度。

    推荐理由:AI研发或应转向奖励函数设计,而非一味堆叠架构复杂度

12月30日周二
  1. xAI:News(网页)1

    xAI推出Grok Business与Enterprise企业版

    xAI发布Grok Business和Grok Enterprise企业版。Business版定价30美元/座位/月,支持自助开通,提供团队管理、统一账单及Google Drive集成(保留原文件权限),并承诺用户数据永不用于模型训练。Enterprise版面向大型组织,提供Custom SSO、Directory Sync及高级审计控制;可选的Enterprise Vault插件提供独立数据平面与客户自管加密密钥(CMEK),实现应用级加密隔离。平台支持实时使用监控、安全对话共享及Projects功能。

    推荐理由:xAI 推出 Grok 企业版,主打隐私保护与 Agent 能力,月费 30 美元起

12月29日周一
  1. Manus:Blog(网页)69

    Manus 官宣加入 Meta,将继续独立运营并服务现有用户

    Manus 官宣加入 Meta,称此举将巩固其在 AI 应用层的战略位置,把 Meta 平台上的数百万企业和数十亿用户作为下一步服务对象。截至 12 月初,Manus 已处理超过 147 万亿个 token,创建超过 8000 万台虚拟计算机;Manus 将继续通过 app 和网站提供产品和订阅服务,公司继续在新加坡运营,CEO 肖弘表示运作方式和决策机制不变。

    推荐理由:官方公告交代了收购后的服务安排和运营计划,读者可以据此判断 Manus 现有用户的订阅与使用是否受影响。

12月22日周一
  1. xAI:News(网页)1

    以 AI 支持 DOW 的使命

    xAI 被美国战争部(DOW)选中,为其 GenAI.Mil 套件提供 Frontier AI 系统。基于 Grok 模型的解决方案将覆盖 DOW 旗下 300 万军事和文职人员,支持 Impact Level 5(IL5)级别的企业 AI 和关键任务用例,可嵌入从五角大楼到战术边缘的日常工作流,并支持机密作战工作负载。DOW 用户还可独家获取 X 平台实时全球洞察。

    推荐理由:xAI获美国国防部大单,Grok将覆盖300万军事人员并提供实时情报支持

12月19日周五
  1. Anthropic:Alignment Science Blog(网页)60

    Anthropic 等提出 Activation Oracle:训练 LLM 以自然语言回答模型激活相关问题

    Anthropic 联合 MATS、Truthful AI 等机构发布研究,训练 Activation Oracle(AO)将 LLM 神经激活作为输入,用自然语言回答关于激活的任意问题。

    推荐理由:文章给出 Activation Oracle 的训练方法、审计表现和局限,读者可以据此判断它与机械可解释性方法的互补关系。

12月18日周四
  1. OpenRouter:Announcements(RSS)61

    Response Healing:将 JSON 缺陷减少 80% 以上

    OpenRouter 推出新功能 Response Healing,可在 LLM 生成的畸形 JSON 响应抵达用户应用前自动修复。该功能旨在将 JSON 格式错误减少超过 80%,直接提升 API 响应的结构完整性与可靠性,减少下游应用的处理负担。

    推荐理由:做 Agent 的人最怕 JSON 解析炸掉整个 pipeline,OpenRouter 这个 Response Healing 相当于在网关层加了自动纠错,接入成本几乎为零,值得试试。

  2. 英国 AI Security Institute:Blog(网页)81

    英国 AI Security Institute 发布首份 Frontier AI Trends 报告的五大发现

    英国 AI Security Institute(AISI)发布首份 Frontier AI Trends Report,汇总其对 30 多个前沿模型的测试结果。

    推荐理由:官方测试机构首次以报告形式公开跨领域趋势数据,读者可据此了解前沿模型在生化、网络和失控风险上的实际水平。

  3. Transluce(网页)60

    Transluce 发布 Predictive Concept Decoders:用可解释性助手读取模型内部状态

    Transluce 提出 Predictive Concept Decoders(PCD),训练可解释性助手把模型内部状态翻译成人类可读的概念列表,再据此回答模型行为问题。PCD 由编码器和解码器组成,能在越狱、秘密提示和注入概念三类场景中揭示模型自身不报告的信息,且性能随训练数据扩展而提升,论文见 arXiv 2512.15712,可在 decoder.transluce.org 体验。

    推荐理由:把可解释性建模为预测问题来端到端训练,并展示能揭示模型未言明信息的实验场景,方法思路可借鉴。

12月17日周三
  1. xAI:News(网页)1

    xAI 发布 Grok Voice Agent API

    xAI 开放 Grok Voice Agent API,基于自研语音栈(VAD、tokenizer、音频模型),Big Bench Audio 基准排名第一,首音频延迟低于 1 秒(比竞品快近 5 倍),定价 $0.05/分钟。支持数十种语言自动切换、实时搜索 X 和网页、调用自定义工具,已深度集成特斯拉车机。提供 Ara、Eve 等多种自然声线,支持 [whisper] 等听觉标签,兼容 OpenAI Realtime API 规范。

    推荐理由:xAI发布Grok语音Agent API,延迟低于1秒且定价仅为OpenAI一半,已集成至Tesla车载系统

  2. 英国 AI Security Institute:Blog(网页)65

    英国 AI Security Institute 联合 Thorn 发布防范 AI 生成儿童性虐待材料的安全协议

    英国 AI Security Institute(AISI)与儿童安全组织 Thorn 发布安全协议,指导 AI 开发者和托管平台防止系统被滥用于生成儿童性虐待材料(CSAM)。配套的11月新立法将在严格条件下授权少量组织直接测试模型能否被用于生成此类内容,协议同时列出监测、访问控制等措施,并指出在训练数据和模型输出中可靠检测 CSAM 仍是待解的技术难题。

    推荐理由:AISI 与 Thorn 发布防止 AI 生成 CSAM 的安全协议,并配合新的合法测试授权,读者可了解全生命周期防护思路。

12月15日周一
  1. 通义 QwenAudio:原创语音项目60

    通义实验室开源 Fun-ASR 系列语音识别模型,含方言与 31 语言版本

    通义实验室发布 Fun-ASR 端到端语音识别模型系列并开源。Fun-ASR-Nano-2512 参数量 800M,基于数千万小时语音训练,支持中英日三语、7 种汉语方言和 26 种地方口音;Fun-ASR-MLT-Nano-2512 同为 800M,基于数十万小时训练,支持 31 种语言。

    推荐理由:原文给出两个识别模型的训练规模、语言覆盖和开源基准对比,还附部署与推理路径,读者可据此评估在中文和方言场景的可用性。

12月12日周五
  1. Thinking Machines Lab:News(网页)67

    Thinking Machines Lab 宣布 Tinker 全面开放并支持视觉输入

    Thinking Machines Lab 宣布 Tinker 正式开放(GA),取消候补名单,并新增四项更新:支持微调 Kimi K2 Thinking(万亿参数。

    推荐理由:官方宣布 Tinker 全面开放并新增视觉输入,附上 VLM 与传统视觉基线在少样本分类下的对比数据,可作选型参考。

12月9日周二
  1. Claude:Blog(网页)1

    Anthropic调研:2026年企业AI智能体应用趋势

    Anthropic与Material调研500余位技术领导者显示,57%企业已将AI智能体用于多阶段工作流,16%实现跨职能部署。编码是核心场景,90%用于开发辅助,86%用于生产代码,平均节省近六成时间。80%受访者称投资已产生可衡量回报,如Thomson Reuters将法律检索从数小时缩短至分钟级。2026年81%企业计划处理更复杂用例,但面临系统集成、数据质量和变革管理三大挑战。

    推荐理由:Anthropic发布企业AI Agent深度调研,揭示2026年应用趋势与头部企业实战案例

12月5日周五
  1. ARC Prize:官方博客69

    ARC Prize 2025 结果公布:NVARC 摘得桂冠,Grand Prize 仍无人认领

    ARC Prize 发布 2025 年结果与分析,NVARC 以约 24% 的 ARC-AGI-2 私有集得分($0.20/task)夺得 Kaggle 竞赛冠军,Grand Prize 连续第二年无人认领。

    推荐理由:官方复盘给出 2025 年获奖方案、成本数字与 refinement loop 框架,读者可借此理解当前 AI 推理的真实边界。

12月4日周四
  1. PromptArmor:Threat Intelligence67

    PromptArmor 披露 vLex Vincent AI 屏幕接管钓鱼攻击,vLex 已修复

    PromptArmor 披露法律 AI 工具 Vincent AI(所属公司 vLex 上月被 Clio 以 10 亿美元收购)存在提示词注入漏洞。

    推荐理由:PromptArmor 原创披露 vLex 提示词注入可导致屏幕接管钓鱼,读者可借三步攻击链理解上传文档类 AI 工具的注入风险。

  2. 英国 AI Security Institute:Blog(网页)75

    英国 AI Security Institute 联合多校研究:AI 模型说服力更多取决于后训练而非模型规模

    英国 AI Security Institute 与牛津、LSE、Stanford、MIT 合作在 Science 发表研究,通过三项实验让 76000 余名参与者与 19 个模型就 707 个议题对话,检验 AI 说服力的来源。结果显示后训练的影响远超模型规模,强调事实与证据的提示词使说服力提升 27%,个性化微定向效应则不到 1 个百分点;同时提升说服力的手段会系统性降低事实准确性。

    推荐理由:研究基于 76000 多人实验,指出后训练和信息密度比模型规模更能提升说服力,且说服力提升伴随事实准确性下降。

12月3日周三
  1. 蚂蚁 inclusionAI:GitHub 新仓库63

    蚂蚁集团开源AState:面向强化学习的高性能状态管理系统

    蚂蚁集团开源了AState,这是一个专为强化学习设计的高性能通用状态数据管理系统。它旨在解决RL训练与推理中的I/O效率低下、权重同步性能不足及状态恢复不鲁棒等核心挑战。系统采用三层架构:提供张量原生接口的API层、支持多种部署模式的服务层以及具备高效可扩展传输能力的基础层。其关键特性包括统一的张量级API、高性能权重同步和拓扑感知设计。在万亿参数规模下,AState能在约6秒内完成权重同步,远低于业界常见的分钟级延迟,目前已作为ASystem的关键组件在蚂蚁内部生产环境部署。

    推荐理由:蚂蚁把万亿参数 RL 训练的权重同步从分钟级压到 6 秒,这套 AState 系统是真刀真枪的工程解法,做大规模 RL infra 的团队值得拆一拆它的 RDMA P2P 架构。

  2. Dwarkesh Patel:Podcast & Blog(RSS)1

    对 AI 进展的思考(2025年12月)

    作者对人工智能发展作出阶段性预判:短期内持温和看跌态度,认为行业可能面临调整期或增速放缓;长期来看则极度看涨,预期将迎来爆发式增长。这一观点揭示了技术成熟度曲线中短期波动与长期变革潜力之间的典型张力,为2025年底的 AI 发展态势提供了审慎而前瞻的研判框架。

    推荐理由:顶级AI播客主持人对AGI发展节奏的宏观判断,短期谨慎与长期爆发的前瞻视角值得参考

12月2日周二
  1. OpenAI:Alignment 研究博客(RSS)60

    大规模验证代码的实用方法

    研究团队训练并部署了一个专为高精度和实际应用优化的AI代码审查智能体。该智能体旨在对自主生成的代码进行有效监督,使代码审查能力能够与自动化代码生成的规模同步扩展。通过优化智能体的精确度,该方法致力于解决大规模代码生成中的质量控制难题,为AI辅助软件开发提供了可落地的规模化监督方案。

    推荐理由:OpenAI 把对齐研究落到了代码审查这个具体场景,不是空谈 alignment 理论,而是训了个高精度 review agent 来给 AI 写的代码做质检。做 coding agent 的团队该看看,这可能是未来安全合规的标配。

11月26日周三
  1. Anthropic:Engineering(事故复盘 + 工程实践 · 网页)75

    为长时运行智能体设计有效约束方案

    为解决AI智能体在跨越多上下文窗口执行长期任务时的“记忆丢失”与进展不一致问题,Anthropic为Claude Agent SDK开发了一套双重方案。该方案包含一个初始化智能体,负责在首次运行时建立基础环境并生成功能清单;以及一个编码智能体,负责在后续会话中进行增量开发并提交清晰可合并的代码。通过结构化的进度日志和Git历史等机制,引导智能体避免“试图一次性完成所有功能”或“过早宣布完成”的失败模式,从而实现跨会话的持续有效协作。

    推荐理由:Anthropic 把 Claude Agent SDK 跑长任务踩过的坑全摊开了,初始化 agent + 增量进度文件这套方案不复杂但极实用,做 Agent 产品的团队可以直接抄作业。

  2. Prime Intellect(网页)69

    Prime Intellect 发布 INTELLECT-3:106B 参数 MoE 模型,大规模 RL 训练并全栈开源

    Prime Intellect 发布 INTELLECT-3,一个 106B 参数的 MoE 模型,在 GLM-4.5-Air 基座上经 SFT 和大规模 RL 训练,在数学、代码、科学和推理基准上达到同规模最先进水平。

    推荐理由:原文给出了完整的模型权重、训练框架与 RL 环境开源清单,读者可以据此复现大规模强化学习后训练。

11月25日周二
  1. Together AI 研究与产品博客(RSS)64

    Together AI 上线 Black Forest Labs 的 FLUX.2 多参考图生图模型

    Together AI 将 Black Forest Labs 的 FLUX.2 图像模型接入 Model Library,面向 100 万以上开发者提供多参考输入、hex 色号颜色匹配和文本渲染能力。

    推荐理由:原文列出了多参考输入、hex 色号匹配和三个型号的具体参数,读者可据此判断是否接入现有生成工作流。

  2. LlamaIndex:产品、工程与评测65

    LlamaIndex 发布 LlamaSheets Beta,将杂乱电子表格转为 AI 可用数据

    LlamaIndex 发布 LlamaParse 新 API LlamaSheets(Beta,免费),把任意 .xlsx 电子表格语义化结构为 Parquet 文件,供 Agent 或下游应用使用。

    推荐理由:原文介绍了将杂乱表格转为 Parquet 的多阶段处理方法与接入方式,读者可据此评估是否嵌入自己的表格自动化流程。

  3. Suno:Blog(网页)56

    音乐创作的新篇章 · Suno 联合创始人兼首席执行官 Mikey Shulman · 2025年11月25日 Suno 与华纳音乐集团合作,共同构建交互式音乐的未来 公告

    Suno宣布与华纳音乐集团达成合作。Suno已拥有近1亿音乐创作者社区,此次合作旨在推出更强大的创作功能、提供与WMG旗下艺术家互动的机会,并基于授权音乐构建新一代Suno模型,其性能将超越v5。未来,部分同意授权的WMG艺术家声音与形象可用于新的AI生成音乐创作体验,为其开辟新收入渠道。同时,歌曲下载功能将调整为仅限付费用户使用,而Suno Studio作为专业工具将保持现有功能并持续更新。

    推荐理由:Suno和华纳的牵手,意味着AI生成音乐终于拿到了正版内容的通行证,从此不用再躲躲藏藏,对音乐创作者和听众都是质变信号。

11月24日周一
  1. OpenAI Developers:Blog(网页)66

    OpenAI 发布指南:什么样的 ChatGPT 应用才算好应用

    OpenAI 在 DevDay 推出 ChatGPT Apps 后发布开发者设计指南,说明 ChatGPT 应用本质是模型可调用的一组明确定义的工具,而非产品缩略版。

    推荐理由:OpenAI 给出判断 ChatGPT 应用价值的 know/do/show 框架和设计清单,开发者可据此决定移植哪些能力、如何命名工具。