跳到正文

#教程/实践

今日 0 条
10月2日周五
  1. OpenRouter Blog40

    OpenRouter 客服机器人模型路由指南:低成本优先的 FAQ 处理

    OpenRouter 的模型路由指南建议客服机器人采用 cheap-first 方案:常规 FAQ 交给小型廉价模型,仅把困难或不确定的请求升级到更强模型。文中对比静态规则、分类器分流和带置信度阈值的答案校验三种模式,并指出 Auto Router 负责选择初始模型、有序 fallback 列表处理请求错误,支持策略的验收检查仍由应用维护

10月1日周四
9月11日周五
  1. OpenRouter Blog55

    OpenRouter 解读零数据留存 ZDR 对 AI API 的含义

    零数据留存(ZDR)指 AI 提供商处理提示词并返回结果后不再保存,它只约束提供商侧的留存,不改变数据仍会到达模型,也不覆盖应用日志、插件或第三方工具。在 OpenRouter 上可通过账户隐私设置、护栏或请求中的 provider.zdr 字段强制 ZDR,请求级开关与账户级设置按或关系生效,且只能开启、不能放宽账户规则。

9月2日周三
  1. Modal Blog25

    Botika 如何在 Modal 上运行全栈生成式 AI

    Botika 把全栈生成式 AI 运行在 Modal 上:自研数十亿参数基础模型、100TB 图像数据管道,并在生产环境同时服务约 15 个模型。该管道用数千个并发容器处理 100TB 数据,错误率低于 1%;单个研究员的实验量从每天一两个提升到 50 个。生产推理覆盖 L4、L40S、A100 和 H100,队列、自动扩缩容与冷启动由 Modal 承担。

8月27日周四
  1. LangChain Blog37

    AI Agent 延迟 101:如何加速你的 AI 智能体?

    LangChain 博客给出加速 AI 智能体的方法:先用 LangSmith 的 waterfall 视图定位延迟瓶颈,再针对性优化。做法包括流式返回计划步骤与检索结果——Perplexity 仅改 UI 展示中间步骤就提升了用户满意度,总耗时未变。其余手段是减少 LLM 调用、改用 Gemini Flash 等更快模型、缩短上下文,并用 LangGraph 做并行调用。

8月26日周三
  1. LangChain Blog47

    LLMs 与 SQL:LangChain 的 SQL chains 与 SQL agent 实践

    LangChain 的 SQL chains 和 SQL agent 通过向提示词注入数据库描述,让 LLM 生成可执行的 SQL 查询。为对抗模型幻觉(编造表、字段)与上下文窗口限制,做法是在提示词中附上 CREATE TABLE 语句和示例行;Rajkumar 等人的研究显示 3 行示例效果最佳,更多内容反而降低表现,LangChain 已将其设为默认。

  2. Google Blog · AI29

    用 Google Search 升级家居装饰的 5 种方式

    Google Search 提供 5 种家居装饰用法:AI Mode 可上传房间照片、生成沙发等家具在房间中的效果图,Lens 拍照查找同款复古家具,Circle to Search 圈选屏幕画面找相似装饰,Search Live 逐步指导 DIY 安装,商品列表可展开价格历史并开启 Track price 降价提醒。

8月25日周二
8月14日周五
8月12日周三
  1. Hamel Husain14

    Hamel Husain 的 AI 产品工程笔记

    Hamel Husain 汇总了其在 AI 产品工程与评估方向的长期写作,最新一篇为 9/30/26 的《Claude 新 auto eval 工具》。他联合教授 AI Evals for Engineers and PMs 课程,已有来自 500+ 公司的 5,000 多名学生,包括 OpenAI、Anthropic 和 Google。

8月7日周五
  1. OpenRouter Blog55

    OpenRouter 团队 AI 花费控制配置指南

    OpenRouter 发布团队 AI 花费控制配置指南,按组织、预设、密钥限额、guardrail、Activity 五步依次设置。组织默认支持最多 10 名成员并共享一个额度池,仅管理员可购买额度;密钥可设 limit 和 limit_reset(daily、weekly、monthly),guardrail 可按成员设 USD 预算与模型白名单,超限请求返回 403。