跳到正文

#部署/工程

今日 0 条
10月2日周五
  1. IT之家29

    《战争机器:事变日》发售宣传片公开:首发支持 DLSS 4.5 及光追,10 月 7 日正式发售

    The Coalition 公布《战争机器:事变日》发售宣传片,该作将于 10 月 7 日登陆 XBOX Series X|S 与 PC,首发加入 XBOX Game Pass。PC 版首发支持英伟达 DLSS 4.5 与硬件光线追踪,同时兼容 AMD FSR、虚幻引擎 TSR 和 Intel XeSS。标准版售价 298 元,高级版 428 元,预购高级版可提前最多 5 天体验。

  2. OpenRouter Blog40

    OpenRouter 客服机器人模型路由指南:低成本优先的 FAQ 处理

    OpenRouter 的模型路由指南建议客服机器人采用 cheap-first 方案:常规 FAQ 交给小型廉价模型,仅把困难或不确定的请求升级到更强模型。文中对比静态规则、分类器分流和带置信度阈值的答案校验三种模式,并指出 Auto Router 负责选择初始模型、有序 fallback 列表处理请求错误,支持策略的验收检查仍由应用维护

10月1日周四
9月29日周二
  1. HuggingFace Daily Papers36

    FlexRouter:为灵活 LLM 路由学习互补模型集

    FlexRouter 是显式建模模型互补性的 LLM 路由框架,通过最大化答案覆盖率来选取互补模型集,避免独立打分选 top-k 导致的冗余。它用 DPP 建模路由策略,以失败集边缘化的训练目标直接优化覆盖率,推理时按边际增益贪心选取,无需预设预算即可自适应确定子集大小。在 RouterEval 基准上,其域内与域外任务的覆盖率更高、冗余更低。

  2. Databricks Blog27

    制造业数据与 AI:Databricks 连接产品价值链

    Databricks 的 Data and AI Platform 通过 zero-copy Open Sharing 和 Lakehouse Federation 直接查询工厂、供应商与质量系统中的原始数据,无需为每个用例新建 ETL 管道或复制数据。平台以序列号、批次或零件号作为关联键,把跨阶段的追溯问题变成一次查询,并支持机器与车辆遥测的低延迟处理。

9月28日周一
9月25日周五
9月24日周四
9月22日周二
9月17日周四
9月11日周五
  1. OpenRouter Blog55

    OpenRouter 解读零数据留存 ZDR 对 AI API 的含义

    零数据留存(ZDR)指 AI 提供商处理提示词并返回结果后不再保存,它只约束提供商侧的留存,不改变数据仍会到达模型,也不覆盖应用日志、插件或第三方工具。在 OpenRouter 上可通过账户隐私设置、护栏或请求中的 provider.zdr 字段强制 ZDR,请求级开关与账户级设置按或关系生效,且只能开启、不能放宽账户规则。

9月10日周四
  1. Mistral AI33

    Mistral 与 Cloudera 合作,将专用、主权智能带入企业数据

    Mistral 与 Cloudera 建立合作,将 Mistral 模型集成进 Cloudera 混合数据平台,让企业在私有云、公有云、本地及完全气隙环境中运行推理并保持完全控制。企业还可在受控环境中基于大量专有数据训练自有模型,数据与由此产生的智能均归自己所有,合作面向 Cloudera 平台上 30 exabytes 的客户管理数据。

9月9日周三
9月2日周三
  1. Modal Blog25

    Botika 如何在 Modal 上运行全栈生成式 AI

    Botika 把全栈生成式 AI 运行在 Modal 上:自研数十亿参数基础模型、100TB 图像数据管道,并在生产环境同时服务约 15 个模型。该管道用数千个并发容器处理 100TB 数据,错误率低于 1%;单个研究员的实验量从每天一两个提升到 50 个。生产推理覆盖 L4、L40S、A100 和 H100,队列、自动扩缩容与冷启动由 Modal 承担。

8月31日周一
8月27日周四
  1. LangChain Blog56

    LangSmith 发布 LLM Gateway 公共测试版,为生产智能体提供运行时控制

    LangChain 的 LangSmith LLM Gateway 进入公开测试版,作为智能体与所调用模型之间的集中治理层,提供生产环境的运行时控制。它支持在组织、工作区、API key 和用户四个层级设置消费上限与限流,可用自定义请求头为多租户场景中的每个终端客户单独控制,并定义跨模型和主机的回退路由。

  2. LangChain Blog34

    Replit Agent 的复杂工作流如何把 LangSmith 推向新极限

    LangChain 与 Replit 合作为 LangSmith 新增大 trace 性能扩展、trace 内搜索过滤与 thread view 三项能力。Replit Agent 的智能体流程会产生数百步 trace,新能力让 Replit 可直接按输入输出关键词过滤而非逐条翻查。thread view 还能把同一多轮对话中分散的 trace 归并,帮助定位用户卡点与人工介入机会。

  3. LangChain Blog37

    AI Agent 延迟 101:如何加速你的 AI 智能体?

    LangChain 博客给出加速 AI 智能体的方法:先用 LangSmith 的 waterfall 视图定位延迟瓶颈,再针对性优化。做法包括流式返回计划步骤与检索结果——Perplexity 仅改 UI 展示中间步骤就提升了用户满意度,总耗时未变。其余手段是减少 LLM 调用、改用 Gemini Flash 等更快模型、缩短上下文,并用 LangGraph 做并行调用。

8月26日周三
  1. LangChain Blog46

    LangServe 新增 Playground 与可配置能力

    LangChain 为 LangServe 新增 Playground 与配置(configuration)能力。部署链或智能体后会自动附带 Playground,支持流式输出、中间步骤完整日志和可调参数,方便发链接给同事协作试用。配置基于 LangChain Expression Language,可通过 URL 保存不同版本,但当前配置尚不持久化,官方正 alpha 测试可持久化的部署平台。

8月25日周二
8月21日周五
8月19日周三
  1. LangChain Blog33

    LangChain:企业要拥有自己的智能,才能建立持久 AI 优势

    LangChain 博客主张,企业要获得持久的 AI 优势,必须拥有自己的智能,而非只依赖通用模型。文章认为不必自建 AI 每一层,但要控制模型、harness 编排逻辑以及上下文与记忆这些决定智能行为的部分。企业还需像管理操作系统一样控制成本、衡量质量,并界定智能体可独立行动与需要监督的边界。

8月11日周二
8月10日周一
8月7日周五
  1. OpenRouter Blog55

    OpenRouter 团队 AI 花费控制配置指南

    OpenRouter 发布团队 AI 花费控制配置指南,按组织、预设、密钥限额、guardrail、Activity 五步依次设置。组织默认支持最多 10 名成员并共享一个额度池,仅管理员可购买额度;密钥可设 limit 和 limit_reset(daily、weekly、monthly),guardrail 可按成员设 USD 预算与模型白名单,超限请求返回 403。