跳到正文

#数据/训练

今日 0 条
10月1日周四
9月30日周三
9月29日周二
  1. Databricks Blog27

    制造业数据与 AI:Databricks 连接产品价值链

    Databricks 的 Data and AI Platform 通过 zero-copy Open Sharing 和 Lakehouse Federation 直接查询工厂、供应商与质量系统中的原始数据,无需为每个用例新建 ETL 管道或复制数据。平台以序列号、批次或零件号作为关联键,把跨阶段的追溯问题变成一次查询,并支持机器与车辆遥测的低延迟处理。

9月28日周一
9月24日周四
  1. Sarvam AI50

    Sarvam Vision 2.1:拓展文档智能的帕累托前沿

    Sarvam Vision 2.1 在 olmOCR-Bench 总体得分 87.3,OmniDocBench v1.6 总体得分 94.97,并新增复杂多页表格结构化抽取、表单 KV 抽取与 Indic 手写识别能力。该模型沿用 harness-with-VLM 架构,在监督微调后进行 RLVR 后训练,缓解了此前的幻觉与不一致问题。团队同时优化推理栈,使 API 定价低于发布时,面向生产负载。

9月2日周三
  1. Modal Blog25

    Botika 如何在 Modal 上运行全栈生成式 AI

    Botika 把全栈生成式 AI 运行在 Modal 上:自研数十亿参数基础模型、100TB 图像数据管道,并在生产环境同时服务约 15 个模型。该管道用数千个并发容器处理 100TB 数据,错误率低于 1%;单个研究员的实验量从每天一两个提升到 50 个。生产推理覆盖 L4、L40S、A100 和 H100,队列、自动扩缩容与冷启动由 Modal 承担。

8月31日周一
8月26日周三
  1. LangChain Blog41

    Cube x LangChain:用 LLM 与语义层构建 AI 体验

    Cube 与 LangChain 集成,以文档加载器 CubeSemanticLoader 将语义层数据模型的嵌入写入向量数据库。该向量库可用于匹配语义层实体,把自然语言输入映射到数据模型中的视图及其成员,加载时只载入视图。Cube 还提供 chat 演示应用,用 OpenAI 提示词、FAISS 向量库和 Streamlit 界面生成对 Cube SQL API 的查询。

8月12日周三
  1. Hamel Husain14

    Hamel Husain 的 AI 产品工程笔记

    Hamel Husain 汇总了其在 AI 产品工程与评估方向的长期写作,最新一篇为 9/30/26 的《Claude 新 auto eval 工具》。他联合教授 AI Evals for Engineers and PMs 课程,已有来自 500+ 公司的 5,000 多名学生,包括 OpenAI、Anthropic 和 Google。

12月24日周三
7月11日周五