跳到正文

#模型发布

今日 0 条
10月2日周五
  1. TechCrunch · AI59

    Google 发布 Gemini 4 Argon,称其为迄今最强模型

    Google 发布 Gemini 4 Argon,称其可处理编程、研究和写作等任务,目前仅通过 Fairwind Program 向部分网络安全合作伙伴开放。该模型专门针对防御性网络安全训练,Google 称它能自主发现、验证并修复关键软件漏洞,自家员工已用它做调试和代码库迁移,还可解析长视频和图表。

  2. The Decoder43

    Ideogram 称新模型 Ideogram 4.5 可局部编辑图像而不影响其余部分

    Ideogram 称新模型 Ideogram 4.5 只修改用户指定区域,其余部分保持不变,主打产品摄影、室内设计、照片修复和图内文字编辑。该模型提供 0.8 至 22 美分四档单图价格,均为原生 2K 分辨率,现已在 Ideogram 平台和 API 上线。合作方包括 Picsart、Runway、Pika 和 Leonardo AI,Ideogram 还表示将很快推出开放权重版本。

10月1日周四
9月29日周二
9月28日周一
  1. Hugging Face Blog63

    H 公司发布 Holo4 通用计算机操作智能体模型

    H 公司发布 Holo4 系列通用计算机操作智能体模型,含 27B dense 与 35B-A3B MoE 两个版本,已上线 H Models API,并在 Hugging Face 开放 BF16、FP8、NVFP4 和 4-bit GGUF 权重。

    推荐理由:Holo4 给出与前沿闭源模型在 OSWorld 2.0 上的分数和成本对比,并公开全部评测轨迹,便于判断通用计算机操作智能体的性价比。

9月24日周四
  1. Sarvam AI50

    Sarvam Vision 2.1:拓展文档智能的帕累托前沿

    Sarvam Vision 2.1 在 olmOCR-Bench 总体得分 87.3,OmniDocBench v1.6 总体得分 94.97,并新增复杂多页表格结构化抽取、表单 KV 抽取与 Indic 手写识别能力。该模型沿用 harness-with-VLM 架构,在监督微调后进行 RLVR 后训练,缓解了此前的幻觉与不一致问题。团队同时优化推理栈,使 API 定价低于发布时,面向生产负载。

9月22日周二
  1. elsewhere56

    阶跃 Step 5 Preview 实测:金融数据能力突出,长思考与美术资产偏弱

    阶跃发布 Step 5 Preview,总参数量 600B、激活参数 27B,支持视觉输入,官方称单任务成本仅为 Claude Opus 5 的 1/8,并称其在 Artificial Analysis 上进入全球开源前三。第三方实测显示,它在利润表桑基图、金融数据获取与交叉验证上表现较好,但在冷门基准、泛化性以及寻找和制作美术资产上偏弱,且思考过程偏长会让长任务耗时明显增加。

8月25日周二
7月27日周一
7月15日周三
8月7日周四
7月1日周二