Black Forest Labs 发布 Flux 3 Image,支持多步局部编辑
Black Forest Labs 发布 Flux 3 家族的图像模型 Flux 3 Image,支持多步编辑且不改动画面其余部分,覆盖文生图、图生图、文字渲染和写实生成。
Black Forest Labs 发布 Flux 3 家族的图像模型 Flux 3 Image,支持多步编辑且不改动画面其余部分,覆盖文生图、图生图、文字渲染和写实生成。
OpenAI 升级 ChatGPT 购物功能,新增虚拟试穿和 Favorites 收藏两项能力,用户可上传自拍或现拍照片生成穿着特定服饰或配饰的效果图。虚拟试穿以 Try on 按钮出现在支持该功能的服饰和配饰商品页面,效果大致依托 ChatGPT Images 2.5 图像生成模型,该模型在光照、材质细节和人物特征保留上有所改进。
OpenAI 宣布 ChatGPT 全球上线两项购物功能,分别是虚拟试穿和收藏(Favorites)。用户在购物结果中点击新的 Try On 按钮并上传自拍或全身照,即可查看服装或配饰的上身效果,也可上传网页截图等商品图让 ChatGPT 代为试穿;Favorites 则把商品存入应用内的 Library 以便之后找回,并与试穿图片一起保存。
Ideogram 称新模型 Ideogram 4.5 只修改用户指定区域,其余部分保持不变,主打产品摄影、室内设计、照片修复和图内文字编辑。该模型提供 0.8 至 22 美分四档单图价格,均为原生 2K 分辨率,现已在 Ideogram 平台和 API 上线。合作方包括 Picsart、Runway、Pika 和 Leonardo AI,Ideogram 还表示将很快推出开放权重版本。
Midjourney 在 alpha.midjourney.com 推出一批更新,正在测试界面中的快速模型,Styles 侧栏可预览当前提示词在已点赞与精选风格下的效果。
Google 与设计师 Jane Wade、Sergio Hudson 合作,用 Google Flow 为纽约时装周定制了 Styling Suite 和 Runway Visualization 两款工具。
Midjourney 更新 alpha.midjourney.com,新增韩语支持,并修复 v8.2 编辑器与移动端多项问题。v8.2 编辑器在附图后提示栏会询问修改需求,草稿批次以网格展示源图并可悬停预览,Enhance 取代了原先的 Upscale 按钮;移动端改用全宽页面,上传项新增可删除的 3 点菜单。
Botika 把全栈生成式 AI 运行在 Modal 上:自研数十亿参数基础模型、100TB 图像数据管道,并在生产环境同时服务约 15 个模型。该管道用数千个并发容器处理 100TB 数据,错误率低于 1%;单个研究员的实验量从每天一两个提升到 50 个。生产推理覆盖 L4、L40S、A100 和 H100,队列、自动扩缩容与冷启动由 Modal 承担。
Google 发布 Google Pics,这是 Google Workspace 中基于 Nano Banana 模型的图像生成与编辑工具,将在未来数周面向 Google AI Pro、Ultra 订阅用户和多数 Workspace 商业客户开放。
Midjourney 更新了 V8.2 编辑模型,称图像质量有所提升,并建议过去 24 小时内遇到问题的用户重新尝试。官方表示仍在收集用户反馈,后续还会有更多更新。
Midjourney 开始向所有用户开放 V8.2 图像编辑模型测试,支持按指令编辑图像、用最多 4 张参考图生成图像(取代 omni-reference)、局部重绘(inpainting)和画布扩展(outpainting),也可搭配个性化、moodboards 和 srefs 使用。
Midjourney 更新 alpha.midjourney.com,恢复 Upscale、Zoom 与 Vary,并在侧边栏加入可折叠的文件夹分组与双击重命名。同时修复创建项目或工作区崩溃、设置值自行重置、Relax 跳回 Fast 及输入框与设置滑块卡顿。Vary 现在遵循用户设置而非静默跑 HD,V8.2 旧图也重获 Upscale 按钮。
OpenRouter 上线 Visual Image Benchmarks,用一组挑战性提示词测试其平台上 39 个图像模型的能力,并以网格展示全部结果,支持按价格和生成时间排序。