Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111
Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 stable-diffusion-webui 的大部分功能重建为单张工作流画布。
推荐理由:用 73 个节点复刻 A1111 的十一类图像与视频管线,可直观看到节点式工作流的组织方式与复用边界。
AI 画图的最前线:文生图模型迭代、图像编辑能力与创作工具生态的全部动态。
Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 stable-diffusion-webui 的大部分功能重建为单张工作流画布。
推荐理由:用 73 个节点复刻 A1111 的十一类图像与视频管线,可直观看到节点式工作流的组织方式与复用边界。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精细的图像,更贴近用户原本的构想。
Hugging Face 在 Diffusers 中引入 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 风格的 SVDQuant 量化检查点,无需自定义 pipeline 或本地 CUDA 编译。
推荐理由:原文给出 Nunchaku Lite 在 Diffusers 中的原生加载方式和显存与延迟对比,读者可据此判断是否替换现有量化后端。
Google DeepMind 发布 Nano Banana 2 Lite(gemini-3.1-flash-lite-image)与 Gemini Omni Flash(gemini-omni-flash-preview)。
推荐理由:同属 Nano Banana 家族的三档模型首次给出速度、成本与质量的分工定位,可作为选型参照。
Google Photos 的 Auto frame 新增一项自动重构图能力,将照片理解为 3D 场景并自动调整相机位置与焦距,从而改变视角。该方法分两步:先用内部 3D 点图估计模型还原人体与人脸并推算原始焦距,再用生成式潜扩散模型补全换视角后露出的空白区域。该功能现已上线,只处理含人物的合格照片,重构图版本作为 Auto frame 候选中的第二个方案,一步即可应用。
推荐理由:Google Photos 把拍照后的视角问题交给 3D 估计加扩散补全处理,读者可了解这套两阶段方法如何改变自动修图流程。
Mistral 为 Le Chat 推出多项新功能,包括预览版 Deep Research 模式、由新语音模型 Voxtral 驱动的 Voice 模式、由推理模型 Magistral 支持的 Think 模式、用于整理对话的 Projects,以及与 Black Forest Labs 合作的高级图像编辑。
推荐理由:Mistral 一口气给 Le Chat 补上研究、语音、推理与图像编辑,读者可据此判断其产品线扩张方向。