跳到正文
  1. Hugging Face Blog62

    用 Gradio Workflow 重建 AUTOMATIC1111:Workflow1111 的 73 节点画布

    Hugging Face 团队用 Gradio Workflow 重建了 AUTOMATIC1111 的大部分功能,做成名为 Workflow1111 的画布,由 11 条媒体流水线和 73 个节点组成,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 存储和图生视频。

    推荐理由:原文用 73 个节点复刻 A1111 的十一条图像流水线,并说明输出如何变成 REST 端点和 MCP 工具。

  1. OpenAI News62

    OpenAI 发布 ChatGPT Images 2.5

    OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,并更贴近用户原本的构想。

    推荐理由:官方给出 ChatGPT Images 2.5 的定位,读者可据此了解图像生成在个性化与成图质量上的变化方向。

  1. Hugging Face Blog62

    Diffusers 原生支持 Nunchaku 4-bit 扩散推理

    Hugging Face 在 Diffusers 中引入 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 量化检查点,无需自定义 pipeline 或本地 CUDA 编译。

    推荐理由:Diffusers 原生支持 Nunchaku 4-bit 推理,读者可据此了解消费级 GPU 跑扩散模型的内存与速度取舍。

  1. Google DeepMind80

    Google DeepMind 发布 Nano Banana 2 Lite 与 Gemini Omni Flash

    Google DeepMind 发布 Nano Banana 2 Lite(gemini-3.1-flash-lite-image)和 Gemini Omni Flash(gemini-omni-flash-preview)。

    推荐理由:两款模型同时开放开发者入口,并给出延迟、单价与能力边界,便于判断图像与视频生成链路的成本取舍。

  1. Google Research60

    Google Photos 上线 Auto frame,用生成式 AI 重设照片机位

    Google Research 宣布在 Google Photos 的 Auto frame 功能中上线一种新方法,把照片理解为 3D 场景并自动调整相机位置与焦距,生成新的视角。该方法分两步:先用内部 3D 点图估计模型重建人体与面部并估算原相机焦距,再用生成式潜在扩散模型补全换视角后出现的空洞。该功能已面向含人物的照片自动提供重新构图版本,作为 Auto frame 候选中的第二个选项。

    推荐理由:Google Photos 把照片当作 3D 场景重设机位,读者可了解生成式补全如何改变后期修图流程。

已经到底了