跳到正文

#图像生成

今日 1 条
今天9月30日周三
  1. Google Research42

    Google Research 提出 Diffusion Controller:统一并简化 AI 图像生成控制

    Google Research 提出 Diffusion Controller 框架,将去噪过程重构为连续控制问题,用轻量级"转向阻尼"网络在不改动基座模型的情况下引导生成。基于 Stable Diffusion v1.4 的实验用 HPS-v2 评测,涵盖 SFT、RWL 和 PPO 三种微调方式,其完全解锁版本相对基线模型达到 90% 胜率,并且能在不接触底层代码的情况下控制闭源模型。

9月29日周二
9月15日周二
9月10日周四
9月8日周二
7月23日周四
  1. Hugging Face Blog68

    Hugging Face 将 Nunchaku 4-bit 扩散推理原生集成进 Diffusers

    Hugging Face 在 Diffusers 中新增 Nunchaku Lite 集成路径,可像普通 Diffusers 模型一样用 from_pretrained() 加载 Nunchaku SVDQuant 4-bit(W4A4)检查点,无需单独推理引擎或本地 CUDA 编译。

    推荐理由:官方宣布 Diffusers 原生支持 Nunchaku 4-bit 推理,附实测数据和自己量化新架构的完整工作流。

7月16日周四
7月6日周一
7月1日周三
4月23日周四
  1. Google Research62

    Google Photos Auto frame 上线 3D 视角重组功能

    Google 在 Google Photos 的 Auto frame 功能中推出新方法,可在拍摄后调整照片的相机视角。方法先用内部 3D 点图估计模型重建场景并近似焦距,再用生成式 latent diffusion 模型补全新视角下的空洞,并自动检测广角前置镜头的人脸透视畸变,自动为含有人物的合格照片生成重组后的第二候选版本。

    推荐理由:原文解释了用 3D 点图加生成补全改换拍摄视角的两阶段方法,读者可以理解它与普通裁剪编辑的本质差别。

8月1日周五