照片转插画 / 绘画风格
- 方式
- 轻量 GAN(AnimeGANv2 / fast-neural-style),只替换画风
- 所需环境
- 无需 WebGPU,手机和较旧的笔记本也能用
- 首次下载
- 每种风格约 8MB,7 种约 50MB
- 每张耗时
- WebGPU 下 1 秒以内,CPU 也只需几秒
- 画风指定
- 从 7 种固定风格中选择
- 效果
- 构图、表情、五官保持不变,很少失败
- 适合谁
- 想快速做头像的人、设备配置一般的人
在浏览器内运行基于 Stable Diffusion 的扩散模型,把照片重绘为动漫、水彩、油画等风格。比“照片转插画 / 绘画风格”更灵活,可通过提示词指定画风。照片绝不会离开您的设备。
此工具首次运行时会下载 AI 模型(约 2100 MB)。由于目前服务器端带宽有限,下载可能需要 10 分钟左右;之后会使用浏览器中保存的副本。需要 WebGPU 支持。
把照片变成插画的工具有两个。请根据设备和目的选择。建议先用轻量版试试,不够满意再用扩散模型版。
| 项目 | 照片转插画 / 绘画风格 | AI 照片转插画(扩散模型)当前页面 |
|---|---|---|
| 方式 | 轻量 GAN(AnimeGANv2 / fast-neural-style),只替换画风 | 扩散模型(LCM Dreamshaper v7),根据提示词重新绘制照片 |
| 所需环境 | 无需 WebGPU,手机和较旧的笔记本也能用 | 必须支持 WebGPU,GPU 显存 4GB 以上(核显为共享内存) |
| 首次下载 | 每种风格约 8MB,7 种约 50MB | 约 2.1GB。目前受服务器带宽限制,约需 10 分钟 |
| 每张耗时 | WebGPU 下 1 秒以内,CPU 也只需几秒 | 核显 20〜40 秒,独立显卡几秒 |
| 画风指定 | 从 7 种固定风格中选择 | 5 种预设,另可用英文提示词自由指定 |
| 效果 | 构图、表情、五官保持不变,很少失败 | 作为画作重绘,表现力更丰富;强度越高越偏离原本的面容 |
| 适合谁 | 想快速做头像的人、设备配置一般的人 | 有游戏 PC 或 Apple Silicon Mac、想细致指定画风的人 |
拖入一张照片。处理时使用中央的正方形区域(512×512),因此人脸位于画面中央的照片效果最好。
从动漫、水彩、油画、美式漫画、像素画中选择,或用英文自行输入提示词。变化强度越高,画风越明显;越低,则越多保留原本的相貌。
按指定张数生成图片并排显示。只保存您喜欢的即可;用相同设置再次运行会得到不同的结果。
将 LCM Dreamshaper v7(MIT 许可证)转换为 fp16 ONNX 格式,通过 onnxruntime-web 在 WebGPU 上运行。照片先被编码为潜在表示并加入噪声,再由模型按照提示词分 4 步重绘,即 img2img 方式。变化强度对应噪声的多少,0.5 左右可以在保持人物可辨认的前提下改变画风。
模型总计 2.1 GB,首次下载需要一些时间。受目前服务器端带宽(主代理上行链路)限制,可能需要 10 分钟左右;这一点将随基础设施迁移而改善。之后会使用浏览器中保存的副本,无需等待。需要 WebGPU 和约 4 GB 显存(集成显卡为共享内存);每张图片在集成显卡上耗时 20–40 秒,独立显卡只需几秒。
不会。模型会下载到您的浏览器中,生成在您设备的 GPU 上完成。
目前服务器端带宽上限约为 4–5 MB/s,因此 2.1 GB 需要 10 分钟左右。带宽升级已在计划中。下载只需一次,之后会使用已保存的副本。
扩散模型的 img2img 会随着变化强度升高而逐渐偏离原照片。将强度调低到 0.4–0.5 可以保留相貌。如果五官细节出现崩坏,可对结果再运行一次“AI 人脸修复”。
那个工具使用轻量级 GAN,保留构图、只改变渲染方式(几秒完成,模型 8 MB)。本工具用扩散模型重新绘制图像,因此更灵活、可由提示词控制,但模型体积大,并且需要 WebGPU。
转换或压缩失败时,若能把当时的情况发送给我们,将有助于查明原因。了解哪些设备、哪些格式更容易失败,以及处理需要多长时间之后,我们就能调整支持的格式并修复相应问题。如果方便,保持开启会帮上很大的忙。
会发送的信息
使用的工具和所选设置(输出格式、质量等)、设备性能(有无 GPU、内存、核心数)、输入格式和大致大小、成功与失败的数量和耗时,以及失败时的错误类型和内容。
不会发送的信息
文件本身、文件名、添加到视频中的文字、字幕或提示词,以及 IP 地址。数据只发送到本站自有服务器,不会交给第三方服务。