不要再研究什么无审查版模型了!qwen-image-2.1 拿来本地平替 GPT-image-2.5 才是最香的!完整部署教程来了
我不明白,qwen-image-2.1 本地部署完本来就没有验证和审核,大伙为啥都把重心放在奇怪的地方了。
这次 qwen-image-2.1 给我带来最大的震撼,还是其原生2K的生成质量,完全不输 GPT-image-2.5。最关键的一点是,它生成的图片不会出现GPT 经常出现的那种噪点,非常适合拿来做首帧参考图,拿去跑AIGC短片。
给大家带来单卡 4090 部署模型,并跑通2K图像的攻略:(直接发给Codex帮你部署就行)
不建议用梯子下载权重,直接走国内下 ModelScope 的分片,这样会快得多(国模最大的好处之一了,不用代理也下载快);diffusers 同理,可以不走github,用 Gitee 上的源码。
有个小坑,本来想直接加在现成的 Comfy 上。版本一查是 0.32,qwen-image-2.1 要 0.37 以上。这点大家要注意,用comfy的话一定要对上版本。版本不对不支持,服务起不来。
服务就做一个出图接口,一共33G 权重在启动时加载,我这边两分钟左右。不要等第一张图的请求来了再加载,那边会先超时。CFG 没开,官方默认就是关的,打开之后每步计算大概翻倍,2K 会更慢,没必要。
把这篇帖子内容喂给AI,它能直接帮你搞定部署流程,怕找不到的话大伙可以点个收藏。
最后再跑一下测试,我这边2048的尺寸,30步跑的话,耗时3分钟左右(CFG=0),成品如图所示,审核什么的完全不用担心,完全没有任何限制。
我有预感,本地部署 qwen-image-2.1 + Minimax-h3 很有可能成为接下来AI短片流水线的爆款流水线。
显示更多
これ面白い!!
GPT Image 2.5×Grokの動画機能でかなりクオリティ高く表現できた!
気になる人はやってみて!
リアルすぎてAI感なくなってきた
GPT Image 2.5とSeedance 2.5は相性良いね🫶
7/ 对比结果很明显:
GPT Image 2.0画面更平、更干净,表面和布景更简单,配色更克制,光线也更均匀。
2.5则能保留更多纸张、金属和织物纹理,画面中的小字也更加稳定。
GPT Image 2.5即将登陆ImagineArt。
显示更多
1/ GPT Image 2.0和2.5的差别有多大?
ImagineArt用6组高难度提示词做了对比👇
提示词1:虚构品牌的时尚大片。相机贴近地面,使用24mm镜头并倾斜15度。6人分别身穿电蓝、番茄红、青柠绿、亮粉、奶油黄和丁香紫服装,以不同姿势站在纯钴蓝色天空下。
显示更多
GPT Image 2.5 刚摸一下就懂了
这东西真的绝啊…光是改个画风指令就能感受到那股怪物级的能力
有点可怕
gpt-image-2.5-flare、gpt-image-2.5-sunburst 正式上线,低价格渠道和纯官方渠道的都已经上线
低价格渠道:这个目前 codex 的和客户端的都没有明确说是哪个 gpt-image-2.5 版本的图片,后续有更新的消息第一时间同步,先把目前版本发出来
纯官方渠道:官方价 8 折,绝不掺水,参数完整,可对公签合同
欢迎使用,目前出图速度延迟都很低 成功率高,稳定高并发使用,目前每天的任务量是百万级的,有这个实力
国内访问用:
海外网络访问用(最好用这个):
显示更多
🎉🎉🎉 看左侧是 GPT Image 2 生成的,右侧是 GPT Image 2.5 生成的。
这组对比中,GPT Image 2.5 的发丝、针织纹理和手部轮廓更清楚,光影更自然,整体更接近精致手办的商品展示效果,而左侧 GPT Image 2 只能说还凑合。
GPT Image 2.5 的适用性已经完全不一样了。
而且现在 OpenAI 还在 API 中引入了两个新图像模型:Sunburst 侧重精细编辑,Flare 主打快速出图。
如果你没有 API 可在 Higgsfield 上直接试用。
显示更多
不知道为什么 GPT-image-2.5 死活不给生成透明的 PNG 图片了,可能得单独再重新训练和适配吧。
GPT-image-2.5 图像生成模型果然发布了。官方说明的优化点主要有这几个新特性:
更快的图像生成速度,更高的参考图一致性,多次编辑中的一致性保持,基于评论的编辑
目前已全量在 GPT 和 Codex 推出。但图像元数据里标注的依然是 2.0,所以无法通过元数据判断模型版本;
神奇的是,GPT-image-2.5 这两个版本的 API 价格跟 GPT-image-2 相比没有任何差异。
实际体验下来,破碎感和涂抹感的问题确实变好了一些,不过提升不算太大;
但一致性确实明显变强了,尤其是连续多次编辑的一致性。
显示更多