西班牙 AI 初创公司 Speridlabs 尝试了一种新的生图方式:跳过压缩后的图像信息阶段,直接生成每个像素。
目前,不少 AI 生图模型会先在压缩后的图像信息中生成画面,再将其还原成图片。Speridlabs 认为,这一过程可能带来细节损失,因此测试如果省去这一步,画面效果是否会更好。
为完成这项测试,团队训练了开源模型 Iris-3B,并将另一款现有模型改造成可直接生成像素的版本。随后,他们让这些模型执行低清图片修复、判断照片中物体远近等任务,再与原有方案进行比较。
结果没有出现预期中的稳定提升,部分指标反而略差。直接生成像素的模型在部分测试中还出现了轻微的方格纹。
不过,这项研究也证明了直接生成像素具备可行性。Iris-3B 在一项生图评测中取得 0.540 分,与千问 Qwen-Image 的 0.539 分基本持平。整体来看,仅去掉图像压缩环节,并没有让模型在细节要求更高的任务中获得明显优势。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

