最近在做 Image to Image Generator,想解决一个很直接的问题:用户手上已经有参考图,也知道大概想改什么,但不想先学习传统桌面编辑器,网页端能不能把从参考图到可下载结果这条路径做清楚?
目前我先把这几步连起来:
输入目前支持 JPEG、PNG 和 WebP,单图不超过 24 MB,提示词上限 1,000 字符。单图模式使用一张参考图;符合条件的多图流程可以组合 2 到 5 张图。
多放参考图不一定更可控。图片越多,越需要说清楚每张图负责什么、哪些内容要改变、哪些主体或结构要保留。否则输入虽然变多,模型收到的约束反而可能更模糊。
所以当前取舍不是继续堆更多入口,而是让用户在生成前确认输入、提示词和当前设置,生成后再对照主体、构图、细节和瑕疵做复核。
网站是英文界面,处理范围是图片。符合条件的流程可以从 guest trial 开始,但部分功能需要 Google 登录和点数;模型、设置、登录要求、点数消耗和可用性可能变化。生成结果也不保证精确保留主体、没有瑕疵、唯一或自动具备商业使用许可。
产品地址: https://imagetoimagegenerator.io/
想听听大家一个具体建议:多参考图场景里,你更希望产品先帮你定义 “每张图的角色”,还是优先加强 “生成前后对比复核”?
