即梦是在即梦AI里新上线的一项能力,主打快速出图。它在细节层面做了比较全面的调整,采用多模态思路,画面能呈现出接近电影的质感,也能用来生成科幻风格的人物形象。

这是一款多模态图像生成工具,把文生图、图像编辑、组图生成三块能力放在了一起。用户用日常说话的方式下达指令,就能对画面里的细节做比较灵活的把控。

1、换背景、换衣服这类操作,做起来比修图软件还省事。AI出图带编辑能力不算稀奇,即梦4.0的长处在于改得够准。
2、一张图能拉出多个视角,做广告或影视分镜时能省下不少功夫。搞广告、拍短片的人可以留意一下,这个功能把一张图变成好几个角度,不用再一遍遍手绘分镜。
3、人物的动作可以按你的意思来安排,两张图就能融出关系很自然的效果。想让AI人物摆出指定动作,以前要么僵要么偏,即梦4.0换了思路——传2到6张参考图,再用一句话描述,人物就能照着做。
4、一次能出14张系列图,人物不崩、风格也统一。一次只出一张、凑一套系列图要调很久,这种麻烦即梦4.0直接绕开了,上限提到14张,风格和人物的一致性保持得比较稳。
1、它带来五项技术层面的能力:指令编辑够准、特征保持够稳、意图理解够深、支持多图输入输出,以及超高速加超高清。角色数字分身这块,可以拿面部特征参考图或者一段文字描述来生成统一形象,参考强度能调,人物轮廓、发型、服装在不同场景里都能稳住。这个版本还面向电商、营销设计这类商业用途做了优化,加了墨迹渗透质感和金属光影两个专项模块,正在分批向全部用户开放。
2、多模态生图技术是头一回引入,三大功能被收进同一个模型里,用户用几句自然语言就能完成比较复杂的创作。性能方面,文生图出2K分辨率图像耗时不到1.8秒,最高能原生直出4K分辨率;图像编辑支持单张或多张图片输入,配合自然语言指令做增删、修改、替换这类复合操作;组图生成能一次吐出多张内容互相关联的图像,适合用来做创意脑暴。
智能多帧功能这次加了智能多帧。用户可以一次拿多帧图片去生成更顺滑的视频,比起过去只能处理首尾两张帧的限制,更贴近实际需要。眼下这个版本还有打磨空间,随着技术一轮轮更新,它会越来越能打。
参考图功能强化参考图这块也做了加强。原先复杂的8大选项被砍掉,只留下智能参考,用起来更省心。改动之后能力反而更强,参考图里人物的特征还原得更准。它还能凭单张参考图生成一组风格统一的套图,也支持多图输入做图片合成。
Agent模式功能Agent模式是新增的。它能跟即梦AI现有的各项功能串起来,用户把要求写进去,系统就自动产出符合要求的图片或视频,过程中还能实时调整修改。用户也可以反推提示词,或者传参考图做二次创作,玩法上多了些选择。
文生图4.0新模型文生图换上了4.0新模型,理解力更强,对用户输入的提示词或参考图意图抓得更准。跟早前版本比,碰到文字乱码、创意类绘画这些容易翻车的场景,表现好了不少。新模型的画质也更接近真实,参考图特征能高度一致地继承下来,整体上了一个台阶。
最新评论