数据处理方法、装置、设备、计算机可读存储介质及产品与流程

文档序号:36174938 发布日期:2023-11-24 23:08 阅读:55 来源:国知局
数据处理方法与流程

本公开涉及人工智能中的深度学习,尤其涉及一种数据处理方法、装置、设备、计算机可读存储介质及产品。


背景技术:

1、拍摄产品宣传图是一项复杂且耗时的工作,为了快速地生成多张产品宣传图,现有技术中一般使用扩散模型进行产品宣传图的生成。但是在图像生成过程中,虽然可以通过文本描述控制生成的背景,但经常会出现对产品图自身边缘部分进行随意外扩补充,例如给商品进行延伸,给人多长出一只手等,导致产品主体遭到改变,无法有效进行宣传图生成。


技术实现思路

1、本公开提供了一种用于解决扩散模型在生成目标图像时对输入图像边缘部分进行随意外扩补充的技术问题的数据处理方法、装置、设备、计算机可读存储介质及产品。

2、根据本公开的第一方面,提供了一种数据处理方法,包括:

3、获取训练数据集,其中,所述训练数据集中包括多组训练数据,所述训练数据中包括预先进行像素处理的第一图像、包括随机噪声的第二图像以及预设的文本描述信息,所述第一图像中内容主体的边缘部分被配置为预设的第一像素值,所述第一图像中所述内容主体以外的区域被配置为预设的第二像素值,所述第一像素值大于所述第二像素值;

4、采用所述训练数据集对预设的待训练扩散模型进行训练操作,直至所述待训练扩散模型满足预设的收敛条件,获得训练后的目标扩展模型。

5、根据本公开的第二方面,提供了一种数据处理方法,包括:

6、获取图像生成请求,其中,所述图像生成请求中包括目标物品对应的关联图像以及预设的背景描述信息;

7、根据所述图像生成请求,将所述关联图像中目标物品的边缘部分的像素值调整为预设的第一像素值,将所述关联图像中非目标物品区域的像素值调整为预设的第二像素值,获得控制图像;

8、将所述控制图像以及所述背景描述信息输入至预设的目标扩展模型中,获得所述目标扩展模型输出的与所述目标物品关联的至少一张扩展图像;

9、其中,所述目标扩展模型是基于第一方面所述的数据处理方法训练获得的。

10、根据本公开的第三方面,提供了一种数据处理装置,包括:

11、获取模块,用于获取训练数据集,其中,所述训练数据集中包括多组训练数据,所述训练数据中包括预先进行像素处理的第一图像、包括随机噪声的第二图像以及预设的文本描述信息,所述第一图像中内容主体的边缘部分被配置为预设的第一像素值,所述第一图像中所述内容主体以外的区域被配置为预设的第二像素值,所述第一像素值大于所述第二像素值;

12、训练模块,用于采用所述训练数据集对预设的待训练扩散模型进行训练操作,直至所述待训练扩散模型满足预设的收敛条件,获得训练后的目标扩展模型。

13、根据本公开的第四方面,提供了一种数据处理装置,包括:

14、请求获取模块,用于获取图像生成请求,其中,所述图像生成请求中包括目标物品对应的关联图像以及预设的背景描述信息;

15、像素调整模块,用于根据所述图像生成请求,将所述关联图像中目标物品的边缘部分的像素值调整为预设的第一像素值,将所述关联图像中非目标物品区域的像素值调整为预设的第二像素值,获得控制图像;

16、输入模块,用于将所述控制图像以及所述背景描述信息输入至预设的目标扩展模型中,获得所述目标扩展模型输出的与所述目标物品关联的至少一张扩展图像;

17、其中,所述目标扩展模型是基于第三方面所述的数据处理装置训练获得的。

18、根据本公开的第五方面,提供了一种电子设备,包括:

19、至少一个处理器;以及

20、与所述至少一个处理器通信连接的存储器;其中,

21、所述存储器存储有可被所述至少一个处理器执行的指令,所述指令被所述至少一个处理器执行,以使所述至少一个处理器能够执行第一方面或第二方面所述的方法。

22、根据本公开的第六方面,提供了一种存储有计算机指令的非瞬时计算机可读存储介质,其中,所述计算机指令用于使所述计算机执行第一方面或第二方面任一项所述的方法。

23、根据本公开的第七方面,提供了一种计算机程序产品,所述计算机程序产品包括:计算机程序,所述计算机程序存储在可读存储介质中,电子设备的至少一个处理器可以从所述可读存储介质读取所述计算机程序,所述至少一个处理器执行所述计算机程序使得电子设备执行第一方面或第二方面所述的方法。

24、根据本公开的技术解决了提高了扩散模型输出的目标图像的精准度,避免扩散模型在生成目标图像时对输入图像边缘部分进行随意外扩补充。

25、应当理解,本部分所描述的内容并非旨在标识本公开的实施例的关键或重要特征,也不用于限制本公开的范围。本公开的其它特征将通过以下的说明书而变得容易理解。



技术特征:

1.一种数据处理方法,包括:

2.根据权利要求1所述的方法,所述获取训练数据集,包括:

3.根据权利要求2所述的方法,所述基于所述内容主体的显示位置对所述内容主体的边缘部分以及所述待处理图像中所述内容主体以外的区域进行像素调整操作,获得所述第一图像,包括:

4.根据权利要求3所述的方法,所述将所述非主体区域的像素设置为预设的第二像素值,包括:

5.根据权利要求2所述的方法,所述待处理图像中包括预设的标注信息,所述标注信息用于标注所述内容主体的显示区域;

6.根据权利要求1-5任一项所述的方法,所述第一像素值为最大像素值,所述第二像素值为预设的负值像素。

7.根据权利要求1-5任一项所述的方法,所述采用所述训练数据集对预设的待训练扩散模型进行训练操作,直至所述待训练扩散模型满足预设的收敛条件,获得训练后的目标扩展模型,包括:

8.一种数据处理方法,包括:

9.根据权利要求8所述的方法,所述将所述关联图像中目标物品的边缘部分的像素值调整为预设的第一像素值,将所述关联图像中非目标物品区域的像素值调整为预设的第二像素值,包括:

10.一种数据处理装置,包括:

11.根据权利要求10所述的装置,所述获取模块包括:

12.根据权利要求11所述的装置,所述调整单元包括:

13.根据权利要求12所述的装置,所述设置子单元,用于:

14.根据权利要求11所述的装置,所述待处理图像中包括预设的标注信息,所述标注信息用于标注所述内容主体的显示区域;

15.根据权利要求10-14任一项所述的装置,所述第一像素值为最大像素值,所述第二像素值为预设的负值像素。

16.根据权利要求10-14任一项所述的装置,所述训练模块,包括:

17.一种数据处理装置,包括:

18.根据权利要求17所述的装置,所述像素调整模块包括:

19.一种电子设备,包括:

20.一种存储有计算机指令的非瞬时计算机可读存储介质,其中,所述计算机指令用于使所述计算机执行根据权利要求1-7或8-9中任一项所述的方法。

21.一种计算机程序产品,包括计算机程序,该计算机程序被处理器执行时实现权利要求1-7或8-9中任一项所述方法的步骤。


技术总结
本公开提供了数据处理方法、装置、设备、计算机可读存储介质及产品,涉及人工智能领域,尤其涉及深度学习领域。具体实现方案为:获取训练数据集,训练数据集中包括多组训练数据,训练数据中包括预先进行像素处理的第一图像、包括随机噪声的第二图像以及预设的文本描述信息,第一图像中内容主体的边缘部分被配置为预设的第一像素值,所述第一图像中所述内容主体以外的区域被配置为预设的第二像素值;采用所述训练数据集对预设的待训练扩散模型进行训练操作,直至所述待训练扩散模型满足预设的收敛条件,获得训练后的目标扩展模型。从而提高了扩散模型输出的目标图像的精准度,避免扩散模型在生成目标图像时对输入图像边缘部分进行随意外扩补充。

技术研发人员:曹超
受保护的技术使用者:北京百度网讯科技有限公司
技术研发日:
技术公布日:2024/1/16
网友询问留言 已有0条留言
  • 还没有人留言评论。精彩留言会获得点赞!
1