在审
基于通识大模型的私有知识视觉内容生成方法和装置
摘要
本申请涉及一种基于通识大模型的私有知识视觉内容生成方法和装置。所述方法包括:获取数据集和当前业务模式所需的企业私有图像;构建视觉内容生成模型;视觉内容生成模型包括多模态信息输入模块、多模态信息抽取模块和通识大型语言模型;根据数据集和多个企业私有图像对视觉内容生成模型进行两阶段训练,得到训练好的视觉内容生成模型;获取用户输入的图像和对话指令,将图像‑文本对输入训练好的视觉内容生成模型,得到对话指令对应的视觉内容。采用本方法能够对企业私有知识进行理解学习,提高企业用户所需视觉内容的准确性和可靠性。
暂无引用专利




