摘要
本申请涉及一种基于文本的视频生成方法、装置、电子设备及可读介质,其中,方法包括:提取待识别文本的语义特征;通过预设生成模型对语义特征进行识别,生成第一视频;从多个判别层面对第一视频的物理合理性进行判别,得到判别结果,其中,不同的判别层面表示不同的物理规律;在判别结果指示第一视频不具备物理合理性的情况下,利用判别结果对预设生成模型进行迭代优化,直至得到目标生成模型,其中,目标生成模型满足不同物理规律的约束;利用目标生成模型对语义特征进行识别,生成与待识别文本匹配的符合物理规律的第二视频。解决了生成的视频中会出现违反物理规律的现象的问题。