摘要
本发明公开了一种基于多模态集成的航空语音转写方法、装置及介质,所述方法包括:获取输入方的初始语音信号;将输入方的初始语音信号转换为目标语言文本;基于多模态大模型对目标语言文本生成纠正建议,并输出至输入方;获取输入方根据纠正建议进行表达修正后的最终语音信号,根据最终语音信号生成以目标语言呈现的指令并发送至接收方。本发明提出一种基于多模态集成的航空语音转写方法、装置及介质,通过多模态大模型驱动的闭环纠错机制和双向实时通信框架,可以将输入方修正后的语音以目标语言的形式生成精准指令发送至接收方,能够解决难以降低塔台与飞行员之间的语言沟通门槛,以及提升空地通信的准确性与效率的问题。