基于指令监督微调与自演绎强化学习的意图生成方法
# 热门搜索 #
大模型
人工智能
openai
融资
chatGPT
验证码登录
×
发送
登录即代表您已同意AITNT
用户协议
和
隐私政策
登录
登录成功后会自动刷新界面
AITNT公众号
AITNT APP
AITNT交流群
搜索
未登录
首页
AI中心
退出
首页
AI资讯
AI技术研报
AI监管政策
AI产品测评
AI商业项目
AI产品热榜
AI 源力市场
寻求报道
基于指令监督微调与自演绎强化学习的意图生成方法
申请号:
CN202510889712
申请日期:
2025-06-30
公开号:
CN120804817A
公开日期:
2025-10-17
类型:
发明专利
摘要
本发明公开了一种基于指令监督微调与自演绎强化学习的意图生成方法,主要通过生成式意图分类模型生成意图,该生成式意图分类模型首先基于已知意图数据进行监督指令微调,然后基于自演绎对话进行强化学习;其中强化学习中,奖励函数包括语义相关性奖励和领域相关性奖励。本发明可突破传统静态聚类的局限性,在“收敛”与“发散”之间建立起动态平衡机制,从而提升意图生成模型在复杂多变场景下的泛化能力。
技术关键词
意图分类模型
生成方法
样本
标签
语义
文本
指令
参数
度函数
数据
注意力
编码器
表达式
邻域
索引
机制
场景
代表
阶段