基于大模型的机器人视觉物体语义理解与姿态生成方法
# 热门搜索 #
大模型
人工智能
openai
融资
chatGPT
验证码登录
×
发送
登录即代表您已同意AITNT
用户协议
和
隐私政策
登录
登录成功后会自动刷新界面
AITNT公众号
AITNT APP
AITNT交流群
搜索
未登录
首页
AI中心
退出
首页
AI资讯
AI技术研报
AI监管政策
AI产品测评
AI商业项目
AI产品热榜
AI 源力市场
寻求报道
基于大模型的机器人视觉物体语义理解与姿态生成方法
申请号:
CN202511107947
申请日期:
2025-08-08
公开号:
CN120997286A
公开日期:
2025-11-21
类型:
发明专利
摘要
本发明提供一种基于大模型的机器人视觉物体语义理解与姿态生成方法,属于图像处理技术领域。包括:S1.输入图像与3D模型;S2.物体检测;S3.多模态特征对齐;S4.扩散模型采样;S5.几何筛选;S6.NeRF形态建模;S7.光流优化;S8.联合损失计算;S9.置信度分析;S10.输出姿态结。本发明通过创新的单视角渲染‑光流优化闭环策略,显著降低了计算开销并提升了估计精度。本发明通过多尺度特征融合和置信度分解策略显著提升了复杂场景下的算法性能。
技术关键词
机器人视觉
生成方法
语义
联合概率建模
物体检测
场景深度信息
多模态特征
特征金字塔
多尺度特征融合
坐标
相机
深度图
图像处理技术
策略
检测器
误差
网络架构
分辨率