AI资讯新闻榜单内容搜索-Acti

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Acti
浙大&港理工等提出InfiGUI-R1:利用强化学习,让GUI智能体学会规划任务、反思错误

浙大&港理工等提出InfiGUI-R1:利用强化学习,让GUI智能体学会规划任务、反思错误

浙大&港理工等提出InfiGUI-R1:利用强化学习,让GUI智能体学会规划任务、反思错误

当前,多模态大模型驱动的图形用户界面(GUI)智能体在自动化手机、电脑操作方面展现出巨大潜力。然而,一些现有智能体更类似于「反应式行动者」(Reactive Actors),主要依赖隐式推理,面对需要复杂规划和错误恢复的任务时常常力不从心。

来自主题: AI技术研报
9652 点击    2025-05-02 20:21
OpenAI“Agent 圣经”翻车?LangChain 创始人怒怼“全是坑”!

OpenAI“Agent 圣经”翻车?LangChain 创始人怒怼“全是坑”!

OpenAI“Agent 圣经”翻车?LangChain 创始人怒怼“全是坑”!

当前,AI 领域呈现出一种近乎“追星式”的热情氛围,每当有新的东西发布,便迅速引发广泛关注与高度评价,仿佛技术变革即将一触即发。同时大家情绪也波动剧烈,从“危机论”到“爆发论”频繁切换。OpenAI 最近出的《A Practical guide to building AI agents》的指南,就是他们最近捧上天的“神作”。它直接被捧成了“圣经”,一时间风头无两。

来自主题: AI资讯
8967 点击    2025-04-23 11:07
行业必读丨OpenAI 最新报告:构建 Agents 最佳实践

行业必读丨OpenAI 最新报告:构建 Agents 最佳实践

行业必读丨OpenAI 最新报告:构建 Agents 最佳实践

OpenAI 最近发布了三份针对企业客户的研究报告,本次挑选了其中的「A Practical guide to building AI agents」一篇进行了翻译。除非已经是 Agent 资深开发大佬,否则强烈建议 AI 行业的大家都来读一下这篇报告。

来自主题: AI技术研报
12479 点击    2025-04-22 09:30
独家|深度原理完成亿元级Pre-A轮战略融资,领航AI4S赛道,开启微观世界智能化革命

独家|深度原理完成亿元级Pre-A轮战略融资,领航AI4S赛道,开启微观世界智能化革命

独家|深度原理完成亿元级Pre-A轮战略融资,领航AI4S赛道,开启微观世界智能化革命

在全球AI技术加速重构产业格局的浪潮中,AI for Science(AI4S)赛道明星企业深度原理 Deep Principle 近日正式宣布完成亿元级Pre-A轮战略融资,本轮投资方包括联想创投、联想之星、锦秋基金、BV百度风投、启高资本,公司股东高瓴创投与线性资本持续追加投资,明德资本担任独家财务顾问。

来自主题: AI资讯
12386 点击    2025-03-19 15:16
AI游戏设计师问世,自学成才,无需任何先前知识

AI游戏设计师问世,自学成才,无需任何先前知识

AI游戏设计师问世,自学成才,无需任何先前知识

游戏开发不仅需要生成新颖的内容,更需要在保持游戏世界一致性、多样性和用户修改持续性方面达到高度平衡。近日,一篇发表在Nature上的研究论文World and Human Action Models towards Gameplay Ideation揭示了如何利用生成式AI模型推动游戏玩法创意的生成。

来自主题: AI技术研报
10012 点击    2025-02-20 10:20
全新模型RoboVLMs解锁VLA无限可能,真实机器人实验交出满分答卷

全新模型RoboVLMs解锁VLA无限可能,真实机器人实验交出满分答卷

全新模型RoboVLMs解锁VLA无限可能,真实机器人实验交出满分答卷

近年来,视觉语言基础模型(Vision Language Models, VLMs)大放异彩,在多模态理解和推理上展现出了超强能力。现在,更加酷炫的视觉语言动作模型(Vision-Language-Action Models, VLAs)来了!通过为 VLMs 加上动作预测模块,VLAs 不仅能 “看” 懂和 “说” 清,还能 “动” 起来,为机器人领域开启了新玩法!

来自主题: AI技术研报
8095 点击    2025-01-02 16:29
把RLHF带给VLA模型!通过偏好对齐来优化机器人策略,代码已开源

把RLHF带给VLA模型!通过偏好对齐来优化机器人策略,代码已开源

把RLHF带给VLA模型!通过偏好对齐来优化机器人策略,代码已开源

近年来,视觉-语言-动作模型(Vision-Language-Action, VLA)在诸多机器人任务上取得了显著的进展,但它们仍面临一些关键问题,例如由于仅依赖从成功的执行轨迹中进行行为克隆,导致对新任务的泛化能力较差。

来自主题: AI技术研报
9483 点击    2024-12-28 11:41
字节整新活!照片+音频让蒙娜丽莎秒变播客主理人

字节整新活!照片+音频让蒙娜丽莎秒变播客主理人

字节整新活!照片+音频让蒙娜丽莎秒变播客主理人

在大语言模型和 AIGC 的热潮下,科研人员对构建「视觉对话智能体」(Visual Chat Agent)展现出极大兴趣。其中,可实时交互的人像生成技术(Audio-Driven Real-Time Interactive Head Generation)是实现链路中极为关键的一环。

来自主题: AI资讯
9641 点击    2024-12-24 15:44