AI资讯新闻榜单内容搜索-模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型
Kimi K3:智能的新前沿

Kimi K3:智能的新前沿

Kimi K3:智能的新前沿

Kimi K3 是一个 2.8 万亿参数模型,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。

来自主题: AI资讯
8793 点击    2026-07-19 10:08
不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

上海人工智能实验室团队提出的Self-Harness,近期被LangChain CEO、联合创始人Harrison Chase转发,也被前OpenAI副总裁Lilian Weng收进自进化Agent相关博客。它盯上的不是换模型,而是Agent外层那套Harness。

来自主题: AI技术研报
8646 点击    2026-07-18 19:10
WAIC机器人搭长城积木火爆展区,这才是VLA+WM的最佳用法

WAIC机器人搭长城积木火爆展区,这才是VLA+WM的最佳用法

WAIC机器人搭长城积木火爆展区,这才是VLA+WM的最佳用法

一项机器人拼搭长城的展示火爆全网。从彩排现场的照片来看,围观者已经里三层外三层。原力灵机联合阶跃星辰,用 6 台机器人挑战 15 小时连续作业,搭建完成一座包含超 8 万个零件的长城模型 —— 最小组件不到 1 厘米宽,成品长 3.5 米、宽 1.5 米、高 1.1 米。其中 4 台桌面机器人负责精细零件的拼装,2 台轮式机器人 Apex 负责将拼装完成的组件运输、组装。

来自主题: AI资讯
8415 点击    2026-07-18 14:21
Kimi逼得两大巨头改变定价?奥特曼罕见认错,Claude额度重置

Kimi逼得两大巨头改变定价?奥特曼罕见认错,Claude额度重置

Kimi逼得两大巨头改变定价?奥特曼罕见认错,Claude额度重置

外媒Axios称,K3定价远低于它所挑战的高端模型,美国AI公司的高价策略还能维持多久?巧的是,就在最近,两大巨头正在打客户争夺战。此前,特曼在X上发帖,不提新模型,开头就是一句认错:

来自主题: AI资讯
10161 点击    2026-07-18 11:47
WAIC信息爆炸!大佬们都在说什么,笔记看这里

WAIC信息爆炸!大佬们都在说什么,笔记看这里

WAIC信息爆炸!大佬们都在说什么,笔记看这里

WAIC(世界人工智能大会)第一天,信息量已经爆炸。从AI时代国家和企业的核心竞争力,到大模型迈向物理世界、迈向AGI所面临的挑战,再到Coding之后新的AI产品趋势……围绕从技术到产业的方方面面,图灵奖得主、两院院士、AI TOP研究者和企业、企业家们共聚一堂,精彩发声不断:

来自主题: AI资讯
8017 点击    2026-07-18 11:46
星尘智能甩出20+超难家务自主,具身模型圈:不要再卷了

星尘智能甩出20+超难家务自主,具身模型圈:不要再卷了

星尘智能甩出20+超难家务自主,具身模型圈:不要再卷了

WAIC 前夕,星尘智能(Astribot)新模型 Lumo-2,直接在官网甩出 20 + 真机视频 ——这背后,是星尘智能发布的第二代具身基座模型,也是业内首个面向家庭场景的隐式世界 - 动作模型(Latent World-Action Model),同步发的,还智能体 Agent Philia。

来自主题: AI资讯
8650 点击    2026-07-18 10:36
全球首个云端具身大模型炸场WAIC:一脑控多手、30秒换手,行业首例

全球首个云端具身大模型炸场WAIC:一脑控多手、30秒换手,行业首例

全球首个云端具身大模型炸场WAIC:一脑控多手、30秒换手,行业首例

RoboScience机器科学直接把世博馆展台,变成了 Visics 的压力测试场。换本体、换物品、换任务,多轮挑战轮番上阵,专挑具身大模型最容易掉链子的地方下手。Visics 的泛化能力究竟行不行?现场观众可以直接点题,围观验货。

来自主题: AI资讯
8070 点击    2026-07-18 10:27
具身数采新方案:数字遥操作,现已开源,达摩院出品

具身数采新方案:数字遥操作,现已开源,达摩院出品

具身数采新方案:数字遥操作,现已开源,达摩院出品

阿里巴巴达摩院的最新工作RynnWorld-Teleop对此给出的方案是:用生成式世界模型替代真实机器人。操作员的手势驱动一个实时视频生成器,由“数字世界中的机器人”完成全部视觉演示,同时自动获得关节级的动作标签。该方案被称为数字遥操作(Digital Teleoperation)。

来自主题: AI技术研报
9372 点击    2026-07-18 10:11
ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

最近,来自 Google、哥本哈根大学、牛津大学等机构的研究者提出了 VGGRPO(Visual Geometry GRPO,收录于 ECCV 2026)。这项工作聚焦于一个核心问题:如何在不牺牲预训练模型泛化能力的前提下,高效地提升视频生成的几何一致性,并使其适用于动态场景。其核心思路是,在隐空间(latent space)中利用 4D 几何奖励,进行几何感知的视频后训练。

来自主题: AI技术研报
9195 点击    2026-07-18 10:09
FreeStyle来了!从社区LoRA中挖掘风格与内容,让双参考图像生成更可控

FreeStyle来了!从社区LoRA中挖掘风格与内容,让双参考图像生成更可控

FreeStyle来了!从社区LoRA中挖掘风格与内容,让双参考图像生成更可控

最近,一篇名为 FreeStyle: Free Control of Style-Content Dual-Reference Generation from Community LoRA Mining 的工作引起了不少关注。换句话说,FreeStyle 研究的是 style-content dual-reference generation,也就是「内容 - 风格双参考生成」。

来自主题: AI技术研报
7464 点击    2026-07-18 10:09