ECCV2024 Oral | 第一视角下的动作图像生成,Meta等提出LEGO模型
ECCV2024 Oral | 第一视角下的动作图像生成,Meta等提出LEGO模型如何基于用户的问题和当前场景的照片,生成同一场景下的第一视角的动作图像,从而更准确地指导用户执行下一步行动?
搜索
如何基于用户的问题和当前场景的照片,生成同一场景下的第一视角的动作图像,从而更准确地指导用户执行下一步行动?
EMOVA(EMotionally Omni-present Voice Assistant),一个能够同时处理图像、文本和语音模态,能看、能听、会说的多模态全能助手,并通过情感控制,拥有更加人性化的交流能力。
OpenAI 的宫斗大戏刚落下帷幕,今日凌晨就在旧金山召开了第二届 DevDay 开发者大会。
面对以 Sora 为代表的各种「后辈」视频生成模型的冲击,Pika 迟迟没有大的版本更新。
本文中,我们将分享 8 款人工智能数学工具,这些工具正在辅助数学教育、学习过程,并使学生和教育工作者能够应对挑战。
小杨哥事件中曝出来那段“卢文庆录音”,先是内容尺度之大引起舆论哗然,接着又被查明全部是AI伪造。 一来二去,AI技术再次被推上了风口浪尖。
2019年,Jony Ive离开了苹果公司。 这位iPhone的设计师在苹果工作的27年里,构想了苹果产品的极简主义美学。
就在刚刚,MIT系初创公司Liquid AI团队官宣:推出首批多模态非Transformer模型——液体基础模型LFM。
近一个月来,全面对标 OpenAI 的智谱大小动作不断,GLM-4-Flash 免费,推出极致性价比的 FlashX,旗舰模型升级到 Plus 系列... 其中最为关注的就是 Plus 系列,模型性能越来越强的同时,价格也越来越低。
风平智能获AI数字人赛道的最大笔融资