Runway把世界模型做成了操作系统!不用代码直接生成界面
Runway把世界模型做成了操作系统!不用代码直接生成界面Runway发布首个界面世界模型Solaris,基于Gen-4.5视频生成模型与GWM-1世界模型技术,用户通过点击、拖拽或输入文本即可实时生成交互界面而无需编写代码,该系统还可用于训练Computer Use Agent。
搜索
Runway发布首个界面世界模型Solaris,基于Gen-4.5视频生成模型与GWM-1世界模型技术,用户通过点击、拖拽或输入文本即可实时生成交互界面而无需编写代码,该系统还可用于训练Computer Use Agent。
阿里千问创作平台上线 Wan 3.0 视频生成模型及 Agent Teams 多智能体协作模式,用户输入剧本与一句话提示词即可由编剧、导演、美术、分镜师、配乐师等 Agent 自动接力完成影视短剧制作,文章以"华强买瓜"剧本配合《JoJo的奇妙冒险》风格进行实测,展示了从需求拆解、角色资产生成、镜头提示词确认到视频拼接与片段迭代修改的完整流程。
过去几年,视频生成模型在清晰度、运动表现和画面质感上不断进步。输入一句文字,模型已经能够生成颇具电影感的视频。
今天的视频生成模型,已经越来越像一个会拍电影的导演。
太卷了!过去两年,视频生成模型把画面参数几乎卷了个遍。
再牛的大模型,也要放到行业面前公开露个面,才算真交卷。
近两年,视频生成模型在具身智能领域受到持续关注。从 UniPi、SuSIE 到各类 action-conditioned video generation 变体,其核心思路一致:先由模型生成一段未来视频,再从中提取动作信号供机器人执行。
最近《在超市后门抽烟的二人》这部剧挺火的,尤其是里面的音乐我很喜欢,所以就想着做一个真人版音乐短片,正好发现美图旗下的 MVLAND 上线了创意画布模式,接入 Seedance2.0、可灵、HappyHorse 等顶尖视频生成模型。
今天,阿里巴巴发布了其最新一代视频生成模型HappyHorse 1.1(快乐小马1.1)。阿里称,相比HappyHorse 1.1,这代模型在动态表现力、主体一致性、指令遵循、视觉质感和音频能力等维度有了一定提升。
当用户给出一句简单提示词时,当前的音视频生成模型往往已经能够生成具有不错质量的视听内容。然而,一旦提示词变得复杂,问题便开始暴露出来。