扩散语言模型驱动的实时交互视频模型:SigmaZ 完成数百万美元融资
扩散语言模型驱动的实时交互视频模型:SigmaZ 完成数百万美元融资Pixel 擅长表达 appearance,Code 擅长表达 structure;未来会进入 Pixel-Code 联合的视觉表达。
来自主题: AI技术研报
8347 点击 2026-08-20 10:54
搜索
Pixel 擅长表达 appearance,Code 擅长表达 structure;未来会进入 Pixel-Code 联合的视觉表达。
7 月 24 日,Vivix 正式发布两款激活参数约 30B 的模型 Vivix-A1(开放世界演员)和 Vivix-W1(开放世界剧情)。这次发布试图回答的问题不是"生成能不能更快",而是更前一步的:模型在持续生成音视频的同时,能不能随时接住用户的新输入,并即时改变正在生成的内容?