让代码接管世界演化,西湖大学发布Code视频世界模型
让代码接管世界演化,西湖大学发布Code视频世界模型西湖大学AGI实验室发布Code World Model视频世界模型,将世界演化与视觉生成分离,由Coding Agent和代码负责因果规则执行、视频模型负责高保真视觉渲染,并提出Proxy作为可编译视觉条件通道,用约5.6小时游戏视频完成原型验证。
搜索
西湖大学AGI实验室发布Code World Model视频世界模型,将世界演化与视觉生成分离,由Coding Agent和代码负责因果规则执行、视频模型负责高保真视觉渲染,并提出Proxy作为可编译视觉条件通道,用约5.6小时游戏视频完成原型验证。
OpenAI正式发布旗舰模型GPT-6 Astra,宣称其为全球最智能模型并在多项基准测试中刷新SOTA,其计算机使用能力达人类水平,动用超10万块GPU训练,且成为首款在训练监督中由先前AI模型发挥重要作用及首个达到网络安全Critical级别的模型,OpenAI总裁Greg Brockman宣布人类正式进入AGI时代。
颜水成团队发布语音领域首个实时“流式双脑架构”记忆框架,左脑记信息,右脑记住你。 编辑丨岑峰 科幻电影曾无数次预演过AI与人类共生的场景。但在2026年的今天,尽管GPT-4o、全双工模型、Inter
OpenAI正式发布GPT-6 Astra,宣称其为"全球最智能且最对齐的模型",在电脑操作(OSWorld完成率72.6%)、ARC-AGI-3(99.9分)、审美判断力、主动性及网络安全(首个达Critical等级)等方面全面升级,Greg Brockman在媒体闭门会上宣布"欢迎来到AGI时代"。
Yukai Engineering CEO 青木俊介在 AGI Playground 2026 上复盘 mirumi 包挂件机器人的成功经验,这款不接大模型的产品在 CES 2025 意外走红,他认为消费机器人的关键在于提出正确的问题而非比拼技术参数。
如果说大语言模型拉开了本轮人工智能革命的序幕,那么今天人机交互的瓶颈,早已不再是模型的智商,而是人类接收信息的生理带宽。
AGI已经有人宣布实现了。
大模型开始吞噬越来越多的东西,创业公司究竟还能做什么?
毫无疑问,四月份发布的生图模型 GPT-Image-2,现在依然是当之无愧的 AI 生图之王。
8 月 3 日,Genspark 创始人&CEO 景鲲在 AGI Playground 2026 大会上发布了 GenOffice。这是一款 AI 深度集成的本地 Office 客户端,其亮点在于打通了从 AI 生成到工作交付间的链路:通过 GenOffice 打造的软件工程框架,模型得以直接操作 Office 文件最复杂的底层格式,将生成内容转化为可编辑、可交付的 Word 和 PPT 成品。