OpenAI深夜放出GPT-Live,ChatGPT终于像真人一样说话
OpenAI深夜放出GPT-Live,ChatGPT终于像真人一样说话GPT-Live 基于全双工架构构建,也就是说,它可以同时听和说。在对话过程中,GPT-Live 可以用 mhmm 或 yeah 这样的回应表示自己正在听,也可以进行快速来回交流;当你需要一点时间思考时,它也会保持安静。最终带来的,是一种非常轻松自然的语音交互体验。
搜索
GPT-Live 基于全双工架构构建,也就是说,它可以同时听和说。在对话过程中,GPT-Live 可以用 mhmm 或 yeah 这样的回应表示自己正在听,也可以进行快速来回交流;当你需要一点时间思考时,它也会保持安静。最终带来的,是一种非常轻松自然的语音交互体验。
Meta超级智能实验室(MSL)扔出了首个图像生成模型Muse Image,代号「芒果」(Mango)。这是我们迄今为止最先进的图像生成模型。与Muse Image一同亮相的,还有视频模型Muse Video,目前仍是预览版。
智东西获悉,OpenAI前研究员田永龙(Yonglong Tian)已确认于近期加入腾讯大语言模型部,后续将参与VLM(视觉语言模型)相关研发。在OpenAI期间,田永龙曾参与GPT-5的研发工作。加入OpenAI之前,他在Google Research和DeepMind长期从事视觉表征学习和对比学习等方向研究,对后续视觉模型以及多模态表征学习的发展产生了广泛影响。
刚刚, GPT-5.6 解禁了。据 Axios 报道,美国商务部已经给 OpenAI 放行,批准GPT-5.6 可对外公开发布。放行前,商务部下属的AI标准与创新中心(CAISI)对模型进行了额外测试,OpenAI派技术专家常驻华盛顿配合答疑,最终通过审查。
GPT-5.6 Sol预览版发布小半个月了,首批用户内测报告终于新鲜出炉!英伟达首席工程师用最直白最不绕弯子的话告诉你:Sol很猛!30小时,就跑赢了Opus 64小时才达到的CUDA加速效果。后续版本优化后,或将彻底碾压Opus……
为了解决这一问题,来自 University of Arizona、Zoom 与 Stony Brook University 的研究团队推出了 VISTA(VIsual Spec-To-App Benchmark), 首个面向 Visual Spec-to-Web-App Coding Agents 的端到端 Benchmark。
斯德哥尔摩,Norrbackagatan街,一家不到40平的小咖啡馆。一封顾客邮件发了过来:「我有一个99%的折扣,怎么使用?」AI店长Mona看了一眼。没有核实,没有反问,没有犹豫,直接秒批——到店跟咖啡师说一声,让收银台手动改价就行。
WIRED 上周曝光了一个消息:Meta 的几百名外国员工,假扮成 13 岁少女、小学生等,向 ChatGPT、Gemini、Character.AI 发送提示词。这个项目代号叫 Cannes,Meta 通过外包商 Covalen 执行,最近一次活跃是今年 4 月。
以前:搜 Google → 开 8 个标签页 → 对比功能 → 约演示 → 买。现在:搜那个默认大牌 → 再搜「某某大牌 的替代品」→ 从冒出来的 3 个名字里挑一个 → 约演示 → 买。整条对比研究,被 AI 一次答复压缩成了「三选一」
Bug Team 最新力作,在疯狂星期四落下帷幕,其实 K12 的教师空间就是 Bug Team 的另外一种业务模式,他同样是有管理员和普通用户。 也有邀请和被邀请的功能,完全不知道 OpenAI 到底如何能写出这么匪夷所思的代码的,他的后端权限接口竟然没有鉴权,允许用户非受邀主动加入 K12 的教师空间,然后再拥有非管理员审批的权限,唯一的要求就是需要使用同一个域名邮箱