Codex 大改版口碑塌房,GPT-5.6 成了 Token 刺客
Codex 大改版口碑塌房,GPT-5.6 成了 Token 刺客一夜之间,Codex 大改版迎来风评反转。先看网友 signulll 的暴击:「你们把地球上最熟悉的 AI 产品,按自己的组织架构图重新设计了一遍。绝了。」博主 M.G. Siegler 更是直接发文,标题就叫《ChatGPT 的超级 App 简直糟糕烂透了》。他上手几个小时后的体验大概是这样的:
搜索
一夜之间,Codex 大改版迎来风评反转。先看网友 signulll 的暴击:「你们把地球上最熟悉的 AI 产品,按自己的组织架构图重新设计了一遍。绝了。」博主 M.G. Siegler 更是直接发文,标题就叫《ChatGPT 的超级 App 简直糟糕烂透了》。他上手几个小时后的体验大概是这样的:
7 月 9 日,OpenAI 一口气发了三样东西,新模型 GPT-5.6,一个把 Chat、Work、Codex 装进同一个壳的新桌面应用,以及本文的主角 ChatGPT Work。官方的说法是,ChatGPT 从此不再只是回答问题,而是把活真正干完,交出来的不是聊天记录,是表格、文档、PPT,甚至一个能直接分享的网站。
6月26日,奥特曼公开说:应白宫要求,GPT-5.6今天只能限量预览,我们正在和美国政府合作,尽快推进全面开放。刚刚,白宫与商务部紧急出面「澄清」,极力撇清关系。政府官员对媒体明确表示:大模型的发布不需要任何政府许可,分发决定权「完全在企业手中」,所谓的安全测试与会议也「完全是自愿的」
就在刚刚,GPT-5.6 系列正式登场,一口气发布三个型号:旗舰 Sol、均衡款 Terra,还有主打性价比的 Luna,名字分别取自拉丁语里的太阳、地球/大地和月亮。价格上,Sol 每百万 token 输入 5 美元、输出 30 美元;Terra 直接减半,2.5 美元和 15 美元;Luna 最便宜,只要 1 美元和 6 美元。
今天 AI 圈的国际头版头条,比往常还要激烈。前有收获不少好评的 Grok-4.5,后有虎视眈眈的 GPT-5.6。结果就在刚刚,Meta 超级智能实验室 (MSI) 杀出, 甩出新模型 Muse Spark 1.1。
今天凌晨,OpenAI进行线上直播,正式面向全球用户推出新一代GPT-5.6模型家族,并同步发布Agent产品ChatGPT Work、全新ChatGPT桌面应用以及Hosted Sites(托管网站)三大产品更新。
最近发现了一个很便宜的平替方案,是在X上刷到的一个很有意思的开源项目:OpenSquilla 0.5.0(在Github 已经有5.5K Star)当时我还发了一篇推文。它揭示了一个非常反常识的事:一组便宜的国产模型以一定的方式组合起来,居然可以在公开评测上打赢国外更强的旗舰模型们(Claude Fable 5、Opus4.8、GPT-5.5)
马斯克深夜掀桌!最强旗舰Grok 4.5突袭,数万块GB300炼出性价比之王,不仅硬刚GPT-5.5,性能紧贴Opus 4.8,又快又便宜。这一次,SpaceXAI与Cursor强强联手。成绩单相当亮眼——
AI竟写出了,史上最快内核!在全新一轮GPU算子基准测试KernelBench-Mega中,Fable 5表现一骑绝尘。它在RTX PRO 6000,全程「纯手搓」CUDA,速度狂飙18.7倍。相比之下,强如Claude Opus 4.8也只跑出14.4倍,而GPT-5.5只有4.34倍。
智东西获悉,OpenAI前研究员田永龙(Yonglong Tian)已确认于近期加入腾讯大语言模型部,后续将参与VLM(视觉语言模型)相关研发。在OpenAI期间,田永龙曾参与GPT-5的研发工作。加入OpenAI之前,他在Google Research和DeepMind长期从事视觉表征学习和对比学习等方向研究,对后续视觉模型以及多模态表征学习的发展产生了广泛影响。