突发,OpenAI首颗「辣椒」芯片压倒英伟达!GPT-6干崩CUDA
突发,OpenAI首颗「辣椒」芯片压倒英伟达!GPT-6干崩CUDA就在刚刚,OpenAI首颗自研芯片Jalapeño「墨西哥辣椒」,交出了首批实测成绩单——AI推理性能,全面反超英伟达GB200和GB300。实测速度直接起飞!Jalapeño一秒能狂吐1459个Token,英伟达GB200只有535个,连一半都不到。
搜索
就在刚刚,OpenAI首颗自研芯片Jalapeño「墨西哥辣椒」,交出了首批实测成绩单——AI推理性能,全面反超英伟达GB200和GB300。实测速度直接起飞!Jalapeño一秒能狂吐1459个Token,英伟达GB200只有535个,连一半都不到。
2026 年最好的 AI PC,刚刚迎来了一大波更新。苹果正式发布全新一代 Mac mini 和 Mac Studio。新一代桌面 Mac 带来了 M6、M5 Pro、M5 Max 与 M5 Ultra 四款芯片选择,也进一步拉高了苹果在本地 AI 计算领域的性能上限。
有从产品创立之初就「全力押注」Agent 实况协作的团队,而这个团队在 8 月 24 日发布了正式产品 ——Tutti · VM。根据官方信息,Tutti · VM 把自己定义为行业「首个实况级」多人、多 Agent 实时协作空间,其把本地工具和云端工具的优点结合到了一起。
2025年,杨斌体验了一款海外语音交互产品Sesame。一两轮对话后,他因暂时想不到问题陷入沉默。几秒后,对面突然主动开口:“你现在是不是思维卡壳了?”随后补了一句话,把中断的话题接了起来。
由华东师大智金院团队孵化的金融原生 Agentic Foundation Model 家族 Mint-Agent 正式发布。在 FinanceAgentBench v2 上,27B 的 Mint-Ag 达到 60.49%,超过 GPT-5.6-Sol 与 Claude Opus 4.8;单题推理成本分别仅为两者的约 22% 和 10%。
就在刚刚,英伟达史上首次公布了下一代旗舰级机柜 Vera Rubin NVL72 的首次片上实测数据。而且,这次实测直接拉来了DeepSeek-V4-Pro,跑最真实的「智能体编码」任务!结果令人吃惊:对比当前的主力机皇GB300 NVL72,Vera Rubin的每兆瓦吞吐量最高飙升了30倍、Token成本最高暴降了35倍!
最近两天,X 上网友 Max For AI@MaxForAI 的一篇帖子引发了网友热议:「太疯狂了 —— 现在你甚至可以直播围观一个 535B 大模型是如何被训练出来的。」
同样的模型,同样的任务,让它执行五遍,再让他自己挑一遍最稳的,效果能有多大提升?斯坦福把这套玩法用在了AI身上,DeepSeek V4 Flash在Terminal-Bench 2.1的成绩从79%一路涨到88%,反超了尖子生Fable 5。而且连做五遍加挑选这一通折腾,价格依然比Fable 5便宜了4-11倍。
顶会可以年年开,但这本期刊不是每个实验室都能进的。
今年的 WRC 格外热闹。