大模型是残酷的制造业
大模型是残酷的制造业大模型的版本告一段落,AI应用的新版本已经到来。
搜索
大模型的版本告一段落,AI应用的新版本已经到来。
最近,第三方视觉评测机构Roboflow,把GPT-5.6 「全家桶」拖进自家VLM基准跑了一圈。测试的内容,都是最实在的活儿:找东西、数东西、认字、抽信息。仅在目标检测这项,上一代GPT-5.5只拿到13.8分。这个分数,在视觉模型圈里基本等于交白卷。
新智元报道 据传,下一代GPT-6本周就要来了! 这不刚在昨天,OpenAI「义父」Tibo亲自爆料,Codex将接入最强Astra模型。 消息一出,全网瞬间沸腾,人们期待值直接拉满。就连Polymarket上,关于OpenAI本周发布下一代Astra的概率,飙涨到了52%。
「套壳」是 Cherry Studio 最大的标签。但这个「壳」,在过去一年成了 GitHub 上增长最快的 AI 桌面应用之一。Cherry Studio 最初的目标很明确,就是帮用户在不同大模型之间自由切换,做一个更好用的聊天客户端。
从物理视频生成到运动迁移,再到可控世界建模。
端到端策略模型在物理世界频频失灵,研究者转向 “大模型智能体 + 工具调用” 自救,试图在动态物理世界中持续学习。然而,这条在线学习路径在物理世界仍未真正走通。
Gemini 领跑,GPT表现平平,国立清华、英伟达提出双奖励孪生网络,告别算力焦虑。
给AI一句“生成一款坦克大战游戏”,代码很快跑了起来。
面对大模型规模与硬件内存之间高达20倍的算力鸿沟,不重训的“1比特量化”如何把千亿参数的硅基大脑塞进微型设备?
机器人撬开啤酒瓶盖,啤酒泡沫涌起,酒液从画面右下角流入杯中。