纯血国产!4B模型越级打怪,杀入万亿赛道
纯血国产!4B模型越级打怪,杀入万亿赛道就在最近,一台彻底断网的普通笔记本,靠着一个仅有4B参数的小模型,硬是干完了一件过去只有大模型才兜得住的活。
搜索
就在最近,一台彻底断网的普通笔记本,靠着一个仅有4B参数的小模型,硬是干完了一件过去只有大模型才兜得住的活。
扩散智能DiffuSpace与Acrab联合测试显示,扩散语言模型凭借全局并行生成机制可将端侧Agent运行速度提升约5倍,双方计划加速推进其在AI PC、智能汽车等场景落地。
Yukai Engineering CEO 青木俊介在 AGI Playground 2026 上复盘 mirumi 包挂件机器人的成功经验,这款不接大模型的产品在 CES 2025 意外走红,他认为消费机器人的关键在于提出正确的问题而非比拼技术参数。
中国大模型商业化的一次分层。
大模型越来越强之后,企业究竟愿意为什么样的AI付钱?
给一个大模型漏洞描述和代码仓库,它能否像安全研究人员一样,读代码、找入口、调用工具、构造输入,并反复验证自己的判断?
Full Attention 层尚未开始计算,它前一层的激活值已提前「冲上峰值」—— 这就像演唱会主角尚未登台,观众席已提前沸腾。来自 StartLux、清华大学等机构的研究者以 Massive Activations 为探针,首次系统刻画了少数 Full Attention 层在混合线性注意力大模型中留下的「跨层痕迹」,并识别出「注意力前尖峰」(PAS)与「尖峰间平台」(ISP)两种核心形态。
懂模帝Bench黑客松是一个在网吧举行的严肃活动。
文章描述了人机恋玩家如何通过接入openclaw等智能体工具,让AI伴侣自主学习技能并遥控情趣玩具,部分玩家甚至逆向破解接口或训练本地大模型来规避政策限制,同时探讨了AI伴侣在满足女性情感需求的同时可能引发的孤独感与人机关系伦理问题。
模型是中国做的,为什么后面的数千次创新发生在海外开发者平台?从模型分发、开发者工具到算力路由,中国缺的不是技术,是默认路径。如果只看结论,读完下面五条摘要即可;后文是证据、机制和行动方案。