沙特HUMAIN基于MiniMax M3推出阿拉伯语大模型,中国开源模型走向全球底座
沙特HUMAIN基于MiniMax M3推出阿拉伯语大模型,中国开源模型走向全球底座沙特人工智能公司HUMAIN基于中国MiniMax的开源旗舰模型MiniMax M3推出阿拉伯语大模型HUMAIN M3,使用超过1万亿Token阿拉伯语数据进行后训练,在七项阿拉伯语基准测试中等权平均分达89.37%,标志着中国开源模型正成为全球AI生态的底层技术基础。
搜索
沙特人工智能公司HUMAIN基于中国MiniMax的开源旗舰模型MiniMax M3推出阿拉伯语大模型HUMAIN M3,使用超过1万亿Token阿拉伯语数据进行后训练,在七项阿拉伯语基准测试中等权平均分达89.37%,标志着中国开源模型正成为全球AI生态的底层技术基础。
面向Agent Harness层自进化方向,CREAO AI近日完成千万级美元新融资,资金将用于扩大真实业务工作流与高质量反馈数据规模,加速基于开源模型后训练的垂直模型迭代。
随着开源模型能力不断提升,它们已经能够以极低的成本生成多个高质量候选方案,并进一步利用模型自身对这些结果进行验证、打分和筛选。斯坦福团队最新实验发现,使用 DeepSeek V4 Flash + LLM-as-a-Verifier 进行「自验证」,可以在 Terminal-Bench 2.1 上超越 Claude Fable 5,同时整体成本低约 11 倍。
老黄刚砸60亿,要造一个地表最强开源模型。
大模型的版本告一段落,AI应用的新版本已经到来。
老黄,真的不甘心只做卖铲人了!
近来文生图模型发展迅速,但每篇工作多是独立地引入一整套模型、数据和训练设计,然后用私有的数据训出来了一个亮眼的模型。
这期节目的嘉宾黄东旭,就是Token Maxing热潮的亲历者。他曾经只用最前沿的模型,每天账单三四百美元。让他转变的,是前沿模型的智力碾压和中国开源模型们的崛起——Fable 5可以一句话终结Agent群的讨论,同时大量的日常任务可以做到“只烧电费,不烧Token”。他的结论是:不是前沿模型用不起,而是本地开源模型底座+前沿模型的搭配,成本可控,更具性价比。
长期依赖外部模型,不是最好的选择。
Qwen3.8-27B开始和顶级闭源模型正面叫板,过度思考是最大问题。