英伟达官方推理指南来了!6倍无损加速,最优解全是华人写的
英伟达官方推理指南来了!6倍无损加速,最优解全是华人写的最近,英伟达发了篇官方的大模型推理指南,结果翻着翻着,硬是让人看成了一本华人团队的论文合集。
搜索
最近,英伟达发了篇官方的大模型推理指南,结果翻着翻着,硬是让人看成了一本华人团队的论文合集。
OpenAI正式发布旗舰模型GPT-6 Astra,宣称其为全球最智能模型并在多项基准测试中刷新SOTA,其计算机使用能力达人类水平,动用超10万块GPU训练,且成为首款在训练监督中由先前AI模型发挥重要作用及首个达到网络安全Critical级别的模型,OpenAI总裁Greg Brockman宣布人类正式进入AGI时代。
模型的发布流程,早已在密集迭代中演变为精准的工业流水线:技术报告开路,Benchmark榜单刷屏,紧接着开放API,最后以开源权重收尾。
据一位知情人士透露,Nvidia已就投资Mercor展开讨论。Mercor是一家数据标注服务商,协助这家芯片设计商开发其开源AI模型。此次投资将作为一轮估值200亿美元融资的组成部分。现有投资方General Catalyst已在洽谈领投本轮融资。
8月13日凌晨,DeepSeek V4 Pro正式登场,给开源模型生态又添一把猛火。从Kimi K3到MiniMax H3,再到DeepSeek V4 flash、DeepSeek V4 Pro,在中国开源模型的猛攻之下,美国的AI公司这次是真的坐不住了。
前不久用Fable 5推翻雅可比猜想的Anthropic研究员,又吭哧吭哧和两个人类伙伴带着Claude,做出了668阶哈达玛矩阵!(好数学家不挑AI模型,doge)不过这人每次有成果都不明说,发一堆只有内行才看得懂的东西。
今天,英国《金融时报》援引知情人士报道,字节跳动正在训练一个参数量高达10万亿的AI模型。而这一数字,在昨日晚间的晚点LatePost独家报道中还是“超5万亿”。即使是5万亿,这一模型的规模也已经超过目前中国已发布的最大模型Kimi K3,接近Anthropic的Fable 5;如果是10万亿,那字节的新模型规模将超越约有8万亿参数的Mythos 5。
Transformer 的上限在哪里?这个问题从 2022 年 ChatGPT 问世起,就开始被广泛讨论。
OpenAI宣称下一代AI模型解决了10个世界级难题,其中包括推翻了Connes刚性猜想。
今天,OpenAI重磅放出一份长达62页的「核心手稿」,详细展示了GPT的完整推演。传送门:https://cdn.openai.com/pdf/reasoning-walkthroughs.pdf。它的「摘要」只有一小段,但信息量却大得惊人——这份笔记由AI模型独立撰写,OpenAI团队完全没有插手。