AMD跑GLM 5.2,成本只要英伟达一半
AMD跑GLM 5.2,成本只要英伟达一半GLM 5.2,用AMD芯片也能跑出来了,而且成本只要英伟达的一半。这是推理优化公司Wafer这周公布的一组数据。Wafer用AMD的MI355X芯片跑最新开源模型GLM 5.2,单节点吞吐做到2626 tok/s,单流吞吐也跑到了213 tok/s。
搜索
GLM 5.2,用AMD芯片也能跑出来了,而且成本只要英伟达的一半。这是推理优化公司Wafer这周公布的一组数据。Wafer用AMD的MI355X芯片跑最新开源模型GLM 5.2,单节点吞吐做到2626 tok/s,单流吞吐也跑到了213 tok/s。
众所周知,大模型训练成本极高。
一家几乎尚未公开具体产品的AI初创公司,刚刚拿下硅谷最受关注的一笔融资。AI初创公司Hark宣布完成7亿美元A轮融资,投后估值达60亿美元。本轮融资阵容堪称豪华,由Parkway Venture Capital领投,英伟达、AMD、高通、英特尔、Salesforce等产业资本集体押注。
黄仁勋刚走,苏妈就来了。
奥特曼不买芯片,只租未来。AMD股价翻倍、英伟达深度绑定,如今Cerebras也乖乖奉上50亿认股权证——硅谷新领主,正在悄然对全行业征税。
OpenAI,这次又真·Open了一下。
两位哈佛毕业的女生 Eva Tuecke 和 Catherine Yeo 用 AI 改变了电池故障排查,她们创立的 Altara 公司在近日获得 700 万美元种子轮融资,估值 7 亿美元,领投方是 Greylock。Neo、BoxGroup 和 Liquid 2 Ventures 也参与了本轮融资,此外还有包括 Jeff Dean 在内的知名天使投资人以及 OpenAI 和 AMD 的高层领导。
Claude性能降智,已经成了重度用户们绕不开的槽点。而且发现这一点的,还是AMD高级总监Stella Laurenzo。在翻烂了近7000份会话日志后直言,Stella发现现在的Claude在处理复杂任务时已经变傻了。
过去Claude粉丝如今直呼「垃圾!20倍价格的Max计划,却连基本规划模式都激活不了,这波操作让所有人看清:智能是可以随时被回收的体验。
刚刚推出的一款最新芯片,直接冲上硅谷热榜。峰值推理速度高达每秒17000个token。什么概念呢?当前公认最强的Cerebras,速度约为2000 token/s。 速度直接快10倍,同时成本骤减20倍、功耗降低10倍。