阿里、美团、字节、小米罕见「会师」,四大厂为何共同押注自变量机器人
阿里、美团、字节、小米罕见「会师」,四大厂为何共同押注自变量机器人当很多具身智能公司更关心机器人先在哪些场景里跑通商业化时,自变量更想寻找哪条路径能够通往 AGI。
搜索
当很多具身智能公司更关心机器人先在哪些场景里跑通商业化时,自变量更想寻找哪条路径能够通往 AGI。
唯一一家同时被四家互联网大厂(字节、美团、阿里、小米)投资的具身智能公司。
AI医疗,又一巨头涌入!
浙江大学联合美团龙猫团队、清华大学推出全新研究成果——SKILL0,并提出技能内化(Skill Internalization)——小模型真正需要的,或许不是推理时的“外挂技能”,而是将技能内化为本能。
相似度超越Seed-TTS、MiniMax-Speech等知名模型。昨晚,美团LongCat团队发布了文本转语音模型LongCat-AudioDiT,并开源1B、3.5B参数量的版本。这一模型的最大特点,是彻底抛弃了梅尔谱等中间表示,直接在波形潜空间进行基于扩散模型的文本转语音。通俗地说,这一模型直接根据声音本身的规律进行生成,“雕刻”出最原始的声音波形,从根源阻断数据转换的级联误差。
当所有人盯着大模型时,美团看到了什么?
近期,复旦大学 NLP 实验室(FDU NLP)、北京大学知识计算实验室(KCL)联合美团 LongCat Team 提出了一种 Block Diffusion 推理模型 Test-Time Scaling 新框架 TDAR,通过引入 “粗思考,细求证” (Think Coarse Critic Fine, TCCF) 范式与有界自适应置信度解码
大家是否有这样的感觉?给定几张场景中拍摄的图片,往往能够在脑海中想象出这个场景的三维布局,然而当前的多模态大模型还停留于纯文本或者 2D 视觉的推理表示,限制了图像中隐含几何结构的表达能力。
我本来以为这玩意儿就是个技术圈的小众玩具。结果今天刷美团,发现它居然上架了。。。美团联合联想IT服务品牌百应,推出了OpenClaw远程部署服务。395元起,还可用团购券。
Tabbit 背后的团队,是美团的光年之外 对,就是那个最早由王慧文老师创办,后来并入美团的那个光年之外