所有AI创作工具,都该学学 MVLAND 这个功能
所有AI创作工具,都该学学 MVLAND 这个功能最近《在超市后门抽烟的二人》这部剧挺火的,尤其是里面的音乐我很喜欢,所以就想着做一个真人版音乐短片,正好发现美图旗下的 MVLAND 上线了创意画布模式,接入 Seedance2.0、可灵、HappyHorse 等顶尖视频生成模型。
搜索
最近《在超市后门抽烟的二人》这部剧挺火的,尤其是里面的音乐我很喜欢,所以就想着做一个真人版音乐短片,正好发现美图旗下的 MVLAND 上线了创意画布模式,接入 Seedance2.0、可灵、HappyHorse 等顶尖视频生成模型。
同样一兆瓦电,英伟达最新的GB300 NVL72能同时扛住61400个智能体,上一代H200只扛得住大约2600个。这中间,差了整整20倍。它就是独立评测机构Artificial Analysis发布的新基准:AA-AgentPerf。
5周内,他们如何做出了一个新的Agent产品,并完成了组织改造?那时,他们的公司火星电波成立了1年2个月,刚刚拿到新一笔200万美元融资。ListenHub——他们打造的一款AI驱动的音频内容生成工具,已经做到300万美元ARR,并实现了月度盈亏平衡。且,ListenHub仍在增长。按照原来的计划,他们会继续把它推向海外,到年底,营收或许还能再翻几倍。
还在用 DragGAN、DragDiffusion 拖拽修图?点选拖拽容易变形、边界割裂、细节丢失的时代落幕了!ECCV 2026 ICRDrag 首创上下文区域拖拽模型,用掩码精准定位局部区域,移动、缩放、变形全都丝滑自然,兼顾精准度与画面真实感。
本次访谈于2026年彭博科技大会举办,博通CEO陈福阳是业内知名的半导体并购大佬,正带领博通发力AI芯片赛道;采访者TomGiles为彭博资深科技记者,访谈恰逢博通财报发布后市场担忧其AI业务增长,他借此详解公司AI布局与发展预期。
今天来好好盘点 2026 年上半年的图片与视频模型,伴随模型更新时间轴出现的,还有我一些当时的测试文章。也算是对不怎么努力也没什么收获的上半年做个总结汇报了。
浙江大学等五所高校的研究团队提出 EgoTSR。研究从第一人称机器人视角出发,希望让 VLM 学会判断任务状态,并把这种能力进一步扩展到长程规划。团队构建了包含 4600 万条样本的 EgoTSR-Data,并设计了三阶段课程学习流程。
7月4日,豆包和通义千问宣布智能体功能将下线。豆包发布《豆包智能体功能下线通知》,称由于产品功能调整,智能体功能将于2026年7月15日下线。功能下线后,用户仍可在一段时间内查看并自行保存智能体信息及历史对话数据,10月15日后,豆包将根据《隐私政策》对智能体相关数据进行处理,后续将无法在豆包内查看或恢复。
上线短短一个月,抖音科技发起的#VibeCoding大赏 就有2.3万人参与、超6.3亿次播放。在这里,没有枯燥的PPT和高大上的行业术语,这届独立开发者、各路创作者以及无数普通用户,用一种好玩的方式释放想象力。
AI新云赛道再现巨额融资。成立于2022年的AI新云(Neocloud)公司Together AI,于7月1日正式宣布完成8亿美元C轮融资,投后估值达到83亿美元。Together AI的核心业务是出租NVIDIA GPU集群及其他AI专用基础设施,为企业提供运行开源大模型的云平台。