让Skill“有图可依”:openJiuwen首发多模态Skill范式Skill-Omni
让Skill“有图可依”:openJiuwen首发多模态Skill范式Skill-Omni针对这一问题,openJiuwen社区正式发布Skill-Omni——业界最早工程化落地的多模态Skill范式。 它让Agent的经验从“读得懂”升级为“看得见”,把网页和视频中的视觉知识,沉淀为Agent可复用的多模态Skill。
搜索
针对这一问题,openJiuwen社区正式发布Skill-Omni——业界最早工程化落地的多模态Skill范式。 它让Agent的经验从“读得懂”升级为“看得见”,把网页和视频中的视觉知识,沉淀为Agent可复用的多模态Skill。
袁语2016年清明节后在九合创投拿到第一份投资工作,跟着王啸干,投的第一个项目就是VUE——一个帮普通人拍出好视频的创作工具。他说自己一直对"像钢琴一样的东西"着迷,那种能激发创造力的工具。
7月7日,Fable 5没下线!就在凌晨,Anthropic突然官宣, 最强Claude Fable 5限时免费,延长到了7月12日。比原计划,又多了足足五天的「白嫖」时间。具体用法,和之前一模一样,每周使用限额50%,超出之后想继续用,就得买credits了。
刚刚,翁荔(Lilian Weng)又更新博客了!距离她上一次更新《谨慎对待 Scaling Law》还不到 10 天。这一次,她书写的主题是当前大热的 Harness Engineering,聚焦的正是当下 AI 研究最前沿一个环节:当模型本身的智能已经足够强大时,真正决定它能走多远的,或许是包裹在模型外面的那层「Harness」也就是负责编排模型思考、调用工具、管理上下文、评估结果的那套系统。
今天,据路透社报道,三位知情人士透露,DeepSeek正在自研AI推理芯片,以减少对英伟达以及华为芯片的依赖。知情人士称,DeepSeek自研芯片的工作大约在一年前启动,其研发仍处于早期阶段。目前,DeepSeek正在接触外部合作伙伴,并与芯片设计企业、晶圆代工厂以及存储企业展开讨论。
近日,北京月之暗面科技有限公司发生工商变更,联合创始人汪箴退出股东序列。公开工商信息显示,退出前,汪箴持有公司约0.075%的股份。原因并不在于股份,而在于身份。公开资料显示,汪箴不仅是月之暗面的联合创始人,也是公司现任总裁张予彤的丈夫。
昨天,腾讯混元 Hy3 正式版上线,小程序更新了「成长计划」:小程序开发者的可以获得 10 亿的文本 Token,和 10 万张生图额度→ 10 亿 token 按官方 API 价折算,约 1000~4000 块
今天,Synthetic Sciences直接发布一款OpenScience的开源替代项目。团队表示,Open Science比 Claude Science 更好用,且完全开源。Open Science支持30个可用的数据库,超250个研究skills。这些数据和技能,让Open Science具备实验假设、消融实验、结果溯源、论文撰写等全套科研能力。
我现在核心做的项目叫QLab,一个AI出海加速器。用多智能体,搭了一张高效的协作网络,专门帮国内的中小创业者、一人公司和AI团队,把产品推到海外去。 1. AI Agent相关技术产品支持:帮助非技术背景OPC迅速搭建AI产品体系
陈勇超在 x 平台宣布,正式创立 Apex Intelligence(中文名:超衍智能),主攻自主进化基础模型(Self-Improving Model),公司 Slogan 是"Unlock Undiscovered Discovery"(解锁尙被发现的发现),目标是让大模型从复刻人类已有知识,转向自主发现未知规律。
家人们,最近刷到一个硅谷新瓜——美国有钱人最近流行一种新式鸡娃,把孩子从传统学校撤出来,送进AI私塾。所谓AI私塾,就是上课没有老师、由AI来教的私立学校。最出名的一所叫Alpha School,收着全旧金山最贵的学费:一年7.5万美元,折合人民币约52万。
GitHub上有个项目叫 Project N.O.M.A.D,33k Star,3k Fork。作者 Chris Sherwood 是个搞网络设备的 YouTuber,Crosstalk Solutions 频道有 38 万多订阅。这项目说白了就是把维基百科、本地 AI、离线地图、离线教育平台全塞进 Docker 里,断网也能用。
超级麦吉自媒体工作台,做的就是这件事——把选题、创作、诊断、复盘、管理这五个环节串起来,把黑盒一个个打开,让你每一步都能看到自己在做什么。不是给你一堆工具,是给你一套能跑起来的系统。
Ricursive Intelligence 由 Google AlphaChip 项目负责人 Anna Goldie 和 Azalia Mirhoseini 于 2025 年创立。与当前大多数 AI 芯片创业公司不同,Ricursive 并不制造芯片,而是试图改变芯片被设计出来的方式。
刚刚,DeepSeek 在官方 API 文档里给出了一个 thinking mode 和 tool call 结合使用的样例。表面上看,这只是一个常规的工具调用演示:用户提出问题,模型判断需要调用工具,工具返回结果后,模型再继续生成答案。
中共北京市委教育科技人才工作领导小组正式印发《北京市加快推进人工智能赋能科学研究实施方案(2026-2028年)》(简称:《实施方案》),成为国内首个覆盖自主实验室、科研智能体、科学大模型、科学数据中心、高价值应用场景等完整体系的AI for Science(AI4S)中长期实施方案。
如果你的日常任务里包含编程,今天给大家介绍一个特别适合团队用的AI开发平台「MonkeyCode」,目前在GitHub已狂揽3.4k Star,开源免费。开源地址:github.com/chaitin/MonkeyCode
逸文科技(Even Realities)宣布完成Pre-B轮融资,融资金额1.5亿美元,投后估值超10亿美金,正式跻身独角兽行列。本轮融资由美团龙珠及美团战投领投,腾讯及其他老股东超额跟投。023年底才成立的逸文科技,用G1和G2两代产品打破了用户对智能眼镜不过是“科技玩具”的刻板印象。
2026年上半年,中国AI创业公司经历了一场狂热的融资热潮,总融资额突破三千亿元,仅6个月的融资体量已超过2025年全年。AI融资金额占市场约48.6%,接近一半,事件数占比约22.5%。
General Intuition 做的事听起来有点绕:用游戏数据训练现实世界里的 AI Agent。换成更直白的话说,General Intuition 做的是让 AI 先在游戏里学会“怎么行动”,再把这种能力迁移到机器人、无人机、自动驾驶、仿真环境里。
视频虚拟试衣(VVT)作为电商展示与数字内容创作中的核心技术,已在动态人物换装、服装纹理保持和视频时序连贯性方面取得显著进展。然而,现有方法大多仍受限于固定相机视角,生成结果被动依赖源视频的原始相机轨
以 LeWorldModel(LeWM)为例,它在规划时有一个重要瓶颈:每评估一条候选动作序列,模型都要一步步自回归 rollout。也就是说,LeWM 先预测下一步 latent,再把预测出的 latent 输入 dynamics model,继续预测下一步:
手机GUI Agent正在从「看懂屏幕、点击按钮」走向更复杂的跨App自动化任务:这些任务听起来并不复杂,但对现有手机GUI Agent来说,一个核心难题始终存在:任务一长,就容易忘。
AI视频生成技术迅猛发展,生成内容的逼真度不断提升,现有检测方法已无法满足需求。最新综述提出「事实保真度验证」新目标,从视觉与语言双视角梳理出四层检测框架,涵盖底层线索、时空一致性、跨模态核验及世界知识推理,强调多层证据耦合与可解释性。
AI营销科技公司智推时代GenOptima(简称“智推时代”)宣布完成数千万元天使轮融资,由上海知识产权基金、天图投资、知名个人投资人魏巍等参与投资,老股东三七互娱继续跟投。多维资本担任独家财务顾问。
蚂蚁灵波的 LingBot-Depth 2.0,一出手就是王炸——12项世界第一!深扒内幕发现:他们竟然直接抛弃了 DINOv3,从头自研预训练基座,仅用11亿参数暴力干翻70亿大魔王,且宣布重磅开源。
近日,深穹星核正式发布首款高仿真人脸机器人 Nova S1,搭载 VLIA 一体化端侧交互大脑,面向家庭、日常交互与协作场景。继上周天使 4 轮融资后,公司再次完成新一轮数千万元天使 5 轮战略融资,持续加码意图理解与情感交互技术的研发落地。
没人设计过,Claude却在学习预测下一个token时,自发长出了一个和人脑「意识」惊人相似的结构!Anthropic开源「手术刀」J-Lens,第一次读出了AI咽回肚子里的念头。
7月6日晚,一则帖子引爆了AI行业。 一个中科大少年班出身、华为第一批天才少年、AI创业公司首席科学家,在DeepSeek的面试现场,被面试官当面说:停止抄袭。 他叫李博杰。
隐私优先AI平台Venice AI,于7月1日宣布完成6500万美元A轮融资,投后估值达到10亿美元,正式跻身独角兽行列。与大多数AI公司“先融资后发展”的路径不同,Venice AI走了一条“先发币后融资”的独特路线。