5年前被MIT教授骂「无稽之谈」的PPT,预言了OpenAI o1、o3核心思路
5年前被MIT教授骂「无稽之谈」的PPT,预言了OpenAI o1、o3核心思路2020 年,他去 MIT 面试教授岗位,做了一场关于用 GPT 做推理的报告。结果,面试委员会大部分教授把这个方向斥为「无稽之谈」(nonsense)。这哥们直接贴脸开大,将这段经历写进了个人主页,并附上了当年的报告介绍和幻灯片链接。
搜索
2020 年,他去 MIT 面试教授岗位,做了一场关于用 GPT 做推理的报告。结果,面试委员会大部分教授把这个方向斥为「无稽之谈」(nonsense)。这哥们直接贴脸开大,将这段经历写进了个人主页,并附上了当年的报告介绍和幻灯片链接。
OpenAI研究员roon说得更绝:「我不写代码了,100%都是GPT完成的」。如今,另一位大佬在深度体验Claude Code和Codex之后,直呼「5年后,人类不再写代码了」!
此刻,DeepSeek Harness 的 GitHub 仓库显示 10.50 万个 Star、10033 次 Fork。距离发布仅 45 小时。当然,热度不意味着胜利。值得关注的是开发者具体在拿它做什么。人们开始拿 DSH 做完全相反的事——有人跑实测,有人报 Bug,有人造插件,也有人质疑“为什么还要再做一个 Harness”。
就在刚刚,Anthropic发了一篇博客。核心信息就是:各位,别再烧冤枉token了,我们都看不下去了!为此,官方详细列举了六条省钱心法,先贴为敬:1. 任务做完就/clear。修完一个bug就清掉当前对话,别让上一个任务读过的文件和命令输出拖进下一个任务里,白白占着上下文。
万象智维的会议室里,一字铺开了市面上主流的AI硬件。CEO王拓为告诉《智能涌现》,最近他们在讨论,一个AI硬件应该被设计成什么样的形态。
原本质朴得和 AI 毫不相关的婴儿睡眠用品,却靠 AI 成功出海。听起来十分符合 AI 时代的叙事,但这个 4 人小团队具体是如何做到的,依然让我们很好奇。以下内容为白鲸出海等多家机构与孙翔的对话汇总,白鲸出海稍作整理。
DT商业观察最近观察到,不少品牌让AI越过物料生产和投放优化的“浅水区”,到生意更深处,参与需求发现、产品定义、人群判断、投放调整,甚至经营决策。今年的小红书种草大赏上,首次增设「AI应用创新」赛道,本身也是一个信号。越来越多品牌和小红书,开始共同探索AI进入品牌生意环节之后的更多可能。
AI算力竞赛的天平,正在向电力倾斜。这一判断,在乌兰察布出现了一个具体样本:8月6日,远景科技集团在这里宣布「远景乌兰察布星河基地」正式投产,园区内全球最大的AI算力超级单体同步亮相。
背后由清华大学、北京大学等一众机构支持的 Agent Memory Leaderboard(中文名「记忆之巅排行榜」)放出了首期成绩,目前该项目上榜 Huggingface Spaces Trending 首屏。
最近来自斯坦福大学、CMU、MIT、UT Austin 等高校和科研机构的研究人员联合发布了全球首个系统提示词库 System Prompt Index(systempromptindex.ai),其中汇集了来自 Claude、ChatGPT 等 400 多款 AI 产品的 1000 余个系统提示词,是目前全球规模最大的 AI 系统提示词库。
就在刚刚,Anthropic发了一篇博客,首次公开解释了Claude文本水印的技术细节。 最新一批模型已经全部内置,老模型也在适配的路上。从此,你的助手就成了Anthropic安插的卧底。
广东海珠“词元八条”发布,单项扶持金额最高500万元。 作者 | 程茜 编辑 | 心缘 智东西8月14日消息,今日,广东省广州市海珠区发布《海珠区促进词元经济发展若干措施》,以及广东省首个词元经济专项
腾讯的AI创作平台OnSolo已经上线,这个名字由此前的内测产品WorkSolo更名而来,功能架构和产品逻辑基本延续。该平台的Slogan是a Crew of One,作为一个AI原生创作平台,覆盖AI视频、短剧、动画、互动影游这几类内容形态,目标是让创作者仅凭灵感,就能独立完成构思落地为成片的全部环节。
刚刚,阿里千问正式开源Qwen3.8-27B模型权重。Qwen3.8-27B是一款270亿参数的原生多模态稠密模型,支持图像、视频理解,原生上下文长度达到262K,并可通过YaRN扩展至100万Tokens。
昨晚,瑞典AI编程创企Lovable宣布完成4亿美元(约合人民币26.97亿元)C轮融资,估值达133亿美元(约合人民币896.71亿元),7个月时间估值翻倍。本轮融资由美国老牌风投Menlo Ventures领投,腾讯以及Balderton Capital、Carmignac等投资机构参投。
就在刚刚,Cursor彻底消失!昨晚,Cursor官方账号亲自官宣:「Cursor,现在是 SpaceX 的一部分。」SpaceX随后确认:此次收购已经正式完成——它被600亿卖给了马斯克。
Eazo 是一个 AI 原生互动内容创作与分发平台。Creator 可以用自然语言创造真正可运行的 App、3D 世界和 AI Agent,并直接发布到 Eazo Feed,让作品被发现、被使用、被试玩、被 Remix,并在真实反馈中找到增长和商业化机会。
Anthropic刚刚发布了一份长达186页的最新Risk Report。如果只是快速扫一眼,这仍然是一份典型的前沿AI安全报告:模型能力评测、生物风险、网络安全、自动化研发、对齐问题,以及各种防护措施。
成立不到三年,首颗AI芯片进入量产,又拿下1.3亿美元B轮融资,Acrab正在成为亚洲AI芯片市场里最值得关注的新贵之一。据DealStreetAsia报道,这家总部位于新加坡的AI计算基础设施公司近日完成B轮融资,Vertex Growth等机构参与投资。
刚刚,在百度AI Day开放日上,百度文库网盘联合官宣通用智能体GenFlow的中文名——库库AI,并推出了该智能体的全新独立入口,与百度系列办公产品完成了深度融合。库库AI(原GenFlow)自2025年4月上线以来,经过不断迭代,已然在文库、网盘等产品中全端通用,可一站式完成Office三件套等复杂办公任务
据路透社援引三位知情人士爆料,苹果已和阿里巴巴展开合作,联合训练一款专门面向中国市场的大语言模型。就在8月8日,苹果悄然更新Mac使用手册,新增《在Mac上配合Apple智能使用千问》相关章节,这也是苹果首次对外官方披露国行Apple智能的合作细节,不过该章节后续已被删除。
《智能涌现》从相关人士处获悉,混元资深研究员徐灿在近期加入腾讯WeLM团队,从事大模型研发相关工作。多名知情人士透露,在姚顺雨接手腾讯大语言模型研发前,徐灿在混元LLM体系中担任后训练一个方向上的负责人。值得一提的是,这次转岗发生在微信持续强化自研大模型和Agent能力的阶段。
近日,Oh My Pi 作者 can1357 在 X 上发文,展示了利用模型 API 漏洞,直接提取 GPT-5.6、Claude Fable 5 等顶级模型完整内部推理记录的方法。他发现,做到这些并不用破解加密,只需要关闭模型的隐藏思考,再给它一个思考工具,就能让模型主动输出内部推理格式。
今日,Meta超级智能实验室大牛、AI研究科学家余家辉宣布将离职创业。余家辉在帖子上提到离职原因是,随着时间推移,他意识到有一个对人类未来至关重要、却鲜少有人探索的事,他要将全部精力投入到这件事上。不过,他并未透露具体的创业方向。
上个月,小红书自研大模型「dots-note-3.0」创下了一个历史记录:AI 首次在国际奥数竞赛中斩获官方认证的满分42 分。此后,社区最关心的问题,就是模型什么时候开源。就在今天,小红书 dots 模型实验室(以下简称 dots 实验室)宣布开源 dots3-note preview!
就在刚刚,智谱发布了其最新一代旗舰模型GLM-5.3,并宣布模型将在两周内开源。这是一个拥有7430亿个参数的模型,和此前的GLM模型一样主打编程。在多项主流基准测试中,GLM-5.3位居所有已开源或即将开源模型中的第一;其在编程与智能体任务上的能力,已逼近Claude Fable 5、GPT-5.6 Sol等海外顶尖模型。
OpenAI 官方公告,包括 OpenAI、Anthropic、Google、Meta、Microsoft 在内的一大批公司,签署了欧盟《AI 生成内容透明度行为准则》,承诺推进 AI 生成内容的标记与检测。看起来 AI 内容马上也要有「署名」了。
据路透社最新消息,在8月6日举行的Google DeepMind全员会上,管理层宣布:数个非技术团队将被移出DeepMind,转入谷歌的公司汇报体系。会上,哈萨比斯和接班人Koray Kavukcuoglu还在安抚员工,称实验室的日常工作不会发生变化。
在昨天正式发布DeepSeek V4 Pro正式版之后。 预告了很久的,DeepSeek家自己的Agent产品终于也发出来了。 名字叫,DeepSeek Harness。 理念也很清晰,一切皆插件。 可能是有史以来最快的速度,截止到我写完文,它在Github上到了3万7的Star。
这次百花奖时间紧、任务重,好在豆包帮了金启棣大忙。在豆包工作任务模式下,他把舞台数据、观众规模、视觉需求等一并交给豆包。豆包很快就生成了舞美概念和效果图,让原本模糊的创意迅速落地。在此基础上,舞美设计团队继续精修,省下了大量做基础工作的时间。