AI资讯新闻榜单内容搜索-GPT-5

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: GPT-5
神话级Claude 5,登顶了!

神话级Claude 5,登顶了!

神话级Claude 5,登顶了!

发布24小时,神话级Claude 5光速登顶!不仅创下AI史上最大分差纪录,更将GPT-5.5直接斩落马下。

来自主题: AI资讯
10914 点击    2026-06-11 15:26
GPT-5.6首批实测来了!精准狙击Mythos

GPT-5.6首批实测来了!精准狙击Mythos

GPT-5.6首批实测来了!精准狙击Mythos

刚刚,Anthropic放出藏了俩月的大杀器——Claude Fable 5和Mythos 5,无异于扔下一枚炸弹。

来自主题: AI资讯
10687 点击    2026-06-10 16:07
刚刚,Mind Lab开源V1系列模型Preview,749B参数,专为Agent 后训练

刚刚,Mind Lab开源V1系列模型Preview,749B参数,专为Agent 后训练

刚刚,Mind Lab开源V1系列模型Preview,749B参数,专为Agent 后训练

过去一个多月,大模型圈依旧热闹。从 GPT-5.5、DeepSeek V4 到 Claude Opus 4.8,后训练正在成为模型能力提升的关键引擎。

来自主题: AI技术研报
7304 点击    2026-06-08 15:29
Anthropic偷跑代码又秒删,GPT-5.6震撼升级决战Mythos!

Anthropic偷跑代码又秒删,GPT-5.6震撼升级决战Mythos!

Anthropic偷跑代码又秒删,GPT-5.6震撼升级决战Mythos!

GPT-5.6发布候选版本kindle-alpha敲定,前端和视觉能力大幅跃升。与此同时,Claude Mythos 5在API中闪现又秒删。双雄争霸,好戏开始!

来自主题: AI资讯
8204 点击    2026-06-08 10:47
37万次真实会话实测Agent榜单:GPT-5.5High第一,Claude最稳,真实干活能力看这五项核心指标

37万次真实会话实测Agent榜单:GPT-5.5High第一,Claude最稳,真实干活能力看这五项核心指标

37万次真实会话实测Agent榜单:GPT-5.5High第一,Claude最稳,真实干活能力看这五项核心指标

6月4日,Arena.ai发布Agent Arena排行榜,用373,431次真实会话的数据,给18个主流模型的Agent能力排了个座次。先看总榜。Agent Arena的排名依据是“净改进”(Net Improvement),用因果推断方法算出每个模型相对于随机基线的性能提升幅度。正值代表比随机选择更好,负值说明不如随机。

来自主题: AI技术研报
9970 点击    2026-06-07 14:38
OpenAI今晚放大招!奥特曼亲自上阵,GPT-5.6本周反杀

OpenAI今晚放大招!奥特曼亲自上阵,GPT-5.6本周反杀

OpenAI今晚放大招!奥特曼亲自上阵,GPT-5.6本周反杀

刚刚,OpenAI今晚直播预告,奥特曼或现身。明天,OpenAI将于美国东部时间上午举行「Intelligence at Work」直播活动,奥特曼将出席。随后,纳德拉将于美国东部时间下午发表Microsoft Build大会的开幕主题演讲。

来自主题: AI资讯
10039 点击    2026-06-02 16:59
牛津、英伟达等提出记忆压缩新范式:训练时让模型学会断舍离

牛津、英伟达等提出记忆压缩新范式:训练时让模型学会断舍离

牛津、英伟达等提出记忆压缩新范式:训练时让模型学会断舍离

2026 年初,各大 AI 厂商在上下文窗口长度上展开激烈角逐。Google 的 Gemini 3 Pro 已支持 100 万级 token 上下文,Meta 的 Llama 4 Scout 更宣称可处理 1000 万 token。GPT-5 系列也在快速推进长上下文能力。

来自主题: AI技术研报
10483 点击    2026-06-02 11:23
OpenAI官宣退役o3与GPT-4.5!

OpenAI官宣退役o3与GPT-4.5!

OpenAI官宣退役o3与GPT-4.5!

o3被封「GOAT」、GPT-4.5被叫「灵魂写手」,OpenAI说退就退。GPT-5.6已在热身——但「更强」能不能信?OpenAI自己说:未必。

来自主题: AI资讯
9324 点击    2026-05-31 11:45
AI权威清洗: 一张肉眼难辨的图片,就能让GPT-5.4、Claude Opus 4.6集体造谣

AI权威清洗: 一张肉眼难辨的图片,就能让GPT-5.4、Claude Opus 4.6集体造谣

AI权威清洗: 一张肉眼难辨的图片,就能让GPT-5.4、Claude Opus 4.6集体造谣

来自 ETH Zurich 的 Florian Tramèr 团队在最新论文中抛出了一个出乎意料的问题:如果 AI"看到" 的图,根本不是你肉眼看到的那张,会发生什么样的后果呢?他们把这种现象称作 AI 权威清洗(AI Authority Laundering)。

来自主题: AI技术研报
9636 点击    2026-05-31 11:27
Opus 4.8连夜算尽1170亿人命运,一句话敲出人类投胎模拟器!

Opus 4.8连夜算尽1170亿人命运,一句话敲出人类投胎模拟器!

Opus 4.8连夜算尽1170亿人命运,一句话敲出人类投胎模拟器!

你此刻喝的干净水、用的电、看的病,1170亿人里绝大多数做梦都够不着。而算清这串概率的Opus 4.8,前天刚把GPT-5.5踢下全球第一的王座。

来自主题: AI资讯
10902 点击    2026-05-30 15:58