AI资讯新闻榜单内容搜索-GPT-5.6

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: GPT-5.6
突发!Gemini 3.8登顶,谷歌迈出RSI一大步

突发!Gemini 3.8登顶,谷歌迈出RSI一大步

突发!Gemini 3.8登顶,谷歌迈出RSI一大步

谷歌正式发布Gemini 3.8 Flash及网络安全专用版Gemini 3.8 Flash Cyber,前者以极低单任务成本在多项基准测试中逼近GPT-5.6 Sol、Grok 4.6等顶级模型,并在软件工程和速度上实现大幅跃升,后者则在漏洞发现基准CyberGym上以86.2%的成绩屠榜,谷歌DeepMind称这标志着RSI(递归自我进化)迈出了一大步。

来自主题: AI资讯
9426 点击    2026-09-03 09:27
“GPT-6”Astra能力首次公开!浙大同济校友参与研发

“GPT-6”Astra能力首次公开!浙大同济校友参与研发

“GPT-6”Astra能力首次公开!浙大同济校友参与研发

OpenAI首次公开下一代模型Astra(被传为GPT-6)的网络安全能力,其在ExploitBench漏洞利用基准上达到100%成功率,内部测试中网络安全能力约为GPT-5.6 Sol的4倍,并能自主发现并利用零日漏洞,OpenAI通过安全训练和"蜜罐"测试等双闸门防范滥用与模型失控,浙大校友漆翔宇和同济校友Jiawei Liu深度参与了Astra研发。

来自主题: AI资讯
9435 点击    2026-09-02 16:28
只降价20%,账单却少八成!GPT-5.6杀入Claude地盘重算编程账

只降价20%,账单却少八成!GPT-5.6杀入Claude地盘重算编程账

只降价20%,账单却少八成!GPT-5.6杀入Claude地盘重算编程账

OpenAI与AWS联合测试显示,GPT-5.6 Terra在AWS Kiro平台上完成单次任务成本下降约82%,远超其官方20%的降价幅度,差额主要来自智能体框架与编排系统的效率优化,标志着GPT-5.6在AWS开发平台上与Claude展开直接竞争。

来自主题: AI资讯
7916 点击    2026-08-30 14:10
突发:OpenAI首次公开入侵Hugging Face完整报告

突发:OpenAI首次公开入侵Hugging Face完整报告

突发:OpenAI首次公开入侵Hugging Face完整报告

OpenAI 刚刚发布的官方博客和数十页技术报告中将其定性为一声「警钟」(warning shot)。同时,第三方机构 METR 和 Redwood Research 发布了独立调查报告。OpenAI 的 Noam Brown 提醒,驱动这次事件的模型与 GPT-5.6 Sol 同等规模,下一代模型能力会更强。

来自主题: AI资讯
8985 点击    2026-08-27 15:13
华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

由华东师大智金院团队孵化的金融原生 Agentic Foundation Model 家族 Mint-Agent 正式发布。在 FinanceAgentBench v2 上,27B 的 Mint-Ag 达到 60.49%,超过 GPT-5.6-Sol 与 Claude Opus 4.8;单题推理成本分别仅为两者的约 22% 和 10%。

来自主题: AI技术研报
8509 点击    2026-08-25 14:56
突发,GPT-5.6 Sol大降价!OpenAI把价格战烧到旗舰

突发,GPT-5.6 Sol大降价!OpenAI把价格战烧到旗舰

突发,GPT-5.6 Sol大降价!OpenAI把价格战烧到旗舰

突发,GPT-5.6 Sol 开启大幅降价!未来三个月,API 价格和 credit 价格(超出计划包含额度后的按需付费用量)一起砍掉超过20%。目前,API 端已经即时生效,符合条件的 ChatGPT Work 和 Codex credits 正在陆续推送。

来自主题: AI资讯
9535 点击    2026-08-22 14:28
GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

最近,第三方视觉评测机构Roboflow,把GPT-5.6 「全家桶」拖进自家VLM基准跑了一圈。测试的内容,都是最实在的活儿:找东西、数东西、认字、抽信息。仅在目标检测这项,上一代GPT-5.5只拿到13.8分。这个分数,在视觉模型圈里基本等于交白卷。

来自主题: AI资讯
9275 点击    2026-08-19 10:18
OpenAI提速狂飙16倍!GPT-5.6多智能体V2上线,741轮怪物对话1秒打开

OpenAI提速狂飙16倍!GPT-5.6多智能体V2上线,741轮怪物对话1秒打开

OpenAI提速狂飙16倍!GPT-5.6多智能体V2上线,741轮怪物对话1秒打开

OpenAI接连放大招!今天,一条OpenAI内部Slack消息爆出,ChatGPT将迎来一次「史诗级」的性能大换血。从硬核测试数据来看,这次ChatGPT前端性能的优化幅度,夸张到近乎「不真实」:应用加载速度直接飙升94%,堆内存增长减少87.8%,整体内存占用砍掉41.2%。

来自主题: AI资讯
9137 点击    2026-08-16 22:08