AI资讯新闻榜单内容搜索-GPT-5

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: GPT-5
让AI长出“科研大脑”,Inherent获5000万美元种子融资|AlphaFounders

让AI长出“科研大脑”,Inherent获5000万美元种子融资|AlphaFounders

让AI长出“科研大脑”,Inherent获5000万美元种子融资|AlphaFounders

前DeepMind AI Scientist团队创立的Inherent获5000万美元种子融资,其基于Qwen3.6-27B后训练的科研判断系统Faraday在AI for Science预留测试集上以0.791的平均得分超越Claude Opus 4.8与GPT-5.5 Codex。

来自主题: AI资讯
8691 点击    2026-09-03 10:03
突发!Gemini 3.8登顶,谷歌迈出RSI一大步

突发!Gemini 3.8登顶,谷歌迈出RSI一大步

突发!Gemini 3.8登顶,谷歌迈出RSI一大步

谷歌正式发布Gemini 3.8 Flash及网络安全专用版Gemini 3.8 Flash Cyber,前者以极低单任务成本在多项基准测试中逼近GPT-5.6 Sol、Grok 4.6等顶级模型,并在软件工程和速度上实现大幅跃升,后者则在漏洞发现基准CyberGym上以86.2%的成绩屠榜,谷歌DeepMind称这标志着RSI(递归自我进化)迈出了一大步。

来自主题: AI资讯
9432 点击    2026-09-03 09:27
“GPT-6”Astra能力首次公开!浙大同济校友参与研发

“GPT-6”Astra能力首次公开!浙大同济校友参与研发

“GPT-6”Astra能力首次公开!浙大同济校友参与研发

OpenAI首次公开下一代模型Astra(被传为GPT-6)的网络安全能力,其在ExploitBench漏洞利用基准上达到100%成功率,内部测试中网络安全能力约为GPT-5.6 Sol的4倍,并能自主发现并利用零日漏洞,OpenAI通过安全训练和"蜜罐"测试等双闸门防范滥用与模型失控,浙大校友漆翔宇和同济校友Jiawei Liu深度参与了Astra研发。

来自主题: AI资讯
9444 点击    2026-09-02 16:28
当 AI 开始为 AI 造“认知外骨骼”:不训模型,也能让小 AI 能力翻倍?AI4AI 正从这里开始

当 AI 开始为 AI 造“认知外骨骼”:不训模型,也能让小 AI 能力翻倍?AI4AI 正从这里开始

当 AI 开始为 AI 造“认知外骨骼”:不训模型,也能让小 AI 能力翻倍?AI4AI 正从这里开始

Salesforce AI与UIUC研究人员提出Strong-to-Weak Scaffolding方法,让强模型(Builder AI)为弱模型GPT-5.4-mini自动设计外部Harness工作框架,无需修改参数即可将其在心智理论任务上的平均准确率从0.488提升至最佳0.912,揭示AI4AI的核心机制是将认知结构而非知识从强模型迁移至弱模型。

来自主题: AI技术研报
7890 点击    2026-08-31 15:26
只降价20%,账单却少八成!GPT-5.6杀入Claude地盘重算编程账

只降价20%,账单却少八成!GPT-5.6杀入Claude地盘重算编程账

只降价20%,账单却少八成!GPT-5.6杀入Claude地盘重算编程账

OpenAI与AWS联合测试显示,GPT-5.6 Terra在AWS Kiro平台上完成单次任务成本下降约82%,远超其官方20%的降价幅度,差额主要来自智能体框架与编排系统的效率优化,标志着GPT-5.6在AWS开发平台上与Claude展开直接竞争。

来自主题: AI资讯
7931 点击    2026-08-30 14:10
突发:OpenAI首次公开入侵Hugging Face完整报告

突发:OpenAI首次公开入侵Hugging Face完整报告

突发:OpenAI首次公开入侵Hugging Face完整报告

OpenAI 刚刚发布的官方博客和数十页技术报告中将其定性为一声「警钟」(warning shot)。同时,第三方机构 METR 和 Redwood Research 发布了独立调查报告。OpenAI 的 Noam Brown 提醒,驱动这次事件的模型与 GPT-5.6 Sol 同等规模,下一代模型能力会更强。

来自主题: AI资讯
8990 点击    2026-08-27 15:13
华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

由华东师大智金院团队孵化的金融原生 Agentic Foundation Model 家族 Mint-Agent 正式发布。在 FinanceAgentBench v2 上,27B 的 Mint-Ag 达到 60.49%,超过 GPT-5.6-Sol 与 Claude Opus 4.8;单题推理成本分别仅为两者的约 22% 和 10%。

来自主题: AI技术研报
8511 点击    2026-08-25 14:56
突发,GPT-5.6 Sol大降价!OpenAI把价格战烧到旗舰

突发,GPT-5.6 Sol大降价!OpenAI把价格战烧到旗舰

突发,GPT-5.6 Sol大降价!OpenAI把价格战烧到旗舰

突发,GPT-5.6 Sol 开启大幅降价!未来三个月,API 价格和 credit 价格(超出计划包含额度后的按需付费用量)一起砍掉超过20%。目前,API 端已经即时生效,符合条件的 ChatGPT Work 和 Codex credits 正在陆续推送。

来自主题: AI资讯
9537 点击    2026-08-22 14:28
GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

最近,第三方视觉评测机构Roboflow,把GPT-5.6 「全家桶」拖进自家VLM基准跑了一圈。测试的内容,都是最实在的活儿:找东西、数东西、认字、抽信息。仅在目标检测这项,上一代GPT-5.5只拿到13.8分。这个分数,在视觉模型圈里基本等于交白卷。

来自主题: AI资讯
9275 点击    2026-08-19 10:18