Codex「额度黑洞」终于查清!真凶竟是这个小功能
Codex「额度黑洞」终于查清!真凶竟是这个小功能折腾了整整一周,Codex「额度消耗过快」的悬案终于告破。
搜索
折腾了整整一周,Codex「额度消耗过快」的悬案终于告破。
2024 年,Boris Cherny 加入 Anthropic 时,AI 编程产品大多还停留在代码补全和对话问答阶段。模型已经能够写出完整的函数和文件,但产品通常只允许它在编辑器里提出建议,很少真正赋予它读取代码库、修改文件和调用终端的能力。
本周五,AI 社区热烈讨论的是一个端侧大模型部署技术,它能让笔记本 RTX 4060 跑 Qwen 3.6-35B,桌面 RTX 5090 跑得起 DeepSeek-V4-Flash 284B。而且都是单卡,模型都是满血的。Codex 生产 trace 的中位 decode 速度是 33 token/s
突发,GPT-5.6 Sol 开启大幅降价!未来三个月,API 价格和 credit 价格(超出计划包含额度后的按需付费用量)一起砍掉超过20%。目前,API 端已经即时生效,符合条件的 ChatGPT Work 和 Codex credits 正在陆续推送。
学不过来,刚刚学会怎么用好 Codex,现在又来了个 DeepSeek Harness。 过去几天,我们已经介绍过它的插件、各种新玩法和新上线的多模态,但还有一个最基础的问题没有解决:DeepSeek
DeepSeek Harness 是 DeepSeek 官方最新开源的 AI Agent 运行环境,简称 DSH。你可以把它理解成一个高度可定制的 AI 编程工具,对标 Claude Code 和 Codex,核心理念是「一切皆插件」。本期我就来带大家鉴赏一大波 DeepSeek Harness 热门插件,有实用的、也有好看的。
就在昨天,OpenAI又完成一次升级。
用户让 AI 编程助手写个贪吃蛇小游戏,智能体照办了,但同时多跑了一条 curl | bash 命令,把攻击者的脚本下载到本地并执行。
当一个视频模型和 Seedance 2.5 同一天发布,似乎大概率要成炮灰,但 MiniMax H3 却成了一个例外。而现在 MiniMax 也开始把这种模型的能力,放到了具体的产品上,正式推出了 MiniMax Design,进一步把 H3 视频模型的能力放大,同时也让我们少折腾一些,可以更高效地制作各种商业化内容。
最近,一个神级工具,震撼了硅谷。