AI资讯新闻榜单内容搜索-token

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: token
单卡5090跑满血DeepSeek V4Flash,已开源,Token自由了!

单卡5090跑满血DeepSeek V4Flash,已开源,Token自由了!

单卡5090跑满血DeepSeek V4Flash,已开源,Token自由了!

本周五,AI 社区热烈讨论的是一个端侧大模型部署技术,它能让笔记本 RTX 4060 跑 Qwen 3.6-35B,桌面 RTX 5090 跑得起 DeepSeek-V4-Flash 284B。而且都是单卡,模型都是满血的。Codex 生产 trace 的中位 decode 速度是 33 token/s

来自主题: AI资讯
10314 点击    2026-08-23 00:27
Token经济转点:OpenClaw、Hermes到本地自研的Agent进化之路

Token经济转点:OpenClaw、Hermes到本地自研的Agent进化之路

Token经济转点:OpenClaw、Hermes到本地自研的Agent进化之路

这期节目的嘉宾黄东旭,就是Token Maxing热潮的亲历者。他曾经只用最前沿的模型,每天账单三四百美元。让他转变的,是前沿模型的智力碾压和中国开源模型们的崛起——Fable 5可以一句话终结Agent群的讨论,同时大量的日常任务可以做到“只烧电费,不烧Token”。他的结论是:不是前沿模型用不起,而是本地开源模型底座+前沿模型的搭配,成本可控,更具性价比。

来自主题: AI资讯
10745 点击    2026-08-22 14:00
解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

视觉 - 语言 - 动作(VLA)模型已成为端到端自动驾驶的主流技术路线,但基于自回归(AR)解码的现有架构面临双重结构性瓶颈:其一,逐 Token 串行生成导致推理延迟随序列长度线性增长,严重制约实时部署;其二,训练阶段依赖真实前缀的 teacher forcing 机制,使模型在推理时暴露于自身生成的误差之上,引发长时序累积的曝光偏差(exposure bias)。

来自主题: AI技术研报
6927 点击    2026-08-19 14:39
最高涨1100%!DeepSeek新定价今日生效

最高涨1100%!DeepSeek新定价今日生效

最高涨1100%!DeepSeek新定价今日生效

今日零时起,DeepSeek正式执行新版API价格,DeepSeek-V4-Flash和DeepSeek-V4-Pro两款主力模型首次采用峰谷定价,闲时价格统一为高峰时段的一半。此次调整同步抬高了两款模型的基础价格。DeepSeek-V4-Flash高峰时段每百万Tokens缓存命中输入、缓存未命中输入和输出价格分别为0.1元、3元和9元,闲时分别降至0.05元、1.5元和4.5元。

来自主题: AI资讯
9840 点击    2026-08-17 14:38
OpenRouter,70亿美元把自己“卖了”

OpenRouter,70亿美元把自己“卖了”

OpenRouter,70亿美元把自己“卖了”

美国当地时间8月16日,Stripe以超过70亿美元的价格收购OpenRouter。

来自主题: AI资讯
7451 点击    2026-08-17 10:52
全球程序员都在给Anthropic白送钱!官方终于看不下去了

全球程序员都在给Anthropic白送钱!官方终于看不下去了

全球程序员都在给Anthropic白送钱!官方终于看不下去了

就在刚刚,Anthropic发了一篇博客。核心信息就是:各位,别再烧冤枉token了,我们都看不下去了!为此,官方详细列举了六条省钱心法,先贴为敬:1. 任务做完就/clear。修完一个bug就清掉当前对话,别让上一个任务读过的文件和命令输出拖进下一个任务里,白白占着上下文。

来自主题: AI资讯
9876 点击    2026-08-16 11:01