实测比DeepSeek便宜的Qwen 3.8 Flash,卷飞了
实测比DeepSeek便宜的Qwen 3.8 Flash,卷飞了阿里千问新模型,又卷出了新水平。
搜索
阿里千问新模型,又卷出了新水平。
最近我在琢磨用 AI 做带货视频。
谷歌发布语音转文本模型Gemini 3.5 Transcribe,支持85种以上语言、流式转录与智能整理功能,流式词错误率为4.0%,文章认为该模型并非Agent时代的落伍产品,而是语音Agent走向生产环境所必需的关键基础拼图。
先说一个数字:177%。 这是Moderna的股价在8月19号一天之内的涨幅——一家250亿美金市值的公司,一夜之间变成了690亿。华尔街为什么疯狂?因为Moderna与Merck共同研发的个性化mR
OpenClaw数月内GitHub Star飙至38万成现象级爆款,但因Token消耗与安全风险被Claude Code、Codex等Harness取代而迅速降温,国内已涌现30余款衍生产品,创始人Peter Steinberger已加入OpenAI研发下一代Agent。
Ornith-1.5采用模型自出题、自搭脚手架、自跑轨迹的三段式强化学习闭环,在Terminal-Bench 2.1自测中以86.1分超过其自测的Claude Opus 4.8(85.0分),较两个月前的1.0版本提升约11%。
OpenAI与AWS联合测试显示,GPT-5.6 Terra在AWS Kiro平台上完成单次任务成本下降约82%,远超其官方20%的降价幅度,差额主要来自智能体框架与编排系统的效率优化,标志着GPT-5.6在AWS开发平台上与Claude展开直接竞争。
Perplexity推出本地优先智能体Portable Computer,通过专为端侧模型设计的Harness配合Qwen3.8-27B实现近零成本的本地推理,并在多项基准测试中超越Hermes和Pi等开源通用框架。
OpenAI于8月26日向所有免费用户开放ChatGPT侧栏的定时任务功能,使其覆盖9亿周活用户中的九成以上,免费版可设3个任务并支持一次性提醒、周期性任务和监测型任务三类场景,同期仅为Plus及以上付费用户上线接入Gmail、Slack和GitHub的事件触发能力。
Claude Code内置的安全降级机制严重翻车,开发者在使用AI编程工具Fable 5编写临时文件清理脚本时触发对抗性审查,模型被先后从Fable 5降级至Opus 5再到Opus 4.8,最终因变量复用错误导致Opus 4.8误删开发者Guillemot的整个主目录,700GB数据丢失。