news_article.exe
📰
#Claude#开源#大模型#多模态

千问办公首发上线Qwen3.8-Flash,生成速度提升100%,Token消耗减少75%

2026年8月27日1 次浏览来源:量子位 阅读原文

8月26日晚,千问办公首发上线刚刚发布的Qwen3.8-Flash模型,同时推出标准模式。

千问办公首发上线Qwen3.8-Flash,生成速度提升100%,Token消耗减少75% 量子位

千问办公首发上线Qwen3.8-Flash,生成速度提升100%,Token消耗减少75%

8月26日晚,千问办公首发上线刚刚发布的Qwen3.8-Flash模型,同时推出标准模式。

8月26日晚,千问办公首发上线刚刚发布的Qwen3.8-Flash模型,同时推出标准模式。即日起,所有用户可通过全新的标准模式体验Qwen3.8-Flash。基于最新的模型,用户可以用更少的积分消耗、更快的Token吞吐速度完成任务。未来,千问办公的模型供给将只有标准和高级两种模式,95%的日常任务通过千问办公标准模式即可完成,仅5%的复杂任务需要使用高级模式。

用户体验的提升来自模型升级与Agent协同优化。全新架构的Qwen3.8-Flash以千亿级总参数实现了超越Claude Opus 4.6的性能。同时,千问大模型团队与千问办公团队还联合推出了办公专属版本Qwen3.8-Flash,针对多步规划、工具选择、上下文压缩等场景进行专项训练调优,并通过推理优化和定制Harness架构进一步实现吞吐效率提升。在真实办公场景测试中,千问办公标准模式的单任务生成速度提升约100%,Token消耗平均减少75%。

在真实AI应用场景,高性能通常意味着高成本和高延迟,低成本则需要以牺牲智能为代价。Agent与模型的深度协同优化,正在打破性能、成本和速度的“不可能三角”。随着模型智能密度的持续提升,以及千问办公与模型的双向优化,Agent即将告别Token焦虑,迎来“量大管饱”时代。

基元律动累计融资数千万美元,推出“中国版OpenRouter”2026-08-27

Falcon TST 2.0获世界权威测评第一名,推动时间序列基础模型从通用预测走向金融应用2026-08-26

达卯科技与福建智算方舟达成合作,全栈式算电协同服务在闽落子2026-08-26

实测拿215项SOTA的Qwen3.5-Omni:摄像头一开,AI给我现场讲论文、撸代码

Qwen3.7-Plus上线!多模态智能体新基座,一键复刻桌面端专业软件

匿名牛来大模型被扒出智谱血缘,也有人怀疑Cursor拿开源GLM训的

英伟达AI服务器将涨价15%!1GW数据中心成本激增50亿美元

量子位 QbitAI 版权所有©北京极客伙伴科技有限公司 京ICP备17005886号-1

> 分享: