资讯
阿里千问办公上线 Qwen3.8-Flash 及标准模式:单任务生成速度提升约 100%,Token 消耗平均减少 75%
📌 概要
<p>IT之家 8 月 27 日消息,今天,阿里旗下千问办公首发上线刚刚发布的 Qwen3.8-Flash 模型,同时推出标准模式。</p><p>即日起,所有用户可通过全新的标准模式体验 Qwen3.8-Flash<strong>。</strong>基于最新的模型,用户可以用更少的积分消耗、更快的 Token 吞吐速度完成任务。未来,千问办公的模型供给将会有标准和高级两种模式。<strong>95
<p>IT之家 8 月 27 日消息,今天,阿里旗下千问办公首发上线刚刚发布的 Qwen3.8-Flash 模型,同时推出标准模式。</p><p>即日起,所有用户可通过全新的标准模式体验 Qwen3.8-Flash<strong>。</strong>基于最新的模型,用户可以用更少的积分消耗、更快的 Token 吞吐速度完成任务。未来,千问办公的模型供给将会有标准和高级两种模式。<strong>95% 的日常任务通过千问办公标准模式即可完成</strong>,仅 5% 的复杂任务需要使用高级模式。</p><p style="text-align: center;"><img class="no-alt-img" src="https://img.ithome.com/newsuploadfiles/2026/8/03d4b079-e7c1-4d4d-b987-3316bf418fab.png?x-bce-process=image/format,f_auto" /></p><p>IT之家从官方介绍获悉,用户体验的提升来自模型升级与 Agent 协同优化。全新架构的 Qwen3.8-Flash 以千亿级总参数实现了超越 Claude Opus 4.6 的性能。</p><p>同时,千问大模型团队与千问办公团队还联合推出了办公专属版本 Qwen3.8-Flash,针对<strong>多步规划、工具选择、上下文压缩等场景</strong>进行专项训练调优,并通过推理优化和定制 <span>Harness</span> 架构进一步实现吞吐效率提升。</p><p>在真实办公场景测试中,千问办公标准模式的单任务生成速度提升约 100%,<strong>Token 消耗平均减少 75%</strong>。</p><p>在真实 AI 应用场景,高性能通常意味着高成本和高延迟,低成本则需要以牺牲智能为代价。Agent 与模型的深度协同优化,正在打破性能、成本和速度的“不可能三角”。官方宣称,Agent 即将告别 Token 焦虑,迎来“量大管饱”时代。</p>