通义千问Flash版实测与办公Agent对比引关注

AI 大众点评·

雷锋网实测Qwen3.8-Flash并对比千问办公等三款办公Agent,通义千问在生产力场景持续受关注。

通义千问近期动态:Flash 模型与办公场景成焦点

近期,围绕通义千问(Qwen)的讨论主要集中在模型能力升级与办公场景落地两个方向。根据雷锋网的多篇报道,通义千问在 2026 年 8 月至 9 月期间发布了新版本模型,并参与了办公 Agent 领域的横向对比测试。

Flash 模型定位转向生产力

2026 年 8 月 26 日,通义千问发布 Qwen3.8-Flash-Next 与 Qwen3.8-Flash,同日 Z.AI 发布 GLM-5.3-Flash。雷锋网的实测报道指出,两家官方给出的宣传重点已不再停留在“便宜聊天”上。

  • 千问云对 Qwen3.8-Flash 的定位直指 1M 长上下文、长文档、完整代码库、复杂对话、编程辅助、工作流编排和视觉理解,并强调其能够接入开发者工具。
  • 报道认为,Flash 模型并非只是旗舰模型的低价补位,而是正在进入办公、开发和交付物生成等真实生产力场景的底层基座。

办公 Agent 横向对比中的表现

在另一篇报道中,雷锋网以职场任务为场景,将同一份“脏销售流水”和同一句提示词同时交给 WorkBuddy、千问办公和豆包工作三款办公 Agent。

  • 三家均交付了 Excel、PPT 和摘要,但算出的三个季度总额最高比最低多出 57.7%。
  • 测试还让三者核查五项近期公开信息,并提供了一份实际不存在的内部文件,随后拆开三个 macOS 安装包,观察它们为 Agent 准备的执行环境。

报道未单独给出通义千问的结论性评价,但将其置于办公 Agent 这一产品类别中进行拆解,指出三者“其实不是同一种产品”。

行业背景中的位置

在更广的行业语境中,雷锋网提到 Personal Agent 正成为 AI 产品竞争的热门概念,Meta 的 Muse、OpenAI 的 dots、Manus 的 Cue 等产品相继入场,国内大厂也开始往同一方向布局。此外,在阶跃星辰 Step 5 Preview 的报道中,Qwen 被列为旗舰基模正面比较的对象之一,显示其在基座模型讨论中仍处于参照位置。

综合来看,检索结果中关于通义千问的信息集中于模型发布与办公场景实测,未涉及其消费端对话助手产品的直接更新。

  • 雷锋网:《实测 Qwen-3.8 与 GLM-5.3 的 Flash 版:谁能让我提前下班半小时?》 https://www.leiphone.com/category/yanxishe/Dp2FW4Pb6iLUvdhf.html
  • 雷锋网:《拆解 WorkBuddy、千问办公和豆包工作,它们其实不是同一种产品》 https://www.leiphone.com/category/yanxishe/d4mykzxmMYWWwHNk.html
  • 雷锋网:《Muse爆火,dots入场:Personal Agent开始和互联网平台抢入口》 https://www.leiphone.com/category/yanxishe/Zqcw9XvSO2Ht6FIQ.html
  • 雷锋网:《全球开源前二,阶跃终于回来了》 https://www.leiphone.com/category/yanxishe/LjT1ojuhnJ3pBvu4.html

相关产品

延伸阅读