企业Agent若「又贵又慢」,再聪明也进不了日活工单。千问办公把刚发布的Qwen3.8-Flash做成办公专属版本,并推出标准模式,声称真实办公场景里单任务生成速度约提升100%、Token消耗平均约减少75%。对办公采购而言,验收项从「能不能写」换成「同样积分能跑多少份纪要、多少张表」。
千问办公是阿里通义千问体系下的办公Agent产品,面向纪要、调研、表格、方案等生产力场景。8月26日晚,产品首发上线Qwen3.8-Flash,并同步推出标准模式;即日起用户可通过标准模式体验该模型。公开材料称,未来模型供给将收敛为标准与高级两种:约95%日常任务走标准模式,约5%复杂任务走高级模式——这是在产品层把「默认够用」和「偶尔顶配」分开定价,避免所有工单都按旗舰模型计费。
产品与协同优化要点:
所谓标准模式,白话是把「够用且便宜」的默认档位产品化,而不是永远让用户在旗舰价上点餐。所谓Harness,白话是围绕工具调用、权限、上下文压缩与失败回退的运行时骨架——Agent不是裸模型,而是模型加上「怎么拆任务、怎么调飞书/表格、怎么少烧Token」的工程层。所谓上下文压缩,白话是在长文档场景里只把与当前步骤相关的片段送进模型,而不是每次把整本PDF全文重读一遍。
国内办公Agent近月密集发布:字节「豆包工作」强调与飞书打通,千问办公则绑在通义生态。两者都在回答同一题——企业IM里沉淀的会议纪要、表格与审批链路,能不能变成Agent的默认燃料。千问办公选择用「标准模式」把成本预期写进产品名,是在赌大多数工单不需要每次调用最强模型;复杂法务审阅、跨部门长链推理才应触发高级模式。
产业观察上,办公Agent竞争正从「会不会写」滑向「同样预算能跑多少工单」。积分与Token若可预期,CIO才敢把周报流水线、竞品扫描、活动复盘交给默认模式。可以把它想成:高级模式是应急车道,标准模式才是早高峰主路。对采购方,应抽检同题多轮改写的积分消耗、长文档压缩后的事实保留率,以及高级模式触发条件是否透明、是否可审计。
需要把边界读清楚。速度与Token降幅来自厂商真实场景测试自述;与外部闭源模型的对比仍待第三方复现;标准模式在飞书、钉钉等生态外的渗透尚未全面披露。下一观察点是企业私有化部署是否提供同口径效率数据,以及标准/高级切换是否会产生「隐性升档」导致账单超预期。