中国电信|TeleAgent在IDC企业级通用Agent评估中综合第三

PromptTree|阅读 1
2026/09/18 07:19
中国电信TeleAgentIDC企业Agent
IDC发布《中国企业级通用Agent产品技术评估》,电信TeleAgent综合约6.85分列参评第三;任务表现获5分最高档,近百道非公开办公任务统一实测;公司称用户约118万、Skill达数万。

企业买通用智能体,真正怕的不是不会聊天,而是「开箱之后,脏数据、模糊指令、权限约束一上来就翻车」。近日国际数据公司(IDC)发布《中国企业级通用Agent产品技术评估》,用统一仿真环境给国内约11款主流及开源通用Agent做闭环实测;中国电信旗下TeleAgent(星辰超级智能体)综合得分约6.85分,位列参评第三。

TeleAgent由中电信人工智能科技有限公司研发,定位依托中国电信星辰大模型与国产智算底座的AI原生办公智能体,强调任务拆解、工具调用与结果交付,而不是停在对话窗。产品约在2026年中对外推出;公司侧披露注册用户已突破约118万,Skill数量从数千扩展至数万量级,并称属首批通过相关安全评测的智能体产品之一。

评测与产品要点(报告及公司口径):

  1. 综合:约6.85分,参评综合第三
  2. 任务表现:获5分最高档;常规任务约3.49分、复杂任务约3.36分等分项叙述
  3. 方法:统一模型基线、统一仿真工具与数据;「开箱即测、无提示词优化、失败后不追加人工指令」
  4. 任务:统一MCP仿真环境近百道非公开办公题
  5. 维度:任务表现、成本效率、交互体验、多智能体编排、记忆与工作空间、可观测、安全可控、工具与技能、生态与开放性等九项
  6. 安全叙事:信通院等相关测评通过;内部/联合场景通过率给出高分口径

所谓企业级通用Agent,白话是能在真实办公栈里把邮件、表格、浏览器、长文档等多步骤活干完,而不是只答百科。所谓MCP仿真,白话是用标准工具插头搭一套可控考场,让各家在同一规则下被考。所谓开箱即测,白话是不给厂商赛前调提示词、失败后也不允许人工补刀——更接近采购方第一天的真实体验。

放在国内Agent选型升温的上下文里,IDC此轮把讨论从模型Arena分数,推进到交付闭环与成本效率。竞品若只有演示PPT、给不出统一协议下的任务完成率,采购文本会更虚;若只有高分、缺安全与可观测分项,政企侧也会犹豫。

产业影响上,若后续有更多可引用的私有化案例,会加速「通用Agent进央企办公」;若长期只有榜单第三、复杂跨系统对接仍失败,市场会回到可复核交付物。需要把边界读清楚:名次属特定参评集合;用户与Skill数为公司披露;安全通过率绑定具体测评。下一观察点是企业版落地合同与跨系统任务成功率。