千问AI平台升级全栈服务,覆盖MaaS、Agent服务、行业AI解决方案

红星新闻 2026-09-23 23:23

9月22日,在2026云栖大会MaaS & Agent技术主论坛上,阿里巴巴集团战略副总裁、ATH事业群MaaS业务线总裁文征宣布千问AI平台全面升级:以推动Agent进入生产作为建设核心,在模型服务基础上新增对Agent服务、行业AI解决方案的支持,并推出了API优速模式、Agent Studio、千问AI座舱解决方案等一系列能力,帮助企业将智能转化为生产力。

从消耗Token到交付结果,AI价值的衡量方式正在改变

文征表示,AI仍处于非常早期的阶段,用户覆盖、场景渗透和算力规模均有巨大增长空间。持续增长的Token用量说明,AI需求已不再是一道需要证明的题,关键在于谁能将智能转化为结果。单任务价值、Token生产效率和单Token能力,共同决定“智能价值密度”。

过去一年,阿里云MaaS平台服务的客户数增长六倍。随着订单、代码、内容和业务流程主动发起调用,Agent开始进入企业核心流程,企业需要的不再只是一个模型API,而是一套覆盖模型供给、生产运行、Agent构建与托管的完整体系。智能正在从被调用走向被交付。

需求的持续放大,对算力和基础设施提出了更高要求。阿里将坚定投入全栈AI,预计到2032年,阿里云运营的算力规模将超过20GW,支撑从芯片、AI基础设施,到千问大模型、模型服务、Agent工具和AI原生应用的完整AI体系,加速Agent时代的产业进化。

面向Agent负载持续完善模型服务

在模型供给方面,千问AI平台以“First and Best”原则,支持全球一流的自研和开放模型第一时间上线。针对Agent决策链路长、并发高、对时延敏感等特点,平台通过FlashBoot、UniScheduler等能力调度异构算力,将模型弹性启动时间由1200秒缩短至70秒,可在1分钟内拉起1万个Pods;首Token延迟降低38%,Prompt Caching成本最高节省95%。

平台提供99.9%生产级SLA、十亿级单客户峰值TPM和CMaaS机密推理服务,支持监控、告警和成本治理。本次升级的API优速模式可将TPS提升1.5至2倍,用户切换model ID即可使用;吞吐预留(PTU)新增夜间8小时预留规格;独占吞吐(DTU)则面向大型企业及金融、政企客户,支持定制模型部署与性能定制。

Agent Studio发布,提供企业级全栈Agent服务

从模型调用到业务结果,Agen需要模型匹配、任务运行、上下文接入和服务调用等基础能力。千问AI平台正式发布企业级全栈Agent服务平台Agent Studio,可根据任务自动路由选择模型,提供24小时不间断托管运行,并支持企业内部知识数据和外部软件服务接入。

在Agent开发运行方面,平台提供原子API,50多个原子API覆盖运行环境、长期记忆、工具服务、会话请求和服务端点部署等能力,企业可按需组合并接入自身业务;全新的Agent API即将发布,可将环境、记忆、工具、部署等需逐项调用的配置,一次请求全部搞定。

Agent Studio还将推出Agent自进化引擎,包含运行观测、AI评测器、AI优化器和自动验证等能力,支持在上下文交互中持续调优与进化。

在应用和行业侧,千问AI平台通过自身产品实践持续验证技术和体验,并将沉淀能力向生态开放。

红星新闻记者 胡沛

编辑 李星龙