阿里千问平台构建Agent三层服务体系推动产业落地

阿里千问平台构建Agent三层服务体系推动产业落地

财π新闻 据阿里云官微2026年9月23日报道,9月22日在2026云栖大会MaaS & Agent技术主论坛上,阿里巴巴集团战略副总裁、ATH事业群MaaS业务线总裁文征宣布千问AI平台全面升级,本次升级以推动Agent进入生产作为建设核心,在原有模型服务的基础上新增对Agent服务、行业AI解决方案的支持,同步推出API优速模式、Agent Studio、千问AI座舱解决方案等一系列全新能力,帮助企业将智能能力直接转化为实际生产力。

平台核心升级方向聚焦Agent生产落地

本次千问AI平台的全面升级,将核心建设目标锚定在推动Agent进入实际生产环节,打破此前AI服务仅停留在单一模型调用层面的局限,构建起覆盖模型服务、Agent服务、行业AI解决方案的完整三层服务体系。此前企业接入AI能力,大多需要自行完成模型适配、环境搭建、工具对接等一系列复杂工作,技术门槛高、落地周期长,很多场景下模型能力无法直接对接业务需求,导致AI技术难以真正融入企业核心生产流程。本次升级正是针对这一行业普遍痛点,将平台能力从单纯提供模型接口,延伸至Agent全生命周期的开发、运行、托管全链条,让企业无需从零搭建整套Agent运行体系,即可快速将智能能力部署到自身业务场景中。

在本次升级推出的多项核心能力中,API优速模式首先针对高并发场景下的性能瓶颈进行优化,可将平台整体TPS提升1.5至2倍,企业用户仅需切换对应的model ID即可直接启用该能力,无需对原有业务代码进行大规模调整,大幅降低了高并发AI场景的适配成本。对于需要支撑大量用户同时发起AI请求的企业级应用而言,TPS的显著提升意味着相同算力资源下可承载的业务规模直接扩大一倍左右,能够有效应对业务高峰时段的请求压力,避免出现请求排队、响应超时等影响用户体验的问题。

作为本次升级的核心产品之一,Agent Studio是面向企业推出的全栈Agent服务平台,完全围绕企业级Agent的生产级运行需求设计开发。该平台支持根据不同任务的特性自动路由选择最适配的模型,无需开发者手动指定模型类型,大幅提升Agent任务的处理效率与结果准确性。同时平台提供24小时不间断托管运行能力,企业无需自行搭建运维7×24小时的运行服务器集群,即可保障Agent服务始终处于可用状态,避免因服务器宕机、运维人员轮值等问题导致业务中断。

为了进一步降低Agent的开发门槛,Agent Studio内置了覆盖运行环境、长期记忆、工具服务、会话请求和服务端点部署等能力的50多个原子API,企业开发者可以根据自身业务需求按需组合调用这些原子能力,无需从零开始编写底层逻辑,大幅缩短Agent的开发周期。平台还同步推出了Agent自进化引擎,包含运行观测、AI评测器、AI优化器和自动验证等多项能力,支持Agent在实际上下文交互过程中持续自主调优与进化,无需人工反复介入调整参数,即可让Agent的处理能力随着业务运行时长的增加不断提升。此外平台推出的One Key MCP能力,支持使用同一个API Key连接100多项生态服务,覆盖高德、飞猪、1688及金融、法律等各领域的主流服务,平台可自动理解用户需求、寻找对应工具并完成调用,大幅减少开发者逐一注册服务、配置鉴权信息的重复工作。

全栈算力投入支撑长期产业落地

阿里巴巴方面明确表示将坚定投入全栈AI体系建设,预计到2032年,阿里云运营的算力规模将超过20GW,这一规模的算力布局将能够完整支撑从芯片、AI基础设施,到千问大模型、模型服务、Agent工具和AI原生应用的全链路AI体系运行,为整个Agent时代的产业进化提供坚实的算力底座支撑。随着AI应用在各行业的不断渗透,企业对AI服务的并发量、响应速度、运行稳定性的要求持续提升,大规模的算力储备能够有效应对未来持续增长的AI算力需求,避免出现算力供给不足导致的服务能力受限问题。

过去一年时间里,阿里云MaaS平台服务的客户数实现了六倍的增长,这一数据直观反映出国内企业对AI服务的需求正在快速爆发。随着订单处理、代码生成、内容创作和各类业务流程开始主动发起AI调用,Agent已经逐步进入企业的核心业务流程,企业对AI服务的需求也随之发生了根本性转变,不再满足于仅获取一个单一的模型API接口,而是需要一套覆盖模型供给、生产运行、Agent构建与托管的完整服务体系,AI智能的价值正在从过去的被动被调用,转向直接向用户交付可落地的业务结果。

针对Agent负载的特性,千问AI平台的模型供给环节严格遵循First and Best原则,保障全球范围内一流的自研和开放模型都能在第一时间在平台上线,让企业用户可以第一时间使用到最新的模型能力。针对Agent决策链路长、并发高、对时延敏感等特点,平台通过FlashBoot和UniScheduler等核心能力对异构算力进行智能调度,将模型的弹性启动时间从原本的1200秒大幅缩短至70秒,最快可在1分钟内拉起1万个Pods,完全能够应对突发的大规模AI请求扩容需求。同时优化后平台的首Token延迟降低38%,Prompt Caching相关的使用成本最高可以节省95%,在大幅提升响应速度的同时,显著降低了高频调用场景下的使用成本。

除了性能层面的优化,千问AI平台还为企业用户提供了99.9%的生产级SLA保障,支持十亿级单客户峰值TPM,配套CMaaS机密推理服务,同时提供完整的监控、告警和成本治理能力,完全满足金融、政企等对运行稳定性和数据安全性有极高要求的行业客户的使用需求。在吞吐服务模式上,平台还新增了吞吐预留(PTU)的夜间8小时预留规格,为有非高峰时段大规模AI处理需求的企业提供更具性价比的算力选择;独占吞吐(DTU)模式则面向大型企业及金融、政企客户开放,支持定制化的模型部署与性能定制,充分满足不同规模、不同类型企业的差异化使用需求。

Token Plan服务覆盖多类模型实现灵活订阅

本次升级推出的Token Plan服务,以一份统一订阅即可覆盖Qwen、Kimi、GLM、DeepSeek等多类主流大模型,用户无需为不同模型分别购买不同的服务套餐,大幅简化了多模型使用的订阅流程。该服务原生打通了Qoder、Cursor、Codex、OpenClaw等主流编程工具与各类Agent框架,开发者无需进行复杂的适配配置,即可在日常使用的开发工具中直接调用平台的各类模型能力,大幅提升开发效率。同时Token Plan的订阅额度还可以与千问App、千问办公实现共享抵扣,用户在不同产品中产生的Token消耗可以统一从订阅额度中扣除,避免不同产品分别计费带来的额度浪费,进一步降低用户的综合使用成本。

结合平台原有的按量付费模式,以及本次升级新增的优速模式、吞吐预留与独占吞吐等多种服务模式,千问AI平台已经形成了覆盖个人开发者、中小微企业、大型集团客户的全层级服务供给体系,不同需求的用户都可以在同一平台上找到适配自身使用场景的服务方案,无需在多个不同平台之间切换,大幅降低了多场景使用AI服务的综合管理成本。对于个人开发者而言,按量付费的模式可以满足轻量级开发测试的需求,无需提前支付高额的订阅费用;对于业务规模快速增长的中小企业而言,Token Plan的统一订阅模式可以在控制成本的同时灵活调用多类模型能力;对于有大规模生产级使用需求的大型企业而言,独占吞吐模式可以提供专属的算力资源和定制化的性能配置,保障核心业务的稳定运行。

行业侧能力开放推动多场景产业落地

千问AI平台将自身在应用和行业侧沉淀的技术能力全面向生态开放,通过自身的产品实践持续验证技术和体验,再将经过实际场景验证的成熟能力开放给生态合作伙伴,帮助合作伙伴减少技术试错成本,加快AI落地的速度。目前平台已经推出了Meoo 1.0、伶鹊2.0、万镜一刻、万小智3.0等多款面向不同场景的产品,其中Meoo 1.0通过CLI和OpenAPI提供应用构建、部署及企业协作能力,帮助企业快速搭建内部AI应用;伶鹊2.0已经服务20个行业、5000余家企业客户和超过10万个坐席,在客服等场景实现了大规模落地;万镜一刻以Agent、创作工作台和技能广场服务视频生产领域,大幅降低视频内容的生产门槛;万小智3.0则从建站能力延展至获客和经营全链路,推动“Vibe Coding”走向“Vibe Business”,帮助中小商家通过AI能力实现全链路经营效率提升。

在具体的产业落地合作方面,平台已经与泛海集团、网易游戏、荣耀等不同领域的头部企业开展深度合作,在工业、游戏研发和端云协同等多个场景实现了AI能力的实际落地。其中泛海集团基于千问AI平台搭建工业AI平台和数控工艺Agent,将资深工程师的经验和各类零件加工案例沉淀为AI可调用的结构化知识,解决了工业领域资深工程师经验难以传承的行业痛点,大幅提升数控加工的工艺优化效率。网易游戏则与千问AI平台围绕游戏研发全链路开展合作,将AI能力融入游戏策划、内容生成、测试等各个研发环节,有效提升游戏研发的整体效率,缩短新游戏的上线周期。

荣耀基于Qwen Intelligence方案,以端云协同的方式为荣耀YOYO智能体提供多模态理解、长链路任务规划等核心能力,推动AI手机的智能体验从过去的被动响应用户指令,转向主动感知用户需求并提供对应服务,大幅提升移动端智能助手的实际使用价值。比亚迪则依托千问AI座舱解决方案打造出座舱超级智能体,支持用户理解和执行模糊、多重指令,用户在驾驶过程中无需进行多步操作,通过自然语言即可一次性完成多个座舱功能的调整,大幅提升智能座舱的使用便捷性和驾驶过程中的操作安全性。

相关负责人表示,千问AI平台的核心价值并非自行定义所有AI应用,而是搭建起完善的底层支撑体系,让更多不同行业的合作伙伴可以基于平台的能力生长出适配自身场景的专属AI应用。只有将模型服务、Agent服务、AI原生应用和各行业的实践经验连成完整的体系,通用的AI智能能力才能真正转化为实实在在的产业生产力,覆盖到更多过去难以触达的细分场景中。目前相关的模型服务和Agent能力已经在千问AI平台正式上线,开发者可以直接通过API完成产品集成,或者订阅Token Plan服务,在已支持的常用AI工具中直接调用对应的模型和服务,快速开启自身的AI应用开发工作。

(编辑:付健)