阿里千问AI平台全面升级模型服务、Agent服务、AI应用 – 量子位
Quick Answer
Alibaba's Qianwen AI platform has upgraded its services, introducing Agent capabilities and industry AI solutions, with a focus on production efficiency.
Quick Take
The platform now offers a 1.5 to 2x increase in TPS and reduced model startup time from 1200 seconds to 70 seconds, supporting extensive enterprise integration and real-time operations.
Key Points
- Introduced Agent Studio for enterprise-level full-stack Agent services.
- Achieved a 38% reduction in first token latency and 95% savings in prompt caching costs.
- Token usage on Alibaba Cloud's MaaS platform grew sixfold over the past year.
- Plans to exceed 20GW of computing power by 2032 to support AI infrastructure.
- One Key connects over 100 ecological services with a single API key.
📖 Reader Mode
~2 min read< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">
2026-09-23 13:13:19 来源:量子位
覆盖MaaS、Agent服务、行业AI解决方案
允中 发自 凹非寺
量子位 | 公众号 QbitAI
9月22日,在2026云栖大会MaaS & Agent技术主论坛上,阿里巴巴集团战略副总裁、ATH事业群MaaS业务线总裁文征宣布千问AI平台全面升级:以推动Agent进入生产作为建设核心,在模型服务基础上新增对Agent服务、行业AI解决方案的支持,并推出了API优速模式、Agent Studio、千问AI座舱解决方案等一系列能力,帮助企业将智能转化为生产力。
从消耗Token到交付结果,AI价值的衡量方式正在改变
文征表示,AI仍处于非常早期的阶段,用户覆盖、场景渗透和算力规模均有巨大增长空间。持续增长的Token用量说明,AI需求已不再是一道需要证明的题,关键在于谁能将智能转化为结果。单任务价值、Token生产效率和单Token能力,共同决定“智能价值密度”。
过去一年,阿里云MaaS平台服务的客户数增长六倍。随着订单、代码、内容和业务流程主动发起调用,Agent开始进入企业核心流程,企业需要的不再只是一个模型API,而是一套覆盖模型供给、生产运行、Agent构建与托管的完整体系。智能正在从被调用走向被交付。
需求的持续放大,对算力和基础设施提出了更高要求。阿里将坚定投入全栈AI,预计到2032年,阿里云运营的算力规模将超过20GW,支撑从芯片、AI基础设施,到千问大模型、模型服务、Agent工具和AI原生应用的完整AI体系,加速Agent时代的产业进化。
面向Agent负载持续完善模型服务
在模型供给方面,千问AI平台以“First and Best”原则,支持全球一流的自研和开放模型第一时间上线。针对Agent决策链路长、并发高、对时延敏感等特点,平台通过FlashBoot、UniScheduler等能力调度异构算力,将模型弹性启动时间由1200秒缩短至70秒,可在1分钟内拉起1万个Pods;首Token延迟降低38%,Prompt Caching成本最高节省95%。
平台提供99.9%生产级SLA、十亿级单客户峰值TPM和CMaaS机密推理服务,支持监控、告警和成本治理。本次升级的API优速模式可将TPS提升1.5至2倍,用户切换model ID即可使用;吞吐预留(PTU)新增夜间8小时预留规格;独占吞吐(DTU)则面向大型企业及金融、政企客户,支持定制模型部署与性能定制。
在服务模式上,Token Plan以一份订阅覆盖Qwen、Kimi、GLM、DeepSeek等多类模型,原生打通Qoder、Cursor、Codex、OpenClaw等主流编程工具与Agent框架,并可与千问App、千问办公共享抵扣。结合按量付费、优速模式、吞吐预留与独占吞吐,从个人到企业的各类需求均可在同一平台获得对应供给。
Agent Studio发布,提供企业级全栈Agent服务
从模型调用到业务结果,Agen需要模型匹配、任务运行、上下文接入和服务调用等基础能力。千问AI平台正式发布企业级全栈Agent服务平台Agent Studio,可根据任务自动路由选择模型,提供24小时不间断托管运行,并支持企业内部知识数据和外部软件服务接入。
在Agent开发运行方面,平台提供原子API,50多个原子API覆盖运行环境、长期记忆、工具服务、会话请求和服务端点部署等能力,企业可按需组合并接入自身业务;全新的Agent API即将发布,可将环境、记忆、工具、部署等需逐项调用的配置,一次请求全部搞定。
Agent Studio还将推出Agent自进化引擎,包含运行观测、AI评测器、AI优化器和自动验证等能力,支持在上下文交互中持续调优与进化。
同时,针对Agent生态服务,One Key MCP可用一个API Key连接100多项生态服务,包括高德、飞猪、1688及金融、法律等各领域服务。平台还可自动理解需求、寻找工具并完成调用,减少开发者逐一注册和配置鉴权的工作,
以全栈基础能力,支撑应用与行业落地
在应用和行业侧,千问AI平台通过自身产品实践持续验证技术和体验,并将沉淀能力向生态开放。Meoo 1.0通过CLI和OpenAPI提供应用构建、部署及企业协作能力;伶鹊2.0服务20个行业、5000余家企业客户和超过10万个坐席;万镜一刻以Agent、创作工作台和技能广场服务视频生产,万小智3.0则从建站延展至获客和经营,推动“Vibe Coding”走向“Vibe Business”。
在行业与终端场景,泛海集团基于千问搭建工业AI平台和数控工艺Agent,沉淀工程师经验与零件案例;网易游戏与千问AI平台围绕游戏研发链路开展合作。荣耀基于Qwen Intelligence方案,以端云协同的方式,为荣耀YOYO智能体提供多模态理解、长链路任务规划等能力,推动AI手机从被动响应走向主动服务;比亚迪依托千问AI座舱解决方案打造座舱超级智能体,支持理解和执行模糊、多重指令。
文征认为,平台的价值不是定义所有应用,而是让更多应用生长出来。只有将模型服务、Agent服务、AI原生应用和行业实践连成体系,智能才能从通用能力走向产业生产力。
目前,相关模型服务和Agent能力已在千问AI平台上线。开发者可通过API完成产品集成或订阅Token Plan,在已支持的常用AI工具中直接调用相应模型和服务。
版权所有,未经授权不得以任何形式转载及使用,违者必究。
— Originally published at qbitai.com
Want this in your inbox every morning?
Daily brief at your local 8am — bilingual EN/中文, free.
More from WebSearch (Tavily)
See more →全球AI芯片峰会,9月上海见!
The 2026 Global AI Chip Summit will take place in Shanghai on September 22-23, focusing on the evolving AI chip landscape, including the shift from training to inference, the rise of diverse chip technologies, and the restructuring of industry competition. Notable speakers include experts from leading universities and companies, discussing advancements in AI chip architecture and applications.