PAI Model Gallery 支持云上一键部署 Qwen3 全尺寸模型
模型简介
Qwen3 是 Qwen 系列最新一代的大语言模型,提供了一系列密集(Dense)和混合专家(MOE)模型。基于广泛的训练,Qwen3 在推理、指令跟随、Agent 能力和多语言支持方面取得了突破性的进展,具有以下关键特性:
-
独特支持在思考模式(用于复杂逻辑推理、数学和编码)和 非思考模式(用于高效通用对话)之间无缝切换,确保在各种场景下的最佳性能。
-
显著增强的推理能力,在数学、代码生成和常识逻辑推理方面超越了之前的 QwQ (在思考模式下)和 Qwen2.5 指令模型(在非思考模式下)。
-
卓越的人类偏好对齐,在创意写作、角色扮演、多轮对话和指令跟随方面表现出色,提供更自然、更吸引人和更具沉浸感的对话体验。
-
擅长 Agent 能力,可以在思考和非思考模式下精确集成外部工具,在复杂的基于代理的任务中在开源模型中表现领先。
-
支持 100 多种语言和方言,具有强大的多语言理解、推理、指令跟随和生成能力。
PAI Model Gallery 简介
Model Gallery 是阿里云人工智能平台 PAI 的产品组件,它集成了国内外 AI 开源社区中优质的预训练模型,涵盖了 LLM、AIGC、CV、NLP 等各个领域。通过 PAI 对这些模型的适配,用户可以以零代码方式实现从训练到部署再到推理的全过程,简化了模型的开发流程,为开发者和企业用户带来了更快、更高效、更便捷的 AI 开发和应用体验。
PAI Model Gallery 访问地址:https://pai.console.aliyun.com/#/quick-start/models
阿里云 PAI Model Gallery 已同步接入Qwen3本次开源的所有模型,提供企业级部署方案。
✅ 零代码一键部署
✅ 自动适配云资源
✅ 部署后开箱即用API
✅ 全流程运维托管
✅ 企业级安全 数据不出域
一键部署 Qwen3 方案
⬇️ 立即体验 ⬇️
下面以 Qwen3-8B 模型部署为例(推理成本较低,可用于快速验证)。
-
在 Model Gallery 模型广场找到 Qwen3-8B 系列模型,或通过链接直达该模型:https://pai.console.aliyun.com/?regionId=cn-beijing#/quick-start/models/Qwen3-8B/intro
-
在模型详情页右上角点击「部署」,已支持SGLang、vLLM高性能部署框架。在选择计算资源后,即可一键完成模型的云上部署。
-
部署成功后,在服务页面可以点击“查看调用信息”获取调用的 Endpoint 和 Token,想了解服务调用方式可以点击预训练模型链接,返回模型介绍页查看调用方式说明。
-
使用推理服务。您可以在 PAI-EAS 推理服务平台上在线调试已部署好的 Qwen3 模型服务,从图中可以看出模型回复具备较好的思维链能力。
下表提供了部署所需的最低配置,以及使用不同机型部署时在不同推理框架上支持的最大 Token 数。
更多模型支持
除 Qwen3 全系列模型外,PAI-Model Gallery 持续提供开源社区热门模型快速部署、训练、评测实践。
-
DeepSeek-R1 推理性能优化版
推理性能提升,相同时延约束下,吞吐能提升492%;相同吞吐情况下, 首token时延直降86%,token间时延直降69%。
-
DeepSeek-R1 满血版模型
PAI Model Gallery 支持云上一键部署 DeepSeek-V3、DeepSeek-R1 系列模型
-
QwQ 32B
云上一键部署通义千问 QwQ-32B 模型,阿里云 PAI 最佳实践
联系我们
欢迎各位小伙伴持续关注使用 PAI-Model Gallery,平台会不断上线 SOTA 模型,如果您有任何模型需求,也可以联系我们。您可通过钉钉扫描下方二维码(或搜索钉钉群号79680024618),加入PAI-Model Gallery用户交流群。

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。
持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。
转载内容版权归作者及来源网站所有,本站原创内容转载请注明来源。
- 上一篇
携手创未来,“HarmonyOS 协同·创新”技术沙龙在济南顺利举办
加入鸿蒙开发者联盟官网,快速成为鸿蒙开发者! 4月27日,“HarmonyOS 协同·创新”(软件行业专场)在济南顺利举行。本次会议由开源中国主办,山东省软件行业协会协办,吸引了来自全国各地的近百名鸿蒙开发者、技术团队负责人及生态企业代表齐聚济南,围绕HarmonyOS技术创新与产业实践展开深度研讨,为鸿蒙生态发展注入新动能。 会议伊始,华为云HCDE专家姚圣伟以《共建未来:HarmonyOS 生态全景与开发者新机遇》为主题发表演讲,系统阐述了HarmonyOS的生态发展现状与技术前景:截至2025年3月,鸿蒙设备突破10亿台,以17%市占率成为中国第二大移动操作系统,吸引720万开发者,超2万款应用覆盖18个行业,腾讯、阿里等头部企业已深度参与;其全栈自研的分布式架构通过“一次开发、多端部署”实现跨终端协同,并深度融合AI技术优化全场景体验。未来,将持续推动跨终端生态协同创新,助力HarmonyOS NEXT向更智慧、高效的全场景操作系统演进,持续引领万物互联时代。 在智能终端加速向全域协同演进的时代背景下,HarmonyOS通过分布式技术打破硬件边界的能力已成为行业焦点。在《鸿蒙分...
- 下一篇
SQLShift 全新上线:Oracle→OceanBase 迁移利器
AI+SQL 语法专家模型驱动,Oracle→OceanBase 迁移效率提升 10 倍! 企业级 SQL 方言智能转换平台 SQLShift 今日正式上线。 作为国内首个支持 Oracle→OceanBase 存储过程自动转换的 SaaS 服务,SQLShift 深度融合 AI 与 SQL 语法专家模型,精准解决数据库国产化迁移中的隐式转换、逻辑失真等核心痛点,助力企业实现零误差交付。 操作视频:SQLShift 全新上线:Oracle→OceanBase 迁移利器 直击国产化迁移刚需 传统工具仅支持基础表结构迁移,而 Oracle 存储过程、物化视图等对象需人工逐行适配,耗时长且易引发生产事故。SQLShift 聚焦国产化替代场景,实现三大突破: 首攻 OceanBase 迁移 :V1.0 版本独家支持 Oracle 存储过程→OceanBase 4.x 自动转换,覆盖 DBMS_JOB 调度、ROWNUM 分页等高频场景。 三重校验体系:基于 OceanBase 官方文档+国产化迁移规则库,对语法、语义、性能三重校验,规避如隐式类型(如 NUMBER→DECIMAL)、分页查询失...
相关文章
文章评论
共有0条评论来说两句吧...
文章二维码
点击排行
推荐阅读
最新文章
- CentOS7编译安装Cmake3.16.3,解决mysql等软件编译问题
- SpringBoot2配置默认Tomcat设置,开启更多高级功能
- CentOS7编译安装Gcc9.2.0,解决mysql等软件编译问题
- CentOS6,7,8上安装Nginx,支持https2.0的开启
- 设置Eclipse缩进为4个空格,增强代码规范
- CentOS关闭SELinux安全模块
- CentOS7,8上快速安装Gitea,搭建Git服务器
- Hadoop3单机部署,实现最简伪集群
- Windows10,CentOS7,CentOS8安装MongoDB4.0.16
- Docker安装Oracle12C,快速搭建Oracle学习环境