通义千问 Qwen3-235B-A22B 和 Qwen3-32B 服务
1. 概述
为持续推动人工智能落地教育场景应用,为师生提供更为便捷的学习、科研服务,天津大学信息与网络中心(以下简称:信网中心)于 2025 年 3 月 10 日完成 QwQ-32B 的本地部署,又于 2025 年 4 月 30 日完成 通义千问 Qwen3-235B-A22B 及 Qwen3-32B 的本地部署并上线试用,师生可在 天津大学 AI 服务 中选择使用。
2026 年 5 月 13 日,信网中心进一步上线 词元(Token)API 服务,现阶段采用 千问 Qwen3.6-35B-A3B 模型,面向全校师生提供 OpenAI 协议兼容的接口调用能力。
2. 背景
通义千问(Qwen)是阿里巴巴集团旗下的开源大语言模型系列。2025 年 4 月 29 日,阿里巴巴开源新一代通义千问模型 Qwen3,参数量仅为 DeepSeek-R1 的 1/3,成本大幅下降,性能全面超越 R1、OpenAI-o1 等全球顶尖模型。Qwen3 是国内首个"混合推理模型",将"快思考"与"慢思考"集成进同一个模型——对简单需求可低算力"秒回"答案,对复杂问题可多步骤"深度思考",大大提升模型的推理效率。
"混合推理"相当于把顶尖的推理模型和非推理模型集成到同一个模型里去,需要极其精细、创新的设计及训练。在"推理模式"下,模型会执行更多中间步骤,如分解问题、逐步推导、验证答案等,给出更深思熟虑的答案;而在"非推理模式"下,模型会直接生成答案。这类似于人类在回答简单问题时凭经验或直觉快速作答,面对复杂难题时再深思熟虑、仔细思考给出答案。
评测显示,Qwen3 在推理、指令遵循、工具调用、多语言能力等方面均大幅增强,创下所有国产模型及全球开源模型的性能新高。其中:
- 在奥数水平的 AIME25 测评中,Qwen3 斩获 81.5 分,刷新开源纪录;
- 在考察代码能力的 LiveCodeBench 评测中,Qwen3 突破 70 分大关,表现甚至超过 Grok3;
- 在评估模型人类偏好对齐的 ArenaHard 测评中,Qwen3 以 95.6 分超越 OpenAI-o1 及 DeepSeek-R1。
天津大学信网中心依托校级高性能计算平台及私有云环境,持续跟踪国产大语言模型开源项目动态,完成通义千问系列模型的本地化部署与服务能力建设,将服务纳管于学校数据中心,由学校网络安全管理、防护体系保障隐私数据安全。
3. 服务对象
校园网版 通义千问 服务面向天津大学 在校学生、教职工 提供服务。用户需通过 天津大学统一身份认证系统 进行登录。
4. 访问渠道
通义千问服务目前支持 网页端对话 和 词元(Token)API 调用 两种使用方式。
4.1. 网页端对话服务
渠道一:AI 对话网页端
用户通过浏览器直接访问以下地址,在模型选择中使用通义千问对应模型:
图片:通义千问 Qwen3 服务界面
渠道二:融合门户网页端
用户通过浏览器访问以下地址:
使用本人 天津大学统一身份认证系统 账号密码完成登录后,点击顶部导航栏右上角 "AI" 图标进入 AI 服务界面。
渠道三:融合门户 APP 端
用户通过手机打开 天津大学融合门户 APP,使用本人 天津大学统一身份认证系统 账号密码完成登录后,点击右上角 "AI" 图标进入 AI 服务界面。
互联网环境访问
用户在互联网环境下,电脑端和手机端需通过 天津大学 VPN 服务 连接校园网后,即可采用上述方式进入通义千问服务界面。
4.2. 词元(Token)API 服务
为进一步降低大模型与校园智能体应用门槛及算力成本,信网中心上线 词元(Token)服务,依托校内本地化算力资源,为师生提供 普惠共享、安全合规、自主可控 的 AI 算力支撑。现阶段采用 千问 Qwen3.6-35B-A3B 模型,通过 vLLM 推理引擎及架构优化部署于校内高性能计算平台。
4.2.1. 接口形态
服务提供 OpenAI 协议兼容的 API。支持自定义 Base URL 与 API Key 的桌面客户端、IDE 插件或浏览器扩展等工具,均可依据 智能体平台 公布的技术指引完成配置,实现对话、补全或插件类能力调用;与常见云端接口的使用方式相近,调用流量指向校内服务。
4.2.2. 网络与安全
- 模型权重与推理服务运行于 校内网络环境,不接入公网;
- 采用容器化编排构建独立服务域,结合 RBAC 权限模型 与 API 密钥鉴权,对数据流向与调用范围实施约束;
- 业务数据默认经校内服务域处理,不向校外服务商传输,以降低敏感信息外溢风险。
4.2.3. 使用流程
(一)网上办事大厅办理申请
登录融合门户 网上办事大厅,检索 Token 或 大模型 相关事项,如实填写并提交申请材料。提交后,系统将自动开通 API 访问权限。
(二)接口密钥与用量
登录 智能体广场,获取个人 API Key,并在此查询用量、管理密钥。密钥须 妥善保管,不得转借,不得发布于公开平台。
(三)客户端参数配置(不同软件界面表述或有差异,配置项一致)
| 配置项 | 说明 |
|---|---|
| API Key | 由智能体广场获取并填入客户端 |
| API 地址 / Base URL | https://ai.tju.edu.cn/api/v3/ |
| 模型名 | 校内 模型名称,即 tju-llm |
请求示例
以下为官方 curl 请求样例(调用前请将 <YOUR_API_KEY> 替换为从智能体广场获取的真实 API Key):
curl 'https://ai.tju.edu.cn/api/v3/chat/completions' \
-H 'Content-Type: application/json' \
-H 'Authorization: Bearer <YOUR_API_KEY>' \
-d '{"model":"tju-llm","messages":[{"role":"user","content":"你好"}]}'
配置保存后,即可在客户端中开展对话、补全或插件调用。其它支持 OpenAI 兼容接口配置的应用,原则上可参照上述步骤对接。
4.2.4. 词元额度
为保障服务质量与公平使用,实行 按月统计 的额度管理:
| 方向 | 每人每月额度 |
|---|---|
| 上行(请求侧词元) | 10 亿 |
| 下行(响应侧词元) | 1000 万 |
上述额度可满足多数日常办公与常规辅助场景需求。
5. 使用说明
- 请严格遵守学校网络及数据安全相关规定,合理利用模型资源,尽量避免资源过度占用;我们一起努力杜绝非法用途及违反学术道德的行为发生;
- 词元(Token)服务定位为 辅助性、工具性 能力,相关输出仍需由使用者结合专业规范自行研判与把关;
- API 密钥须妥善保管,不得转借他人,不得发布于公开平台;
- 后续如算力条件与模型路线发生调整,以信网中心发布的公告为准。
6. 联系方式
如有功能或技术问题及建议,请及时与信网中心联系。
- 联系电话: 022 - 27404455
- 邮箱: 27404455@tju.edu.cn
7. 天津大学大语言模型部署应用日志
| 时间 | 部署内容 |
|---|---|
| 2025 年 2 月 19 日 | 部署国内首个开源大语言模型 DeepSeek-R1-671B 满血版,推出问答应用 |
| 2025 年 3 月 10 日 | 部署 QwQ-32B,基于 320 亿参数规模,性能比肩 6710 亿参数的完整版 DeepSeek-R1 |
| 2025 年 3 月 31 日 | 部署 DeepSeek-v3-0324,大幅提高推理类任务表现,数学、代码类评测优异 |
| 2025 年 4 月 30 日 | 部署 Qwen3-235B-A22B 及 Qwen3-32B,代码、数学、通用能力等基准测试表现极具竞争力 |
| 2026 年 5 月 13 日 | 上线 词元(Token)API 服务,采用 Qwen3.6-35B-A3B 模型,OpenAI 协议兼容 |