本词条由2026级新生群:1028226838(
)提供 侵权必究
DeepSeek-V4-Flash 正式版服务
作者:吴文宇 最后编辑于: 2026-8-19 14:08 浏览量:177
1. 概述
2026 年 8 月 17 日,天津大学智能体广场完成 DeepSeek-V4-Flash-0731(DeepSeek-V4-Flash 正式版)本地部署并上线,师生可在 https://ai.tju.edu.cn 中选择使用。
图片:AI 对话页面

(图片来源:天津大学信息与网络中心)
2. 背景
2026 年 7 月 31 日,深度求索(DeepSeek)正式发布 DeepSeek-V4-Flash-0731 大语言模型。该模型是 DeepSeek-V4-Flash 的官方正式版本,取代了预览版,并大幅增强了智能体(Agentic)能力。作为 DeepSeek-V4 系列中主打高效推理与高性价比的轻量化版本,该模型在延续旗舰级能力的同时,进一步降低部署门槛与推理成本,为教学、科研与智能体应用提供了更优的选择。
DeepSeek-V4-Flash-0731 采用稀疏混合专家(MoE)架构,总参数量 284B、激活参数仅 13B,支持百万 token 级超长上下文。模型在架构上引入混合注意力机制(压缩稀疏注意力 CSA 与重度压缩注意力 HCA),大幅提升长上下文处理效率,思考强度可调,兼顾响应速度与复杂任务表现。
3. 性能亮点
本次发布带来了显著升级,尤其体现在以下方面:
- 智能体能力(Agentic):模型在 Terminal Bench 2.1、NL2Repo、DeepSWE 等智能体基准测试中成绩大幅超越预览版本,整体表现可与当前最强闭源模型相媲美,能够更稳定地完成复杂工作流。
- 超长上下文与高效推理:百万 token 上下文配合混合注意力与推测解码,在保证高质量生成的同时显著降低推理成本与延迟,更适合高并发、多轮交互场景。
图片:测评结果

(图片来源:天津大学信息与网络中心)
4. 服务对象
智能体广场 DeepSeek-V4-Flash 服务面向天津大学在校学生、教职工提供服务。师生需通过 天津大学统一身份认证系统 登录后,在模型选择中使用 DeepSeek-V4-Flash 对应模型。
5. 访问渠道
用户通过浏览器直接访问以下地址,在模型选择中切换使用 DeepSeek-V4-Flash:
6. 使用说明
- 请严格遵守学校网络及数据安全相关规定,合理利用模型资源,共同杜绝非法用途及违反学术道德的行为发生;
- 模型输出定位为辅助性、工具性能力,相关结果仍需由使用者结合专业规范自行研判与把关;
- 信息与网络中心将持续跟踪国产大语言模型开源项目动态,结合应用反馈与实际需求稳步完善相关功能,并适时增加新模型词元(Token)调用服务,敬请关注。
相关阅读
附:天津大学大语言模型部署应用日志
| 时间 | 部署内容 |
|---|---|
| 2025 年 2 月 19 日 | 部署国内首个开源大语言模型 DeepSeek-R1-671B 满血版,推出问答应用 |
| 2025 年 3 月 10 日 | 部署 QwQ-32B,基于 320 亿参数规模,性能比肩 6710 亿参数的完整版 DeepSeek-R1 |
| 2025 年 3 月 31 日 | 部署 DeepSeek-v3-0324,大幅提高推理类任务表现,数学、代码类评测优异 |
| 2025 年 4 月 30 日 | 部署 Qwen3-235B-A22B 及 Qwen3-32B,代码、数学、通用能力等基准测试表现极具竞争力 |
| 2025 年 6 月 4 日 | 部署 DeepSeek-R1-0528,处理复杂推理任务显著改进,减少幻觉现象,增强函数调用支持,提升代码编写体验 |
| 2026 年 3 月 12 日 | 部署 Qwen3.5-35B-A3B,融合多模态学习、架构效率、强化学习规模和全球可访问性等方面突破 |
| 2026 年 5 月 13 日 | 部署 Qwen3.6-27B 和 Qwen3.6-35B-A3B,编程、智能体与工具调用能力较 Qwen3.5 系列显著提升 |
| 2026 年 5 月 15 日 | 推出 “词元(Token)” API 服务,将常用客户端与校内部署的大模型对接,用于办公辅助、教学支持与科研创新等场景 |
| 2026 年 8 月 17 日 | 部署 DeepSeek-V4-Flash-0731,百万级超长上下文,智能体与工具调用能力大幅提升 |