Toggle navigation
爱折腾的工程师
All Posts
ARCHIVE
NOTES
ABOUT
爱折腾的工程师
未来的你会感谢现在努力的自己
DeepSeek-V3.2 多机推理部署指南:vLLM-Ascend 与 TIONE 在线服务
面向昇腾 Atlas 800 A2/A3 的 DeepSeek-V3.2 多机推理部署规范:vLLM-Ascend 原生部署与 TIONE 在线服务部署
本文档基于 vLLM-Ascend DeepSeek-V3.2 官方教程与 TIONE 3.11 在线服务实践,规范化描述 DeepSeek-V3.2 在昇腾 Atlas 800 A2/A3 上的多机推理部署流程。内容覆盖硬件与版本基线、容器与网络配置、vLLM 原生多机命令、TIONE 在线服务数据源与启动脚本、Prefill-Decode 分离部署、功能与性能验证以及运维排障清单,适用于生产环境落地。
Posted by iceyao on Thursday, April 30, 2026
Software Developer, Open Source Enthusiast
FEATURED TAGS
agent
ai
ascend
claude
claude code
devops
go
k8s
kubernetes
llm
multi-agent
openstack
python
rag
tkestack
vllm
练车