Qwen3-TTS on AMD Radeon 780M (gfx1103): A Docker + ROCm Deployment Autopsy
2026-08-03
A full post-mortem of deploying Qwen3-TTS-Openai-Fastapi on an AMD Radeon 780M (gfx1103) APU via Docker + ROCm. Central finding: per-step .item() GPU-to-CPU syncs inside transformers generate() deadlock permanently on this APU because of lost HSA completion signals; routing around them with the project’s fast codebook path made the service stable.
Qwen3-TTS 在 AMD Radeon 780M 上的 Docker + ROCm 部署排障记录
2026-08-03
在 AMD Radeon 780M (gfx1103) 集成 GPU 上用 Docker + ROCm 部署 Qwen3-TTS 的完整 排障记录。核心结论:transformers generate() 每步 .item() 的 GPU→CPU 同步在 APU 上会因 HSA 信号丢失而永久卡死,绕过它的 fast codebook 方案使服务稳定运行。