产品Agent 与开发者精选21:33fractalyze_io 优化 Qwen3-Omni,单卡 RTX 5090 首音频延迟降至 23ms有人在单张 RTX 5090 上跑 Qwen3-Omni,用 AWQ-4bit 把首音频延迟从 213ms 压到 23ms,本地语音对话流畅度差了近十倍。#Qwen3-Omni#vLLM#RTX 5090#AWQ量化1 个信源在谈事件专题官方账号vLLM@vllm_project2 个信源在谈原文稍后读已读值得跟进有用关注 Qwen3-Omni