论文Agent 与开发者13:28DuplexCadence:让全双工语音模型运行提速 2.85 倍、峰值内存降低 38.8%跑全双工语音模型的开发者可以看,它把推理速度提到原来的 2.85 倍还省内存,输出结果完全一致。#DuplexCadence#全双工语音#推理优化#语音生成aarXiv cs.AI@Haixiao Gao 等 4 人原文稍后读已读值得跟进有用关注 DuplexCadence