00:45官方账号xAI@xai精选SpaceXAI与LiveKit合作,使用Grok Voice模型构建患者接待智能体,支持ZDR。集成Grok STT、Grok 4.3和Grok TTS,无需额外API密钥或账单,实现端到端ZDR支持。AI产品Grok Voice模型LiveKit语音智能体推荐理由:SpaceXAI与LiveKit合作,利用Grok Voice模型构建智能体,支持ZDR,无需额外API和账单,值得一看。原文稍后读已读值得跟进有用关注 Grok Voice模型
10:16Fish Audio@FishAudioLiveKit Agents今日发布Expressive mode,解决语音代理语气单一的问题。该模式由LLM自动在文本中写入情绪标签,如[whispering]、[laugh]、[excited],再由Fish Audio S2.1 Pro渲染成相应语音。用户只需在LiveKit Agents中切换一个开关即可启用,无需手动编写情绪提示词。此功能让语音代理能根据对话内容动态调整语气,比如在播报坏消息时不再使用欢快腔调。AI产品LiveKitFish AudioS2.1 Pro推荐理由:LiveKit给语音代理加了个情绪开关,让AI说话不再一个调,配合Fish Audio S2.1 Pro自动生成表情,想试的可以直接开。原文稍后读已读值得跟进有用关注 LiveKit
02:25官方账号LangChain@LangChainAI71°LangChain 发布 LangSmith 追踪功能,支持 Pipecat、LiveKit、OpenAI Realtime 和 Gemini Live 四个语音框架。开发者只需几行代码即可捕获完整的音频轨迹、STT/TTS 延迟、中断事件和 VAD 状态。该功能解决了语音代理在生产中的黑盒问题,提供详细的性能洞察。AI产品LangSmith语音代理Pipecat10 个信源在谈事件专题推荐理由:做语音代理的兄弟,LangSmith 现在能追踪 Pipecat、LiveKit 这些框架的音频和延迟了,几行代码就能搞定,调试省大事。原文稍后读已读值得跟进有用关注 LangSmith
22:06小互@imxiaohu精选LiveKit 在其推理平台 LiveKit Inference 上推出针对 Google Gemma 4 31B 的优化服务。实时语音场景中,首字延迟低至192毫秒,比GPT-4.1的1006毫秒快5.2倍。成本降低约83%,约为GPT-4.1的六分之一。在酒店前台场景测试中,任务完成率达88%,超过GPT-4.1(73%)和Gemini 2.5 Flash(64%)。AI产品LiveKitGemma 4GPT-4.13 个信源在谈事件专题推荐理由:LiveKit 用 Gemma 4 31B 做实时语音,延迟比 GPT-4.1 低5倍,成本仅六分之一,酒店测试胜出,值得试试。原文稍后读已读值得跟进有用关注 LiveKit