LiveKit 针对 Gemma 4 31B 进行优化
在实时语音方面比 GPT-4.1 快 5 倍、成本六分之一
LiveKit 上线一项新服务:在自家推理平台 LiveKit Inference 上跑 Google 新一代大模型 Gemma 4 31B
跟 GPT-4.1 比:接话延迟低 5.2 倍(首字 192 毫秒对 1006 毫秒)、成本便宜约 83%(大概六分之一)
酒店前台场景测试任务完成率 88%,超过 GPT-4.1(73%)和 Gemini 2.5 Flash(64%)...
显示更多