diff --git a/AI 视觉对话助手/语音交互.md b/AI 视觉对话助手/语音交互.md index b1461ca..ed9bb35 100644 --- a/AI 视觉对话助手/语音交互.md +++ b/AI 视觉对话助手/语音交互.md @@ -55,12 +55,12 @@ vad.start(); 主流方案对比: -| 方案 | 延迟 | 成本 | 特点 | -|------|------|------|------| -| **Whisper API** | 1-3s | 按分钟计费 | 准确率高,支持多语言 | -| **Deepgram** | <500ms | 按分钟计费 | 流式识别,延迟极低 | -| **浏览器原生** | ~1s | 免费 | 依赖浏览器,中文效果一般 | -| **FunASR** | <500ms | 自部署免费 | 阿里开源,中文优化 | +| 方案 | 延迟 | 成本 | 特点 | +| --------------- | ------ | ----- | ------------ | +| **Whisper API** | 1-3s | 按分钟计费 | 准确率高,支持多语言 | +| **Deepgram** | <500ms | 按分钟计费 | 流式识别,延迟极低 | +| **浏览器原生** | ~1s | 免费 | 依赖浏览器,中文效果一般 | +| **FunASR** | <500ms | 自部署免费 | 阿里开源,中文优化 | 流式 STT 是低延迟的关键——不必等用户说完,边说边识别: