docs: 更新技术文档,同步 Eino 重构和默认 provider 变更
- 架构设计:更新为 Eino Graph 声明式编排,增加三级存储架构说明 - 接口文档:AI 编排器章节重写为 Eino Graph,更新 LLM 服务接口 - 技术选型:新增 Eino 框架选型章节,修正 STT/LLM/TTS 默认方案 - 语音交互:Pipeline 描述改为 Eino Graph - 成本控制:模型引用修正为 qwen3-vl-plus - 技术名词解释:新增 Eino 框架相关术语 - README:增加 10/11/12 Eino 文档索引 - 10-Eino重构方案:状态更新为已实施 - CLAUDE.md:同步所有变更
This commit is contained in:
@@ -50,12 +50,12 @@ const ACTIVE_INTERVAL = 1000; // 用户说话时 1 秒一帧
|
||||
|
||||
```
|
||||
用户提问 → 问题复杂度判断
|
||||
├── 简单识别 → GPT-4o-mini ($0.15/1M tokens)
|
||||
├── 深度分析 → GPT-4o ($2.5/1M tokens)
|
||||
└── 代码/推理 → o1 ($15/1M tokens)
|
||||
├── 简单识别 → 轻量模型(如 qwen-turbo)
|
||||
├── 深度分析 → qwen3-vl-plus(默认,按量计费)
|
||||
└── 代码/推理 → 更强模型(如 o1)
|
||||
```
|
||||
|
||||
> 当前 MVP 阶段使用单一模型(默认 GPT-4o),模型分级路由为未来优化方向。通过配置 `ai.llm.model` 可手动切换模型。
|
||||
> 当前 MVP 阶段使用单一模型(默认 DashScope qwen3-vl-plus),模型分级路由为未来优化方向。通过配置 `ai.llm.model` 可手动切换模型。LLM 通过 Eino 框架的 eino-ext ChatModel 组件接入,支持任何 OpenAI 兼容接口。
|
||||
|
||||
## 策略四:缓存与复用(待实现)
|
||||
|
||||
|
||||
Reference in New Issue
Block a user