智能台灯LeLampX快速入门教程-AI提供商配置
纠错,疑问,交流: 请进入讨论区或 请点击进入页面,扫码加入微信群或Q群进行交流
获取最新文章: 扫一扫加入“创客智造”公众号
AI 提供商配置
目标:学会切换 LLM(DeepSeek/Ollama)、STT 与 TTS 引擎,配置 API Key,更换 LeLamp 的声音
一、前提
- ✅ 能打开 Web 设置界面
/settings - ✅ 如需改
config.yaml,准备好 SSH 终端(见教程 31 网络与远程访问)
LeLamp 的 AI 能力分三块,可独立切换:
| 模块 | 干什么 | 可选引擎 |
|---|---|---|
| LLM | 理解你的话、组织回答(大脑) | DeepSeek(云端)/ Ollama(本地) |
| STT | 把你的话转成文字(耳朵) | SenseVoice / FunASR(暂不用) / Whisper(暂不用) |
| TTS | 把回答念出来(嘴巴) | Edge / Piper(暂不用) / Kokoro(暂不用) / gTTS(暂不用) |
二、两种配置方式
| 方式 | 适用人群 | 说明 |
|---|---|---|
Web 界面 /settings → "AI 后端设置"卡片 |
推荐 | 图形化选引擎、填 API Key |
编辑 config.yaml |
进阶 | 更精细的参数;改完需重启服务 |
无论哪种方式,改完配置都要让配置生效:Web 方式一般自动重启,config.yaml 方式执行
sudo systemctl restart lelamp。
三、切换 LLM:DeepSeek(云端)或 Ollama(本地)
先看对比,选适合你的
| 特性 | DeepSeek V3(云端) | Ollama(本地) |
|---|---|---|
| 位置 | 云端 API | Pi 本地 |
| 需要网络 | 是 | 否 |
| 回答质量 | 很好 | 一般 |
| 上下文 | 64K tokens | 2K tokens |
| 成本 | 按量付费 | 免费 |
| 需要 API Key | 需要 | 不需要 |
选择建议:家里网络稳定 → DeepSeek(更聪明);想完全离线/省钱 → Ollama。
用 Web 界面切换
- 打开
/settings→ "AI 后端设置"卡片 - 提供商选择 DeepSeekLLM 或 OllamaLLM
- 选 DeepSeek 时填入 API Key(见第四节)
你应看到什么:仪表盘"AI 后端信息"显示当前 LLM 名称;对 LeLamp 说"现在几点了",它能正常回答。
用 config.yaml 切换
pipeline:
llm:
# 1. 本地 Ollama
provider: OllamaLLM
# 2. 云端 DeepSeek(二选一)
provider: DeepSeekLLM
api_key: 'sk-your-key-here'
model: deepseek-chat # deepseek-chat (V3) / deepseek-reasoner (R1)
base_url: https://api.deepseek.com
temperature: 0.7
模型选择注意:
deepseek-v4-flash支持工具调用(开关灯、放音乐等);
这套实现兼容所有 OpenAI 格式的 API:OpenAI、OpenRouter、Groq、Together AI 等,只需把
base_url和api_key改成对应服务商的即可。
四、设置 API Key
三种方式任选其一:
| 方式 | 操作 |
|---|---|
| Web 界面 | /settings → AI 后端设置卡片 → 填入 API Key |
| 环境变量(推荐) | export DEEPSEEK_API_KEY="sk-你的key"(写入 ~/.bashrc 或 systemd 环境) |
| config.yaml | pipeline.llm.api_key: 'sk-你的key' |
你应看到什么:Key 填错时,LeLamp 会回复"AI 服务返回错误"(401),日志里也会记录状态码;填对后对话恢复正常。Key 要去 platform.deepseek.com 申请。
五、切换 STT 引擎(让 LeLamp 更听懂你)
三种引擎,默认是 FasterWhisper(tiny 模型):
| 特性 | Whisper (tiny) | FunASR / Paraformer | SenseVoice |
|---|---|---|---|
| 模型大小 | ~150MB | ~50MB | ~50MB |
| Pi 内存占用 | ~800MB–1GB | ~200MB | ~200MB |
| 中文准确率 | 2星 | 5星 | 5星 |
| 英文准确率 | 4星 | 3星 | 4星 |
| 情感/事件检测 | 否 | 否 | (高兴/悲伤/掌声/笑声) |
| 语言自动识别 | 否 | 否 | 中/英/日/粤/韩 |
中文用户建议换 FunASR 或 SenseVoice——又准又快还省内存。 目前只使用效果最好的SenseVoice
切换步骤
# 1. 安装依赖(项目用 uv 则:uv pip install funasr onnxruntime)
pip install funasr onnxruntime
# 2. 修改 config.yaml
stt:
provider: SenseVoiceSTT # FasterWhisperSTT / FunASRSTT / SenseVoiceSTT
model: paraformer-zh-small # tiny / paraformer-zh-small / iic/SenseVoiceSmall
# 3. 重启生效
sudo systemctl restart lelamp
验证
cd ~/lelampv2
python3 scripts/test_stt_backends.py --record # 录音并测试所有后端
python3 scripts/test_stt_backends.py --backend funasr --file test.wav
你应看到什么:测试脚本打印各后端的识别文本;换用 FunASR 后说同一句中文,识别准确率明显更高。SenseVoice 还能额外识别情感(高兴/悲伤/愤怒/中性)和事件(掌声/笑声/音乐)。
六、切换 TTS 引擎与语音(给 LeLamp 换声音)
四种引擎:
| 特性 | Edge TTS | gTTS | Kokoro | Piper |
|---|---|---|---|---|
| 网络 | 需要 | 需要 | 离线 | 离线 |
| 中文音质 | 5星 | 3星 | 4星 | 4星 |
| 语音选择 | 200+ 多口音 | 按语言自动 | ~10 种 | 每 voice 一个文件 |
| 音调控制 | rate/pitch | 否 | speed | 否 |
推荐优先级:edge-tts(在线、免费、音质最好)> kokoro(离线)> gTTS > piper。
目前只使用效果最好的dge-tts
切换步骤
# 1. 安装依赖(Edge 需要 ffmpeg 解码)
pip install edge-tts
sudo apt install ffmpeg
# 2. 修改 config.yaml
tts:
provider: edge # edge / gtts / kokoro / piper
voice: zh-CN-XiaoxiaoNeural # 各后端独立命名
lang: zh
edge:
rate: "+0%" # 语速,如 "+20%" 加快
pitch: "+0Hz" # 音调
常用中文语音
| 引擎 | 语音 ID | 听感 |
|---|---|---|
| Edge | zh-CN-XiaoxiaoNeural |
晓晓,女声(推荐) |
| Edge | zh-CN-YunxiNeural |
云希,男声 |
| Edge | zh-CN-XiaoyiNeural |
晓伊,女声,情感丰富 |
| Edge | zh-TW-HsiaoChenNeural |
晓臻,台湾国语 |
| Edge | zh-HK-HiuGaaiNeural |
晓佳,粤语 |
| Kokoro | zf_heart |
中文女声(离线) |
| Kokoro | zm_heart |
中文男声(离线) |
验证
cd ~/lelampv2
python3 scripts/test_tts_backends.py --quick # 单句对比所有后端并播放
python3 scripts/test_tts_backends.py --list-voices # 查看全部可用语音
你应看到什么:脚本依次播放各引擎合成的声音,并打印耗时对比表;改完配置重启后,对 LeLamp 说句话,听到的声音就是新引擎/新音色了。
七、语音指令快捷切换(临时)
不改配置也能临时切换,直接说:
| 你说 | 效果 |
|---|---|
| "切换到 DeepSeek" | LLM 切到 DeepSeekLLM |
| "切换到 Ollama" | LLM 切回本地 Ollama |
| "用 SenseVoice 识别" | STT 切到 SenseVoice |
| "用 FunASR 识别" | STT 切到 FunASR |
| "切换到 Edge 语音" | TTS 切到 Edge |
| "切换到 Piper 语音" | TTS 切回 Piper |
语音切换是运行时生效,重启后仍以
config.yaml为准。想要长期固定某个引擎,请用第二节的配置方式。
八、常见问题
| 问题 | 处理 |
|---|---|
| 改了配置没生效 | 执行 sudo systemctl restart lelamp 重启服务 |
| 提示 401 / Key 无效 | 检查 Key 前后是否有空格、是否过期;重新在平台生成 |
| DeepSeek 能聊天但不会开关灯 | 用的是 deepseek-reasoner(R1),换成 deepseek-chat(V3) |
| 想完全离线使用 | LLM 用 Ollama + STT 用 FunASR/SenseVoice + TTS 用 Piper/Kokoro |
| Edge 语音没声音 | 未安装 ffmpeg:sudo apt install ffmpeg |
| 中文识别不准 | STT 换成 FunASR(paraformer-zh-small)或 SenseVoice |
| 说话要很大声才识别 | 调低 VAD 阈值(microphone.local_vad_threshold 0.65→0.50),详见延伸阅读 VAD 文档 |
纠错,疑问,交流: 请进入讨论区或 请点击进入页面,扫码加入微信群或Q群进行交流
获取最新文章: 扫一扫加入“创客智造”公众号


















