turtlebot3-burger_150.png
turtlebot3-waffle-pi_150.png
turtlebot3-arm_150.png
walking-y2_150.png
turbot3-multi_150.png
turbot3-dl-ros1_150.png
turbot3-ai.png
turbot3-dl-ros2_150.png
turbot3-slam_150.png
turbot3-arm_150.png
turtlebot4-lite_150.png
turtlebot4-pro_150.png
turbot4-dl_150.png
turbot4-ai_150.png
aidriving-racebot_150.png
aidriving-autodrive_150.png
turtlebot-arm_150.png
openmanipulator-x_150.png
Home » 智能台灯LeLampX快速入门教程 » 智能台灯LeLampX快速入门教程-AI提供商配置

智能台灯LeLampX快速入门教程-AI提供商配置

纠错,疑问,交流: 请进入讨论区请点击进入页面,扫码加入微信群或Q群进行交流

获取最新文章: 扫一扫加入“创客智造”公众号

AI 提供商配置

目标:学会切换 LLM(DeepSeek/Ollama)、STT 与 TTS 引擎,配置 API Key,更换 LeLamp 的声音


一、前提

  • ✅ 能打开 Web 设置界面 /settings
  • ✅ 如需改 config.yaml,准备好 SSH 终端(见教程 31 网络与远程访问)

LeLamp 的 AI 能力分三块,可独立切换:

模块 干什么 可选引擎
LLM 理解你的话、组织回答(大脑) DeepSeek(云端)/ Ollama(本地)
STT 把你的话转成文字(耳朵) SenseVoice / FunASR(暂不用) / Whisper(暂不用)
TTS 把回答念出来(嘴巴) Edge / Piper(暂不用) / Kokoro(暂不用) / gTTS(暂不用)

二、两种配置方式

方式 适用人群 说明
Web 界面 /settings → "AI 后端设置"卡片 推荐 图形化选引擎、填 API Key
编辑 config.yaml 进阶 更精细的参数;改完需重启服务

无论哪种方式,改完配置都要让配置生效:Web 方式一般自动重启,config.yaml 方式执行 sudo systemctl restart lelamp

三、切换 LLM:DeepSeek(云端)或 Ollama(本地)

先看对比,选适合你的

特性 DeepSeek V3(云端) Ollama(本地)
位置 云端 API Pi 本地
需要网络
回答质量 很好 一般
上下文 64K tokens 2K tokens
成本 按量付费 免费
需要 API Key 需要 不需要

选择建议:家里网络稳定 → DeepSeek(更聪明);想完全离线/省钱 → Ollama。

用 Web 界面切换

  1. 打开 /settings → "AI 后端设置"卡片
  2. 提供商选择 DeepSeekLLMOllamaLLM
  3. 选 DeepSeek 时填入 API Key(见第四节)

你应看到什么:仪表盘"AI 后端信息"显示当前 LLM 名称;对 LeLamp 说"现在几点了",它能正常回答。

用 config.yaml 切换

pipeline:
  llm:
    # 1. 本地 Ollama
    provider: OllamaLLM

    # 2. 云端 DeepSeek(二选一)
    provider: DeepSeekLLM
    api_key: 'sk-your-key-here'
    model: deepseek-chat        # deepseek-chat (V3) / deepseek-reasoner (R1)
    base_url: https://api.deepseek.com
    temperature: 0.7

模型选择注意deepseek-v4-flash 支持工具调用(开关灯、放音乐等);

这套实现兼容所有 OpenAI 格式的 API:OpenAI、OpenRouter、Groq、Together AI 等,只需把 base_urlapi_key 改成对应服务商的即可。

四、设置 API Key

三种方式任选其一:

方式 操作
Web 界面 /settings → AI 后端设置卡片 → 填入 API Key
环境变量(推荐) export DEEPSEEK_API_KEY="sk-你的key"(写入 ~/.bashrc 或 systemd 环境)
config.yaml pipeline.llm.api_key: 'sk-你的key'

你应看到什么:Key 填错时,LeLamp 会回复"AI 服务返回错误"(401),日志里也会记录状态码;填对后对话恢复正常。Key 要去 platform.deepseek.com 申请。

五、切换 STT 引擎(让 LeLamp 更听懂你)

三种引擎,默认是 FasterWhisper(tiny 模型):

特性 Whisper (tiny) FunASR / Paraformer SenseVoice
模型大小 ~150MB ~50MB ~50MB
Pi 内存占用 ~800MB–1GB ~200MB ~200MB
中文准确率 2星 5星 5星
英文准确率 4星 3星 4星
情感/事件检测 (高兴/悲伤/掌声/笑声)
语言自动识别 中/英/日/粤/韩

中文用户建议换 FunASR 或 SenseVoice——又准又快还省内存。 目前只使用效果最好的SenseVoice

切换步骤

# 1. 安装依赖(项目用 uv 则:uv pip install funasr onnxruntime)
pip install funasr onnxruntime

# 2. 修改 config.yaml
stt:
  provider: SenseVoiceSTT            # FasterWhisperSTT / FunASRSTT / SenseVoiceSTT
  model: paraformer-zh-small     # tiny / paraformer-zh-small / iic/SenseVoiceSmall
# 3. 重启生效
sudo systemctl restart lelamp

验证

cd ~/lelampv2
python3 scripts/test_stt_backends.py --record   # 录音并测试所有后端
python3 scripts/test_stt_backends.py --backend funasr --file test.wav

你应看到什么:测试脚本打印各后端的识别文本;换用 FunASR 后说同一句中文,识别准确率明显更高。SenseVoice 还能额外识别情感(高兴/悲伤/愤怒/中性)和事件(掌声/笑声/音乐)。

六、切换 TTS 引擎与语音(给 LeLamp 换声音)

四种引擎:

特性 Edge TTS gTTS Kokoro Piper
网络 需要 需要 离线 离线
中文音质 5星 3星 4星 4星
语音选择 200+ 多口音 按语言自动 ~10 种 每 voice 一个文件
音调控制 rate/pitch speed

推荐优先级edge-tts(在线、免费、音质最好)> kokoro(离线)> gTTS > piper。 目前只使用效果最好的dge-tts

切换步骤

# 1. 安装依赖(Edge 需要 ffmpeg 解码)
pip install edge-tts
sudo apt install ffmpeg
# 2. 修改 config.yaml
tts:
  provider: edge                 # edge / gtts / kokoro / piper
  voice: zh-CN-XiaoxiaoNeural    # 各后端独立命名
  lang: zh
  edge:
    rate: "+0%"                  # 语速,如 "+20%" 加快
    pitch: "+0Hz"                # 音调

常用中文语音

引擎 语音 ID 听感
Edge zh-CN-XiaoxiaoNeural 晓晓,女声(推荐)
Edge zh-CN-YunxiNeural 云希,男声
Edge zh-CN-XiaoyiNeural 晓伊,女声,情感丰富
Edge zh-TW-HsiaoChenNeural 晓臻,台湾国语
Edge zh-HK-HiuGaaiNeural 晓佳,粤语
Kokoro zf_heart 中文女声(离线)
Kokoro zm_heart 中文男声(离线)

验证

cd ~/lelampv2
python3 scripts/test_tts_backends.py --quick            # 单句对比所有后端并播放
python3 scripts/test_tts_backends.py --list-voices      # 查看全部可用语音

你应看到什么:脚本依次播放各引擎合成的声音,并打印耗时对比表;改完配置重启后,对 LeLamp 说句话,听到的声音就是新引擎/新音色了。

七、语音指令快捷切换(临时)

不改配置也能临时切换,直接说:

你说 效果
"切换到 DeepSeek" LLM 切到 DeepSeekLLM
"切换到 Ollama" LLM 切回本地 Ollama
"用 SenseVoice 识别" STT 切到 SenseVoice
"用 FunASR 识别" STT 切到 FunASR
"切换到 Edge 语音" TTS 切到 Edge
"切换到 Piper 语音" TTS 切回 Piper

语音切换是运行时生效,重启后仍以 config.yaml 为准。想要长期固定某个引擎,请用第二节的配置方式。

八、常见问题

问题 处理
改了配置没生效 执行 sudo systemctl restart lelamp 重启服务
提示 401 / Key 无效 检查 Key 前后是否有空格、是否过期;重新在平台生成
DeepSeek 能聊天但不会开关灯 用的是 deepseek-reasoner(R1),换成 deepseek-chat(V3)
想完全离线使用 LLM 用 Ollama + STT 用 FunASR/SenseVoice + TTS 用 Piper/Kokoro
Edge 语音没声音 未安装 ffmpeg:sudo apt install ffmpeg
中文识别不准 STT 换成 FunASR(paraformer-zh-small)或 SenseVoice
说话要很大声才识别 调低 VAD 阈值(microphone.local_vad_threshold 0.65→0.50),详见延伸阅读 VAD 文档

纠错,疑问,交流: 请进入讨论区请点击进入页面,扫码加入微信群或Q群进行交流

获取最新文章: 扫一扫加入“创客智造”公众号


标签: LeLampX, LeLamp2