小爱音箱怎么接入大模型:MiGPT本地部署完整教程(10分钟搞定)
【免费下载链接】mi-gpt🏠 将小爱音箱接入 ChatGPT 和豆包,改造成你的专属语音助手。项目地址: https://gitcode.com/GitHub_Trending/mi/mi-gpt
你问小爱音箱一个问题,它只回你一段官方腔的套话,而且对话还绕去了你看不见的云端。MiGPT 解决的就是这件事:它把小爱音箱接入 ChatGPT 等开源或商用大模型,改造成能闲聊、能演人设、还记得你聊过什么的专属语音助手,适合想在自家机器上跑大模型服务的小米用户。部署完成后,说一句"小爱同学,请问天空为什么是蓝的",音箱就会用自然语言答你。
MiGPT 能力速览:装好之后你直接得到什么
装完即得,不用二次开发:
- AI 问答:天文地理、写作改稿都能答,不再是"这个问题我还在学习中"
- 角色扮演:在配置文件里写一段人设,音箱就按这个人设跟你说话
- 长短期记忆:自动保存近期对话和关键细节,聊得越久越懂你的上下文
- 流式应答:大模型边生成边播报,不用等整段回答读完才开口
- 自定义 TTS:可接第三方 TTS 服务,换音色不用改配置,说一声就行
部署前准备清单
把下面 5 样东西备齐,后面基本不会卡:
- 一台在支持列表里的小爱音箱,推荐小爱音箱 Pro(运行最完整),完整型号与对应参数见 docs/compatibility.md
- 一台装了 Docker 的电脑(Linux / macOS / Windows 均可),服务会一直跑在这台机器上
- 小米账号的小米 ID和账号密码——小米 ID 在账号"个人信息"页,不是手机号或邮箱
- 一个大模型服务的 API Key:OpenAI 官方或任何兼容 OpenAI API 的服务(通义千问、DeepSeek 等)
- 如果手头音箱型号不在兼容列表里,先去米家规格站搜型号,确认它有没有 play-text 和 wake-up 两条指令,没有就不用试了
MiGPT Docker 部署步骤
全程 3 步,10 分钟内能听到第一声回答。
第 1 步:拉取项目代码。
git clone https://gitcode.com/GitHub_Trending/mi/mi-gpt cd mi-gpt验证:目录里能看到.env.example和.migpt.example.js两个示例配置文件。
第 2 步:改出两份配置,一份管"谁来思考",一份管"接管哪台音箱"。
# .env(由 .env.example 改名):决定"谁来思考" OPENAI_MODEL=gpt-4o-mini # 使用的模型名 OPENAI_API_KEY=sk-xxxx # 你的大模型服务密钥 # OPENAI_BASE_URL=https://api.openai.com/v1 # 自建或第三方模型服务时才填 // .migpt.js(由 .migpt.example.js 改名):决定"接管哪台音箱" speaker.userId: "你的小米ID" // 个人信息页的小米ID,不是手机号 speaker.password: "你的账号密码" speaker.did: "小爱音箱Pro" // 米家里设置的名称,空格大小写都要一致验证:两个文件都已改名并写入密钥与音箱信息。
⚠️did以米家里显示的名称为准,多一个空格、错一个大小写都连不上;userId 填错时日志会直接报登录失败,回头核对"个人信息"页即可。
第 3 步:后台启动 Docker 容器。
docker run -d --env-file $(pwd)/.env -v $(pwd)/.migpt.js:/app/.migpt.js idootop/mi-gpt:latest验证:跑docker logs -f <容器名>,日志出现"服务已启动..."后,对着音箱喊"小爱同学,请问地球为什么是圆的",有语音应答就算部署成功。
⚠️ Windows 终端不识别$(pwd),把两处换成 .env 和 .migpt.js 的实际绝对路径。
⚠️ 改完配置必须重启容器才生效;重启仍不生效时,删除旧容器重新创建一次。
常见失灵情况速查
90% 的翻车都落在这 4 种现象里,对着表查就行:
| 现象 | 原因 | 处理 |
|---|---|---|
| 音箱完全不应答 | userId或did填错 | 对照"个人信息"页的小米 ID 和米家设备名,逐字核对后重启容器 |
| 改了配置没反应 | Docker 还在跑旧配置 | 先重启容器;不行就删掉旧容器用第 3 步命令重新创建 |
| 不出声 / 唤醒失灵 | 这款音箱的ttsCommand、wakeUpCommand编号不同 | 去米家规格站查 play-text 和 wake-up 两项,填进对应字段,最常见是 [5,1] 和 [5,3] |
| 连续对话时断句、重复播报 | 机型查不到正确的播放状态 | 把streamResponse改成false,回到单句问答模式 |
更多细节可以看 docs/faq.md,支持模型接入、TTS 替换等问题都有现成答案。
进阶调优:3 个最影响说话手感的参数
全部在 docs/settings.md 里,改完重启容器生效:
wakeUpKeywords和exitKeywords→ 把默认词改成你自己的口令:喊"小爱同学,召唤傻妞"就进入 AI 模式,之后直到你说"退出"为止,中间不用按按钮、不用开 AppcallAIKeywords→ 控制哪些词一开口就交给 AI,默认"请""你"开头就走大模型,加一个"嘿","嘿,为什么天是蓝的"也能触发streamResponse和exitKeepAliveAfter→ 打开连续对话后每句话都不用再喊"小爱同学";无响应满 30 秒(默认值)自动退出,机型播放状态不稳时直接把streamResponse关掉最稳
接下来做什么
核心链路通了之后,米家联动、本地音乐、日程提醒这些扩展方向在 README.md 的项目列表里都有现成入口,项目的后续计划写在 docs/roadmap.md。今晚就可以验收:对着音箱喊一句"小爱同学,召唤傻妞",看它是不是用你设定的人设回你。
【免费下载链接】mi-gpt🏠 将小爱音箱接入 ChatGPT 和豆包,改造成你的专属语音助手。项目地址: https://gitcode.com/GitHub_Trending/mi/mi-gpt
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考