
智能音箱AI语音助手改造指南5步让旧音箱用大模型和你自然对话【免费下载链接】mi-gpt 将小爱音箱接入 ChatGPT 和豆包改造成你的专属语音助手。项目地址: https://gitcode.com/GitHub_Trending/mi/mi-gpt改造完你家的智能音箱不再只会放歌和定闹钟。MiGPT 把小爱音箱接上 ChatGPT、豆包这类大模型让旧音箱变成AI语音助手。问它问题、陪它聊天、给它立人设都能自然应答。整个流程不长选一条路线Docker把整个服务打包成盒子、一条命令跑起来的工具免装环境或者源码方式改好两个配置文件启动服务然后开口和它说话。读完这篇文章你能做到完成部署、跑通第一次对话再学会换人设、连续对话、换音色三个改造。常见的六个卡点也附了自查手册。 动手前先确认这5件事设备小米生态的小爱音箱基本都支持小爱音箱 Pro 最稳。型号是否兼容查 兼容的小爱音箱型号。小度、天猫精灵、HomePod 不支持。账号一个小米账号音箱已经在米家 App 里正常使用。准备好数字的小米 ID不是手机号也不是邮箱。大模型密钥OpenAI 的 key或者通义、DeepSeek、Moonshot 等国产模型的 key。运行位置家里电脑、迷你主机、NAS 都行。不需要和音箱同一网络它走的是小米云端接口。网络用 OpenAI 需要代理直接用国产模型就省掉这个麻烦。 上手从0到第一次对话第1步拿项目备好配置模板目标把代码放到机器上准备两个配置文件。操作git clone https://gitcode.com/GitHub_Trending/mi/mi-gpt cd mi-gpt cp .migpt.example.js .migpt.js cp .env.example .env成功信号你应该看到 mi-gpt 目录下多了.migpt.js和.env两个文件。不对就查这里cp提示找不到文件说明你没在项目目录里先cd mi-gpt再执行。第2步配置账号和音箱目标告诉服务用哪个账号、控制哪台音箱。操作编辑.migpt.jsmodule.exports { speaker: { userId: 123456789, // 数字小米ID在「个人信息」里 password: 你的密码, did: 小爱音箱Pro, // 和米家一致直接复制 }, };did对大小写敏感。打开米家-音箱主页-右上角更多-设备名称复制粘贴最稳。另外ttsCommand、wakeUpCommand两个参数各型号不同。默认值大多数机型能跑跑不通再去 MIoT 规格站按型号查成功信号三个字段填完did和米家完全一致。不对就查这里报找不到设备九成是名称没对上。第3步配置大模型密钥目标告诉服务去调哪个大模型答题。操作编辑.envOPENAI_API_KEY粘贴你的密钥 OPENAI_MODELgpt-4o成功信号两行都写好了等号两边没有多余空格。不对就查这里用国产模型时变量名仍是OPENAI_*把值换成对应密钥、模型名和OPENAI_BASE_URL即可。第4步启动服务目标把 MiGPT 跑起来。两条路线二选一。镜像一键Docker不用装 Node一条命令docker run -d --env-file $(pwd)/.env -v $(pwd)/.migpt.js:/app/.migpt.js idootop/mi-gpt:latest源码需要装好 Node.js 16 以上没有 pnpm 也可以用 npmpnpm install pnpm dev成功信号终端打出 MiGPT 的字符画和服务已启动...一行随后音箱或日志里出现打招呼的话。不对就查这里提示登录验证失败 70016是账号密码错了提示触发异地登录保护要人在同一网络下登录一次小米账号通过安全验证。第5步开口聊第一句目标验证整条链路通了。操作对音箱说小爱同学请问天空为什么是蓝色的注意两个条件先说小爱同学唤醒后面跟请或你开头的问法。成功信号一两秒后音箱开始念出答案。不对就查这里没反应先检查句式正在放音乐的话先暂停再问。 背后的门道一次对话走三站把 MiGPT 想成餐厅的服务员。你说小爱同学请问天空为什么是蓝的音箱固件先把声音转成文字这叫 ASR语音识别相当于你下单。服务员接过订单递给厨房——厨房就是大模型它把你的问题做成一段答案文字。服务员再端回来音箱用 TTS把文字读成声音的技术念给你听。声音进、理解、声音出三站走完一次对话完成。如果问题跟上一句有关服务员会连着前面的订单一起递过去这就是上下文。 从能用到好用三个实用改造改造一给它立人设当孩子的故事伙伴一句话用例睡前让音箱用软萌小女孩的口吻讲童话。核心配置在.migpt.js里bot: { name: 小仙, profile: 6岁小女孩爱讲童话说话简单。, }, master: { name: 爸爸, profile: 平时陪孩子听故事。, },实际效果之后大模型都按小仙的身份回答。聊到一半也能改小爱同学你是一位严厉的老师。改造二连续对话不用每句喊小爱一句话用例连续提问时不用每次重复唤醒词。核心配置speaker: { callAIKeywords: [请, 请问, 告诉我], wakeUpKeywords: [召唤豆包], onAIReplied: [我说完了还有问题吗], },实际效果说一次小爱同学召唤豆包就进入唤醒模式之后直接提问等她说完我说完了再问下一句。想退出配一个退出词exitKeywords比如退出豆包。改造三换成更像真人的音色一句话用例嫌原厂声音机械换成豆包同款真人音色。核心配置speaker: { tts: doubao },实际效果在.env里填好你部署的 TTS 服务地址TTS_BASE_URL回答文字就由第三方 TTS 合成后播放声音明显更软、更像真人。配置细节见 常见问题 里的 TTS 章节。 问题自查手册6个最常卡住的地方1. 启动报70016登录验证失败症状服务起不来日志里有 70016。原因userId填成了手机号或邮箱或密码不对。解决小米账号「个人信息」里找数字小米 ID替换后重启。2. 提示找不到设备xxx症状初始化失败报错里带着设备名。原因did和米家不一致大小写、空格、错别字都算。解决从米家直接复制设备名称粘贴还不行就开debug: true从日志里查数字did。3. 小爱完全不理你症状说请问xxx没反应。原因没先唤醒或消息前缀不在关键词列表里。解决先说小爱同学再说请/你xxx想用别的开头改callAIKeywords。4. AI 回得慢症状问完等很久或念到一半停很久。原因模型本身慢默认参数偏保守。解决换gpt-3.5-turbo这类快模型checkInterval调成 500缩短句间停顿。5. 念到一半戛然而止症状答案说几个字就停了。原因你的型号查不到播放状态默认指令不匹配。解决按规格站查到play-control属性改playingCommand如[3, 1, 1]仍不行就关闭streamResponse。6. 大模型报Connection error症状控制台出现 LLM 响应异常 Connection error。原因国内网络直连不了 OpenAI。解决.env里加HTTP_PROXY或改用国产模型、改OPENAI_BASE_URL。改造完成接下来到这里你手里已经有一台会聊天的音箱。想再深入看这三份参数设置所有开关、提示语、关键词逐项说明。常见问题再卡住先来这里翻九成问题都有答案。工作原理了解它是怎么轮询和打断的。别收藏了再动手。从手边那台音箱开始半小时后你就能听到它回话。【免费下载链接】mi-gpt 将小爱音箱接入 ChatGPT 和豆包改造成你的专属语音助手。项目地址: https://gitcode.com/GitHub_Trending/mi/mi-gpt创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考