资讯详情

小爱音箱怎么变成 AI 语音助手?MiGPT 小爱音箱接入 ChatGPT 实操指南

📅 2026/9/13 15:01:37 | 华诺云谱 👁 阅读
小爱音箱怎么变成 AI 语音助手?MiGPT 小爱音箱接入 ChatGPT 实操指南
小爱音箱怎么变成 AI 语音助手MiGPT 小爱音箱接入 ChatGPT 实操指南【免费下载链接】mi-gpt 将小爱音箱接入 ChatGPT 和豆包改造成你的专属语音助手。项目地址: https://gitcode.com/GitHub_Trending/mi/mi-gptMiGPT 是一个把小爱音箱接入 ChatGPT 等大语言模型的开源项目让它变成能接上下文、会记对话、还能扮演人设的小爱音箱 AI 助手。家里有闲置的小爱音箱、一台装了 Docker 的机器就可以按这篇文章把它跑起来。先跑起来Docker 部署只需两步一个命令 部署只需要两个配置文件加一条命令。服务跑在你的服务器上通过小米云端开放接口和音箱通信不需要和小爱音箱在同一局域网。第一步准备.env填模型密钥。三个变量就够了OPENAI_MODEL模型名、OPENAI_API_KEY密钥、OPENAI_BASE_URL服务地址。不用 OpenAI 官方也没关系把OPENAI_BASE_URL换成通义千问、DeepSeek、Moonshot 等服务的兼容端点即可。第二步准备.migpt.js填人设和设备信息。三个容易错的地方userId填小米 ID在账号「个人信息」里查看不是手机号password是账号密码did填米家里的设备名建议原样复制或设备 did。第三步一条命令启动docker run -d --env-file $(pwd)/.env \ -v $(pwd)/.migpt.js:/app/.migpt.js \ idootop/mi-gpt:latestWindows 终端下要把$(pwd)换成绝对路径。日志里出现「服务已启动」就算部署成功。上手体验接入 ChatGPT 后能做什么启动后有三种方式唤起 AI直接唤起「小爱同学请问地球为什么是圆的」——以「请」「你」等关键词开头的消息会直接交给大模型人设唤起「小爱同学你喜欢我吗」唤醒模式「小爱同学召唤傻妞」进入连续对话之后不用每句都说「小爱同学」等它答完接着问就行和传统音箱的差异很明显原版小爱只能识别固定指令听不懂就答「不知道」接入 MiGPT 后回复由大模型生成开放式提问、角色扮演都能接住。另一个亮点是记忆每轮对话都会写入数据库累计到一定数量后异步生成短期记忆近期对话摘要和长期记忆缓慢滚动的画像下次对话时自动带进请求聊得越多越「懂你」。具体逻辑可以看 对话管理源码。背后原理一次完整对话的旅程MiGPT 并不是「直连」大模型它依赖小米 IoT 开放接口一轮对话走四步拾音唤醒音箱本地固件完成语音识别MiGPT 轮询云端接口拿到设备的最新对话列表大模型处理检测到唤醒关键词后把「人设 聊天历史 记忆摘要」拼成系统提示词发给大模型记忆检索与写入当前对话异步入库达到阈值后由摘要代理生成新的短、长期记忆流式播回回复按句切分经 TTS 合成语音逐句播放到音箱唤醒模式下还会持续检测播放状态才能做到连续对话轮询、打断和流式播放的实现细节见 设备控制源码 与 工作原理 文档。这也解释了为什么会有 1-2 秒「小爱抢话」从小爱开口到 MiGPT 轮询感知到状态变化中间隔着网络延迟属于当前方案的固有限制。调优与个性化人设和模型怎么切 人设配置在.migpt.js里就两块export default { bot: { name: 傻妞, profile: 性别女乖巧可爱喜欢搞怪爱吃醋。, }, master: { name: 陆小千, profile: 性别男善良正直是傻妞的主人。, }, };bot是音箱的角色master是你的画像仓库里的示例还附了一个systemTemplate模板可以控制回复风格。甚至不用改文件直接语音也能临时换人设「小爱同学你是 xxx你 xxx」。模型切换不用改代码改.env里三个变量国产模型把OPENAI_BASE_URL指向兼容端点本地模型用 Ollama 这类自带 OpenAI 兼容接口的工具地址填本地端口国内环境连不上 OpenAI 官方时配HTTP_PROXY即可。踩坑指南常见问题与处理问题大多集中在账号登录、设备匹配和网络三类现象可能原因处理办法70016 登录验证失败小米 ID 或密码错误userId填小米 ID 而非手机号触发异地登录保护账号被风控同一网络登录小米账号通过安全验证约 1 小时后重试提示找不到设备did 与米家不一致原样复制设备名或开调试开关从日志里找 didLLM Connection error网络访问不到模型服务配置代理或改用国内模型401 Invalid AuthenticationAPI Key 无效或未生效检查密钥与环境变量回复了但不发声ttsCommand与型号不匹配查你型号的play-text指令改配置说话总戛然而止播放状态查询参数缺失查playingCommand参数并填上响应慢、停顿长默认参数偏保守调小checkInterval换响应更快的模型表格最后两行需要查你型号的命令编号先在 MIoT 规格查询站搜音箱型号如lx06打开规格文档Intelligent Speaker 下的play-text对应ttsCommandwake-up对应wakeUpCommand说话戛然而止的情况则在文档里找 Play Control 的playing-state属性把对应值如[3, 1, 1]填进playingCommand还卡住的话看 常见问题文档里面有更细的说明比如异地登录失败后导出.mi.json挂到服务器上的做法。写在最后MiGPT 说明了一件事让音箱「接上大模型」不需要新硬件只要读得到对话列表、放得出语音开放接口就够用。多模态交互、米家设备联动这些方向也已在它的路线图上。另外提醒一句项目作者已宣布停止更新遇到新机型或新模型时优先翻官方 FAQ 和社区教程。【免费下载链接】mi-gpt 将小爱音箱接入 ChatGPT 和豆包改造成你的专属语音助手。项目地址: https://gitcode.com/GitHub_Trending/mi/mi-gpt创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
📝

华诺云谱内容团队

资深建站顾问 · 行业研究员

10年+企业数字化服务经验,专注智能建站、SEO优化与品牌营销,持续输出建站技巧、行业洞察与营销干货,已帮助5000+企业实现数字化增长。

你可能需要的服务

订阅华诺云谱资讯周报

每周一封,精选建站技巧、SEO与营销干货,直达邮箱。已有 8,000+ 企业主订阅,助你少走弯路。