ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

MiGPT 快速上手指南:小爱音箱接入 ChatGPT 和豆包,完成音箱 AI 升级

MiGPT 快速上手指南:小爱音箱接入 ChatGPT 和豆包,完成音箱 AI 升级 MiGPT 快速上手指南小爱音箱接入 ChatGPT 和豆包完成音箱 AI 升级【免费下载链接】mi-gpt 将小爱音箱接入 ChatGPT 和豆包改造成你的专属语音助手。项目地址: https://gitcode.com/GitHub_Trending/mi/mi-gptMiGPT 是一个开源项目把小米小爱音箱接入 ChatGPT、豆包等大语言模型让原本只会固定话术的音箱完成 AI 升级。它本身是一个跑在你自己电脑或服务器上的 Node.js 服务通过小米 IoT 云端接口轮询音箱的对话记录检测到提问类消息后交给大模型处理再把回答以 TTS 的形式放回音箱播出。下面按实际使用流程讲清楚先确认设备能不能用再部署然后配置最后聊聊它的边界。开始前先看两件事设备兼容性。MiGPT 支持大部分小爱音箱型号其中小爱音箱 ProLX06体验最完整推荐优先使用。完整型号列表和每个型号对应的指令参数在 docs/compatibility.md其中分三档完美运行、正常运行不支持连续对话、不支持。注意它只适配小米系设备小度、天猫精灵、HomePod 都不在范围内也没有适配计划。维护状态。项目已停止维护不再有新功能和 bug 修复。不过现有代码和 Docker 镜像是完整的存量功能可以正常使用遇到新机型或新问题需要自行排查或在社区求助。如果刚入手且设备是小爱音箱 Pro也可以关注作者的后续同类项目。MiGPT 部署Docker 一条命令Node.js 留给开发者部署前先克隆项目并准备配置文件示例文件改名即可字段说明见下一节git clone https://gitcode.com/GitHub_Trending/mi/mi-gpt cd mi-gpt cp .migpt.example.js .migpt.js cp .env.example .envDocker 方式推荐填好两个配置文件后docker run -d --env-file $(pwd)/.env -v $(pwd)/.migpt.js:/app/.migpt.js idootop/mi-gpt:latestWindows 终端下$(pwd)不可用改成配置文件的绝对路径即可。服务不要求和小爱音箱在同一局域网走的是小米云端接口放在家里的 NAS、树莓派或云上服务器都行。Node.js 方式适合想读代码或二次开发的开发者npm install mi-gpt后调用MiGPT.create()初始化注意此模式不自动读取.env和.migpt.js参数要手动传入本地调试开发流程参考 docs/development.md。MiGPT 配置.migpt.js 和 .env 两个文件.env管模型.migpt.js管音箱和角色。完整的字段说明在 docs/settings.md这里只挑关键字段// .migpt.js 核心字段 export default { bot: { name: 傻妞, profile: 性格乖巧可爱喜欢搞怪。 }, // AI 的人设 master: { name: 你的名字, profile: 你的简介 }, speaker: { userId: 987654321, // 小米 ID在账号个人信息页查看不是手机号/邮箱 password: 你的密码, did: 小爱音箱Pro, // 米家中的设备名称需逐字一致 ttsCommand: [5, 1], // TTS 指令因型号而异 wakeUpCommand: [5, 3], // 唤醒指令因型号而异 callAIKeywords: [请, 傻妞], // 以这些词开头的消息交给 AI wakeUpKeywords: [召唤傻妞], // 进入连续对话模式的关键词 exitKeywords: [退出傻妞], }, };ttsCommand和wakeUpCommand是型号强相关的参数不同型号数值不同。如果音箱收到消息但不发声大概率是这里填错了可到 MIoT 规格页面按型号查指令docs/compatibility.md 里也整理了各型号的现成值接入非 OpenAI 的大模型通义千问、DeepSeek、豆包MiGPT 底层用的是 OpenAI SDK所以任何提供 OpenAI 兼容接口的模型都能直接接。只需改.env环境变量名不变OPENAI_API_KEY你的密钥 OPENAI_MODELgpt-4o OPENAI_BASE_URLhttps://api.openai.com/v1 # 换成对应服务的地址以通义千问为例把OPENAI_BASE_URL指向阿里云的兼容模式地址、OPENAI_MODEL填qwen-turbo即可DeepSeek、MoonshotKimi等改法相同。不兼容 OpenAI 接口的模型豆包、文心一言等则需要先部署 OneAPI 之类的聚合服务做格式转换再指向它的地址。本地部署的 Ollama、LM Studio 自带兼容接口同样直接填地址就能用。更细的申请和配置步骤可查 docs/faq.md 里的模型小节。交互方式三种说话模式服务跑起来后音箱的交互分三层行为不同你说的话实际行为小爱同学请 xxx / 你 xxx仅这一条消息交给大模型回答答完回到原状适合单问单答小爱同学召唤傻妞wakeUpKeywords进入 AI 模式之后连续提问都不用小爱同学开头静默 30 秒后自动退出exitKeepAliveAfter可调小爱同学退出傻妞exitKeywords主动退出 AI 模式连续对话属于实验性功能且依赖音箱能正确上报播放状态。部分型号如 Play 增强版 L05C查不到状态需要把streamResponse设为false此时 AI 模式不可用只能单问单答。进入 AI 模式后注意等它说完我说完了再提问如果误触发播放了音乐先让它暂停再对话。更多交互细节见 docs/faq.md。人设定制、长短期记忆与换声音角色感主要来自三处配置。第一是systemTemplate这是发给大模型的系统提示词内置模板已经带上了聊天记录、短期记忆和长期记忆变量想完全自定义行为规则可以改它变量含义见 docs/prompt.md。第二是bot.profile和master.profile两个人设简介AI 会据此调整语气和称呼应法对话中也能临时改设定直接说小爱同学你是 xxx。第三是记忆机制服务会自动从对话中提炼短期记忆、再沉淀为长期记忆存在本地 SQLite 里所以聊得越多它越了解你的偏好代价是每次对话会多消耗一些 token介意的话可以用精简版 Prompt 关掉记忆变量。声音方面默认走小米自带 TTS。想换成豆包同款音色需要自己搭一个 TTS 服务官方配套项目接入了火山引擎实名后有免费音色额度在.env里填TTS_BASE_URL、把speaker.tts改成custom即可之后语音说把声音换成 xxx就能切换音色完整步骤在 docs/tts.md。限制与避坑已知问题清单这几个是实际使用中最容易踩的点先了解可以省不少排查时间原小爱会抢话。AI 回复前原版小爱可能先开口项目通过播静音音频来打断它但云端轮询有 12 秒延迟做不到完全静默。原理和原因见 docs/how-it-works.md。小米账号异地登录保护。在非日常网络环境尤其海外服务器启动时可能触发安全验证需要在相同网络下先登录小米官网手动通过验证海外节点还需同意个人数据跨境传输协议。共享设备不支持。音箱如果是账号共享设备MiNA 接口取不到它服务无法启动。did 要逐字匹配。米家中设备名称的空格、大小写、别字都会导致找不到设备建议直接从米家 App 复制实在对不上就开debugenableTrace从日志里取miotDID填进去。OpenAI 访问问题。国内网络直连 OpenAI 会报 Connection error要么配代理HTTP_PROXY要么改用国内模型或第三方反向代理服务。更多帮助在哪找遇到问题先查 docs/faq.md覆盖启动失败、播放异常、网络异常三大类参数含义看 docs/settings.md设备型号和指令看 docs/compatibility.mdPrompt 变量和现成模板看 docs/prompt.md。仓库里的 assets/pdf 目录还有官方教程和 Unraid 部署的 PDF适合跟着一步步操作。项目已停止维护建议配置好自己的参数并留一份.migpt.js、.env和数据库文件的备份方便日后迁移环境时直接用。【免费下载链接】mi-gpt 将小爱音箱接入 ChatGPT 和豆包改造成你的专属语音助手。项目地址: https://gitcode.com/GitHub_Trending/mi/mi-gpt创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表