
MiniMax这波更新确实来得又快又狠。Token Plan 正式退役M Plan 以“全模态额度大一统”的方式接棒最直观的变化就是 H3 视频不再需要单独按条算账文本、图片、视频共享一个额度池更让人意外的是官方还开放了一套兼容 Claude Code 与 Cursor 的接入方式配置一次之后日常编码、写脚本、剪分镜可以在同一个工作流里来回切换。这篇文章打算把 M Plan 的规则变化、H3 解禁后的实际玩法以及 Claude Code 和 Cursor 的免密配置一条龙讲清楚。无论你是刚接触 AI 工具的新手还是已经在用 Cursor 和本地模型的老玩家这篇都值得收藏。1. M Plan 到底改了什么从 Token Plan 到“一套额度走全场”1.1 Token Plan 时代大家为什么头疼先聊点背景。旧版 Token Plan 的逻辑本质上是“按 Token 计费”的思路。文本对话和写作这种任务模型每次返回的内容都折成 Token 消耗看起来清晰但一到多模态场景就非常割裂。你要生成一张图、一段视频Token Plan 并不能帮你把这些任务纳入同一个计量单位经常是文本还有余量视频或者图像资源已经单独触发另一套扣费规则。这种割裂带来的实际痛点有两个算不清楚同一段时间内你既在跑文本智能体又在生成参考视频最后账单里出现两种完全不同的消耗维度根本没法快速判断成本花在哪。心态负担重每次调用推理模型做一个小实验都要盯着 Token 消耗反而把真正该关注的业务逻辑抛到了一边。M Plan 出现的意义就是把这些零散的计费维度收拢在一起。视频、文本、图片统一进入一个额度池不用再在几个页面之间切换查看消耗也不用记那些繁琐的换算关系。对我这种同时写代码和做视频实验的人来说体验提升非常明显。1.2 M Plan 的额度池机制M Plan 的额度机制可以简单理解成一个“全模态通行证”你在一个周期内获得一个总额度然后无论你用它来跑文本对话、让模型写代码、生成图片还是调用 H3 生成视频都从这个池子里统一扣减。这样做的好处是使用场景之间的壁垒被拆掉了。以前做一个工作流可能先要用文本模型生成分镜脚本再单独为视频素材充值中间涉及到切换套餐或者给两个不同账户充值。M Plan 直接把这条路拉直了写脚本、画参考图、生成视频预告片全都在同一个额度体系内流转。实际使用时我个人建议把它看作一个“项目预算”而不是单纯的“Token 余额”。因为当你把视频这类高消耗任务也纳入同一个池子之后真正要关心的是单次任务的真实成本占比。用一个不太严谨但容易理解的类比旧方案是按“字数”买墨水M Plan 更像是按“画布”买颜料你画多少个字、涂多大面积的色块都从整盒颜料里出不再区分这笔是写字用的、那笔是画画用的。1.3 H3 视频解禁的实际收益H3 是 MiniMax 在视频生成方向上的主力模型之前受限于独立的视频计费规则很多时候做视频测试需要额外开启单独的计费通道。M Plan 把视频也纳入了统一额度之后等于“解禁”了 H3 的日常使用门槛。现在你可以在同一个 M Plan 账户下反复迭代视频方案而不需要担心视频调用走的是另一套资源。这里有一个容易被忽略的重点H3 生成视频的“提示词”和文本模型的提示词完全不是一个量级。以我的实测经验5 秒短视频的提示词一般控制在 60 到 120 字左右比较合适过短会让模型自由发挥过长则会稀释关键信息。如果是生成一分钟的长视频那就不只是写一段提示词的事而是要拆成 8 到 12 个分镜每个分镜单独写 80 到 200 字的细节描述包括主体、运动轨迹、光影变化和转场方式。为了方便对比我把 Token Plan 和 M Plan 的核心差异整理成了下面的表格对比维度Token Plan 时代M Plan 时代计费逻辑文本按 Token视频和图片另算全模态共用额度池视频生成H3 需要独立开通/单独扣费H3 直接从统一额度中扣减工作流衔接不同任务要切换不同套餐写脚本、出视频、跑代码一条线走通消耗感知分散、难统计单一额度池余额透明2. 为什么 Claude Code 和 Cursor 能“免密”打通 MiniMax2.1 免密的前提API 密钥与兼容端点先澄清一个概念所谓的“免密打通”不是完全不要密钥而是指配置一次之后无需在各个工具的登录页面反复粘贴密钥、反复授权。真正起作用的是 API 密钥加兼容端点这套机制密钥是你的身份凭证兼容端点则是让 Claude Code 或 Cursor 能够用它们熟悉的协议去访问 MiniMax 的模型服务。怎么理解兼容端点你可以把它想象成一个“翻译官”。Claude Code 默认会跟 Anthropic 官方的接口通信而 MiniMax 提供了一个协议格式与 Anthropic 接近的接入地址Claude Code 只要把请求发到这个地址MiniMax 就能用自己的模型来回应双方不需要互相学习对方的方言。这也是 MiniMax 高明的地方。它没有逼着用户抛弃现有的编码工具链而是直接把 MiniMax 的能力塞进了你已经在用的终端和编辑器里。用户不需要改变操作习惯只需要改变环境变量指向的目标技术上成本极低迁移体验却很顺滑。2.2 Claude Code 的接入原理Claude Code 本质上是命令行里的一个编程助手通常通过 npm 安装。它默认会读两个关键环境变量ANTHROPIC_BASE_URL决定请求发送到哪个服务器。ANTHROPIC_AUTH_TOKEN决定服务器如何识别你的身份。当你把ANTHROPIC_BASE_URL指向 MiniMax 提供的兼容地址再把ANTHROPIC_AUTH_TOKEN换成 M Plan 的访问令牌Claude Code 就会把请求发往 MiniMax。整个过程中Claude Code 以为自己还在跟原来的接口对话实际上后端已经切换成了 MiniMax 模型。这里有个额外好处因为配置发生在环境变量层面所以 VSCode 里的终端、Windows Terminal、macOS 的 iTerm 等工具都能统一生效不需要每个应用单独设置一遍。对经常切换编辑器的人来说这个通用性非常舒服。2.3 Cursor 的接入原理Cursor 虽然是一个完整的编辑器但它的底层同样支持自定义模型端点。打开 Cursor 的设置面板找到模型配置区域你可以添加一个自定义模型填入 MiniMax 的兼容地址和 API 密钥然后把模型名指定为你希望调用的那个。配置完成后Cursor 的对话框就会走 MiniMax 的通道。很多人第一次配置时会犯一个错误在 Cursor 里填入密钥后就以为万事大吉但忘了检查请求地址是否存在路径层级差异。不同服务商的兼容端点地址可能带上一段特定的路径少一个斜杠或多一个单词都会导致请求 404。我的习惯是配置之后先用最简单的“你好”测试确认能跑通再做正经任务。额外提一个和 Cursor 相关的实用点中文回复设置。你可以在 Cursor 的设置里找到 Rules for AI加一条“Always respond in Chinese”这样 AI 默认就会用中文回答。如果你用的是 Mac 或 Windows 最新版 Cursor界面语言也能在偏好设置里切换为中文具体路径通常是 Settings General Language。3. 手把手配置M Plan 额度接入 Claude Code 与 Cursor3.1 第一步获取访问凭证所有接入动作之前必须先在 MiniMax 开放平台完成账户注册并升级到 M Plan然后在控制台里创建 API 密钥。创建密钥时建议给它起一个能区分用途的名字比如“mplan-coding”这样如果后续需要轮换或者吊销你能快速定位是哪条链路在用它。拿到密钥之后先别急着粘到工具里把它放在一个安全的位置。我自己的做法是保存到一个本地密码管理器里而不是随手写在笔记中毕竟这个密钥相当于你额度池的钥匙泄露出去别人就能用你的额度跑任务。对应关系如下配置项Claude CodeCursor身份凭证ANTHROPIC_AUTH_TOKENAPI Key 输入框请求地址ANTHROPIC_BASE_URLBase URL 输入框模型标识由服务端决定默认模型手动填入模型名3.2 第二步配置环境变量Windows 10 下打开 PowerShell建议以管理员身份执行setx ANTHROPIC_BASE_URL https://api.minimaxi.com/anthropic setx ANTHROPIC_AUTH_TOKEN 你的M Plan访问令牌注意setx设置的环境变量不会立刻在当前窗口生效你需要重新打开一个终端窗口。很多人在这里踩坑设置完发现命令还是报错就是因为没有重开终端代码读取到的仍是旧环境变量。macOS 和 Linux 用户更简单在~/.zshrc或~/.bashrc中加入export ANTHROPIC_BASE_URLhttps://api.minimaxi.com/anthropic export ANTHROPIC_AUTH_TOKEN你的M Plan访问令牌然后执行source ~/.zshrc让它立刻生效。以上地址和变量名请以你账户控制台里实际生成的信息为准不同时期控制台展示的接入点可能略有差异配置时务必复制官方文档给出的完整地址不要手动拼写。3.3 第三步安装并运行 Claude CodeClaude Code 的安装依赖 Node.js 环境。先确认本机 Node 版本在 18 以上然后执行npm install -g anthropic-ai/claude-code安装之后直接输入claude启动如果环境变量配置正确它就会在终端里启动交互界面。你可以直接让它“检查当前目录的 Python 文件并给优化建议”或者“写一个批量重命名文件的脚本”观察它的回复是否来自 MiniMax 模型。如果你平时使用 VSCode可以直接在 VSCode 的终端里启动claude这样左边是代码、右边是对话体验比只在系统终端里运行更顺手。VSCode 不需要额外装 Claude Code 插件终端继承环境变量后自然生效。3.4 第四步Cursor 自定义模型与中文回复打开 Cursor进入 Settings找到 Models 配置区域。添加自定义模型时模型名可以填minimax-m2这类文本模型标识也可以填兼容列表里的其他型号。Base URL 填 MiniMax 提供的兼容端点API Key 填上一步创建的访问令牌。填写完成后务必点击“验证”或者直接发一条消息测试。如果提示连接失败优先检查 Base URL 是否多了空格、协议头是否正确。中文回复的设置路径如下打开 Settings Rules for AI写入Always respond in Chinese. Use Simplified Chinese by default.保存后Cursor 里的 AI 会用中文回答你。如果你希望编辑器界面本身也显示中文可以在 Settings General Language 中切换为简体中文。4. 实战组合H3 视频创作 ComfyUI 本地显存优化4.1 从 0 到 1 生成一段 H3 视频H3 模型最吸引人的地方是它能直接通过自然语言生成视频片段。在 M Plan 额度支持下你可以直接走官方平台生成短视频也可以调用 API 把它接入自己的脚本流程。我建议新手先按这个步骤练手明确视频时长。5 秒适合做单个镜头60 秒则需要完整分镜。写主提示词。5 秒视频建议 60 到 120 字包含主体、环境、动作、镜头语言。拆解分镜。60 秒视频先拆成 8 到 12 个分镜每个分镜写独立提示词。统一风格。在提示词里固定“关键词画面描述氛围”避免分镜之间风格断裂。举个例子一个 5 秒的“茶杯在清晨窗边冒烟”的视频提示词可以写成清晨阳光从左侧窗户照进室内木质桌面上放着一只白色陶瓷茶杯杯口冒出缕缕水汽水汽在光线下缓慢飘动背景是虚化的绿色盆栽镜头缓慢推近整体色调温暖安静电影感构图。一分钟视频则要像导演写分镜那样处理每个分镜的提示词都要有明确的开始状态和结束状态同时在结尾分镜里提示“画面淡出”。4.2 ComfyUI 接入 H3 模型ComfyUI 是很多视频创作者常用的节点式工作流工具。接入 H3 模型时通常需要先确认本地安装的 ComfyUI 版本是否支持该模型的节点然后在模型目录里放入 H3 的模型文件重启 ComfyUI 后刷新节点列表找到对应的视频生成节点把图像或文本输入接进去。这里要特别提醒ComfyUI 的节点生态更新非常快H3 模型的节点可能存在多个版本。安装时优先选择官方仓库或社区维护量最大的版本安装后先跑一次默认配置确认能出图再调整参数。如果你同时在本机运行 Ollama可以额外跑一个小尺寸语言模型用来辅助生成视频节点的提示词本地生成后复制到 ComfyUI 节点里用完全不消耗 M Plan 的在线额度。4.3 本地部署 H3 的显存策略如果你选择本地部署 H3显存是硬指标。很多人跑大模型时发现显存占用上不去或者甚至直接爆显存往往不是因为显卡不行而是部署参数没调对。首先如果开启“内存高效模式”后显存占用偏低、推理速度变慢这是正常的它是在用时间换显存。想要提高显存占用率可以尝试增大 batch size、关闭不必要的内存优化开关、使用 fp16 或 bf16 精度加载模型。不同精度对显存占用和画质的影响差异明显建议先用低分辨率测试几轮记录稳定后的显存占用数据再决定是否上调。Windows 10 部署时还要注意一个容易忽略的点确保显卡驱动已经更新到较新版本否则部分依赖 CUDA 的算子可能跑不起来。如果你用的是海光 K100 这类国产加速卡需要额外确认加速框架是否支持对应模型并且参考官方给出的速度指标来设定合理预期。部署完成后建议做一个简单的视频生成压力测试连续生成几次短片段观察显存曲线是否稳定再用作长期工作流。5. 常见问题速查与避坑记录5.1 高频问题与排查思路下面这份速查表是我实际配置和运行过程中遇到的高频问题以及对应的处理思路现象可能原因处理建议Claude Code 启动即报错环境变量未生效重开终端输入echo $env:ANTHROPIC_AUTH_TOKEN检查是否读到了密钥Cursor 自定义模型无法保存Base URL 末尾路径冲突删除地址末尾多余斜杠重新添加模型视频生成失败且提示服务不可用密钥权限不足或额度池用完去控制台查看密钥状态和剩余额度生成的视频风格不统一分镜提示词缺少共同风格锚点在每一段提示词里固定相同的关键词和氛围描述本地部署 H3 时显存不足精度设置过高或开了内存优化切换 fp16/bf16适当降低 batch size终端里claude命令找不到Node 版本过旧升级 Node 到 18重装 Claude Code还有一个出现频率很高的场景Claude Code 启动后提示账户权限受限。遇到这种情况先检查系统里是否残留了旧的环境变量比如ANTHROPIC_API_KEY如果有先清除它然后重新设置 M Plan 对应的ANTHROPIC_AUTH_TOKEN问题基本能解决。5.2 三条个人避坑心得第一密钥永远不要硬编码在项目代码或脚本里。即使只是个人项目也建议统一通过环境变量读取避免不小心把密钥提交到 Git 仓库。第二分镜提示词不要贪长。我在实际测试里发现5 秒视频提示词超过 200 字之后模型反而会忽略一些关键细节视觉表现不如 80 字左右的精简版本。第三新方案上线后先做小额试跑。无论你是在 Cursor 里配新模型还是第一次调用 H3 API先用最小成本跑通链路再放开手脚做完整任务。5.3 用 Ollama 配合本地工作流如果你喜欢完全本地化的创作环境可以在本机安装 Ollama通过ollama serve启动服务然后用它跑一个小型文本模型来辅助生成视频脚本。Ollama 的安装很简单下载安装包后执行启动命令即可模型下载则用ollama pull指定名称。这个组合的实际价值在于你不必为了写一段分镜脚本就去消耗 M Plan 的在线额度本地模型能先把文本工作消化掉只有真正生成视频时才把额度花在 H3 上。对于频繁改脚本、反复迭代创意的人来说这样能省下不少有效额度。最后再分享一个我自己的使用习惯我会把 M Plan 的额度看作一个“创意预算”每当头脑里冒出一个视频点子先不动用 H3而是用本地 Ollama 加文本模型把分镜脚本写到 80 分再用 M Plan 的额度一次性跑出多个候选片段。这样既保证了钱包里的额度花在刀刃上也让创作过程保持连贯。配置好 Claude Code 和 Cursor 之后整个流程真的就是打开终端、说一句需求、等结果出来没有以前那种在多个平台之间来回切换的割裂感。