定制专属角色:四步做出只属于你的桌宠
刚装好萌灵时,桌面上是一个默认形象。它可以陪你挂着、可以被拖动和摸头,但它还不是「你的」角色——这篇教程走的是完整路线:把默认形象换成你喜欢的角色,给 TA 写上名字、性格和你们的关系,再让 TA 真的听得懂你说话、用属于 TA 的声音回你。整条路线只有四步,分别对应形象、角色卡、大脑和声音;光看名字可能抽象,所以每一节都会告诉你「这一步在改什么」以及「入口在哪个界面」。
先说清楚两件事,免得你走到一半才发现:不用一次做完,只做前两步,TA 当天就能在桌面上陪你;导入自己的角色需要激活完整版,免费版可以先用内置角色把整套流程试一遍,流程与界面完全一样。
四步分别改什么?
很多人卡在第一步不是因为难,而是因为不知道「定制角色」到底由哪些部分拼起来。一只完整的、只属于你的桌宠,由四块组成,缺一块就少一种能力:
| 步骤 | 这一步决定什么 | 在哪个界面做 | 本节 |
|---|---|---|---|
| ① 形象 | TA 长什么样——用你自己的 VRM 模型替换默认形象 | 萌灵工坊 → 添加萌灵 | 跳到第一步 |
| ② 角色卡 | TA 是谁——名字、性格、说话方式、你们的关系 | 萌灵工坊 → 角色卡 | 跳到第二步 |
| ③ 大脑 | TA 能不能听懂、能不能答上——LLM 与语音识别 | 设置 → AI 服务 | 跳到第三步 |
| ④ 声音 | TA 开口是什么声音——TTS 音色 | 设置 → AI 服务 | 跳到第四步 |
前两块是「角色本身」,在萌灵工坊里完成;后两块是「角色背后的服务」,在设置里配置。这个分界线很重要:换形象、改角色卡是随时可改的本地设置,而接 AI 服务需要你去服务商申请一个密钥——这也是唯一需要额外准备的一步。
第一步:定制形象,怎么把喜欢的 VRM 角色放到桌面?
形象就是 TA 的脸。萌灵用的是 VRM 模型——这是目前二次元角色最通用的 3D 格式,VRoid、BOOTH、模之屋以及大量作者主页上的角色都是这个格式。你要做的,是把拿到手的 .vrm 文件导入进来,替换掉默认形象。
路径是:右键桌面上的萌灵 → 打开「萌灵工坊」 → 左下角点「添加萌灵」 → 选择本地的 .vrm 文件 → 填上名字、缩略图和标签 → 确认导入 → 选中这张角色卡,点「应用到桌面」。做完这一轮,桌面上站着的就是你的角色了。
三个容易踩的地方,提前说:模型文件必须是 .vrm,.pmx、.fbx 需要先转换;导入自己的角色是完整版能力,免费版点开会提示激活,但流程和界面完全一致;模型授权要看清楚,尤其是准备录屏、直播或公开发布内容时。详细的界面级步骤见导入模型教程,还没有模型可以先看免费 VRM 模型去哪找。
第二步:定制角色卡,TA 的名字、性格和世界观写在哪?
角色卡决定 TA 是谁。同一个模型配上不同的角色卡,聊天时的感觉完全是两个角色——这是很多人第一次接触时会忽略的一块,也是「定制」里最像创作的一步。在萌灵工坊里选中角色,打开角色卡,你会看到这几类设定:
- 身份:名字、称呼,以及 TA 是什么样的存在。
- 性格与说话方式:语气、口癖、对你的态度是亲近还是克制。
- 你们的关系:主人与伙伴、同桌、搭档——这句设定会直接影响 TA 怎么称呼你。
- 服务绑定:这张卡用哪套 AI 服务(可以跟随全局默认,也可以单独指定)。
写角色卡的经验只有一条:越具体,回答越稳定。「温柔」不如「说话慢半拍,喜欢用食物打比方,不太会表达关心」;后者会让 TA 在几十轮聊天里都保持同一个样子,而不只是第一句像。如果你不知道从哪写起,可以看看内置的「法芙慕」卡——它是产品助手卡,只读,用全局默认服务,字段写法可以当作模板参考。
第三步:定制大脑,LLM 和语音识别分别负责什么?
「大脑」不是单一的东西,它由两个服务组成,负责的事完全不同:
| 能力 | 负责什么 | 不配的后果 |
|---|---|---|
| LLM | 对话与推理:TA 怎么理解你的话、怎么组织回答 | 面板会提示未配置服务,发出去的话没有回应 |
| 语音识别(ASR) | 把你说的话转成文字,语音输入和实时语音靠它 | 打字聊天照常,但 TA 听不见你说话 |
两个都在「设置 → AI 服务」里添加,都是填服务商提供的 API 密钥。这是整条路线里唯一需要额外准备的一步,也是最容易卡住的一步——它不像形象那样点几下就完,需要你去服务商那边注册、拿到密钥再回来粘贴。我们为此写了一份单独教程:怎么领免费的 LLM 额度;语音识别同理,见免费语音识别额度。
配好之后回到桌面,右键展开对话,输入一句话试试。TA 能答上,说明大脑通了。
第四步:定制声音,怎么给 TA 挑一个 TTS 音色?
声音是最后一块,也是最出效果的一块。TTS 负责把 TA 的回复读出来,音色决定了 TA 给你的第一印象是元气、清冷还是黏人。
入口同样是「设置 → AI 服务」里的 TTS,配置方式和前面一样需要一把密钥,差别在于 TTS 通常可以选音色:同一个服务商往往提供几十个声音,挑一个和角色卡性格对得上的,TA 就会一直用这个声音说话。想要免费额度可以从这份 TTS 免费额度教程开始。
声音不是必须的:不接 TTS,对话照常用文字显示,只是 TA 不会开口。有些人反而喜欢全程安静打字,这点按自己的习惯来就好。
不用一次做完:推荐的顺序
四步都做完当然最好,但别被它吓到。实际体验是分两段的:只做形象和角色卡,你得到的是一只「看得见、能互动」的桌宠——它会在桌面上陪你、跟着鼠标转头、被你摸头、随音乐跳舞;接上大脑和声音之后,它才从「陪着你」变成「和你说话」。
所以推荐顺序就是你看到的样子:先把形象换上,当天就能用;角色卡在有空的时候慢慢写,写着写着性格就清楚了;等到你想让它真的开口,再回头配 LLM、ASR 和 TTS。整个过程不需要一次坐下来做完,也不存在「配到一半不能用」的状态。
常见问题
定制一个完整角色,需要会建模或者会写代码吗?
不需要。四步都是应用内的操作:导入模型、填角色卡、粘贴密钥、选音色。真正需要「创作」的只有角色卡的文字设定,那是写作不是技术;模型也不需要你自己做,用现成的 VRM 就行。
导入自己的 VRM 模型要付费吗?
导入自己的角色属于完整版能力,免费版可以使用内置角色体验全部界面和互动。建议先用内置角色把四步流程走通,确认自己真会用、真喜欢,再决定要不要激活完整版——这样你不会因为「想用某个模型」而付了钱却发现用不上。
LLM、ASR、TTS 必须都配置吗?只配 LLM 能聊吗?
不是必须。只配 LLM 就能文字聊天,这是最常见的最小配置;想用语音说话再加 ASR,想让 TA 出声再加 TTS。三者的免费额度都有单独教程,可以先只领 LLM 的那一份。
没有 API 密钥,能不能先试试对话是什么感觉?
可以。第一次引导里 TA 会主动发一条教程消息并回答你一个问题,那一段不依赖任何 AI 服务,就是为了让你在配置之前先看到「对话大概长什么样」。等你配好服务,再回来正式聊。
换形象或者换角色卡,之前的对话记录会丢吗?
对话记录按角色卡分别保存,换回同一张卡时之前的记录还在。所以你可以放心地用一张卡试性格、另一张卡试另一个角色。具体行为以当前版本为准。
下一步:先把形象换上
四步里最直观、当天就能见效的一步是导入模型。跟着界面级教程走一遍,你的角色就会出现在桌面上。