Skip to content

AI 设置 ​

这些设置控制为你提供体验的 AI 模型及其行为方式。它们在所有世界中全局生效。你可以在设置 > AI 配置中找到它们。

选择模型 ​

Yumina 提供四个价格档位的精选模型:

档位示例说明
经济Yumina Free、Gemini 2.5 Flash Lite、DeepSeek V4 Flash、DeepSeek V3.2、Claude 3 Haiku适合休闲游玩。Claude 3 Haiku 是平台默认模型(平均每条消息约消耗 5 mushies)。
标准Gemini 3.1 Flash Lite、Gemini 2.5 Flash、Gemini 3 Flash、DeepSeek V4 Pro更好的写作质量和指令遵从能力。
高级Claude Haiku 4.5、Grok 4.20、Gemini 3.1 Pro角色塑造和叙事连贯性明显更好。需要 Gold 套餐或以上。
旗舰Claude Sonnet 4.6、Claude Opus 4.7最高写作质量。需要 Platinum 套餐或以上。

更高档位每次回复消耗更多 mushies,但写作质量更好。如果不确定,从默认模型(Claude 3 Haiku)开始,然后自行尝试。

最近更新

  • Claude 3 Haiku 现在是默认模型(替换了已下架的 Grok 4.1 Fast)。
  • DeepSeek V4 Flash 已加入经济档位,价格也按 OpenRouter 实际成本做了同步。
  • 模型选择器现在显示彩色档位圆点(翠绿 = 经济、蓝 = 标准、紫 = 高级、琥珀 = 旗舰),让你能一眼看清整个阵容。

置顶模型 ​

你可以置顶最多 8 个模型,方便在模型选择器中快速切换。默认已置顶四个。前往设置 > AI 配置 > 你的模型来管理置顶列表。点击任意置顶模型可将其设为默认。

最近使用 ​

你最近使用过的模型会显示在置顶列表下方(如果它们还未被置顶)。你可以从那里将它们置顶。

剧情记忆,以及 AI 到底看到了什么 ​

在讲这个设置之前,我们想先简单说一下 AI 每次到底看到、记得什么,因为知道这个之后,那个数字就好理解多了。下面是一个非常基础的例子,是你每次发消息时 AI 看到的东西。

// ——  World setup ——
[lore 1: AI Instruction]
You're the narrator of this survival horror game. Cold and
restrained in tone, you never decide the player's actions for them.

[lore 2: World Settings]
The long-abandoned Matsuzaki Sanatorium, sealed off in the winter of 1987.

// —— Conversation history ——
[user]
I push the door open

[assistant]
A hand grabs your wrist — the skin unnaturally cold...

[user]
I drink the potion

世界设定,也就是世界书,是作者决定的。作者在这里写世界的设定和给 AI 的总体指令,它的体积是固定的。对话历史则是你和 AI 聊天的过程中一点一点堆起来的。你每次发请求,AI 基本上就是把世界书和你的对话历史从头再看一遍。它在回合之间没有记忆,所以每一次都是重读一整遍。

那么,AI 供应商的收费方式是:输入 token 越多收得越多,也就是说你的对话历史越长,他们收得越多。这就是为什么你会看到每回合的蘑菇消耗随着游玩时间慢慢上涨。这不是「玩久了要加钱」,只是真的有更多字要读。

理想情况下,你当然希望 AI 每回合都能看到过去发生的一切,加上完整的世界书,这样它什么都不会忘。但在现实里,受成本和模型自身上下文上限的限制,这个量不可能无限堆下去。所以我们才有了设置页和个人资料页里的这个配置。它做的事情基本上就是:限制发送出去的上限,同时始终保留完整的世界书。作者搭起来的那个世界,永远不会被砍掉。

这确实意味着随着对话推进,AI 会慢慢忘掉你们最最开始聊的内容。好消息是,大多数时候故事往后走,AI 其实并不需要太多开头的信息也能继续写得好,因为它还记得你最近做的所有事。不过,有时候这依然会影响质量,也挺烦人的,所以我们才有会话记忆与剧情摘要这个扩展。它不是把更早的对话直接丢掉,而是整理成摘要保留下来,你失去的是原文措辞,不是发生过的事。

那么,什么才是真正合适的设置?有些人可能觉得,只要预算够就一直拉到最高,然而这是错的。对话历史太长的时候,反而会分散 AI 的注意力,让它偏离真正该关注的东西,比如世界书,或者你最近说的话。这在小模型上问题更明显。所以我们其实建议所有人,不管预算多少,都把它调低一些。

你要设的是剧情记忆,也就是对话中逐字保留的那一部分,我们建议设在 12,000 到 24,000 之间,并配合记忆扩展一起用。我们的默认值是 16,000。以一个普通世界为例,我们这边中等体量大约 7,500 tokens,那就是 7,500 + 15,000,每回合大约 22,500,其中 15,000 全是剧情。世界更大的时候总量会涨,因为世界书那一半变大了,但你的剧情记忆还是稳稳停在你设的数上。这就是我们把它拆成两个数字的全部原因:一个给世界,由你的方案承载;一个给剧情,由你自己决定。

关于方案上限:世界书这一侧,免费版上限 64,000 tokens,黄金 96,000。白金及以上从不裁剪。如果你使用自己的 API Key,任何方案都没有上限。

创造力(温度) ​

温度滑块控制 AI 回复的随机性和创造力:

  • 偏低(0.7 左右): 更可预测、专注、一致。适合策略游戏或需要精确性的世界。
  • 偏高(1.1–1.2): 更有创意、多变。适合创意写作和探索。
  • 默认值:1.0 —— 适用于大多数场景的平衡值。

设置中的滑块范围是 0.5 到 1.5,但两端都属于极端值:1.3 已经算是相当高了,到 1.5 文风通常会开始失控;低于 0.7 则会明显变得机械。日常调整在 0.8–1.2 之间就够用了,超过 1.3 只在你刻意追求"放飞"效果时才考虑。

回复长度(最大 token 数) ​

控制单次 AI 回复的最大长度。默认值为 12,000 tokens。增大可以获得更长、更详细的回复;减小可以获得更简洁、更紧凑的回复。范围:256 到 32,768。

推理强度 ​

对于支持推理的模型(Claude、GPT-5),此设置控制 AI 在回复前进行多少「思考」:

级别效果
最小最少思考,最快回复,最低消耗
低轻度推理(默认)
中更谨慎的回复
高最彻底,最慢,最高消耗

对于大多数角色扮演和互动小说场景,「低」就足够了。如果 AI 出现逻辑错误或忘记约束条件,可以提高推理强度。

流式输出 ​

开启时(默认),AI 回复会在生成过程中逐 token 显示。关闭时,完整回复会在生成完成后一次性显示。除非你的网络连接不稳定,否则建议保持开启。

高级采样参数 ​

在 AI 配置中的高级参数开关下:

参数默认值说明
Top P1.0核采样——将候选 token 池限制在概率最高的前 P%。值越低越集中。
Frequency Penalty0.0减少词语重复。如果 AI 总是重复自己,可以试试 0.3-0.5。
Presence Penalty0.0鼓励新话题。如果 AI 总是围绕同样的想法打转,可以试试 0.2-0.3。
Top K0(关闭)候选 token 的硬性上限。通常与 Top P 同时使用时不需要。
Min P0(关闭)最小概率阈值。是 Top K 的更智能替代方案。

经验法则: 先调整温度。只有当温度本身无法解决问题时才调整这些参数,而且一次只改一个。

自带密钥 (BYOK) ​

你可以使用自己的 API 密钥来代替 Yumina 积分。前往设置 > AI 配置并切换到私有密钥模式。

支持的服务商:

服务商获取密钥
OpenRouteropenrouter.ai/keys —— 一个密钥解锁数百个模型
Anthropicconsole.anthropic.com
OpenAIplatform.openai.com
Googleaistudio.google.dev
Ollamaollama.com —— 在本地运行模型
自定义(OpenAI 兼容)粘贴任意 OpenAI 兼容的 base URL —— DeepSeek、xAI (Grok)、Mistral、Groq、Together、Fireworks、Moonshot,或你自己的代理。常见服务商有一键预设。

设置步骤:

  1. 将服务商开关从「Yumina API」切换到「私有密钥」
  2. 选择你的服务商并输入密钥
  3. 点击验证来测试密钥

你的密钥在存储时会被加密(AES-256-GCM)。原始密钥在存储后永远不会从服务器返回——只会返回元数据(服务商、标签、脱敏后缀)。

使用 BYOK 后,你没有上下文长度上限,并且可以使用你的服务商提供的任何模型。费用直接由你的 API 服务商收取,而不是消耗 Yumina 积分。

打开私有模型选择器时,Yumina 会先显示已保存的列表,五分钟缓存过期后在后台同步。服务商请求失败或返回空列表时会保留原列表,手动添加的模型和默认模型也会保留;没有来源记录的旧条目同样会保留。点击连接配置中的连接可强制刷新。如果服务商更换了模型 ID,请重新选择新模型;如果更换了 API 地址,仍需手动修改连接地址。

自定义提示词 ​

这是一个高级功能,用于在所有世界中调整 AI 行为。位于设置 > AI 配置底部。

你可以在三个位置注入自己的提示词:

  • 系统 —— 注入到系统提示词中(效果最强)
  • 聊天中 —— 注入到聊天历史的中间位置
  • 末尾 —— 在最末尾,AI 回复之前

如果 AI 总是在某个方面表现不正确(总是忘记某条规则、总是用错误的语言回复等),可以使用此功能。大多数玩家不需要这个。

提示词预设 ​

每个世界的创作者都会设置默认的提示词预设。你可以选择:

  • 使用创作者的 —— 使用创作者设定的配置(推荐)
  • 使用自己的 —— 用你自己的配置覆盖

除非你了解提示词架构,否则建议保持使用创作者的设置。更改预设可能会以微妙的方式破坏世界的体验。