DokiLove 指南
Token 消耗与上下文长度说明
理解角色定义、历史消息和输出如何共同占用上下文。
上下文里有什么
角色描述、系统提示词、世界书、用户设定、聊天历史和本轮输入都会进入上下文。模型输出也需要预留空间,因此上下文上限不能全部用于输入。
角色卡显示的定义 Token 只是固定成本,实际对话还会随着历史增长。
低 Token 不等于低质量
结构清晰、信息密度高的短定义可能比重复冗长的定义更稳定。高 Token 卡适合复杂世界观,但需要更长上下文和更高推理成本。
选择时应考虑模型上下文、对话长度和世界书触发方式,而不是只追求数字大或小。
控制消耗
只让必要的世界书条目触发,定期总结长对话,删除重复示例和互相冲突的提示。不要在多个字段复制同一段背景。
当模型开始遗忘早期信息时,先检查上下文截断和提示词优先级,不要盲目增加更多常驻文本。