外观
高楼层用户使用(交火模式)
什么是高楼层用户
游玩楼层平均到 500楼起步 or 纪要超过 200个 的用户
总是在焦虑纪要表的记忆太多,召回上限不够用
☞ 否 → 打开0TK
☞ 是 → 继续阅读
处理方法
—— 假设我们有2000层数据
方法一、从头手动总结
关闭 填表工作台 → 自动更新设置 → 最新层不填表
修改 手动填表 → 手动处理最近N层 与 每N层合并为一次填表
(只算AI楼层,总楼层2000,那么这里是1000)

- 只勾选 纪要表,点击执行手动填表

- 等待结束 —— 这样你原本300多个纪要就会变成100个
☞ 每N层合并为一次填表 数字越大,压缩得越厉害,细节越少,但同样的信息浓度会提高
Q: 为什么不提倡修改召回数量?
A: 因为可能让你的正文质量劣化
方法二、向量交火增强方案
———— 这是基于普通向量之上的全新模式,由向量模型先筛选,再由语言模型,实现高精度记忆提取。
关于0TK与交火模式的选择
| 情况 | 选择 |
|---|---|
| 纪要数 ≤ 200 | 无脑开0TK功能 |
| 纪要数 ≥ 200 + Token数紧张(大卡) | 0tk+交火一起开 |
| 纪要数 ≥ 200 + Token数宽松(小卡) | 关闭0TK,只开交火。可能会多承担8千左右的token,但事件来龙去脉会更加清晰 |
Q: 纪要数一定是200吗?
A: 推荐是200,但若理解原理且想要提前使用本功能,可以降低数量
配置方法
- 仪表盘 → 开关 → 高级设置 → 启用交火模式



- 交火模式 → Embedding / Rerank → 配置API(只能使用向量模型,详情请看下方的如何选择向量模型)


保存
点击 立即构建交火纪要索引
☞ 只需要点一次,之后都不需要了

- 等待结束,随后正常游玩
Q: 报错了怎么办?
A: 出问题可以随时删除,随时构建
如何选择向量模型
Q:什么是向量模型?
A: 你平时用来写正文的模型属于 语言模型 ,不能用来填交火,向量模型是特殊的
Q:一定要用图上模型吗?
A: 不是,有能力者可以填写其他模型或网站,但最方便的途径是硅基流动
A: 硅基流动是正规商业网站,符合社区规定
☞ 硅基流动网址
☞ 【国内】https://www.siliconflow.cn/
☞ 【国际】https://www.siliconflow.com/
Q:这个需要钱吗?
A:要,但是1毛钱能用好久好久,约等于不用钱。
Q: 有其他需要注意的地方吗?
A:国际版不需要实名认证
硅基流动配置
【国内】Embedding 设置
URL:https://api.siliconflow.cn/v1/embeddings
模型:Qwen/Qwen3-Embedding-8B
【国内】Rerank 设置(可选,但建议)
URL:https://api.siliconflow.cn/v1/rerank
模型:Qwen/Qwen3-Reranker-8B
【国际】Embedding 设置
URL:https://api.siliconflow.com/v1/embeddings
模型:Qwen/Qwen3-Embedding-8B
【国际】Rerank 设置(可选,但建议)
URL:https://api.siliconflow.com/v1/rerank
模型:Qwen/Qwen3-Reranker-8B