外观
高楼层用户使用(交火模式)
什么是高楼层用户
☞ 游玩楼层平均到 500楼起步 or 纪要超过 200个 的用户
☞ 总是在 焦虑 纪要表的记忆太多,召回上限不够用
否 → 打开0TK, 是 → 继续阅读
处理方法
不要考虑合并纪要功能,那个东西已经删了!
不要考虑合并纪要功能,那个东西已经删了!
—— 现在假设我们有2000层数据
(方法一)从头手动总结
☞ 关闭最新层不填表
☞ 修改 手动处理最近N层 、每N层合并为一次填表
(只算AI楼层,总楼层2000,那么这里是1000)

☞ 手动总结,只勾选 纪要表

☞ 等待结束
—— 这样你原本300多个纪要就会变成100个
❗ 每N层合并为一次填表 数字越大,压缩得越厉害,细节越少,但同样的信息浓度会提高
—— 为什么不提倡修改召回数量?
❗ 因为这可能让你的正文质量劣化
(方法二)向量交火增强方案
这是基于普通向量之上的全新模式,由向量模型先筛选,再由语言模型,实现高精度记忆提取。
☞ 关于0TK与交火模式的选择
平时游玩的 纪要数 ≤ 200 —— 无脑开0TK功能
平时游玩的 纪要数 ≥ 200 + Token数紧张(大卡) —— 0tk+交火一起开
平时游玩的 纪要数 ≥ 200 + Token数宽松(小卡) —— 关闭0TK,只开交火。可能会多承担8千左右的token,但事件来龙去脉会更加清晰
—— 纪要数一定是200吗?
❗ 推荐是200,但若理解原理且想要提前使用本功能,可以降低数量
☞ 位置



☞ 填写模型(只能是向量模型,下面有介绍)


☞ 保存
☞ 点击(只需要点一次,之后都不需要了)

☞ 等待结束,随后正常游玩
—— 报错了怎么办?
❗ 出问题可以随时删除,随时构建
(分支)怎么选向量模型
—— 什么是向量模型?
❗ 你平时用来写正文的模型属于 语言模型 ,不能用来填交火,向量模型是特殊的
—— 一定要用图上模型吗?
❗ 不是,有能力者可以填写其他模型或网站,但最方便的途径是硅基流动
❗ 硅基流动是正规商业网站,符合社区规定
☞ 硅基流动网址【国内】https://www.siliconflow.cn/
【国际】https://www.siliconflow.com/
Q:这个需要钱吗?
A:要,但是1毛钱能用好久好久,约等于不用钱。
Q: 有其他需要注意的地方吗?
A:国际版不需要实名认证
- 用硅基流动的话,直接复制黏贴URL和模型
【国内】Embedding 设置
| https://api.siliconflow.cn/v1/embeddings Qwen/Qwen3-Embedding-8B 你的key |
【国际】Embedding 设置
| https://api.siliconflow.com/v1/embeddings Qwen/Qwen3-Embedding-8B 你的key |
【国内】Rerank 设置(可选,但建议)
| https://api.siliconflow.cn/v1/rerank Qwen/Qwen3-Reranker-8B 你的key |
【国际】Rerank 设置(可选,但建议)
| https://api.siliconflow.com/v1/rerank Qwen/Qwen3-Reranker-8B 你的key |