Skip to content

高楼层用户使用(交火模式)

什么是高楼层用户

☞ 游玩楼层平均到 500楼起步 or 纪要超过 200个 的用户

☞ 总是在 焦虑 纪要表的记忆太多,召回上限不够用

否 → 打开0TK, 是 → 继续阅读

处理方法

不要考虑合并纪要功能,那个东西已经删了!

不要考虑合并纪要功能,那个东西已经删了!

—— 现在假设我们有2000层数据

(方法一)从头手动总结

☞ 关闭最新层不填表

☞ 修改 手动处理最近N层 、每N层合并为一次填表

(只算AI楼层,总楼层2000,那么这里是1000)

☞ 手动总结,只勾选 纪要表

☞ 等待结束

—— 这样你原本300多个纪要就会变成100个

❗ 每N层合并为一次填表 数字越大,压缩得越厉害,细节越少,但同样的信息浓度会提高

—— 为什么不提倡修改召回数量?

❗ 因为这可能让你的正文质量劣化

(方法二)向量交火增强方案

这是基于普通向量之上的全新模式,由向量模型先筛选,再由语言模型,实现高精度记忆提取。

☞ 关于0TK与交火模式的选择

平时游玩的 纪要数 ≤ 200 —— 无脑开0TK功能

平时游玩的 纪要数 ≥ 200 + Token数紧张(大卡) —— 0tk+交火一起开

平时游玩的 纪要数 ≥ 200 + Token数宽松(小卡) —— 关闭0TK,只开交火。可能会多承担8千左右的token,但事件来龙去脉会更加清晰

—— 纪要数一定是200吗?

❗ 推荐是200,但若理解原理且想要提前使用本功能,可以降低数量

☞ 位置

☞ 填写模型(只能是向量模型,下面有介绍)

☞ 保存

☞ 点击(只需要点一次,之后都不需要了)

☞ 等待结束,随后正常游玩

—— 报错了怎么办?

❗ 出问题可以随时删除,随时构建

(分支)怎么选向量模型

—— 什么是向量模型?

❗ 你平时用来写正文的模型属于 语言模型 ,不能用来填交火,向量模型是特殊的

—— 一定要用图上模型吗?

❗ 不是,有能力者可以填写其他模型或网站,但最方便的途径是硅基流动

❗ 硅基流动是正规商业网站,符合社区规定

☞ 硅基流动网址【国内】https://www.siliconflow.cn/

【国际】https://www.siliconflow.com/

Q:这个需要钱吗?

A:要,但是1毛钱能用好久好久,约等于不用钱。

Q: 有其他需要注意的地方吗?

A:国际版不需要实名认证

  • 用硅基流动的话,直接复制黏贴URL和模型

【国内】Embedding 设置

https://api.siliconflow.cn/v1/embeddings Qwen/Qwen3-Embedding-8B 你的key

【国际】Embedding 设置

https://api.siliconflow.com/v1/embeddings Qwen/Qwen3-Embedding-8B 你的key

【国内】Rerank 设置(可选,但建议)

https://api.siliconflow.cn/v1/rerank Qwen/Qwen3-Reranker-8B 你的key

【国际】Rerank 设置(可选,但建议)

https://api.siliconflow.com/v1/rerank Qwen/Qwen3-Reranker-8B 你的key

ST《数据库》教程