Skip to content

高楼层用户使用(交火模式) ​

什么是高楼层用户 ​

游玩楼层平均到 500楼起步 or 纪要超过 200个 的用户

总是在焦虑纪要表的记忆太多,召回上限不够用

☞ 否 → 打开0TK
☞ 是 → 继续阅读


处理方法 ​

—— 假设我们有2000层数据

方法一、从头手动总结 ​

  1. 关闭 填表工作台 → 自动更新设置 → 最新层不填表

  2. 修改 手动填表 → 手动处理最近N层 与 每N层合并为一次填表

(只算AI楼层,总楼层2000,那么这里是1000)

  1. 只勾选 纪要表,点击执行手动填表

  1. 等待结束 —— 这样你原本300多个纪要就会变成100个

☞ 每N层合并为一次填表 数字越大,压缩得越厉害,细节越少,但同样的信息浓度会提高

Q: 为什么不提倡修改召回数量?

A: 因为可能让你的正文质量劣化

方法二、向量交火增强方案 ​

———— 这是基于普通向量之上的全新模式,由向量模型先筛选,再由语言模型,实现高精度记忆提取。

关于0TK与交火模式的选择

情况选择
纪要数 ≤ 200无脑开0TK功能
纪要数 ≥ 200 + Token数紧张(大卡)0tk+交火一起开
纪要数 ≥ 200 + Token数宽松(小卡)关闭0TK,只开交火。可能会多承担8千左右的token,但事件来龙去脉会更加清晰

Q: 纪要数一定是200吗?

A: 推荐是200,但若理解原理且想要提前使用本功能,可以降低数量

配置方法 ​

  1. 仪表盘 → 开关 → 高级设置 → 启用交火模式

  1. 交火模式 → Embedding / Rerank → 配置API(只能使用向量模型,详情请看下方的如何选择向量模型)

  1. 保存

  2. 点击 立即构建交火纪要索引

☞ 只需要点一次,之后都不需要了

  1. 等待结束,随后正常游玩

Q: 报错了怎么办?

A: 出问题可以随时删除,随时构建

如何选择向量模型 ​

Q:什么是向量模型?

A: 你平时用来写正文的模型属于 语言模型 ,不能用来填交火,向量模型是特殊的

Q:一定要用图上模型吗?

A: 不是,有能力者可以填写其他模型或网站,但最方便的途径是硅基流动

A: 硅基流动是正规商业网站,符合社区规定

☞ 硅基流动网址
☞ 【国内】https://www.siliconflow.cn/
☞ 【国际】https://www.siliconflow.com/

Q:这个需要钱吗?

A:要,但是1毛钱能用好久好久,约等于不用钱。

Q: 有其他需要注意的地方吗?

A:国际版不需要实名认证

硅基流动配置 ​

【国内】Embedding 设置

URL:https://api.siliconflow.cn/v1/embeddings
模型:Qwen/Qwen3-Embedding-8B

【国内】Rerank 设置(可选,但建议)

URL:https://api.siliconflow.cn/v1/rerank
模型:Qwen/Qwen3-Reranker-8B

【国际】Embedding 设置

URL:https://api.siliconflow.com/v1/embeddings
模型:Qwen/Qwen3-Embedding-8B

【国际】Rerank 设置(可选,但建议)

URL:https://api.siliconflow.com/v1/rerank
模型:Qwen/Qwen3-Reranker-8B

ST《数据库》教程