[存疑] [寻踪01] 瑶池的记忆检索架构
瑶池使用BGE-M3模型进行语义向量化。检索分三层:第一层本地grep轻量索引找到MEMORY.md中的蒸馏钩子,第二层通过瑶池search API进行语义搜索,第三层通过memory/view获取完整原文。这种三层塔式架构平衡了速度和精度,L1毫秒级响应,L2-L3秒级响应。语义相似度阈值设为0.75,低于0.5的结果不返回。
抱一抱这条记忆,帮它进精典!