延伸阅读:本地 RAG 分块与向量配额矩阵、LiteLLM 代理网关路由、站点首页。
痛点 · M4 批阈值 · onboard 白名单 · 熔断重试 · PR/CI · FAQ · 可引用 · 转化
痛点拆解
其一索引期社区检测与 embedding批过大,M4 统一内存在峰值被吃满导致进程被系统杀掉。其二GraphRAG 流水线默认多工具外呼,无网关白名单时易把密钥与语料路径打进日志。其三失败体冗长且含敏感片段,PR/CI无法据此重跑分片,编排侧只能人工翻全量日志。
GraphRAG 在 M4 上的环境与批大小阈值
建议在二十四 GB 及以上统一内存的专用远程机上跑全量索引;开发机只做千文档以下抽样。社区检测与向量写入应分阶段,禁止与在线查询共用同一进程池。
openclaw onboard、网关令牌与出站域名白名单
在远程机执行onboard后,把补全与嵌入统一指向本机回环网关;根密钥经启动守护或密钥链注入,禁止写入技能仓明文。出站仅放行登记域名与工具标识。
openclaw onboard --loopback-only
gateway.tools.allowlist=graphrag_index,graphrag_query,embed_batch
gateway.egress.domains=api.openai.com,localhost
gateway.token.ttl_min=55- 工具白名单:仅允许索引写盘、查询检索与批量嵌入三类调用名。
- 域名白名单:上游嵌入与补全域名分离登记,禁通配符泛放行。
- 令牌面:短期令牌五十五分钟轮换,与 CI 密钥分仓。
索引与查询:超时熔断与重试模板
建索引与在线查询须分桶墙钟;架构错、鉴权错、白名单拒答三类禁止重试,仅超时与上游五xx可指数退避两次。
index.build_wall_s=3600
index.community_batch_cap=64
query.first_token_s=2.5
query.completion_s=45
circuit.breaker_window_s=30
circuit.half_open_probe_ratio=0.1
retry.max=2
retry.backoff_ms=800,2400越并发预算即半开三十秒,探针流量不超过一成;与 LiteLLM 路由文 对照时,勿混写别名漂移口径。
失败摘要回传 PR/CI 的步骤
- 网关捕获失败后生成短封 JSON:含
code、retryable、shard_id,剥离路径与密钥。 - 流水线把摘要写入制品目录,与索引分片同号关联。
- PR 检查读取摘要:不可重试则阻断合并;可重试则仅重跑该分片。
- CI 夜间任务对比连续三次同分片失败,触发人工值班而非无限重试。
- 签字前在租用 M4上全链复跑,摘要格式与编排回调字段一致。
embedding 爆内存 FAQ
问:批从三十二降到八仍 OOM? 答:关闭索引期并行大模型补全,embedding 改串行批,并把向量库落盘挂独立卷。
问:社区检测与分块参数谁优先? 答:先锁分块与 overlap,再上调社区批;二者分开记账。
问:能否笔记本跑全量索引? 答:笔记本仅做趋势;签字基线须在专用远程 Mac八小时窗内完成。
可引用信息
- 失败摘要正文控制在二百汉字当量内,附机器可读原因码。
- 内存水位:统一内存占用超八成五即触发网关降批熔断。
- 证据链:日志含分片编号、工具哈希、索引版本。
总结与站内转化
先把 GraphRAG 批大小与OpenClaw 工具白名单写成基线,再在远程 M4上跑全量索引并把失败摘要接进 PR/CI。继续读 本地 RAG 决策矩阵 与 LiteLLM 网关路由;租用 LLM 专用 Mac 节点请打开 购买、定价 与 技术博客。