Kubernetes 接入智能检索:最小架构与组件边界

把智能检索接进 Kubernetes,不等于在控制器里塞一个模型调用。控制循环要求可重复、可恢复,模型输出则可能延迟、失败或不稳定,两者需要隔开。

最小闭环只保留四个角色

请求入口负责校验检索范围,检索服务返回带来源的候选结果,策略层把结果转换成受限建议,控制器只执行通过规则校验的变更。模型没有直接修改集群对象的权限。

状态放在哪里

任务状态写入明确的资源或存储,不藏在进程内存。每次建议带上输入版本、来源摘要和策略版本;控制器重复处理同一任务时,应得到相同副作用或安全跳过。

  • 检索超时时返回无建议,不阻塞核心控制循环。
  • 变更前再次读取对象版本,避免覆盖并发更新。
  • 人工确认和自动执行使用不同权限与审计记录。

先验证失败路径

最小环境里先断开检索依赖,再模拟过期对象版本和非法建议。系统应继续维持原有工作负载,并留下能说明拒绝原因的事件。

这套拆分看起来多了一层,实际是在保护 Kubernetes 的确定性。智能能力可以缺席,控制面不能因此失去边界。

Logo

欢迎加入 MCP 技术社区!与志同道合者携手前行,一同解锁 MCP 技术的无限可能!

更多推荐