Kubernetes 接入智能检索:最小架构与组件边界
·
Kubernetes 接入智能检索:最小架构与组件边界
把智能检索接进 Kubernetes,不等于在控制器里塞一个模型调用。控制循环要求可重复、可恢复,模型输出则可能延迟、失败或不稳定,两者需要隔开。
最小闭环只保留四个角色
请求入口负责校验检索范围,检索服务返回带来源的候选结果,策略层把结果转换成受限建议,控制器只执行通过规则校验的变更。模型没有直接修改集群对象的权限。
状态放在哪里
任务状态写入明确的资源或存储,不藏在进程内存。每次建议带上输入版本、来源摘要和策略版本;控制器重复处理同一任务时,应得到相同副作用或安全跳过。
- 检索超时时返回无建议,不阻塞核心控制循环。
- 变更前再次读取对象版本,避免覆盖并发更新。
- 人工确认和自动执行使用不同权限与审计记录。
先验证失败路径
最小环境里先断开检索依赖,再模拟过期对象版本和非法建议。系统应继续维持原有工作负载,并留下能说明拒绝原因的事件。
这套拆分看起来多了一层,实际是在保护 Kubernetes 的确定性。智能能力可以缺席,控制面不能因此失去边界。
更多推荐


所有评论(0)