plano
Plano(前身为 Arch / archgw,Katanemo 后来将同一仓库重命名为 Plano)是一个 AI-native 代理服务器 / 数据面(data plane),用 Rust 编写、基于 Envoy 构建,由 Envoy 的核心贡献者打造。它把 agentic 应用从 demo 到生产之间那些本该统一实现、却总被每个团队重复造轮子的"管路工程"——路由/编排、模型对接、护栏、可观测性——收敛到一个独立进程的智能网关中,让业务代码只需实现标准的 OpenAI 兼容 /v1/chat/completions 接口即可接入。
核心能力
- 🚦 Agent 编排:在 YAML 里声明各 agent 的 URL 与自然语言描述,Plano 即可低延迟地把请求路由到正确的 agent,新增 agent 无需改动应用代码。
- 🔗 Model Agility(模型灵活性):支持按模型名、别名(语义化名称)或基于偏好自动路由到不同 LLM/Provider,统一屏蔽各家 API 差异,便于模型切换、灰度与降级。
- 🕵 Agentic Signals™ + 可观测性:零代码自动采集端到端 OTEL traces/metrics,用于持续评估和改进 agent 效果。
- 🛡️ 护栏与记忆钩子:通过 Filter Chain 统一实现越狱防护、内容审核策略、记忆能力等,避免安全逻辑散落在各个 agent 里。
架构特点
Plano 官方还提供了专用的轻量路由模型(如 4B 参数的 plano_orchestrator),用小而快的模型替代重量级框架或调用大模型来做意图分类/路由,以更低的成本和延迟获得生产级的编排效果。
典型场景
- 多 agent 编排:如天气 agent + 航班 agent 组成统一对话入口,由 Plano 自动判断并路由到对应 agent,再汇总成一次完整回复。
- LLM 网关 / 智能路由:为已有服务提供统一的模型访问层,支持按名称/别名/偏好路由,简化多模型接入与切换。
- 安全合规:越狱防护、内容审核、PII 过滤等护栏策略集中实现和维护。
- 可观测性:开箱即用的分布式追踪与指标,服务于 agent 效果评估与迭代。
对标产品
agentgateway(同为 Rust/Envoy 系的 AI Agent 网关)、Envoy AI Gateway、Portkey、TrueFoundry AI Gateway