服务网格流量治理方案.docx

服务网格流量治理与Sidecar控制面建设方案实例

(软件研发技术文档·数据与实例为据)

第一章治理目标与接入现状

本文档记录订单中台团队把48个Java与Go服务从自建转发迁到服务网格的做法。迁移前每个服务各自引SDK做重试限流,规则散在17套配置文件里,改一条超时平均要发3次版本。迁移后治理能力收敛到控制面,规则下发90秒内对全部实例生效,SDK从生产代码里逐步剥离。

团队定的验收硬门槛:路由切换成功率不低于99.9%,代理带来的额外时延控制在1毫秒以内,控制面挂掉时数据面仍能按最后一次下发的规则运行不少于30分钟。达不到这三条,就不能把核心交易服务放进网格。

表1-1网格接入前后对比

改造项

迁移前

迁移后

收益

接入服务

12个试点

48个全覆盖

3.9倍

超时改动成本

3次发版

1次配置

-66%

切换成功率

99.2%

99.95%

+0.75百分点

新增治理策略

逐个改码

统一下发

免发版

第二章数据面与控制面形态

网格分两面:数据面是每个Pod里的代理容器,接管进出流量;控制面负责把路由、安全、观测规则翻译成配置推给数据面。团队选了控制面3副本跨可用区,单副本故障不影响配置推送,内存占用峰值约480MB每副本。

数据面以Sidecar方式注入,业务容器和应用代理共享网络空间。团队先给6个边缘服务试点2周,观测代理CPU开销中位数0.08核、内存约110MB

文档评论(0)

1亿VIP精品文档

相关文档