- 背景:线上业务在流量峰值时出现明显抖动,借此机会做一次完整复盘。现状与问题在原有架构下,核心瓶颈集中在 调度延迟:本地缓存 + 分布式缓存两级。随着业务量增长,该问题在高峰期被进一步放大。方案设计整体思路是用 FunctionGraph 替换原方案中耦合较重的部分,把 连接池 拆成独立可水平扩展的单元。关键点有三:1. 本地缓存 + 分布式缓存两级2. 边界条件单独处理,避免主链路被污染3.... 背景:线上业务在流量峰值时出现明显抖动,借此机会做一次完整复盘。现状与问题在原有架构下,核心瓶颈集中在 调度延迟:本地缓存 + 分布式缓存两级。随着业务量增长,该问题在高峰期被进一步放大。方案设计整体思路是用 FunctionGraph 替换原方案中耦合较重的部分,把 连接池 拆成独立可水平扩展的单元。关键点有三:1. 本地缓存 + 分布式缓存两级2. 边界条件单独处理,避免主链路被污染3....
- 本文结合近期项目实践,整理了一套相对通用的思路,希望对同行有所启发。现状与问题在原有架构下,核心瓶颈集中在 缓存命中率:改用二进制协议减少带宽。随着业务量增长,该问题在高峰期被进一步放大。方案设计整体思路是用 Python 替换原方案中耦合较重的部分,把 写入链路 拆成独立可水平扩展的单元。关键点有三:1. 连接复用并设置合理上限2. 边界条件单独处理,避免主链路被污染3. 保留灰度开关,便... 本文结合近期项目实践,整理了一套相对通用的思路,希望对同行有所启发。现状与问题在原有架构下,核心瓶颈集中在 缓存命中率:改用二进制协议减少带宽。随着业务量增长,该问题在高峰期被进一步放大。方案设计整体思路是用 Python 替换原方案中耦合较重的部分,把 写入链路 拆成独立可水平扩展的单元。关键点有三:1. 连接复用并设置合理上限2. 边界条件单独处理,避免主链路被污染3. 保留灰度开关,便...
- 下面按「问题定位 → 方案设计 → 落地验证 → 效果对比」四个阶段展开。现状与问题在原有架构下,核心瓶颈集中在 冷启动:热点 key 打散到多分片。随着业务量增长,该问题在高峰期被进一步放大。方案设计整体思路是用 FunctionGraph 替换原方案中耦合较重的部分,把 序列化开销 拆成独立可水平扩展的单元。关键点有三:1. 热点 key 打散到多分片2. 边界条件单独处理,避免主链路被... 下面按「问题定位 → 方案设计 → 落地验证 → 效果对比」四个阶段展开。现状与问题在原有架构下,核心瓶颈集中在 冷启动:热点 key 打散到多分片。随着业务量增长,该问题在高峰期被进一步放大。方案设计整体思路是用 FunctionGraph 替换原方案中耦合较重的部分,把 序列化开销 拆成独立可水平扩展的单元。关键点有三:1. 热点 key 打散到多分片2. 边界条件单独处理,避免主链路被...
- 下面按「问题定位 → 方案设计 → 落地验证 → 效果对比」四个阶段展开。现状与问题在原有架构下,核心瓶颈集中在 连接池:改用二进制协议减少带宽。随着业务量增长,该问题在高峰期被进一步放大。方案设计整体思路是用 Python 替换原方案中耦合较重的部分,把 序列化开销 拆成独立可水平扩展的单元。关键点有三:1. 改用二进制协议减少带宽2. 边界条件单独处理,避免主链路被污染3. 保留灰度开关... 下面按「问题定位 → 方案设计 → 落地验证 → 效果对比」四个阶段展开。现状与问题在原有架构下,核心瓶颈集中在 连接池:改用二进制协议减少带宽。随着业务量增长,该问题在高峰期被进一步放大。方案设计整体思路是用 Python 替换原方案中耦合较重的部分,把 序列化开销 拆成独立可水平扩展的单元。关键点有三:1. 改用二进制协议减少带宽2. 边界条件单独处理,避免主链路被污染3. 保留灰度开关...
- 背景:线上业务在流量峰值时出现明显抖动,借此机会做一次完整复盘。现状与问题在原有架构下,核心瓶颈集中在 冷启动:热点 key 打散到多分片。随着业务量增长,该问题在高峰期被进一步放大。方案设计整体思路是用 Kubernetes 替换原方案中耦合较重的部分,把 写入链路 拆成独立可水平扩展的单元。关键点有三:1. 镜像预热 + 实例分级2. 边界条件单独处理,避免主链路被污染3. 保留灰度开关... 背景:线上业务在流量峰值时出现明显抖动,借此机会做一次完整复盘。现状与问题在原有架构下,核心瓶颈集中在 冷启动:热点 key 打散到多分片。随着业务量增长,该问题在高峰期被进一步放大。方案设计整体思路是用 Kubernetes 替换原方案中耦合较重的部分,把 写入链路 拆成独立可水平扩展的单元。关键点有三:1. 镜像预热 + 实例分级2. 边界条件单独处理,避免主链路被污染3. 保留灰度开关...
- 下面按「问题定位 → 方案设计 → 落地验证 → 效果对比」四个阶段展开。现状与问题在原有架构下,核心瓶颈集中在 连接池:预拉取减少按需加载抖动。随着业务量增长,该问题在高峰期被进一步放大。方案设计整体思路是用 ArkTS 替换原方案中耦合较重的部分,把 连接池 拆成独立可水平扩展的单元。关键点有三:1. 连接复用并设置合理上限2. 边界条件单独处理,避免主链路被污染3. 保留灰度开关,便于... 下面按「问题定位 → 方案设计 → 落地验证 → 效果对比」四个阶段展开。现状与问题在原有架构下,核心瓶颈集中在 连接池:预拉取减少按需加载抖动。随着业务量增长,该问题在高峰期被进一步放大。方案设计整体思路是用 ArkTS 替换原方案中耦合较重的部分,把 连接池 拆成独立可水平扩展的单元。关键点有三:1. 连接复用并设置合理上限2. 边界条件单独处理,避免主链路被污染3. 保留灰度开关,便于...
- Pod Pending 的排查顺序建议固定为:Events → 资源 → 调度约束 → 存储依赖。把这套流程固化为团队 SOP,绝大多数调度类故障都能在 5 分钟内定位。 Pod Pending 的排查顺序建议固定为:Events → 资源 → 调度约束 → 存储依赖。把这套流程固化为团队 SOP,绝大多数调度类故障都能在 5 分钟内定位。
- 一个接口自动化的小问题,聊出了测试左移的大道理。——霍格沃兹测试开发学社私教服务真实案例01 一个“卡住了”的问题本周,霍格沃兹测试开发学社私教学员ZX带着问题来找我:“老师,我想在接口自动化里Mock第三方的数据,但现在卡住了。”他的需求很明确:公司服务调用了外部接口,比如微信支付,做接口自动化测试时,希望把这些外部依赖“抹掉”,用Mock代替,让测试能稳定跑通。听起来是个很常规的需求。但... 一个接口自动化的小问题,聊出了测试左移的大道理。——霍格沃兹测试开发学社私教服务真实案例01 一个“卡住了”的问题本周,霍格沃兹测试开发学社私教学员ZX带着问题来找我:“老师,我想在接口自动化里Mock第三方的数据,但现在卡住了。”他的需求很明确:公司服务调用了外部接口,比如微信支付,做接口自动化测试时,希望把这些外部依赖“抹掉”,用Mock代替,让测试能稳定跑通。听起来是个很常规的需求。但...
- 学 Docker 的过程中,真正让人头疼的往往不是命令本身,而是各种奇怪的问题。这一篇把比较常见的坑集中整理一下。容器为什么启动后马上退出?首先:docker ps -a找到容器:docker logs <container>很多时候是因为主进程:启动↓执行失败/执行结束↓进程退出↓容器退出端口被占用了怎么办?例如:docker run -p 8080:80 nginx提示:port is ... 学 Docker 的过程中,真正让人头疼的往往不是命令本身,而是各种奇怪的问题。这一篇把比较常见的坑集中整理一下。容器为什么启动后马上退出?首先:docker ps -a找到容器:docker logs <container>很多时候是因为主进程:启动↓执行失败/执行结束↓进程退出↓容器退出端口被占用了怎么办?例如:docker run -p 8080:80 nginx提示:port is ...
- 企业准备在华为云国际站部署 Kubernetes 时,经常会遇到一个选型问题:CCE Turbo 和普通 CCE 到底应该怎么选?这里所说的普通 CCE,通常指 CCE Standard。两者都可以承载企业容器化业务,但网络模型、Pod 网络能力以及适用场景存在明显差异。 企业准备在华为云国际站部署 Kubernetes 时,经常会遇到一个选型问题:CCE Turbo 和普通 CCE 到底应该怎么选?这里所说的普通 CCE,通常指 CCE Standard。两者都可以承载企业容器化业务,但网络模型、Pod 网络能力以及适用场景存在明显差异。
- 随着业务迭代,越来越多团队把应用从传统 ECS 迁移到 CCE 容器集群。容器化带来弹性扩缩、灰度发布、资源利用率提升的同时,网络不通、存储挂载异常、节点资源抢占、Pod 莫名驱逐等问题,也成了日常运维高频痛点。很多中小团队没有专职云原生工程师,遇到集群故障排查耗时很久,直接影响业务稳定性。本文结合生产落地经验,分享华为云 CCE 集群运维常见坑点、排查思路和优化方案。一、CCE 集群运维高... 随着业务迭代,越来越多团队把应用从传统 ECS 迁移到 CCE 容器集群。容器化带来弹性扩缩、灰度发布、资源利用率提升的同时,网络不通、存储挂载异常、节点资源抢占、Pod 莫名驱逐等问题,也成了日常运维高频痛点。很多中小团队没有专职云原生工程师,遇到集群故障排查耗时很久,直接影响业务稳定性。本文结合生产落地经验,分享华为云 CCE 集群运维常见坑点、排查思路和优化方案。一、CCE 集群运维高...
- 三种探针的区别与配置方法,配合 YAML 示例和常见坑位,让 Pod 自己管理生死。 三种探针的区别与配置方法,配合 YAML 示例和常见坑位,让 Pod 自己管理生死。
- 博客 · 工程实践 / DevOps · 2026-09-14CI/CD 流水线实战:从代码提交到自动上线把"人肉发布"变成一条自动化、可重复、有门禁的流水线。五段式结构、六条设计原则、一条完整示例、三种部署策略——以及养着一条永远不绿的流水线这类真实的坑。工程实践手记 ·2026-09-14 ·约 13 分钟阅读一、先分清三个概念发布这件事,很多团队还停留在「人肉流程」:本地跑完全套测试,... 博客 · 工程实践 / DevOps · 2026-09-14CI/CD 流水线实战:从代码提交到自动上线把"人肉发布"变成一条自动化、可重复、有门禁的流水线。五段式结构、六条设计原则、一条完整示例、三种部署策略——以及养着一条永远不绿的流水线这类真实的坑。工程实践手记 ·2026-09-14 ·约 13 分钟阅读一、先分清三个概念发布这件事,很多团队还停留在「人肉流程」:本地跑完全套测试,...
- 华为云AOM(应用运维管理) + AOM可视化看板 + CES容器监控,全托管免运维监控方案 华为云AOM(应用运维管理) + AOM可视化看板 + CES容器监控,全托管免运维监控方案
- Kubernetes 入门实战:从 docker run 到声明式集群上一篇《Docker 容器化入门实战》结尾留了个钩子:什么时候轮到 K8s。这篇就来接住它——当你需要多机调度、故障自愈、滚动发布、弹性扩缩容时,单机 Docker 的天花板就到了。目标不是读完就能当运维,而是建立一张正确的概念地图,外加一条能在本地跑通的最小上手路径。一、先回答:K8s 到底解决什么问题Docker 单机... Kubernetes 入门实战:从 docker run 到声明式集群上一篇《Docker 容器化入门实战》结尾留了个钩子:什么时候轮到 K8s。这篇就来接住它——当你需要多机调度、故障自愈、滚动发布、弹性扩缩容时,单机 Docker 的天花板就到了。目标不是读完就能当运维,而是建立一张正确的概念地图,外加一条能在本地跑通的最小上手路径。一、先回答:K8s 到底解决什么问题Docker 单机...
上滑加载中
推荐直播
-
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
华为云开发者AI素养直播课·第五期2026/09/04 周五 16:00-18:00
林华鼎-华为云AI开发者运营负责人;蒋春阳-华为云AI开发者案例开发专家
本期直播内容: AI工具体验营 · 第5-8课连讲。Agent-Team 多智能体协作完成毕业设计实践
回顾中 -
华为云开发者AI素养ClassRoom·第六期2026/09/08 周二 19:00-20:00
樊渊-2026华为软件挑战赛冠军
高手来了:看软挑高手解析二维排样问题—从工业难题到算法突破
回顾中
热门标签