- 云原生下的机遇和挑战时至今日,Kubernetes 已至成熟期,云原生时代则刚刚开始。虽说云原生不只是围绕着 Kubernetes 生态,但无可质疑,Kubernetes 已是云原生生态的基石。通过规范 API 和 CRD 标准,Kubernetes 已经建立起了一个云原生 PaaS 生态帝国,成为了 PaaS 领域的事实标准。这一层事实标准,对企业交付有着巨大的意义。在 Kubernete... 云原生下的机遇和挑战时至今日,Kubernetes 已至成熟期,云原生时代则刚刚开始。虽说云原生不只是围绕着 Kubernetes 生态,但无可质疑,Kubernetes 已是云原生生态的基石。通过规范 API 和 CRD 标准,Kubernetes 已经建立起了一个云原生 PaaS 生态帝国,成为了 PaaS 领域的事实标准。这一层事实标准,对企业交付有着巨大的意义。在 Kubernete...
- 一 背景Kubernetes 集群备份是一大难点。虽然可以通过etcd来进行备份来实现K8S集群备份,但是这种备份很难恢复单个 Namespace。对于K8s集群数据的备份和恢复,以及复制当前集群数据到其他集群等都非常方便。可以在两个集群间克隆应用和命名空间,来创建一个临时性的开发环境。 二 Velero概述 2.1 什么是VeleroVelero 是一个云原生的灾难恢复和迁移工具,它本... 一 背景Kubernetes 集群备份是一大难点。虽然可以通过etcd来进行备份来实现K8S集群备份,但是这种备份很难恢复单个 Namespace。对于K8s集群数据的备份和恢复,以及复制当前集群数据到其他集群等都非常方便。可以在两个集群间克隆应用和命名空间,来创建一个临时性的开发环境。 二 Velero概述 2.1 什么是VeleroVelero 是一个云原生的灾难恢复和迁移工具,它本...
- 本文在于分享k8s的安装 仅用于参考 生产环境要根据实际情况进行操作 谢谢 本文在于分享k8s的安装 仅用于参考 生产环境要根据实际情况进行操作 谢谢
- kubectl 命令行及 K8S 各个组件的日志级别说明 kubectl 命令行及 K8S 各个组件的日志级别说明
- 基于wayne构建的Kubenetes 多集群管理平面 BasaBasa (体验版) 是一个支持 Multi-cluster Kubernetes集群的 可视化管理平台, 通过直观的页面操作便可完成Kubernetes中资源的创建、部署等操作。采用plugin架构,通过插件化的方式将不同功能尽量的分离,更利于各种定制化功能的扩展。云平台体验版地址:https://play.kubeserv... 基于wayne构建的Kubenetes 多集群管理平面 BasaBasa (体验版) 是一个支持 Multi-cluster Kubernetes集群的 可视化管理平台, 通过直观的页面操作便可完成Kubernetes中资源的创建、部署等操作。采用plugin架构,通过插件化的方式将不同功能尽量的分离,更利于各种定制化功能的扩展。云平台体验版地址:https://play.kubeserv...
- # 首先创建nfs (略)# kubectl create secret generic mysql-pass --from-literal='password=123456'# cat mysql-persistent-storage.yaml apiVersion: v1kind: PersistentVolumemetadata: name: mysql-persistent-sto... # 首先创建nfs (略)# kubectl create secret generic mysql-pass --from-literal='password=123456'# cat mysql-persistent-storage.yaml apiVersion: v1kind: PersistentVolumemetadata: name: mysql-persistent-sto...
- Kubernetes集群搭建Zabbix监控平台 Kubernetes集群搭建Zabbix监控平台
- 想要体面生活,又觉得打拼辛苦;想要健康身体,又无法坚持运动。人最失败的,莫过于对自己不负责任,连答应自己的事都办不到,又何必抱怨这个世界都和你作对?人生的道理很简单,你想要什么,就去付出足够的努力。 想要体面生活,又觉得打拼辛苦;想要健康身体,又无法坚持运动。人最失败的,莫过于对自己不负责任,连答应自己的事都办不到,又何必抱怨这个世界都和你作对?人生的道理很简单,你想要什么,就去付出足够的努力。
- 参考本文前,请确保已经学习完以下文章: Kubernetes相关概念入门 k8s核心概念总结版 k8s的集群搭建前的相关操作–必看 kubeadm方式搭建k8s之docker环境安装 一: 部署kubernetes Master 在192.168.1.17上执行 kubeadm init --apiserver-advertise-address=1... 参考本文前,请确保已经学习完以下文章: Kubernetes相关概念入门 k8s核心概念总结版 k8s的集群搭建前的相关操作–必看 kubeadm方式搭建k8s之docker环境安装 一: 部署kubernetes Master 在192.168.1.17上执行 kubeadm init --apiserver-advertise-address=1...
- 【摘要】容器云平台,主要涉及什么样的安全问题?容器云安全该怎么做?本文总结了9个层面的安全保障。【作者】汪照辉 王作敬 中国银河证券股份有限公司 信息技术部IT研发中心安全是一个非常非常重要但又是一个比较大的命题,涉及到方方面面。采用了容器云平台,主要涉及什么样的安全问题?容器云安全该怎么做?基于我们容器云平台的层次架构,我考虑从容器云的不同层次来看下容器云涉及的安全问题。容器云的底层是基础... 【摘要】容器云平台,主要涉及什么样的安全问题?容器云安全该怎么做?本文总结了9个层面的安全保障。【作者】汪照辉 王作敬 中国银河证券股份有限公司 信息技术部IT研发中心安全是一个非常非常重要但又是一个比较大的命题,涉及到方方面面。采用了容器云平台,主要涉及什么样的安全问题?容器云安全该怎么做?基于我们容器云平台的层次架构,我考虑从容器云的不同层次来看下容器云涉及的安全问题。容器云的底层是基础...
- 作为平台级的容器环境,比以往任何的基础架构平台更加的接近业务,同时也包含了更多的层级和组件,因此也带来了更多的风险,容器平台基础组件部分和容器云管理平台部分是容器云平台安全设计的关键。本文列举了容器平台安全的几个典型风险,并分享了容器云平台基础安全设计的方法。如果您还想进一步系统学习容器云平台的管理安全设计、应用安全设计等,可以关注文章后附介绍。分享者:圆白菜,某股份制银行,云架构师。目前就... 作为平台级的容器环境,比以往任何的基础架构平台更加的接近业务,同时也包含了更多的层级和组件,因此也带来了更多的风险,容器平台基础组件部分和容器云管理平台部分是容器云平台安全设计的关键。本文列举了容器平台安全的几个典型风险,并分享了容器云平台基础安全设计的方法。如果您还想进一步系统学习容器云平台的管理安全设计、应用安全设计等,可以关注文章后附介绍。分享者:圆白菜,某股份制银行,云架构师。目前就...
- 在华为云CCE集群里,业务Pod访问Service或外部域名时偶发超时,很多时候并不是应用代码或容器网络先出问题,而是DNS解析链路在某个环节被拖慢。要真正做好华为云CCE DNS解析超时排查,得先搞清楚CoreDNS在集群内到底承担什么角色,以及一次DNS请求从Pod发出到返回应答中间经过哪些节点。 在华为云CCE集群里,业务Pod访问Service或外部域名时偶发超时,很多时候并不是应用代码或容器网络先出问题,而是DNS解析链路在某个环节被拖慢。要真正做好华为云CCE DNS解析超时排查,得先搞清楚CoreDNS在集群内到底承担什么角色,以及一次DNS请求从Pod发出到返回应答中间经过哪些节点。
- 镜像拉取超时和镜像拉取失败在 Kubelet 日志里经常被混在一起,但成因不同。 镜像拉取超时和镜像拉取失败在 Kubelet 日志里经常被混在一起,但成因不同。
- 容器刚启动就退出,日志一闪而过,Pod 状态在 Running 和 CrashLoopBackOff 之间反复横跳——这是 Kubernetes 运维中最容易“一看就懵”的现场。排查 CCE 容器 CrashLoopBackOff 问题时,多数人上来就盯着 Exit Code,但真正绊住脚步的往往是探针误判、事件被刷掉这些藏在细节里的坑。下面从状态机制本身展开,理清排查的逻辑起点。 容器刚启动就退出,日志一闪而过,Pod 状态在 Running 和 CrashLoopBackOff 之间反复横跳——这是 Kubernetes 运维中最容易“一看就懵”的现场。排查 CCE 容器 CrashLoopBackOff 问题时,多数人上来就盯着 Exit Code,但真正绊住脚步的往往是探针误判、事件被刷掉这些藏在细节里的坑。下面从状态机制本身展开,理清排查的逻辑起点。
- 当 Kubernetes 集群中的 AI 推理服务每隔几分钟就触发一次重启,而业务端只感知到请求超时和 SLA 下滑,很多团队的直觉是代码出了 Bug。但从大量生产环境故障复盘来看,健康检查误判、GPU OOM 和调度资源竞争才是高频根因,且这些故障在日志中往往不会留下明显的异常堆栈。下面从现象层面对这类问题做拆解。 当 Kubernetes 集群中的 AI 推理服务每隔几分钟就触发一次重启,而业务端只感知到请求超时和 SLA 下滑,很多团队的直觉是代码出了 Bug。但从大量生产环境故障复盘来看,健康检查误判、GPU OOM 和调度资源竞争才是高频根因,且这些故障在日志中往往不会留下明显的异常堆栈。下面从现象层面对这类问题做拆解。
上滑加载中
推荐直播
-
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
华为云开发者AI素养直播课·第三期2026/08/21 周五 16:00-18:00
林华鼎-华为云AI开发者运营负责人;念擎-华为云AI开发者运营案例开发专家
本期直播内容:AI六层能力首次详细解读 + 新一代华为云开发者空间亮相 + 校园案例直播带练
回顾中
热门标签