技术博客
聚合 Linux、Windows、Kubernetes、云原生、安全运维和自动化实践,沉淀可检索、可复用的技术文章。
设备远程管理实验:为什么建议用 SSH 替代 Telnet?
围绕华为设备远程登录实验,讲清楚本地用户、VTY、认证方式、SSH 服务和安全加固要点。
静态路由与默认路由实验:小型网络为什么先从路由表开始排查?
用静态路由和默认路由搭建跨网段通信实验,理解下一跳、出接口、路由优先级和连通性验证。
STP 实验:二层环路为什么危险,如何看懂根桥和端口状态?
通过 STP/RSTP 的根桥选举、端口角色和状态变化,建立二层环路防护的实验排查框架。
VLAN 实验怎么做:Access、Trunk 和 Hybrid 的区别与验证
围绕二层隔离场景,讲清楚 VLAN 创建、接口类型、Trunk 放行和 Hybrid 口的排查方法。
HCIA-Datacom 实验入门:华为 VRP 基础配置应该先掌握什么?
从命令视图、设备命名、接口地址、配置保存和基础验证入手,建立华为数通实验的第一套操作习惯。
HCIP 数通:BGP 协议详解、IBGP/EBGP 邻居建立与路由通告实战
深入讲解 BGP(边界网关协议)的核心机制:BGP vs OSPF 的本质区别、IBGP 与 EBGP 邻居建立差异、BGP 路由通告规则(IBGP 水平分割)、Next-hop 属性问题与解决方案、BGP 路由属性(AS-Path/LOCAL_PREF/MED),覆盖华为 VRP 平台企业出口双线 BGP 配置。
HCIP 数通:BGP 路由策略进阶、Route-Policy、Community 属性实战
深入讲解 BGP 路由策略的精细化控制:Route-Policy 与 Filter-Policy 的区别和使用场景、AS-Path Filter 过滤路由、Prefix-List 精确匹配前缀、Community 属性标记路由与策略联动、BGP 路由反射器配置,通过企业双运营商出口策略的完整案例演示路由策略的生产应用。
HCIP 数通:MPLS 标签转发原理、LDP 协议与 MPLS VPN 基础
系统讲解 MPLS(多协议标签交换)的工作原理:标签格式与交换机制(LER/LSR/LSP)、LDP 协议标签分发过程、MPLS 转发表(LFIB)与 IP 路由表的关系、MPLS VPN(L3VPN)的 VRF 隔离与 PE-CE 路由交换,覆盖华为 VRP 平台 MPLS 基础配置。
HCIP 数通:OSPF 多区域设计、LSA 类型详解与 ABR/ASBR 实战
深入讲解 OSPF 多区域架构:为什么要划分区域(LSDB 规模控制)、骨干区域 Area 0 的作用、ABR(区域边界路由器)与 ASBR(自治系统边界路由器)配置、6 种 LSA 类型详解(Type 1-7)、虚链路解决区域不连续问题,覆盖华为 VRP 平台完整配置命令。
HCIP 数通:QoS 流量质量保障、分类标记、队列调度与流量整形实战
系统讲解 QoS(Quality of Service)的完整实现:流量分类(Class-Based Classification)、DSCP/802.1p 标记、PQ/WFQ/CBWFQ 队列调度原理与对比、流量整形(Traffic Shaping)与限速(Traffic Policing)的差异,以及语音/视频/数据业务的典型 QoS 策略配置。
HCIP 数通:VRRP 网关冗余实战、主备切换、BFD 联动与负载分担
深入讲解 VRRP(虚拟路由冗余协议)的工作原理与企业级配置:Master/Backup 主备选举、Priority 优先级抢占、接口监控触发主备切换、双 VRRP 组实现负载分担、BFD 联动实现毫秒级故障检测,覆盖华为 VRP 平台完整配置场景。
华为昇腾910B 驱动安装与CANN环境配置完整指南
详解华为昇腾NPU的完整运维配置流程:Ascend驱动和固件安装、CANN工具链(Toolkit/Kernels)配置、torch_npu安装与验证、npu-smi常用命令、MindX DL容器化部署,以及常见安装报错处理方法,适合首次接触昇腾环境的运维工程师。
混合异构GPU集群运维:NVIDIA+昇腾/DCU共存调度与统一管理
讲解生产环境中NVIDIA GPU与国产GPU(昇腾/海光DCU)混合部署的运维方案:Kubernetes多设备类型调度(不同Device Plugin共存)、通过标签/污点实现任务精准分发、统一监控面板(Prometheus+Grafana同时采集NVIDIA和NPU指标)、混合集群资源配额管理,以及国产GPU逐步替换NVIDIA的平滑迁移策略。
海光 DCU 兼容 CUDA 生态迁移实战指南
系统讲解海光 DCU(深算系列)的 ROCm 兼容架构原理、从 CUDA 代码迁移到 DTK 的实操步骤、主流 AI 框架的 DCU 适配方法,以及在国产 DCU 上运行 PyTorch、vLLM 的实战配置。
海光DCU Kubernetes集成实战:Device Plugin部署与推理服务调度
详解海光DCU在Kubernetes集群中的完整集成方案:DCU Device Plugin安装与验证、hy-smi指标接入Prometheus监控、推理服务Pod调度配置、多DCU并行任务(RCCL分布式通信)、DCU资源配额与LimitRange,以及节点故障时的任务自动迁移配置。
