马上添加播妞学姐
了解课程详情
长按二维码识别,或保存截图

黑马程序员

马上添加播妞学姐
领取资料&在线答疑
长按二维码识别,或保存截图
黑马程序员AI智能运维课程介绍
黑马程序员AI智能运维课程国产信创运维
黑马程序员AI智能运维课程优势
学习经历
开班信息
AI智能运维 时代刚需

AI产业规模化落地的生命线

  • AI Ops与网络安全·AI时代的必备底座

    AI时代,资产价值高、攻击面全域扩大、业务容错为零
    AI Ops与网络安全协同构建“稳定高效+安全可信”双底座

  • AI智能运维·生产力的放大器与效率引擎

    让算力硬件从“有没有”变成“好不好用”,释放新质生产力
    自我调度/自愈/预测优化,释放闲置算力拉高资源利用率

人工智能

AI浪潮

大模型训练、AIGC创作、AI视频生成、数字人、智能推理

智能调度千亿参数训练,动态分配GPU集群,保障推理服务高可用,成本降低

先进制造

工业4.0

数字孪生、工业智能质检、产品仿真研发、柔性智能生产

保障数字孪生实时同步,预测性维护产线,故障响应时间<1s

交通领域

智能出行

自动驾驶、车路协同、智慧交通调度

毫秒级监控边缘节点,弹性调度算力资源,保障车路云一体化99.999%可靠性

城市治理

智慧城市

城市大脑、智慧安防、全域交通调度、应急智能处置

实时融合城市数据,自动扩缩容,保障突发应急场景下毫秒级响应

文娱领域

元宇宙

元宇宙场景搭建、实时云端渲染、虚拟直播、沉浸数字文娱

智能调度渲染节点,保障高并发低延迟,用户体验无感知故障恢复

科研领域

探索

新药研发、气候模拟、可控核聚变推演、高端材料研发

智能管理超算集群,任务优先级调度,资源利用率提升加速科研突破

AI智能运维的重要性?
企业 高薪抢人

懂AI、能主导智能运维的人才

  • 国家战略·刚性需求

    “人工智能+”行动意见(国务院,2025)

    强化智算统筹、自动化监测与智能调度

    算力基础设施高质量发展行动计划(工信部)

    推动数据中心自动化、智能化、绿色化运维

    东数西算·八大枢纽(国家算力枢纽)

    海量GPU/NPU异构集群无法人工运维

  • 产业市场·企业落地

    Gartner 预测60%+中大型企业落地AI Ops平台

    国内AI Ops市场年复合增速>34%

    重点需求行业

    互联网大厂·金融机构·新能源车企、智算中心运营商·大模型AI初创、运营商云·政务算力平台

  • 需求爆发·薪资跃升

    25.8k 全国平均月薪

    薪资普遍比传统运维高出40%~90%

    同等年限下,AI智能运维的薪资天花板更高

    +217% 2026招聘岗位增速

    对比2024年同期岗位增长580%

数据来源:猎聘大数据研究院《2026 年 Q1 I 岗位供需报告》及Gartner 相关预测、黑马程序员AI智能运维学员就业统计

放心学,优就业
黑马程序员AI智能运维学科全国就业情况

毕业班级 就业率 一线城市均薪 应届生占比
武汉AI运维1期 98% 11067 48%
郑州AI运维2期 92% 11220 55%
郑州AI运维3期 93% 11306 73%
广州AI运维1期 97% 10636 52%
郑州AI运维4期 96% 10572 72%
郑州AI运维5期 93% 12716 50%
郑州AI运维6期 96% 10368 70%
广州AI运维2期 91% 12988 55%
更多就业情况?
AI智能运维 入门简单

零基础拥抱AI时代高薪机遇

  • 零基础友好
    告别AI高门槛内卷

    入学门槛宽松,大专/本科均可,计算机应届生、转行小白、传统运维升级,零基础都能快速上手

  • 旧技能无缝复用
    传统运维最优升级路

    Linux、云计算经验100%复用,叠加云原生、GPU算力调度、AI Ops分析,低成本突破薪资天花板

  • 职业生命周期超长
    积累经验持续落地

    “AI Ops智能运维+云原生+GPU算力”政企、互联网/科技企业的新一代技术标配 技术迭代稳定

3分钟了解AI运维

什么是AI智能运维(AI Ops)?

依托大数据、时序算法、大模型、AIAgent技术,对服务器、云平台、业务链路、算力集群实现异常预判、告警降噪、故障根因分析、故障自愈。

  • AI运维学什么?
  • 低学历能拿到高薪吗?
  • 学完AI运维以后做什么?
  • 黑马课程有哪些优势?
我适合学吗?
核心能力清单 锚定未来

四大主流就业方向

  • 云原生与DevOps运维(SRE)
     入门首选

    核心学习内容:

    Rocky Linux网络/高级/核心服务
    AI辅助Shell/Python脚本
    Docker/K8s全栈编排+Helm
    Nginx+Keepalived高可用
    MySQL主从/Redis高可用集群
    Ansible自动化+发版管理
    CI/CD+ArgoCD GitOps
    Prometheus/ELK/SkyWalking可观测
    阿里云组件与云迁移实战
    Nacos/RabbitMQ中间件运维

    零起点,大专可入行
    无强制数学/算法基础要求

  • 智算与大模型运维(AI Infra)
    热门·高薪紧缺

    核心学习内容:

    GPU显卡驱动/CUDA环境配置
    GPU资源管理与算力调度
    nvidia-container-toolkit运行时
    K8s GPU调度策略
    K8s集群部署DeepSeek
    vLLM推理框架实战
    Ollama模型部署与联调
    Dcgm-exporter GPU监控
    ACK/VPC云上智算实战

    大专可入门,核心岗位要求本科
    掌握“GPU调度+大模型部署+GPU监控”即可就业

  • AI 智能运维与Agent开发
    复合型·高薪

    核心学习内容:

    Python脚本开发+企微钉钉告警
    Codex AI辅助编程
    MCP自定义开发与工具调用
    Hermes Agent框架实战
    Prompt工程/Memory/RAG
    多Agent协同与工作流编排
    Dify知识库与工作流构建
    监控集成+AI根因定位RCA
    自动巡检自动修复闭环运维
    SmartCloud多智能体云客服

    本科为主,中小企业可接受大专
    需具备Python脚本+Agent编排能力

  • 信创运维与具身智能交付
    国家战略·稳定就业

    核心学习内容:

    信创政策与2+8+N体系
    麒麟OS安装配置与运维
    openEuler网络与防火墙
    openGauss部署备份恢复
    达梦DM9 SQL与备份恢复
    大模型信创适配部署
    机器人真机开箱与调试
    LinkSoul智能体编排
    机器人刷机与日志导出
    系统加固/大模型安全护栏

    大专可入行,稳定性强
    政策红利导向,面向政企与信创生态

AI智能运维(AI Ops)四大能力体系

01 基建部署与可观测 — 让系统“看得见问题”
给数字系统装“眼睛和神经”

实时监控所有设备、软件,采集运行数据,让AI熟知系统状态

02 智算集群与算力调度 — 让系统“有力气处理信息”
给AI配上“超强心脏和体能”

高性能服务器组成“超级计算团队”,扛住海量数据与AI分析

03 智能体应用部署 — 让系统“看得懂、会思考”
给AI装上“智慧大脑”

AI学习海量故障案例,自主判断隐患、精准定位问题

04 自动化运维管控 — 让系统“自己会处理、会优化”
系统“自我修复、全程省心”

自动巡检、自动修复小故障、过滤无效告警,告别熬夜救火

申请免费试听
五大独家优势 实力碾压

剑指高薪AI智能运维岗

优势一

覆盖运维8大热门就业方向

  • 应用/系统运维工程师

    日常Linux服务器巡检、应用发版、基础故障排查与监控告警处理

  • 软件实施/交付工程师

    部署软件到客户服务器/私有云,并进行调试和客户培训

  • 初中级数据库运维
    DBA工程师

    专注企业的数据底层,不用直面业务代码的Bug,工作相对纯粹

  • 云原生与DevOps工程师

    实现代码提交到自动上云全链路自动化。大厂&中型互联网“标配刚需”

  • AI Infra/大模型
    运维工程师

    负责GPU算力集群调度、VLLM推理框架部署及大模型私有化落地

  • 信创运维工程师

    麒麟/欧拉OS+达梦/高斯数据库,党政军、金融、国企国产化替代

  • AI Ops/自动化
    运维工程师

    用AI管理IT!构建自动化监控与故障自愈体系,策略制定与平台开发

  • 机器人交付/实施工程师

    商用/人形机器人硬件调试、AI智能体配置与现场交付

项目名称:AI智能体项目之星海智伴、K8s生产级项目实战、云岚到家微服务项目部署与维护、云迁移升级实战、AI Ops 智能化监控项目、机器人交付工程、AI Infra 模型建设项目、AI SmartCloud多智能体项目部署与维护

优势二

独家打造AI Infra+AI Agent+
AI Ops全新运维体系

  • AI Infra 算力底座【搭舞台】

    手把手教学GPU服务器驱动安装、算力分配、算力平台搭建,吃透AI行业核心算力底层技术

    GPU驱动·安装与调优、算力分配·资源池化调度、平台搭建·生产级算力底座

  • AI Agent 模型部署【请演员】

    熟练完成各类大模型、智能体软件的上线部署、调试适配,让AI业务稳定落地运行

    大模型部署·LLM/VLM上线、智能体适配·调试与调优、稳定运行·业务级SLA保障

  • AI Ops 智能自治【雇管家】

    解锁AI自动化运维核心技能,搭载智能运维体实现故障自动报警、智能分析、自主修复,全程无需人工反复盯岗排查,仅需简单复核确认

    自动报警·智能异常检测
    智能分析·根因定位
    自主修复·故障自愈闭环

工作轻松·效率翻倍  职场竞争力断层领先

真正实现从熬夜加班的运维苦力升级为指挥AI干活的技术架构人才

优势三

从试学到就业,全程深耕
国产化信创核心技术体系

国产化核心技能栈·政企刚需【市场占有率领先】
  • 麒麟 OS
  • 欧拉 OS
  • 达梦 DB
  • 高斯 DB
  • 国产化中间件
  • 信创云平台
  • 国产网络设备
  • ... ...

√ 全覆盖政企招聘核心考点·黄金刚需技能

  1. 课程贴合国家“2+8+N”信创战略核心人才需求,重点教学政企大批量应用的麒麟、欧拉操作系统与达梦、高斯标杆国产数据库
  2. 1:1还原政企真实信创业务场景实战,完整练习系统运维、数据库迁移及性能调优,吃透国企政务统一技术规范
  3. 系统化一站式学习省去自学成本,掌握企业紧缺国产化技能,适配多种高薪岗位,抢占信创人才缺口

朝九晚五·工作轻松·薪资稳定

日常监控、对接乙方,空余时间充足·兼顾工作与考编

会信创=稳定就业特权
国企/央企/事业单位/政府机构,黄金刚需技能

优势四

全国校区统一部署
云原生企业级物理服务器集群

虚拟机·纸上谈兵

传统网课、普通培训班全程依托笔记本虚拟机实操,和企业真实生产环境脱节

上岗不敢碰真机·上手就翻车

  • × 资源虚拟化,性能严重缩水
  • × 网络环境与生产隔离
  • × 集群规模最多2-3台
  • × 无法模拟真实故障场景
真机实训·硬核实战

1:1复刻企业工作场景,学员全程远程直连真实机房设备实操,练的每一项技能都贴合上岗需求

真刀真枪·面试直接对标企业项目

  • √ 真实物理服务器·性能无损耗
  • √ 生产级网络与存储架构
  • √ 每组3台高配真机集群
  • √ 真实故障排查&应急演练
  • 3 台/组·高配真机
  • 200G 内存
  • 80核 CPU
  • 云原生 企业级集群
  • 远程直连 真实机房
优势五

一次学习,解锁“AI智能运维
+网络安全”两套高薪核心本领

【新增】人形机器人全流程交付 直击顶流科技红利
  • √ 众擎、智元头部机器人实操
  • √ 设备开箱·整机调试·功能定制
  • √ 商用场景落地交付全链路
  • √ 手握前沿案例,面试碾压普通运维
高端科技岗机器人运维优先
【赠送】网络安全+大模型安全 全套课
全网首发·价值¥15000
  • √ 网络安全全套实战技术
  • √ 大模型安全全新定制课程
  • √ 为期60天·8月全新首发
  • √ 稀缺高端网安技能附赠
运维+网安 双向就业通道

双赛道硬核兜底,职业进退自由
求稳可深耕AI智能运维岗位
进取可冲刺网安/机器人高端岗位

获取课程大纲

一门课程

构建企业AI智能运维全栈能力

课程覆盖企业AI智能运维工作完整生命周期
完整复刻企业AI Ops真实业务闭环 告别碎片化知识点学习

01 国产信创与AI大模型入门

课程介绍

紧跟国家信创战略与 AI 浪潮,融合“国产操作系统+云监控+大模型私有化部署”,零基础快速构建信创运维与 AI 应用的双重技术底座。

能力目标

掌握国产信创操作系统与云监控的核心运维技能,具备独立部署与调试 DeepSeek 等国产 AI 大模型的实战能力。

主要内容

运维的工作内容,云计算概念,服务器概念,常见运维名称,网络三要素,kylin服务器安装和配置

目录结构,文件和文件夹操作命令和概念,文件解压缩命令

软件包分类,软件包安装卸载操作,系统服务操作,防火墙开关以及进程的操作

云服务器定义、厂商(阿里云等)、特点(虚拟化、按需分配等)、优势;阿里云 ECS 实例选择(经济性 / 通用算力型等)、计费(按量付费 / 包年包月等)、购买流程;ECS 使用(重启、资源调整、安全组创建、远程连接);云监控介绍、开通、主机监控、资源报警配置、可视化大屏设置

大模型介绍、项目架构、云服务器申领、ollama环境部署、模型下载、ollama指令、python环境部署、聊天机器人上线、云监控体系搭建、联调测试

rocky linux的安装、目录与文件、解压缩、包管理、服务、以及软件包的安装和卸载

02 系统自动化运维

课程介绍

融合传统Linux高阶运维与AI辅助编程,从零构建扎实的系统管理与自动化脚本开发底座。

能力目标

精通Rocky Linux企业级核心服务配置,熟练运用AI辅助编写Shell脚本和Python脚本实现运维自动化。

主要内容

网络分层模型、抓包利器 Wireshark、物理介质与线缆、Cisco网络仿真软件、构建小型办公室网络、TCP/IP 模型、IP 地址与子网掩码、子网划分

用户与组管理、用户组操作、用户操作、权限管理、umask、特殊权限、属主属组修改、ACL、定时任务、防火墙、NetworkManager、nmcli、网卡启禁、静态IP、top/htop、df、free、nohup、screen、主机名配置

SSH原理与配置、免密登录、远程执行、Rsync语法与定时同步

磁盘结构、文件系统、MBR/GPT分区、LVM逻辑卷、软RAID配置

NFS配置与挂载、Samba跨平台共享、FTP模式与vsftpd权限管理

Chrony时间同步、Rsyslog配置与远程转发、Logrotate日志轮替

SELinux模式与管理、DNS原理、BIND安装与内外网解析配置

Shell变量、环境变量、引号区别、特殊变量、运算符

Shell小工具、判断语句、系统负载巡检、CPU内存磁盘检查、日志安全检查

流程结构、if与case选择、while与for循环、嵌套循环、随机数、免密登录与Web部署案例

Shell函数、正则表达式、expect工具

Shell三剑客、grep指令、sed指令、awk指令

服务器初始化、静态IP配置、SSH加固免密、防火墙批量配置、NTP自动部署、vsftpd与BIND一键部署、日志与错误处理

Python环境搭建、变量、数据类型、运算符、流程控制、数据容器

常用运维模块、os、sys、re、time、shutil、psutil、requests、paramiko

服务器资源监控、CPU内存硬盘监控、邮件状态报告

03 容器与高可用运维

课程介绍

直击企业生产环境高可用痛点,深度剖析Nginx、Keepalived与数据库集群,结合Ansible实现高效自动化运维。

能力目标

掌握企业级高可用集群架构设计与自动化部署,保障核心业务与存储服务的极致稳定。

主要内容

Nginx架构原理、Master/Worker机制

虚拟主机、反向代理、负载均衡

HTTPS、Rewrite、Location

缓存优化、静态资源加速、限流防盗链、企业级高性能优化

高可用架构、Keepalived原理、VRRP协议、VIP漂移机制

Keepalived双机热备、健康检查脚本、Nginx高可用实战

MySQL主从复制、同步原理、Binlog、Relay Log、GTID、主从切换、故障排查、备份恢复、性能优化

Redis持久化、主从复制、故障恢复、哨兵模式、集群部署、数据迁移、内存优化

MySQL与Redis架构、缓存一致性、缓存穿透、缓存击穿、缓存雪崩、综合故障排查、高可用存储实战

Inventory主机管理、Playbook编写规范

Role项目化管理、企业自动化部署实战

企业应用发布流程、滚动发布、蓝绿发布、灰度发布

Nginx日志、Tomcat日志、Java应用日志、Linux系统日志、journalctl、syslog

发布异常排查、生产故障恢复

04 云原生与DevOps交付

课程介绍

引入前沿AI Agent辅助K8s运维,全面覆盖容器运行时到Helm包管理,打造企业级云原生技术壁垒。

能力目标

精通Kubernetes云原生核心组件与容器编排,具备生产级K8s集群部署与微服务流量管理能力。

主要内容

Containerd简介、核心组件、工作流程分层、与Docker关系

Containerd安装、配置、基本命令

Codex安装配置、Codex与ChatGPT区别

官方Skill添加、Skill触发、自定义Skill创建与使用

MCP概述、自定义MCP开发、Tool工具调用、Tool与Skill与MCP区别

传统部署问题、K8s优势与概述、核心组件、集群安装部署、集群管理工具、Kuboard、Rancher、Codex Agent部署实战

节点管理、节点调度、命名空间、Pod基础、亲和性反亲和性、生命周期、重启策略、镜像拉取策略、健康检查、钩子、排错

Controller控制器、Service类型、Metrics-Server、HPA三要素、HPA操作

Ingress控制器、Ingress Controller安装、HTTP案例、HTTPS案例、Traefik部署验证

存储卷分类、PV、PVC、存储动态供给

ConfigMap、Secret、创建使用、subPath、Nginx HTTPS案例

K8s部署挑战、Helm、Chart生命周期、升级回退、仓库管理、Harbor、Chart发布私仓

ECS概述、免费资源、远程连接、RDS配置、数据导入导出

云监控配置、报警规则、Prometheus创建、监控告警通知

SLB配置、CDN申领与加速验证、域名注册解析

Answer平台部署、VPC创建、ACK申请创建、连通性测试、本地访问

05 AI Ops 与 AI Infra运维

课程介绍

聚焦稀缺的AI Infra与AI Ops岗位需求,深度实战GPU集群调度、VLLM推理框架与多智能体协同架构,抢占AI时代高薪风口。

能力目标

掌握GPU算力调度与大模型私有化部署,具备构建Multi-Agent多智能体系统及AI Ops自动化运维体系的能力。

主要内容

Agent架构设计、Hermes部署、MCP工具调用、Prompt工程、Memory机制、RAG知识库、多Agent协同、工作流编排、插件开发、API集成

Prometheus监控、Grafana可视化、Node Exporter、Alertmanager告警、GPU监控、K8s监控、APM、多数据源接入、监控指标管理

日志采集、ELK日志分析、Loki日志平台、告警事件接收、企业微信通知

AI智能分析、根因定位、故障诊断、自动工单生成、自动脚本执行、自动服务恢复、自动巡检、自动报告生成、闭环管理

GPU显卡型号、大模型参数、精度、提示词、token、模型训练、模型应用

GPU驱动安装、CUDA配置、GPU资源查看

vllm推理框架、模型运行优势、nvidia-container-toolkit安装、Docker集成

K8s部署Deepseek、Dcgm-exporter、GPU监控

SmartCloud项目背景、业务场景、Multi-Agent架构、核心技术栈、K8s部署架构、Containerd运行时、功能演示

Milvus部署、PVC存储、连通性验证、ElasticSearch部署、索引配置、Service外部访问

MySQL、MongoDB、Redis、OSS、StatefulSet、Deployment、ConfigMap、Secret、Service暴露、健康与异常排查

镜像构建、Dockerfile优化、ACR推送、Gateway部署、Ingress路由、配置管理、流量分发

五大Agent编排、Dify部署、工作流配置、网络互通、全链路联调、部署排错

Prometheus、Grafana、cAdvisor、Containerd监控、资源看板、日志采集、告警通知

GitLab CI/CD、自动化发布、滚动更新、回滚策略、运维演练、故障排查

06 国家新兴方向

课程介绍

精通麒麟/欧拉操作系统与达梦/高斯数据库,具备党政信创项目端到端容器化交付与运维能力。熟练掌握人形机器人硬件实操、AI智能体配置与系统刷机,具备独立完成商用机器人上门交付的能力。

能力目标

紧扣国家“2+8+N”信创战略,打造“国产OS+国产数据库+K8s”全栈技术闭环,直击政企核心岗位需求。依托原厂真机实训,融合“硬件实操+AI智能体+系统运维”,开辟人形机器人落地交付的全新就业赛道。

主要内容

信创概念、发展历程、2+8+N体系、政策里程碑、技术生态、系统分类

麒麟OS优势、服务器安装、网络与SSH配置、启动流程、systemd、chrony同步

欧拉系统介绍、安装与远程连接、常用命令、网络与防火墙管理

高斯数据库介绍、安装、基本使用、备份还原

DM9概述、应用场景、镜像挂载、命令行安装、初始化数据库、服务注册、环境变量配置

DM9 SQL、DCL权限管理、备份恢复、远程连接

开箱验收、开关机调试、基础按键、规范装箱、模式区分、安全规范、搬动注意事项

灵心平台、智能体创建、素材管理、AI技能编排、APP远程控制、舞台大师编排

系统刷机、Linux日志查询与导出

07 【赠送】网络安全与数据安全(线上录播)

课程介绍

聚焦高阶红蓝对抗与大模型安全稀缺岗位需求,深度实战1:1企业级靶场攻防、C/C++免杀开发与AI大模型安全防御,抢占网络安全顶尖人才高薪风口

能力目标

掌握全链路Web攻防与内网域控渗透,具备构建红队免杀武器化体系及蓝队应急响应与AI大模型安全护栏的能力。

主要内容

网络协议栈、Wireshark流量分析、企业级路由交换、VLAN防环、OSPF动态路由、二层安全防御

防火墙安全域、NAT映射、IPSec/SSL VPN、跨域安全互联

公有云安全组、零信任SASE、系统安全加固、自动化扫描、Nmap资产测绘、Nessus漏洞扫描

Web资产收集、敏感指纹识别、SQL注入、SQLmap绕过WAF

XSS、CSRF、SSRF、Redis利用、文件上传绕过、WebShell免杀、RCE、反弹Shell

反序列化、POP链构造、Shiro、Log4j2、Fastjson、业务逻辑漏洞、JWT绕过、DLP、AI安全护栏

内网架构剖析、BloodHound域拓扑探测、多级内网穿透、FRP/NPS隧道级联

凭证窃取、LSASS提取、本地提权、Bypass UAC、DLL劫持、横向移动、NTLM哈希传递、票据传递

Kerberos协议、金票银票伪造、域控高危漏洞、域控权限维持、Cobalt Strike级联控制

SIEM/ELK部署、自动化告警联动

主机应急响应、PDCERF模型、隐藏挖矿排查、勒索病毒处置

Web日志分析、WebShell查杀、定时任务溯源、内存取证、Volatility、C2流量追踪、攻击画像

安服面试考点、模拟答辩、作品集包装、入职规范

C/C++ Shellcode加载器、PE结构分析、内存加密、API Hashing、静态检测绕过

EDR行为监控、NTDLL Unhook、内存重写、AppLocker绕过、LOLBAS利用、DLL劫持、受信进程注入

跨隔离区靶场实战、外网打点、OA突破、内网凭证获取、横向移动排错、域控提权、KRBTGT Hash读取

红蓝对抗总结报告、安服项目交付答辩

学费价格及优惠咨询

开箱即用

企业级AI智能运维实战项目

极速积累AI运维实战经验,全面搭建AI核心技术栈
构建核心竞争力与坚实的技术护城河

AI智能体项目之星海智伴

项目简介

星海智伴是一套为养老院量身定制的智慧管理系统,面向养老行业数字化转型需求,基于前后端分离架构 + AI 能力构建。项目包含管理后台(Web)和家属端(微信小程序)两端,覆盖养老院“来访参观 → 入住办理 → 在住服务 → 退住办理”的全业务链路。

能力目标

掌握Docker容器化编排与核心中间件运维,具备独立部署AI智能体平台及全链路监控的实战能力。

主要内容

项目全景与架构设计:业务背景剖析、核心技术架构与运维部署拆解

容器基建与编排实战:Docker 核心机制、Dockerfile 构建与 Compose 编排

数据底座与中间件:MySQL 架构调优、自动化备份恢复与 Redis 核心应用

全栈工程化构建:SpringBoot/Vue 前后端打包、配置管理与 Node.js 环境

Nginx 流量网关:核心架构解析、反向代理、静态托管与 Location 路由匹配

RAG 与大模型应用:Embedding 向量化、检索增强生成 (RAG) 与 LLM 智能问答

AI Agent 与 IoT 联动:Dify 平台部署、知识库工作流构建与物联网场景接入

监控体系与可观测性:Prometheus 采集、Grafana 可视化与 AlertManager 告警

AI智能体项目之星海智伴

【实战】K8s生产级项目实战

项目简介

本项目主要围绕星海智伴项目进行容器化编排实战, 要求学员将单体的前后端分离的智能体项目如何升级为基于K8s容器化编排方案, 完成从中间件部署、项目前后端部署、智能体平台搭建、监控平台建设完整的链路处理,并基于此项目能够迭代出更多的类似的项目,形成一举反三的能力, 提高学员问题场景解决能力

能力目标

能够基于容器化完成各个中间件部署

能够基于K8s完成项目Pod构建

能够基于K8s构建Dify平台

能够基于K8s搭建项目监控平台

主要内容

K8s 环境初始化与部署准备:命名空间、YAML、Harbor 凭证、证书配置

服务部署与上线监控:MySQL/Redis 部署、数据库导入、前后端镜像构建、应用发布、Ingress 与监控搭建

项目答疑复盘:行业项目分类介绍、项目话术编写、疑难问题分析

【实战】K8s生产级项目实战

云岚到家微服务项目部署与维护

项目简介

云岚到家是一套面向本地生活服务场景的到家服务平台,主要为用户提供家政、保洁、维修、保养等预约上门服务。平台围绕“用户下单、服务人员接单、平台运营管理、订单履约跟踪”构建完整业务闭环,支持用户端、服务人员端和运营管理端多角色协同使用。

项目采用微服务架构设计,将用户、服务、订单、派单、抢单、支付、营销、公共能力等业务拆分为独立服务,便于后期独立开发、部署、扩容和运维。系统通过网关统一接入请求,使用 Nacos 实现服务注册发现和配置管理,结合 Redis、RabbitMQ、Canal、Elasticsearch、Seata 等中间件完成缓存加速、异步解耦、数据同步、搜索查询和分布式事务控制。

能力目标

掌握微服务架构与 Nacos 注册中心/配置中心部署运维

具备 RabbitMQ、Elasticsearch、Sentinel 等中间件集群运维能力

能搭建 GitLab CI/CD 与 GitOps/ArgoCD 持续交付流水线

掌握 Prometheus/ELK 可观测体系构建与生产故障排查

主要内容

项目介绍与架构设计:软件生命周期、功能模块介绍、业务流程演示、单体与微服务对比、运行环境与分布式集群架构设计

微服务治理与核心中间件:Nacos 注册配置中心、RabbitMQ 消息队列、XXL-JOB 任务调度、Elasticsearch、Sentinel 限流降级熔断

上线交付与 CI/CD 流水线:上线准备、容量规划、高可用部署、联调验收、Git/GitLab、CI Pipeline、ArgoCD GitOps 自动化发布

监控可观测与日志体系:Metrics/Logs/Traces、Prometheus K8s 监控架构、ELK 日志平台、Filebeat/Logstash/ES 采集与优化

云岚到家微服务项目部署与维护

云迁移升级实战

项目简介

本项目聚焦企业级应用的云原生改造与全链路可观测体系建设,包含两大核心模块:
1. 云原生基础设施与微服务架构:基于阿里云(ECS/ACK/VPC等)完成基础设施上云,通过 Docker 与 Kubernetes 实现应用容器化改造、微服务部署与弹性治理;整合 Nacos、Gateway、Redis 等核心中间件,构建高可用的微服务运行环境。
2. 全链路可观测与性能监控:结合 Prometheus + Grafana 构建系统指标监控体系,并引入 SkyWalking + Elasticsearch 建立分布式链路追踪,实现应用性能深度分析与故障快速定位。

能力目标

精通阿里云公有云架构与ACK容器服务,具备企业级微服务项目平滑上云与全链路追踪排障能力。

主要内容

项目架构与云原生上云:云岚到家架构解析、微服务模块拆分、Dockerfile 镜像构建、推送 ACR、K8s Deployment/Service/Ingress 编排

微服务治理与云上配置:Nacos 集群部署与注册配置、Gateway 路由规则与灰度发布、RDS 数据库与 Redis 云上实例连接池配置

可观测性与上云验证:Prometheus + Grafana 监控看板、日志收集与告警规则、SkyWalking 部署与探针埋点、全流程上云验证与故障排查演练

项目疑难复盘:行业微服务项目分类介绍、项目话术编写、项目疑难问题分析

云迁移升级实战

AI Ops 智能化监控项目

项目简介

平台通过构建 Hermes Agent 智能体框架,实现 AI 对基础设施、应用服务及业务系统的统一感知、智能分析和自动化处理能力。通过 MCP(Model Context Protocol)协议连接 Linux 主机、数据库、Kubernetes 集群、监控系统等外部资源,使 AI Agent 具备环境感知、工具调用、任务执行和自动决策能力。

系统整合 Prometheus、Grafana、Alertmanager、ELK、Loki 等可观测组件,实现从 指标采集 → 异常检测 → 智能分析 → 根因定位 → 自动修复 → 工单通知 → 运维闭环 的全流程自动化。

最终打造具备故障自发现、自分析、自恢复能力的新一代智能运维体系,提升企业基础设施稳定性和运维效率。

能力目标

掌握基于 Hermes Agent 与 MCP 协议的 AI 智能体开发及全栈可观测技术,具备构建故障自发现、自分析、自恢复的全流程自动化智能运维闭环体系的能力。

主要内容

AI Agent 架构与能力构建:Agent 架构设计、Hermes 部署、MCP 工具调用、Prompt 工程、Memory 记忆机制、RAG 知识库接入、多 Agent 协同、工作流编排、插件开发与 API 集成

可观测性与监控平台:Prometheus 监控、Grafana 可视化、Node Exporter、Alertmanager 告警、日志采集、ELK / Loki 日志分析、GPU / Kubernetes / APM 监控、多数据源与监控指标管理

AI Ops 智能运维闭环:告警事件接收、AI 智能分析、根因定位 RCA、故障诊断、自动工单 / 脚本执行 / 服务恢复、自动巡检与报告生成、企业微信通知、闭环运维管理

AI Ops 智能化监控项目

AI Infra 模型建设项目

项目简介

本项目聚焦 AI Infra 核心实战,为大模型落地提供云原生算力底座,包含两大模块:
1. 单机算力底座搭建:掌握GPU硬件及大模型核心概念(参数、精度、提示词、Token等),实战完成GPU驱动安装、CUDA环境配置与资源查看。
2. K8s集群部署与监控:在K8s中集成 nvidia-container-toolkit,使用 vLLM 框架部署 DeepSeek 等大模型,并引入 DCGM-exporter 实现 GPU 资源的实时监控。

能力目标

掌握大模型核心概念与GPU底层环境配置,具备在云原生K8s集群中部署大模型推理服务及实现GPU资源实时监控的 AI Infra 算力底座构建能力。

主要内容

GPU 与大模型基础:GPU 硬件型号、模型参数、精度、提示词、Token、模型训练与应用概念

GPU 环境配置与模型部署:GPU 驱动安装、CUDA 环境配置、GPU 资源查看、vLLM 推理框架、Docker GPU 运行时集成、K8s 部署 DeepSeek

GPU 资源监控:基于 DCGM Exporter 实现 GPU 资源监控

AI Infra 模型建设项目

AI SmartCloud多智能体项目部署与维护

项目简介

本项目聚焦企业级 AI 智能体应用与云原生工程化落地,包含两大核心模块:
1. AI 多智能体与混合数据架构:采用 Orchestrator 编排器与五大垂直 Agent 协同架构,基于 LangChain/LangGraph 及 A2A/MCP 协议实现智能客服应答;集成 Milvus+ES 实现混合 RAG 检索,并整合 MySQL/Redis/MongoDB/OSS 构建多层存储体系,保障业务数据高效调用。
2. 云原生微服务部署与自动化运维:基于 K8s+Containerd 实现全服务容器化部署与 FastAPI 统一网关接入;搭建 Prometheus+Grafana 全链路监控告警体系,并构建 GitLab CI/CD 流水线,实现镜像构建、集群发布、滚动更新等全流程自动化交付。

能力目标

掌握多智能体协同架构与混合 RAG 检索技术,具备基于云原生 K8s 实现 AI 微服务全链路部署、全栈监控与 CI/CD 自动化交付的工程化落地能力。

主要内容

SmartCloud 项目与 Multi-Agent 架构:项目背景、业务场景、Orchestrator + 5 大 Agent 架构、核心技术栈、K8s + Containerd 部署架构与功能演示

AI 数据服务与中间件部署:Milvus、ElasticSearch、MySQL、MongoDB、Redis、OSS 在 K8s 中的部署、存储配置、Service 暴露、连通验证与健康检查

应用构建与 Agent 服务发布:微服务 Dockerfile 构建优化、ACR 镜像推送、FastAPI Gateway / Ingress 配置、ConfigMap / Secret 管理、各 Agent 与 Dify 编排联调

可观测性与 CI/CD 运维体系:Prometheus + Grafana、cAdvisor 容器监控、日志采集与告警通知、GitLab CI/CD 流水线、滚动更新回滚与故障排查演练

AI SmartCloud多智能体项目部署与维护

机器人交付工程

项目简介

本项目聚焦人形机器人的标准化交付、智能化配置与现场运维,包含三大核心模块:
1. 硬件实操与标准化交付:熟练掌握机器人开箱验收、上电调试及规范收纳全流程;精准切换站立与力控工作模式,严格遵守操作红线与搬运规范,保障硬件交付的安全与标准化。
2. 智能配置与交互展演编排:依托 LinkSoul 平台完成 AI 智能体创建与交互技能编排,通过“舞台大师”定制动作节目,并结合“灵创 APP”实现移动端远程管控,全面配置机器人的智能交互与展演能力。
3. 系统运维与现场故障排查:掌握机器人标准化刷机升级流程,基于 Linux 环境查询与导出运行日志,能够独立排查设备运行异常,完整覆盖现场调试、部署与日常运维全流程。

能力目标

依托原厂真机实训,融合“硬件实操+AI智能体+系统运维”,开辟人形机器人落地交付的全新就业赛道。

主要内容

机器人开箱验收与基础操作:整机开箱验收、开机调试、基础按键操作、关机断电、规范装箱

运行模式与安全规范:力控模式 / 站立模式实操区分、机身组合键禁用准则、两种运行模式下设备搬动注意事项

平台应用与设备运维:LinkSoul 灵心平台智能体创建、素材资源管理、AI 自定义技能编排、APP 远程控制、舞台大师节目编排、系统刷机与 Linux 日志查询导出

机器人交付工程
绝不“纸上谈兵” 拒绝空谈

好技术是练出来的

  • 积累工作经验
    便于面试就业
  • 体验工作流程
    适应职场节奏
  • 转换菜鸟角色
    真实开发经历
  • 发现知识漏洞
    弥补经验不足
  • 锻炼沟通表达
    提高合作能力

利用“项目小组”和“项目拉练”来提升学习成果

项目拉练实训

项目拉练

将课上学习的内容在实际的业务中落地一遍

  • 项目准备
  • 随堂提问
  • 项目答辩
  • 难点收集
  • 获奖
  • 老师总结

模拟真实项目开发小组
学习小组分工

  • 组长项目经理
  • 组员项目开发
  • CTO技术攻关
查看实训过程

实力派讲师天团

伴你跨越职场关卡

讲师出身知名企业核心岗位,拥有完整一线成长经历
传授经过市场验证的落地方法、实战沉淀经验与行业前瞻视野

赵老师

赵老师

高级讲师
研发成果

《系统运维课程》、《信创运维课程》、《大数据运维课程》、《ChatGLM大模型部署课程》

AI运维学科教学负责人,10年+教学一线工作,Apache Pulsar社区活跃贡献者,阿里云认证讲师、麒麟认证讲师
精通RedHat系列、Ubuntu、国产麒麟等操作系统;精通大数据平台、自动化平台的部署、优化与监控。曾参与多个行业运维架构设计与课程实施转化,如教育、电商、保险等,具备出色的技术方案落地能力
教学风格逻辑清晰、生动易懂、激情澎湃, 属"MC"风格讲师, 极其善于培养学员学习思维、调动学员氛围,能够将复杂的运维技术深入浅出地传授给学员。

李老师

李老师

高级讲师
研发成果

《全自动化运维脚本平台项目》、《智能聊天机器人项目研发部署监控一体化平台》、《全链路 Prometheus 统一监控平台搭建》

十余年一线授课经验,深耕系统运维、DBA、中间件、监控告警四大核心方向,主攻企业全栈运维架构搭建、故障处理与性能调优。
参与政企、互联网、金融多行业大型项目,精通 Linux 与信创系统、集群高可用;熟练驾驭 MySQL、国产数据库备份、集群搭建与 SQL 优化;擅长 Nginx、Redis、MQ 中间件部署调优;独立搭建 Prometheus+Grafana 全链路监控,处理过告警风暴、业务宕机等各类线上故障,沉淀大量落地实战方案。
授课摒弃纯理论,以真实生产案例拆解运维思路、排障方法与优化方案,兼顾新手打基础、在职工程师进阶提升,搭建完整运维知识框架,传授企业刚需实战技能,助力学员少踩坑、突破技术瓶颈,所学直接适配企业工作场景。

任老师

任老师

高级讲师
研发成果

《K8S云原生课程》、《星海智伴项目实战课程》、《云岚到家微服务架构项目部署》

简介
任老师拥有6年一线云平台运维实战经历,深耕服务器架构、容器云与AI算力运维,熟练掌握Linux系统调优、Shell/Python运维开发,精通K8s集群部署、微服务高可用架构搭建,可独立落地自动化发布流程、全链路监控、统一日志分析体系,擅长大规模集群扩容、线上突发故障快速处
专业云计算授课讲师,独立开发多套就业向实战课程。讲课摒弃枯燥理论,以企业真实项目驱动教学,语言通俗,课堂互动性强,善于针对性辅导学员实操、简历与面试问题,注重培养独立排错与工程落地思维,学员就业覆盖互联网、人工智能、政企数字化等行业。

王老师

王老师

高级讲师
研发成果

《观测云全链路监控体系落地项目》、《线上故障应急复盘与运维规范落地》、《Ansible 批量自动化运维改造项目》、《服务器资源扩容与架构升级迁移项目》

精通 Linux 深度运维与高可用服务器架构设计,熟练使用 Shell、Ansible 实现自动化运维、批量部署及监控告警体系搭建。精通虚拟化、Docker 容器化与 Kubernetes 集群运维、调度及故障排查全栈实战,深耕 Nginx、Tomcat、Redis、MQ 等主流中间件性能调优、高可用架构设计与线上稳定性保障。
曾任金融头部企业核心业务线高级运维工程师,全程参与核心系统从 0 到 1 架构规划、部署上线与规模化迭代,具备极强线上应急响应、擅长将硬核技术难点拆解为可落地、易理解的实战案例与方法论。
授课风格亲切耐心、风趣幽默,善用生活化案例拆解技术原理,化繁为简。注重学员动手实践,课堂氛围轻松,可适配不同基础学员,手把手带练、耐心答疑,让学员真正听得懂、学得会、用得上。

吴老师

吴老师

高级讲师
研发成果

RHCA、RHCE、HCIP、CKA 等专业认证、企业级 Linux 运维与云平台项目维护、Kubernetes 集群部署与运维实践、Docker 容器化平台项目部署、企业自动化运维体系建设

拥有 8 年云计算与 Linux 运维领域从业经验,曾先后任职于成都冰河云存科技有限公司、星合互娱科技有限公司、易腾创想智能科技有限公司等科技企业,长期从事云计算平台运维、容器化平台建设及自动化运维等工作,具备丰富的企业项目实践经验。
专注于 Linux 系统运维、Docker、Kubernetes、Ansible、DevOps 及云原生等技术方向,熟悉企业级云计算平台架构设计、容器编排、自动化运维体系建设以及生产环境故障排查。
持有 RHCA、RHCE、HCIP、CKA等多项行业权威认证,兼具扎实的理论基础与丰富的实战经验。
教学过程中注重理论与实践相结合,以企业真实项目和实际业务场景为基础,引导学员培养工程化思维和问题分析能力,帮助学员系统掌握云计算与 Linux 运维核心技术,提升岗位竞争力。

路老师

路老师

高级讲师
研发成果

《河北某运营商传输网络隐患诊断系统》、《某省不动产管理系统》、《某省车辆管理系统》、《河南逸祥私有云系统建设》

深耕IT基础设施规划、建设与运维领域十余年,拥有大型外企、省级运营商及大型制造业集团的丰富实战经验。精通Linux操作系统、服务器架构与数据库管理,深耕KVM、Docker、Kubernetes等云计算与云原生核心技术。
历任高级系统运维工程师、数据库DBA、云计算架构师等核心技术岗位;曾主导大型集团混合云架构设计与高密度私有云建设。具备极强的复杂故障排查与底层资源调度能力,以及出色的技术团队管理经验。
授课风格严谨务实、逻辑清晰,善于将真实的生产环境实战经验转化为生动的教学案例。具备极强的耐心与沟通能力,致力于培养懂底层、能实战、符合企业需求的高素质运维人才。

蓝老师

蓝老师

研究员
研发成果

《Skywalking链路追踪课程》、《AI大模型运维课程》、《海航集团的航空船舶交易系统和融资互联网金融平台》、《优必选的GPU算法训练平台和AI人工智能开放平台》

从事互联网运维工作10+年,具备传统到云原生全栈式运维以及AI GPU运维能力,擅长互联网企业服务器高可用集群架构设计、特别擅长云原生与AI智能运维,具备企业生产环境从0到1的构建和部署,包括K8s大规模CPU/GPU集群部署和维护、大型微服务项目部署和日常运维,能够实现企业级CICD自动化流水线、Prometheus监控、Skywalking链路追踪、ELK日志收集等并具备对系统故障精准定位问题和解决问题能力以及持续的系统性能优化
历任海航集团、优必选科技有限公司等大型企业核心运维工程师一职、并完成企业核心业务系统的架构和项目部署以及日常的维护工作,拥有丰富的运维理论知识和项目实战经验

马老师

马老师

研究员
研发成果

《网络通信课程》、《K8S企业化生产部署课程》、《就业面试辅导》、《国家电网数字化转型项目》、《华为运维集成化平台项目》

中央财经大学硕士,前大厂DevOps工程师,10年互联网行业运维经验,深度参与过3个大型国央企数字化转型项目,负责从传统IT架构向云原生架构迁移的实施与落地,协调多方资源推进项目实施,攻克跨部门协作,覆盖业务从0到1搭建、持续升级的全过程。擅长Docker容器化迁移、Kubernetes微服务编排等核心项目,更对云原生技术栈(Istio/Helm/Prometheus)有体系化实战经验,能结合业务需求制定从技术选型到落地运维的全流程解决方案。​在长期工作中,马老师练就了极强的沟通协调能力,善于与人打交道,能精准理解业务部门需求,将技术方案转化为业务价值,成为技术与业务之间的高效桥梁。春风化雨,投身教育,授课通俗易懂,就业辅导经验丰富,广受学生好评。

朱老师

朱老师

研究员
研发成果

《基于K8S的可观测Prometheus监控课程》、《网易开源镜像站》、《LinuxProbe站点》、《中国电子海外镜像站点》、《Ansilble批量操作全球各地Linux服务器自动生成PDF报告》、《SPUG系统管理物理服务器与云服务器》

专研互联网技术超十年,精通Linux、服务器架构、数据库及Shell/Python编程,深耕KVM、Docker、Kubernetes等云计算技术。
历任网易集团、中国电子等互联网大厂与世界五百强企业,担任DevOps工程师、服务器架构师、云计算架构师等职;具备丰富实战经验,拥有强大的故障分析与解决能力。
Red Hat 优秀指导教师,《Linux就该这么学》核心技术支持。热衷技术分享,持续产出高质量文档。
授课幽默、有广度、有深度;善于启发、互动与激励,广受学员认可。有极强的教学耐心且善于沟通,国语、粤语、英语流利。

赵老师

赵老师

研究员
研发成果

《四川省农商联合银行农综站》、《中原银行消费信贷管理系统》、《中国移动南方基地》、《广东省移动应用超市》、《安徽省移动浏览器基地》、《中国移动MISC平台》

拥有11年头部互联网大厂技术研发及大型项目管理经验,美国项目管理协会认证专家(PMP),CSTQB认证讲师。在SRE运维、网络安全领域深耕多年,出版的《Web安全攻防实战教程》,2026年由人民邮电出版社出版发行。曾为顺丰速运、中安网脉、北京安邦保险集团、江苏润和软件等企业提供技术内训服务。

与老师一对一沟通
全方位教学服务 助你 赢在职场
全方位教学服务

课程大纲

  1. 入门试学课

    1. 国产信创与AI大模型入门

  2. 就业班

    1. 系统自动化运维 2. 项目:AI智能体项目之星海智伴 3. 高可用架构升级 4. 云原生技术之K8s容器化编排 5. 实战:K8s生产级项目实战 6. 项目:云岚到家微服务项目部署与维护 7. 云平台核心架构组件 8. 实战:微服务云迁移升级实战 9. 项目:AI Ops 智能化监控项目 10. 项目:‌AI Infra 模型建设项目 11. 项目:AI SmartCloud多智能体项目部署与维护 12. 国产信创运维专题

  3. 线上课

    1. 机器人交付专题(赠送) 2. 网络安全与大模型安全【线上录播】(赠送)

  • 国产信创与AI大模型入门入门试学课 1

    课时:6天 技术点:42项 测验:1次 学习方式:线下面授

    学习目标

    本阶段学习聚焦国产信创系统运维与云端 AI 应用部署,掌握 Kylin、Rocky Linux 系统操作、服务管理与安全运维能力,熟悉阿里云 ECS、云监控及可视化大屏配置,并能完成 Python 环境搭建、Ollama 大模型部署、聊天机器人上云与联调测试,具备从系统运维到 AI 项目落地的综合实践能力。

    主讲内容

    1. 智能运维基本概念与Linux环境准备主要包含下列技术点

    运维的工作内容|云计算概念|服务器概念|常见运维名称|网络三要素|kylin服务器安装和配置

    2. 麒麟操作系统基础_目录与文件操作主要包含下列技术点

    目录结构|文件和文件夹操作命令和概念|文件解压缩命令

    3. 麒麟操作系统基础_包、服务、进程主要包含下列技术点

    软件包分类|软件包安装卸载操作|系统服务操作|防火墙开关以及进程的操作

    4. ECS服务器与云监控服务主要包含下列技术点

    云服务器定义|厂商(阿里云等)|特点(虚拟化、按需分配等)|优势|阿里云 ECS 实例选择(经济性、通用算力型等)|计费(按量付费、包年包月等)|购买流程|ECS 使用(重启、资源调整、安全组创建、远程连接)|云监控介绍|开通|主机监控|资源报警配置|可视化大屏设置

    5. 部署国产大模型Deepseek与聊天机器人项目主要包含下列技术点

    大模型介绍|项目架构|云服务器申领|ollama环境部署|模型下载|ollama指令|python环境部署|聊天机器人上线|云监控体系搭建|联调测试

    6. Rocky Linux操作系统入门主要包含下列技术点

    rocky linux的安装|目录与文件|解压缩|包管理|服务|软件包的安装和卸载

  • 系统自动化运维就业班 1

    课时:17天 技术点:119项 测验:1次 学习方式:线下面授

    学习目标

    本阶段学习聚焦 Linux 系统运维与网络自动化能力,掌握 TCP/IP、IP 子网划分与路由交换基础,能够完成用户权限、磁盘 LVM/RAID、防火墙、SSH/Rsync、文件共享、DNS/NTP/日志等服务配置;具备 Shell 脚本编写与服务器批量初始化能力,熟悉 grep/sed/awk 工具,并能使用 Python 实现资源监控、邮件发送及自动化运维任务。

    主讲内容

    1. 网络通信主要包含下列技术点

    网络分层模型|抓包利器 Wireshark|物理介质与线缆|Cisco网络仿真软件|构建小型办公室网络|TCP/IP 模型|IP 地址与子网掩码|子网划分

    2. Rocky Linux高级主要包含下列技术点

    用户与组基本概念|用户组操作|用户操作|权限管理|umask 默认权限|特殊权限(冒险位 S 、粘滞位 T))|文件所属用户与组修改|ACL 权限控制 定时任务|防火墙|网络服务(NetworkManager、nmcli 命令查看网络接口、启用/ 禁用网卡|静态 IP 配置)|系统状态(top/htop 进程与 CPU 、 内存监控、df 磁盘空间、free 内存使用)|进程后台(nohup 命令、screen 命令)|主机名(命名规范、hostnamectl 修改/etc/hostname 编辑)

    3. Rocky Linux核心服务主要包含下列技术点

    SSH 基本概念|SSH 工作原理|SSH 服务安装配置|SSH 免密登录配置|SSH 远程命令执行|Rsync 基本概念|Rsync 安装|Rsync 语法与选项|定时同步配置 磁盘管理基本概念|磁盘结构|常见文件系统|磁盘管理命令|MBR/GPT 磁盘分区|LVM 逻辑卷(PV|VG|LV 创建)|RAID 级别|软 RAID 配置 NFS 基本概念|NFS 服务安装配置|NFS 共享目录挂载|SAMBA 基本概念|SAMBA 服务安装配置|Linux/Windows 访问 SAMBA 共享|FTP 基本概念|FTP 工作模式(主动 / 被动)|vsftpd 服务安装|FTP 服务端配置|FTP 客户端连接|FTP 权限设置 Chrony 服务安装配置|时间同步验证|日志基本概念|常见系统日志文件|RSYSLOG 配置文件|RSYSLOG 日志远程转发|logrotate 日志轮替配置 SELinux 模式|SELinux 管理工具|DNS 基本概念|DNS 结构|DNS 工作原理|BIND 软件安装|DNS 服务器内外网解析配置|客户端 DNS 配置

    4. AI辅助 Shell脚本开发主要包含下列技术点

    Shell 概述|Shell 脚本(概念、应用场景)|Shell 变量|环境变量|单引号与双引号区别|命令执行结果赋值给变量|特殊内置变量($0/$1/$# 等)|Shell 运算符 Shell 小工具(cut 列截取、sort 排序、uniq 去重统计、tee 双向输出、diff 文件 、目录比较、paste 逐行合并、tr 字符转换、删除)|Shell 判断语句|Linux 运维日常巡检(系统负载、CPU、内存、 磁盘检查、日志 、安全设置检查) 流程结构分类|if 选择结构|case 选择结构|while 循环|for 循环|嵌套循环|随机数生成|场景案例(服务器免密登录、Web 脚本一键部署等) Shell 函数|正则表达式|expect 工具 Shell 三剑客概述|grep 指令|sed 指令|awk 指令 服务器初始化脚本|一键配置静态IP与网络服务|SSH服务安全加固与免密登录自动化|防火墙(firewalld/ufw)规则批量配置|NTP时间同步自动部署|一键部署vsftpd FTP服务|一键部署BIND DNS服务|脚本日志记录与错误处理

    5. AI辅助 Python脚本开发主要包含下列技术点

    Python环境搭建|掌握Python基本语法(变量、数据类型、运算符、流程控制、数据容器)|掌握常用运维模块如os、sys、re、time、shutil、psutil、requests、paramiko等的导入与使用|服务器资源(CPU、内存、硬盘)监控设计|基于邮件模块定时发送服务器状态报告

  • 项目:AI智能体项目之星海智伴就业班 2

    课时:9天技术点:108项测验:1次学习方式:线下面授

    学习目标

    本阶段学习聚焦前后端分离项目容器化与 AI 应用运维能力,掌握 Docker 镜像构建、数据持久化、Compose 编排及容器排障;能够部署 Redis、MySQL、Nginx、Vue、Java 服务与 Dify 平台,了解 Milvus、RAG、AI Agent 及 IoT 基础;并掌握 Prometheus、Grafana 监控告警体系,具备端到端应用部署与运维实践能力。

    星海智伴是一套为养老院量身定制的智慧管理系统,面向养老行业数字化转型需求,基于前后端分离架构 + AI 能力构建。项目包含管理后台(Web)和家属端(微信小程序)两端,覆盖养老院"来访参观 → 入住办理 → 在住服务 → 退住办理"的全业务链路。

    主讲解决方案

    项目整体交付|Docker 容器化部署|Docker 镜像构建与仓库管理|Docker Compose 多服务编排|Redis 缓存服务部署|MySQL 数据库部署|MySQL 备份与性能运维| SpringBoot 后端应用打包发布|Vue 前端构建与静态资源发布|Nginx 反向代理与网关配置|RAG 智能问答与 IoT 数据接入|Dify AI Agent 平台搭建|Prometheus + Grafana 监控告警体系

    主讲知识点

    项目背景 | 业务介绍 | 技术架构 | 运维部署拆解 | 项目演示 | 核心组件说明 Docker概念 | 安装 | pull | images | run | ps | start | stop | rm | logs | exec | 数据卷 | 网络 Docker镜像 | 镜像仓库 | Dockerfile | 核心指令 | 分层构建 YAML语法 | Docker Compose | 服务定义 | 依赖启动 | 多容器编排 Redis数据类型 | String | List | Hash | Set | ZSet | Redis部署 MySQL概念 | MySQL架构 | 索引 | binlog | Docker部署 | SQL语句 | Compose部署 mysqldump | 全量备份 | 数据恢复 | crontab | 定时备份 | 慢查询日志 | 连接数 Java | SpringBoot | JAR包 | 配置文件 | Maven打包 Vue | Node.js | 前端项目构建 | 构建产出 | 静态资源托管 Nginx架构 | 反向代理 | Master-Worker | server块 | location匹配规则 | 匹配优先级 RAG | Embedding | 向量检索 | LLM回答 | IoT AI Agent | Dify部署 | 模型配置 | 知识库搭建 | 工作流构建 Prometheus | 时序数据库 | Exporter | Grafana | PromQL | 告警规则 | AlertManager

  • 高可用架构升级就业班 3

    课时:7天 技术点:105项 测验:1次 学习方式:线下面授

    学习目标

    本阶段学习聚焦企业级 Web 与数据服务高可用运维能力,掌握 Nginx 反向代理、负载均衡、HTTPS 与性能调优,能够基于 Keepalived 构建双机热备;掌握 MySQL 主从复制、备份恢复与 Redis 哨兵、集群架构,解决缓存穿透、击穿、雪崩等问题;并能使用 Ansible Playbook 实现批量部署与发布管理,具备日志分析、故障排查与业务平滑上线能力。

    主讲内容

    1. Nginx服务器深度剖析主要包含下列技术点

    Nginx 架构原理|Master/Worker 工作机制|虚拟主机|反向代理|负载均衡配置|HTTPS|Rewrite|Location|缓存优化|静态资源加速|限流|防盗链配置|企业级 Nginx 高性能优化实践

    2. 高可用架构组件Keepalived主要包含下列技术点

    高可用架构与 Keepalived 原理|VRRP 协议|VIP 漂移机制|Keepalived 双机热备部署|健康检查 Script 编写|Nginx + Keepalived 企业级高可用实战

    3. 存储技术高可用升级:MySQL与Redis主要包含下列技术点

    MySQL 主从复制部署与同步原理|Binlog|Relay Log|GTID 深度解析|MySQL 主从切换与常见故障排查|MySQL 备份恢复(mysqldump、Xtrabackup)|企业数据库性能优化实践(索引、慢查询、连接池)|Redis RDB|AOF 持久化机制|Redis 主从复制部署与故障恢复|Sentinel 哨兵模式高可用实践|Redis Cluster 集群部署与数据迁移|Redis 常见性能问题与内存优化|MySQL + Redis 企业架构设计|数据一致性与缓存更新策略(Cache Aside)|缓存穿透|击穿|雪崩解决方案|MySQL 与 Redis 综合故障排查|企业级高可用存储平台综合实战

    4. 自动化部署Ansible主要包含下列技术点

    Inventory 主机管理|Playbook 编写规范|Role 项目化管理|企业自动化部署实战

    5. 发版、日志管理方案主要包含下列技术点

    企业应用发布流程设计(开发、测试、生产环境管理)|常见发布方式实践(滚动发布、蓝绿发布、灰度发布)|Nginx|Tomcat|Java 应用日志管理|Linux 系统日志分析与故障定位(journalctl、syslog)|应用发布异常排查与生产故障恢复实践

  • 云原生技术之K8s容器化编排就业班 4

    课时:9天 技术点:135项 测验:1次 学习方式:线下面授

    学习目标

    本阶段学习聚焦云原生容器编排与智能体部署能力,掌握 Containerd 与 Kubernetes 集群部署、节点调度、Pod 生命周期、Service/Ingress、存储与配置管理;能够使用 HPA、Helm 完成应用编排与 Harbor 发布,并部署 Codex Agent、理解 MCP,具备容器化服务运维与故障排查能力。

    主讲内容

    1. 容器化技术之 Containerd 运行时主要包含下列技术点

    Containerd 简介|Containerd 核心组件|工作流程分层|Containerd 与 Docker 关系|Containerd 安装|配置|基本命令

    2. ChatGPT Codex Agent企业应用主要包含下列技术点

    Codex软件安装和配置|Codex 与 ChatGPT区别|官方Skill的添加和触发|自定义Skill创建和使用|MCP概述和自定义MCP的开发|Tool工具调用|Tool和Skill|MCP的区别

    3. K8s 生产级部署主要包含下列技术点

    传统部署的问题|Kubernetes 容器编排优势|Kubernetes 概述|Kubernetes 核心组件|Kubernetes 集群安装部署|集群容器管理工具|Kubernetes 集群后台管理(kuboard、Rancher )|Codex Agent实现K8s集群部署实战

    4. K8s 节点管理、命名空间和 POD主要包含下列技术点

    节点基础|节点管理操作|节点调度管理|命名空间|POD 基础|POD 亲和性 / 反亲和性|POD生命周期|重启策略|镜像拉取策略|健康检查|钩子|排错方法

    5. K8s 控制器、Service 与 HPA主要包含下列技术点

    Controller 控制器|Service 类型|Metrics-Server 安装|HPA 三要素|HPA 操作步骤

    6. K8s 的 Ingress 工具主要包含下列技术点

    Ingress 控制器分类|Kubernetes Ingress Controller 安装|Ingress-HTTP 案例|Ingress-HTTPS 案例|Traefik 部署|Traefik 验证

    7. K8s 的存储卷 - PV-PVC - 动态供给主要包含下列技术点

    存储卷背景|存储卷分类|PV 与 PVC 概念|存储动态供给

    8. K8s ConfigMap 与 Secret主要包含下列技术点

    ConfigMap 概念|创建方式|使用方式|subPath 参数|Secret 概念|类型|创建|使用|Nginx HTTPS 案例(证书 Secret 创建、ConfigMap 配置文件挂载、HTTPS 访问验证)

    9. K8s Helm 包管理主要包含下列技术点

    K8s 部署挑战|Helm 解决方案|Helm 概念|Helm 安装|Chart 生命周期|Chart 升级回退|Helm 仓库管理|Harbor 安装案例|发布 Chart 到 Harbor 私仓

  • 实战:K8s生产级项目实战就业班 5

    课时:2天技术点:25项测验:1次学习方式:线下面授

    学习目标

    本阶段学习聚焦 Kubernetes 项目实战与平台化部署能力,能够基于容器化完成各类中间件部署,基于 K8s 构建项目 Pod、Dify 平台及监控平台;同时掌握项目细化表述与重难点解决方案,具备从服务编排、平台搭建到问题排障的综合实践与举一反三能力。

    本项目主要围绕星海智伴项目进行容器化编排实战, 要求学员将单体的前后端分离的智能体项目如何升级为基于K8s容器化编排方案, 完成从中间件部署、项目前后端部署、智能体平台搭建、监控平台建设完整的链路处理,并基于此项目能够迭代出更多的类似的项目,形成一举反三的能力, 提高学员问题场景解决能力

    主讲解决方案

    K8s应用交付方案|创建命名空间|复制数据库等yaml文件|修改yaml命名空间|创建Harbor凭证|部署MySQL服务|数据库导入|部署Redis服务|构建后端镜像|构建前端镜像|创建证书|部署应用|创建Ingress访问入口|监控搭建 行业项目表达方案|各行业单体项目分类介绍|行业各类项目介绍|项目话术编写|项目疑难问题分析

    主讲知识点

    K8s部署实操|命名空间创建|yaml文件复制|yaml命名空间修改|Harbor凭证创建|MySQL服务部署|数据库导入|Redis服务部署|后端镜像构建|前端镜像构建|证书创建|应用部署|Ingress访问入口|监控搭建 行业项目讲解|单体项目分类|行业项目介绍|项目话术编写|项目疑难问题分析

  • 项目:云岚到家微服务项目部署与维护就业班 6

    课时:13天技术点:195项测验:1次学习方式:线下面授

    学习目标

    本阶段学习聚焦微服务项目架构与云原生持续交付能力,掌握单体与微服务架构设计、高可用集群规划及 Nacos、RabbitMQ、xxl-job、Elasticsearch 等中间件部署;能够基于 GitLab、ArgoCD 实现 GitOps 自动化发布,并结合 Prometheus、Grafana、ELK 完成监控告警与日志治理,具备项目上线、容量规划与故障排查能力。

    云岚到家是一套面向本地生活服务场景的到家服务平台,主要为用户提供家政、保洁、维修、保养等预约上门服务。平台围绕“用户下单、服务人员接单、平台运营管理、订单履约跟踪”构建完整业务闭环,支持用户端、服务人员端和运营管理端多角色协同使用。 项目采用微服务架构设计,将用户、服务、订单、派单、抢单、支付、营销、公共能力等业务拆分为独立服务,便于后期独立开发、部署、扩容和运维。系统通过网关统一接入请求,使用 Nacos 实现服务注册发现和配置管理,结合 Redis、RabbitMQ、Canal、Elasticsearch、Seata 等中间件完成缓存加速、异步解耦、数据同步、搜索查询和分布式事务控制。

    主讲解决方案

    项目架构与认知方案|生命周期规划|功能模块设计|业务流程梳理|架构选型对比|分布式集群设计 Nacos注册配置方案|注册中心选型|数据库配置|单机与集群部署|命名空间规划|动态配置设计 RabbitMQ消息队列方案|应用场景规划|高可用架构设计|QuorumQueue应用|故障处理与性能优化 核心中间件集成方案|xxl-job调度规划|ES集群与索引规划|Sentinel流控与熔断降级设计 微服务上线交付方案|容量与高可用规划|微服务配置与部署|系统联调与验收 Git与GitLabCI方案|代码版本管理规划|GitLab仓库搭建|用户与权限管理|CI流水线设计 GitOps持续部署方案|GitOps工作流设计|ArgoCD搭建|配置仓库管理|项目CICD自动发布 K8s可观测监控方案|可观测体系规划|Prometheus监控模型设计|企业级K8s监控平台架构 ELK日志平台方案|ELK高可用架构设计|日志采集与过滤规划|ES集群与索引规划

    主讲知识点

    项目认知与架构|软件生命周期|功能模块介绍|业务流程演示|单体与微服务对比|运行环境|中间件介绍|分布式集群架构 Nacos核心原理|主流工具对比|内置与外部数据库|单机与集群部署|Raft选举原理|命名空间|服务注册|心跳与健康检查|动态配置与监听推送 RabbitMQ核心架构|削峰解耦异步场景|单机与集群部署|Exchange四种类型|高可用与QuorumQueue原理|故障类型|性能优化 核心中间件部署|xxl-job部署与作用|ES集群部署|角色划分|索引分片与字段映射|Sentinel镜像构建|限流降级熔断原理 项目上线准备|容量规划|高可用设计|Nacos配置|微服务部署|系统联调|项目验收 Git核心操作|工作区与版本库|代码提交合并|冲突解决|分支与tag|GitLab搭建|用户与权限管理|Runner部署与注册|gitlab-ci.yaml|CI流水线 GitOps工作流|代码提交与镜像构建|GitOpsRepo更新|ArgoCD检测与K8s更新|ArgoCD搭建与后台管理|配置仓库|项目CICD持续构建与自动发布 可观测性三大体系|Metrics/Logs/Traces区别|K8s监控挑战|Prometheus监控模型|企业级K8s监控平台架构设计 ELK核心组件|高可用部署|Filebeat采集配置|Logstash过滤与优化|ES集群部署|角色分类|索引分片与副本配置|选举原理

  • 云平台核心架构组件就业班 7

    课时:3天 技术点:45项 测验:1次 学习方式:线下面授

    学习目标

    本阶段学习聚焦阿里云公有云架构与容器集群管理能力,掌握 ECS、RDS、SLB、CDN 及域名解析等核心云服务配置,能够基于 1Panel 完成环境搭建与应用部署;并精通 VPC 网络规划与阿里云 ACK 集群的创建与访问管理,具备分布式架构运维与公有云 K8s 环境管理的综合实战能力。

    主讲内容

    1. 阿里云云平台核心组件主要包含下列技术点

    阿里云 ECS 概述及特点|ECS 登录注册与充值|ECS 免费资源领取|ECS 远程连接实战|RDS 概述及特点|RDS 申请与配置|RDS 数据导入导出|云监控开通与 ECS 监控配置|云监控报警规则设置|可观测监控 Prometheus 版开通|Prometheus 实例创建与配置|Prometheus 监控告警与通知|阿里云 SLB 概述及类型|SLB 配置实战|CDN 概述与应用场景|阿里云 CDN 申领与配置|Answer 智能问答平台部署实战|域名注册与解析配置|CDN 加速配置与效果验证

    2. 阿里云容器化组件ACK主要包含下列技术点

    阿里云 ACK 概述与核心优势|专有网络 VPC 创建与配置|阿里云 ACK 申请与创建|ACK 连通性测试|本地访问 ACK 容器服务实战

  • 实战:微服务云迁移升级实战就业班 8

    课时:3天技术点:40项测验:1次学习方式:线下面授

    学习目标

    本阶段学习聚焦企业级微服务项目上云与可观测性建设,掌握微服务容器化改造、ACK 集群编排部署,以及 Nacos、Gateway、Redis/RDS 等组件的云上集成;能够通过 SkyWalking 完成链路追踪、探针埋点与微服务监控,具备项目细化表述、难点解决及举一反三的综合运维实战能力。

    本项目聚焦企业级应用的云原生改造与全链路可观测体系建设,包含两大核心模块: 1. 云原生基础设施与微服务架构:基于阿里云(ECS/ACK/VPC等)完成基础设施上云,通过 Docker 与 Kubernetes 实现应用容器化改造、微服务部署与弹性治理;整合 Nacos、Gateway、Redis 等核心中间件,构建高可用的微服务运行环境。 2. 全链路可观测与性能监控:结合 Prometheus + Grafana 构建系统指标监控体系,并引入 SkyWalking + Elasticsearch 建立分布式链路追踪,实现应用性能深度分析与故障快速定位。

    主讲解决方案

    云岚到家微服务上云方案|项目架构解析|微服务拆分|镜像构建|ACR推送|K8s编排|Nacos集群|网关路由灰度|RDS连接|Redis对接|监控告警|上云验证排障 SkyWalking链路追踪方案|OAPServer部署|UI服务部署|探针埋点|启动参数配置|微服务重启|链路追踪访问 行业项目表达方案|微服务项目分类|行业项目介绍|项目话术编写|疑难问题分析

    主讲知识点

    云岚到家项目实战|项目架构解析|微服务模块拆分|Dockerfile编写|ACR镜像推送|集群部署|微服务注册配置|Gateway路由规则|灰度发布|RDS数据库连接|Redis云上对接|连接池配置|Prometheus监控|Grafana看板|日志收集|告警规则|上云验证|故障排查 SkyWalking监控部署|skywalking-oap-server部署|skywalking-ui部署|探针埋点|微服务启动参数修改|服务重启|SkyWalking访问 行业项目梳理|微服务项目分类|行业各类项目介绍|项目话术编写|项目疑难问题分析

  • 项目:AI Ops 智能化监控项目就业班 9

    课时:2天技术点:45项测验:1次学习方式:线下面授

    学习目标

    本阶段学习聚焦 AI 智能体开发与企业级 AIOps 智能运维平台建设,掌握 Hermes Agent 部署、Prompt/Memory/工具调用配置、MCP 协议集成与多 Agent 协同编排;能够构建覆盖基础设施、容器及 AI 服务的统一监控告警体系,并结合 AI 实现智能分析、自动巡检与故障自愈,具备智能运维工作流设计与自动化闭环处理能力。

    平台通过构建 Hermes Agent 智能体框架,实现 AI 对基础设施、应用服务及业务系统的统一感知、智能分析和自动化处理能力。通过 MCP(Model Context Protocol)协议连接 Linux 主机、数据库、Kubernetes 集群、监控系统等外部资源,使 AI Agent 具备环境感知、工具调用、任务执行和自动决策能力。 系统整合 Prometheus、Grafana、Alertmanager、ELK、Loki 等可观测组件,实现从 指标采集 → 异常检测 → 智能分析 → 根因定位 → 自动修复 → 工单通知 → 运维闭环 的全流程自动化。 最终打造具备故障自发现、自分析、自恢复能力的新一代智能运维体系,提升企业基础设施稳定性和运维效率。

    主讲解决方案

    Agent智能化应用方案|Agent架构设计|Hermes部署|MCP工具调用|Prompt工程|Memory记忆机制|RAG知识库接入|多Agent协同|工作流编排|插件开发|API集成 可观测性监控方案|Prometheus监控集成|Grafana可视化|NodeExporter接入|Alertmanager告警|日志采集|ELK日志分析|Loki日志平台|GPU监控|Kubernetes监控|APM应用性能监控|多数据源接入|监控指标管理 AIOps闭环运维方案|告警事件接收|AI智能分析|根因定位|故障诊断|自动工单生成|自动脚本执行|自动服务恢复|自动巡检|自动报告生成|企业微信通知|工作流编排|闭环运维管理

    主讲知识点

    Agent架构与集成|Agent架构设计|Hermes部署|MCP工具调用|Prompt工程|Memory记忆机制|RAG知识库接入|多Agent协同|工作流编排|插件开发|API集成 监控与日志体系|Prometheus监控|Grafana可视化|NodeExporter|Alertmanager|日志采集|ELK日志分析|Loki日志平台|GPU监控|Kubernetes监控|APM应用性能监控|多数据源接入|监控指标管理 AIOps自动化运维|告警事件接收|AI智能分析|RCA根因定位|故障诊断|自动工单生成|自动脚本执行|自动服务恢复|自动巡检|自动报告生成|企业微信通知|工作流编排|闭环运维管理

  • 项目:‌AI Infra 模型建设项目就业班 10

    课时:2天技术点:48项测验:1次学习方式:线下面授

    学习目标

    本阶段学习聚焦 GPU 服务器运维与 AI 推理环境部署能力,掌握 GPU 硬件型号、大模型参数、精度、Token 等基础概念,能够完成驱动安装、CUDA 环境配置与 GPU 资源查看;并掌握 vLLM 推理框架运行模型、nvidia-container-toolkit 与 Docker 集成,结合 Dcgm-exporter 实现 GPU 资源监控。

    本项目聚焦 AI Infra 核心实战,为大模型落地提供云原生算力底座,包含两大模块: 1. 单机算力底座搭建:掌握GPU硬件及大模型核心概念(参数、精度、提示词、Token等),实战完成GPU驱动安装、CUDA环境配置与资源查看。 2. K8s集群部署与监控:在K8s中集成 nvidia-container-toolkit,使用 vLLM 框架部署 DeepSeek 等大模型,并引入 DCGM-exporter 实现 GPU 资源的实时监控。

    主讲解决方案

    GPU基础环境方案|GPU显卡选型|模型参数与精度规划|提示词与token设计|驱动安装|CUDA环境配置|GPU资源查看 大模型推理部署方案|vLLM推理运行|nvidia-container-toolkit安装|DockerGPU集成|K8s部署Deepseek|Dcgm-exporterGPU监控

    主讲知识点

    GPU与大模型基础|GPU显卡硬件型号|大模型参数|精度|提示词|token|模型训练|模型应用概念|GPU服务器驱动安装|CUDA环境配置|GPU资源使用查看 vLLM推理与GPU监控|vLLM推理框架运行模型|vLLM优势|nvidia-container-toolkit安装|Docker集成|K8s集群部署Deepseek大模型|Dcgm-exporter组件|GPU资源监控

  • 项目:AI SmartCloud多智能体项目部署与维护就业班 11

    课时:7天技术点:133项测验:1次学习方式:线下面授

    学习目标

    本阶段学习聚焦 SmartCloud 多智能体平台的容器化部署与运维实战,掌握基于 K8s + Containerd 的 Multi-Agent 架构与环境准备;能够完成 Milvus、ES、MySQL、Redis 等中间件及 FastAPI 网关、Dify 平台的编排部署,并通过 Prometheus、Grafana、日志系统与 GitLab CI/CD 流水线,实现全链路监控、自动化发布与运维管理。

    本项目聚焦企业级 AI 智能体应用与云原生工程化落地,包含两大核心模块: 1. AI 多智能体与混合数据架构:采用 Orchestrator 编排器与五大垂直 Agent 协同架构,基于 LangChain/LangGraph 及 A2A/MCP 协议实现智能客服应答;集成 Milvus+ES 实现混合 RAG 检索,并整合 MySQL/Redis/MongoDB/OSS 构建多层存储体系,保障业务数据高效调用。 2. 云原生微服务部署与自动化运维:基于 K8s+Containerd 实现全服务容器化部署与 FastAPI 统一网关接入;搭建 Prometheus+Grafana 全链路监控告警体系,并构建 GitLab CI/CD 流水线,实现镜像构建、集群发布、滚动更新等全流程自动化交付。

    主讲解决方案

    SmartCloud项目交付方案|项目背景梳理|Multi-Agent架构设计|技术栈选型|K8s部署架构规划|Containerd环境准备|功能演示 向量检索服务方案|Milvus应用规划|MilvusK8s编排|PVC存储配置|ES部署配置|索引配置|Service外部访问 K8s中间件部署方案|MySQL状态化部署|MongoDB状态化部署|Redis缓存配置|OSS对象存储接入|Secret管理|服务连通验证 镜像与网关发布方案|微服务镜像构建|ACR镜像推送|FastAPI网关部署|Service配置|Ingress路由|配置与密钥管理 Agent服务联调方案|Agent服务编排|副本管理|Dify平台部署|工作流配置|服务网络互通|全链路联调|部署问题排查 监控与CICD方案|Prometheus监控|Grafana可视化|cAdvisor采集|Containerd监控|日志集中管理|告警通知|GitLabCICD|滚动更新回滚

    主讲知识点

    SmartCloud项目认知|项目背景|业务场景|Multi-Agent架构|核心技术栈|K8sContainerd部署架构|各端功能演示 Milvus与ES部署|Milvus概述|应用场景|K8s编排部署|PVC存储配置|连通性验证|ES部署配置|索引配置|Service外部访问 K8s中间件实战|MySQLStatefulSet|MongoDBStatefulSet|RedisDeployment|ConfigMap缓存策略|OSS配置|Secret管理|Service暴露|健康检查排查 镜像构建与网关发布|Dockerfile优化|阿里云ACR推送|FastAPIGateway|Deployment配置|Service配置|Ingress路由|ConfigMap与Secret管理 Agent服务部署联调|五大Agent服务编排|副本管理|DifyK8s部署|工作流配置|服务网络互通|接口验证|部署问题排查 监控运维与CICD|Prometheus部署|Grafana配置|cAdvisor监控|K8s资源监控看板|日志采集管理|告警规则|GitLabCICD流水线|滚动更新与回滚

  • 国产信创运维专题就业班 12

    课时:3天 技术点:64项 测验:1次 学习方式:线下面授

    学习目标

    本阶段学习聚焦信创生态与国产基础软硬件运维能力,理解信创“2+8+N”体系及麒麟、欧拉操作系统的安装使用、网络配置与安全基础;掌握高斯、DM9 等国产数据库的部署、SQL 操作、备份恢复与远程连接,具备国产操作系统与数据库环境搭建、日常运维及基础故障处理能力。

    主讲内容

    1. 国产化操作系统主要包含下列技术点

    信创概念|发展历程|“2+8+N” 体系|2025 政策里程碑|技术生态|操作系统分类|麒麟 OS 核心竞争力|银河麒麟服务器安装|网络配置|SSH 远程接入|启动流程|systemd 守护进程|chrony 时间同步服务 欧拉操作系统介绍|欧拉操作系统安装操作|欧拉操作系统远程连接|欧拉操作系统的命令|欧拉操作系统网络与防火墙管理

    2. 国产化数据库达梦实践主要包含下列技术点

    高斯数据库的基本介绍|高斯数据库安装|高斯数据库基本使用|高斯数据库备份与还原 DM9概述|核心应用场景|DM9 安装|镜像挂载|命令行安装|初始化数据库|服务注册|环境变量配置|DM9 SQL|DCL 权限管理|备份恢复|远程连接

  • 机器人交付专题(赠送)线上课 1

    课时:2天技术点:50项测验:0次学习方式:线下面授

    学习目标

    本阶段学习聚焦人形机器人交付与运维能力,掌握硬件验收、收纳作业、力控与站立模式区分及硬件安全红线;能够使用三大平台完成 AI 智能体配置、节目编排与远程设备管控,并规范完成机器人刷机与 Linux 日志排查,具备全流程交付及基础故障处理能力。

    本项目聚焦人形机器人的标准化交付、智能化配置与现场运维,包含三大核心模块: 1. 硬件实操与标准化交付:熟练掌握机器人开箱验收、上电调试及规范收纳全流程;精准切换站立与力控工作模式,严格遵守操作红线与搬运规范,保障硬件交付的安全与标准化。 2. 智能配置与交互展演编排:依托 LinkSoul 平台完成 AI 智能体创建与交互技能编排,通过“舞台大师”定制动作节目,并结合“灵创 APP”实现移动端远程管控,全面配置机器人的智能交互与展演能力。 3. 系统运维与现场故障排查:掌握机器人标准化刷机升级流程,基于 Linux 环境查询与导出运行日志,能够独立排查设备运行异常,完整覆盖现场调试、部署与日常运维全流程。

    主讲解决方案

    机器人硬件交付方案|整机开箱验收|开机调试|关机断电|规范装箱|力控与站立模式实操|设备安全规范|搬动注意事项 灵心平台与系统运维方案|LinkSoul智能体创建|素材资源管理|AI自定义技能编排|APP移动端远控|舞台节目编排|系统刷机操作|Linux日志管理

    主讲知识点

    机器人硬件操作与安全|整机开箱验收|开机调试|基础按键操作|关机断电|规范装箱|力控与站立模式区分|机身组合键禁用准则|运行模式搬动注意事项 LinkSoul平台与系统运维|智能体创建|素材资源管理|AI自定义技能编排|灵创平台APP远控|舞台大师节目编排|机器人系统刷机|Linux环境日志查询|日志导出

  • 网络安全与大模型安全【线上录播】(赠送)线上课 2

    课时:60天 技术点:900项 测验:0次 学习方式:线下面授

    学习目标

    本阶段学习聚焦企业级网络安全与红蓝对抗实战能力,掌握网络协议分析、边界防护、漏洞扫描与系统加固;能够完成 Web 渗透、内网横向移动、域控攻击及免杀加载器开发,并结合 SIEM/ELK、内存取证与应急响应技术实现攻击溯源与闭环处置,具备渗透测试、安全运营与项目交付综合能力。

    主讲内容

    1. 边界防御与安全底座建设主要包含下列技术点

    网络协议栈与Wireshark流量分析|企业级路由交换与VLAN防环配置|OSPF动态路由与局域网二层安全防御|下一代防火墙安全域划分与NAT映射|IPSec/SSL VPN跨域安全互联部署|公有云安全组与零信任SASE架构|操作系统安全加固基线与自动化扫描|Nmap高级资产测绘与Nessus漏洞扫描

    2. Web 安全深度攻防|源码审计与数据安全主要包含下列技术点

    Web资产信息收集与敏感指纹识别|SQL注入全阶利用与SQLmap绕过WAF|XSS/CSRF/SSRF漏洞原理与内网Redis利用|文件上传高级绕过与WebShell加密免杀|RCE命令执行与多协议反弹Shell通道|PHP/Java反序列化漏洞与POP链构造|Shiro/Log4j2/Fastjson高危组件实战|业务逻辑漏洞与JWT鉴权伪造绕过|DLP数据防泄漏与AI大模型安全护栏

    3. 蓝队安全运营|应急响应与数字取证主要包含下列技术点

    内网环境架构剖析与BloodHound域拓扑探测|多级内网穿透与FRP|NPS代理隧道级联|本地凭证窃取与LSASS内存提取|系统配置缺陷与内核漏洞本地提权|Bypass UAC与DLL劫持白组件利用|内网横向移动与NTLM哈希|票据传递攻击|Kerberos协议剖析与金/白银票据伪造|域控高危漏洞实战(ZeroLogon、NoPac、ADCS)|域控权限维持与Cobalt Strike级联控制

    4. 内网渗透与企业级 AD 域控攻防主要包含下列技术点

    SIEM/ELK日志平台部署与自动化告警联动|主机应急响应PDCERF模型与隐藏挖矿排查|Web中间件日志进阶分析与勒索病毒隔离处置|WebShell查杀与定时任务/自启动驱动溯源|物理内存镜像采集与Volatility取证分析|C2加密流量追踪与黑客攻击画像溯源|安服大厂面试考点解析与1v1模拟技术答辩|个人漏洞作品集包装与入职生存规范

    5. 红队免杀武器化与 1:1 靶场对抗主要包含下列技术点

    C/C++ Shellcode免杀加载器开发与PE结构分析|内存加密与API Hashing静态检测绕过|EDR行为监控机制与NTDLL Unhook内存重写|AppLocker白名单限制与LOLBAS绕过技术|DLL劫持自启动与受信进程动态注入|1:1跨隔离区企业级靶场实战(外网打点/OA突破)|内网凭证获取与多层级横向移动排错|域控提权路径研判与KRBTGT Hash读取|红蓝对抗总结报告撰写与安服项目交付答辩

  • AI运维 V版本课程说明

    课程名称:主要针对:主要使用开发工具:

    课程介绍

返回课程目录

↑ 上拉查看下阶段课程

在线咨询
看不清,点击图片换一张