社区
王伟的课程社区_NO_1
后端工程师的 AI 转型第一课:Ollama 与私有化大模型实战
帖子详情
Kubernetes 部署——从单机到集群资源治理
davidwang456
2026-07-04 10:12:24
课时名称
课时知识点
Kubernetes 部署——从单机到集群资源治理
**定位**:进入云原生部署与资源隔离场景。 **核心内容**:
Deployment、Service、Ingress 与持久化存储
GPU 节点调度与资源请求
模型文件分发与启动预热
HPA 对推理服务的局限
多租户隔离、节点亲和性和 Pod 生命周期
实战目标
:在 K8s 中部署 Ollama 服务,配置 GPU 节点调度、模型卷挂载、健康检查和内网访问入口。
...全文
29
回复
打赏
收藏
Kubernetes 部署——从单机到集群资源治理
课时名称课时知识点Kubernetes 部署——从单机到集群资源治理**定位**:进入云原生部署与资源隔离场景。 **核心内容**: Deployment、Service、Ingress 与持久化存储 GPU 节点调度与资源请求 模型文件分发与启动预
复制链接
扫一扫
分享
举报
写回复
配置赞助广告
用AI写文章
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
第26章:
Kubernetes
部署
——从
单机
到
集群
资源
治理
本文聚焦于在
Kubernetes
集群
中
部署
Ollama推理服务的关键挑战与实践,涵盖GPU节点亲和性调度、模型文件高效分发(HostPath+DaemonSet)、无状态化改造难点、多租户
资源
隔离及避免HPA误用等核心问题。强调Ollama在K8s中非标准无状态服务的特性,提出基于持久化存储、固定副本数、定制Ingress超时与Gateway负载均衡的生产级方案。
2026年云计算运维实战:Docker与
Kubernetes
全链路技能指南
本文系统梳理2026年云计算运维核心技能,聚焦Docker容器化与
Kubernetes
集群
管理的全链路实践。涵盖Linux基础命令、Docker镜像构建与Compose编排、k8s
单机
及生产级
部署
、高可用Web应用实战
部署
、监控排查、安全
治理
及CI/CD集成。强调原理理解与企业级落地能力,突出Pod、Deployment、Service、ConfigMap/Secret等k8s核心
资源
及镜像安全扫描、网络策略等关键运维环节。
Alpamayo-R1-10B开源可
部署
:支持
Kubernetes
集群
调度的VLA模型服务化方案
本文介绍Alpamayo-R1-10B开源VLA模型的服务化
部署
方案,聚焦于
Kubernetes
集群
调度支持。该10B参数模型面向自动驾驶场景,具备多模态理解、因果推理与轨迹预测能力;提供标准化K8s
部署
流程、HPA自动扩缩容、GPU
资源
优化(MPS/RDMA)、WebUI交互式推理及
集群
级性能调优方法,实现从
单机
到生产级
集群
的弹性伸缩和服务
治理
。
Qwen3-4B-Thinking
部署
教程:vLLM与
Kubernetes
集群
集成
部署
方案
本文详解Qwen3-4B-Thinking大语言模型在vLLM推理引擎与
Kubernetes
集群
中的集成
部署
全流程,涵盖
单机
快速启动、K8s环境准备、持久化模型存储、vLLM Deployment/Service/Ingress配置、Chainlit前端集成及生产级监控优化(Prometheus指标采集、HPA自动扩缩容、健康探针、日志
治理
)。强调AI服务高可用、可观测性与
资源
隔离能力。
从Docker到
Kubernetes
:Huly平台无缝迁移终极实战指南
本文详细阐述了将Huly一体化项目管理平台从Docker Compose
单机
部署
迁移至
Kubernetes
集群
的全流程实践,涵盖环境准备、Docker Compose服务拆解、
Kubernetes
资源
配置(Deployment/Service/Ingress)、PostgreSQL数据库迁移、服务发现与入口路由配置,以及迁移后的状态校验和常见故障排查方法,强调
Kubernetes
在弹性伸缩、高可用和服务
治理
方面的优势。
王伟的课程社区_NO_1
1
社区成员
402
社区内容
发帖
与我相关
我的任务
王伟的课程社区_NO_1
复制链接
扫一扫
分享
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
暂无公告
试试用AI创作助手写篇文章吧
+ 用AI写文章