应用编排与管理:Job 和 DaemonSet(一)|学习笔记

简介: 快速学习应用编排与管理:Job 和 DaemonSet(一)

开发者学堂课程【Kubernetes 入门应用编排与管理:Job 和 DaemonSet(一)】学习笔记,与课程紧密联系,让用户快速学习知识。

课程地址:https://developer.aliyun.com/learning/course/51/detail/1013


应用编排与管理:Job 和 DaemonSet(一)


 内容介绍:

一、需求来源

二、用例解读

三、操作演示

四、架构设计

 

一、需求来源

1、Job 背景问题

我们可以通过 Pod 来直接运行任务进程吗?

如果这样做,以下的问题有什么方式来解决?

l 如何保证 Pod 内进程正确的结束?

l 如果进程运行失败,如何重试?

l 如何管理多个任务且任务之间有互相依赖关系?

l 如何并行运行任务并管理他们的队列大小?

2、Job:管理任务的控制器

l Job 能帮助我们做什么事情?

1. 创建一个或多个Pod确保指定数量的 Pod 可以成功地运行终止

2. 跟踪 Pod 状态,根据配置及时重试失败的 Pod

3. 确定依赖关系,保证上一个任务运行完毕后再运行下一个任务

4. 控制任务并行度,并根据配置确保 Pod 队列大小

 

二、用例解读

1、Job 语法

l 新知识点:

restartPolicy:重启策略

backoffLimit:重试次数限制

2、查看 Job 状态

$kubectl create -f job.yaml

$ kubectl get jobs

NAME  COMPLETIONS  DURATION   AGE

Pi  1/1   71s  4m6s

COMPLETIONS:完成 pod 数量

DURATION: Job 实际业务运行时长

AGE: job 创建的时长

3、查看 Pod

$ kubectl get pod

NAME

pi-4cfrp

l Pod 名字格式:

l ${job-name}-${random-suffix}

$kubectl get pods pi-4cfrp -o yaml

apiversion: v1

kind: Pod

metadata:

labels:

controller-uid: d2912fc6-6599-11e9-9fea-00163e00cf4e

job-name: pi

name: pi-4cfrp

namespace: default

ownerReferences:

- apiVersion: batch/v1

blockOwnerDeletion: true

controller: true

kind: Job

name: pi

uid: d2912fc6-6599-11e9-9fea-00163e00cf4e

labels 均为自动匹配与添加

4、并行运行 Job 新知识点:

1.completions:代表本 pod 队列执行次数,这里8代表这个任务将被执行8次

2. parallelism:代表并行执行个数,这里的2代表并行执行的 pod 数量,也就是说会有2个 pod 同时运行

apiVersion: batch/v1

kind: Job

metadata:

name: paral-1

spec:

completions: 8

parallelism: 2

template:

spec:

containers:

- name: param

image: ubuntu

command: ["/bin/sh"]

args: ["-c", "sleep 30; date"]

restartPolicy: OnFailure

相关文章
|
3天前
|
数据采集 人工智能 安全
|
12天前
|
云安全 监控 安全
|
4天前
|
自然语言处理 API
万相 Wan2.6 全新升级发布!人人都能当导演的时代来了
通义万相2.6全新升级,支持文生图、图生视频、文生视频,打造电影级创作体验。智能分镜、角色扮演、音画同步,让创意一键成片,大众也能轻松制作高质量短视频。
1052 151
|
4天前
|
编解码 人工智能 机器人
通义万相2.6,模型使用指南
智能分镜 | 多镜头叙事 | 支持15秒视频生成 | 高品质声音生成 | 多人稳定对话
|
17天前
|
机器学习/深度学习 人工智能 自然语言处理
Z-Image:冲击体验上限的下一代图像生成模型
通义实验室推出全新文生图模型Z-Image,以6B参数实现“快、稳、轻、准”突破。Turbo版本仅需8步亚秒级生成,支持16GB显存设备,中英双语理解与文字渲染尤为出色,真实感和美学表现媲美国际顶尖模型,被誉为“最值得关注的开源生图模型之一”。
1736 9
|
9天前
|
人工智能 自然语言处理 API
一句话生成拓扑图!AI+Draw.io 封神开源组合,工具让你的效率爆炸
一句话生成拓扑图!next-ai-draw-io 结合 AI 与 Draw.io,通过自然语言秒出架构图,支持私有部署、免费大模型接口,彻底解放生产力,绘图效率直接爆炸。
683 152
|
11天前
|
人工智能 安全 前端开发
AgentScope Java v1.0 发布,让 Java 开发者轻松构建企业级 Agentic 应用
AgentScope 重磅发布 Java 版本,拥抱企业开发主流技术栈。
648 12
|
6天前
|
SQL 自然语言处理 调度
Agent Skills 的一次工程实践
**本文采用 Agent Skills 实现整体智能体**,开发框架采用 AgentScope,模型使用 **qwen3-max**。Agent Skills 是 Anthropic 新推出的一种有别于mcp server的一种开发方式,用于为 AI **引入可共享的专业技能**。经验封装到**可发现、可复用的能力单元**中,每个技能以文件夹形式存在,包含特定任务的指导性说明(SKILL.md 文件)、脚本代码和资源等 。大模型可以根据需要动态加载这些技能,从而扩展自身的功能。目前不少国内外的一些框架也开始支持此种的开发方式,详细介绍如下。
409 4