文本处理命令 | 学习笔记

简介: 快速学习文本处理命令。

开发者学堂课程【Linux 文本处理、正则表达式与 Vim文本处理命令】学习笔记,与课程紧密联系,让用户快速学习知识。

课程地址:https://developer.aliyun.com/learning/course/592/detail/8350


文本处理命令


内容介绍

一、文本处理工具


一、文本处理工具

1、文件查看

u 文件查看命令:

cattacrev

u cat[OPTION]...[FILE]...

-E:显示行结束符$

-n:对显示出的每一行进行编号

-A:显示所有控制符

-b:非空行编号

-s:压缩连续的空行成一行

u tac

u Rev

2、分页查看文件内容

u more: 分页查看文件

more [OPTIONS...] FILE...

-d: 显示翻页及退出提示

u less: 一页一页地查看文件或 STDIN 输出

查看时有用的命令包括:

/文本 搜索  文本

n/N  跳到下一个或上一个匹配

less 命令是 man 命令使用的分页器

3、显示文本前或后行内容

u head [OPTION]... [FILE]...

-C#:指定获取前#字节

-n#:指定获取前#

-#:指定行数

u tail [OPTION]... [FILE]...

-c#:指定获取后#字节

-n#:指定获取后#

-#:同上

-f:跟踪显示文件 fd 新追加的内容,常用日志监控相当于--follow=descriptor

-F:跟踪文件名,相当于--follow=name--retry

u Tailf 类似 tail-f,当文件不增长时并不访问文件

4、按列抽取文本 cut 和合并文件 paste

u cut [OPTION]... [FILE]...

-d DELIMITER:指明分隔符,默认 tab

-f FILEDS

#:第#个字段

#,#[,#]:离散的多个字段,例如1,3,6

#-#:连续的多个字段,例如1-6

混合使用:1-3,7

-C 按字符切割

--output-delimiter=STRING 指定输出分隔符

5Cut paste

u 显示文件或 STDIN 数据的指定列

cut -d:-f1/etc/passwd

cat /etc/passwd | cut-d:-f7

cut-c2-5/usr/share/dict/words

u Paste 合并两个文件同行号的列到一行

paste [OPTION]... [FILE]...

-d分隔符:指定分隔符,默认用 TAB

-S:所有行合成一行显示

示例:

paste f1 f2

paste -s f1 f2

6、收集文本统计数据 wc

u 计数单词总数、行总数、字节总数和字符总数

u 可以对文件或 STDIN 中的数据运行

wc story.txt

39 237  1901 story.txt

行数 字数 字节数

u 常用选项

-I 只计数行数

-W 只计数单词总数

-C 只计数字节总数

-m 只计数字符总数

-L 显示文件中最长行的长度

相关文章
|
2天前
|
数据采集 人工智能 安全
|
12天前
|
云安全 监控 安全
|
3天前
|
自然语言处理 API
万相 Wan2.6 全新升级发布!人人都能当导演的时代来了
通义万相2.6全新升级,支持文生图、图生视频、文生视频,打造电影级创作体验。智能分镜、角色扮演、音画同步,让创意一键成片,大众也能轻松制作高质量短视频。
1023 151
|
3天前
|
编解码 人工智能 机器人
通义万相2.6,模型使用指南
智能分镜 | 多镜头叙事 | 支持15秒视频生成 | 高品质声音生成 | 多人稳定对话
|
17天前
|
机器学习/深度学习 人工智能 自然语言处理
Z-Image:冲击体验上限的下一代图像生成模型
通义实验室推出全新文生图模型Z-Image,以6B参数实现“快、稳、轻、准”突破。Turbo版本仅需8步亚秒级生成,支持16GB显存设备,中英双语理解与文字渲染尤为出色,真实感和美学表现媲美国际顶尖模型,被誉为“最值得关注的开源生图模型之一”。
1720 9
|
8天前
|
人工智能 自然语言处理 API
一句话生成拓扑图!AI+Draw.io 封神开源组合,工具让你的效率爆炸
一句话生成拓扑图!next-ai-draw-io 结合 AI 与 Draw.io,通过自然语言秒出架构图,支持私有部署、免费大模型接口,彻底解放生产力,绘图效率直接爆炸。
662 152
|
10天前
|
人工智能 安全 前端开发
AgentScope Java v1.0 发布,让 Java 开发者轻松构建企业级 Agentic 应用
AgentScope 重磅发布 Java 版本,拥抱企业开发主流技术栈。
626 14
|
5天前
|
SQL 自然语言处理 调度
Agent Skills 的一次工程实践
**本文采用 Agent Skills 实现整体智能体**,开发框架采用 AgentScope,模型使用 **qwen3-max**。Agent Skills 是 Anthropic 新推出的一种有别于mcp server的一种开发方式,用于为 AI **引入可共享的专业技能**。经验封装到**可发现、可复用的能力单元**中,每个技能以文件夹形式存在,包含特定任务的指导性说明(SKILL.md 文件)、脚本代码和资源等 。大模型可以根据需要动态加载这些技能,从而扩展自身的功能。目前不少国内外的一些框架也开始支持此种的开发方式,详细介绍如下。
385 4