Python办公自动化【Excel查询重复数据、Excel提取身份证号信息、Python操作Excel模块库文档、Python操作Word基础 】(四)-全面详解(学习总结---从入门到深化)

简介: Python办公自动化【Excel查询重复数据、Excel提取身份证号信息、Python操作Excel模块库文档、Python操作Word基础 】(四)-全面详解(学习总结---从入门到深化)

Excel查询重复数据



代码

def search_data():
  from openpyxl import load_workbook
  # 加载文件
  wb = load_workbook('./base_data/打卡时间.xlsx')
  # 激活Sheet
  sh = wb.active
  # 建立已经读过数据列表
  data = []
  # 建立重复数据列表
  index = []
  # 读取数据
  for i,c in enumerate(sh['B']):
    # 记录是否重复
    # if c.value in data:
    #   flag = True
    # else:
    #   flag = False
    flag = c.value in data
    if flag:
      index.append(i)
    else:
      data.append(c.value)
  # 处理重复数据
  from openpyxl.styles import PatternFill
  fill = PatternFill('solid',fgColor='AEEEEE')
  for i,r in enumerate(sh.rows):
    # 判断是否是重复索引行
    if i in index:
      for c in r:
        c.fill = fill
  # 保存数据
  wb.save('./create_data/25_打卡时间_重复检测.xlsx')
if __name__ =='__main__':
  search_data()


Excel提取身份证号信息



代码

def get_data():
  from openpyxl import load_workbook
  # 加载文件
  wb = load_workbook('./base_data/人员信息.xlsx')
  # 激活Sheet
  sh = wb.active
  # 获取Sheet中最后一列是多少
  max_col = sh.max_column
  # 读取数据-只读取一列-遍历每一行获取具体数据
  for i,cell in enumerate(sh['B']):
    # 从身份证号里提取内容- 6位行政区划 4年 2月 2日 4位个人数字
    pno = cell.value
    # 年
    year = pno[6:10]
    # 月
    mouth = pno[10:12]
    # 日
    day = pno[12:14]
    # 将年存到后面的列
    sh.cell(i+1,max_col+1).value = year
    # 将月存到后面的列
    sh.cell(i+1,max_col+2).value = mouth
    # 将日存到后面的列
    sh.cell(i+1,max_col+3).value = day
  # 保存文件
  wb.save('./create_data/26_提取身份证信息.xlsx')
if __name__ =='__main__':
  get_data()


Python操作Excel模块库文档



https://www.osgeo.cn/openpyxl/index.html 中文

https://openpyxl.readthedocs.io/en/stable/ 英文/可翻译

http://www.python-excel.org/ 汇总网站


Python操作Word基础



在办公自动化的操作,往往可能会存在Word的操作。因为在办公时,对文档的操作是必不可少的。而在Python操作Word时,可以使用一个三方的模块库 Python-docx


安装


pip install python-docx


常用方法与属性

函数名&属性 含义
docx.Document()  创建word文件
doc.add_heading(content,level)  增加word标题
doc.save(path)  保存word文件


代码

from docx import Document
def create_word():
  # 创建word文档
  doc1 = Document()
  # 增加标题
  doc1.add_heading('欢迎使用Python创建Word',0)
  doc1.add_heading('Python操作 增加1级标题',1)
  doc1.add_heading('Python操作 增加2级标题',2)
  # 保存文档
  doc1.save('./create_data/01_创建word文档.docx')
if __name__ == '__main__':
  create_word()


Word写入段落数据



常用方法与属性

函数名&属性  含义
doc.add_paragraph(content,style) 增加word段落
paragraph.add_run(content)  追加word段落内容


# 样式表
from docx.enum.style import WD_STYLE


代码

from docx.enum.style import WD_BUILTIN_STYLE
def create_word():
  from docx import Document
  # 创建一个word文档
  doc1 = Document()
  # 增加段落信息
  doc1.add_paragraph('Python第一阶段','Title')
  # doc1.add_paragraph('Python第一阶段',style = 'Title')
  par1 =doc1.add_paragraph('本阶段是进入“程序员”的门槛,需要学习编程基本的知识。本阶段会从0开始,循序渐进。让小伙伴们学完本阶段,可以掌握:变量、数据类型、控制语句、容器、函数和面向对象等。教程中会穿插一些有趣的案例,寓教于乐,引起大家的兴趣。 ')
  # 给段落后面追加内容
  par1.add_run('“兴趣永远是好的老师,小童只能排第二”。')
  doc1.add_paragraph('本阶段是进入“程序员”的门槛,需要学习编程基本的知识。本阶段会从0开始,循序渐进。让小伙伴们学完本阶段,可以掌握:变量、数据类型、控制语句、容器、函数和面向对象等。教程中会穿插一些有趣的案例,寓教于乐,引起大家的兴趣。 “兴趣永远是好的老师,高淇老师只能排第二”。')
  # 增加列表-无序
  doc1.add_paragraph('哪个不是动物:')
  doc1.add_paragraph('喜洋洋',style='ListBullet')
  doc1.add_paragraph('美羊羊',style='ListBullet')
  doc1.add_paragraph('懒洋洋',style='ListBullet')
  doc1.add_paragraph('苹果',style='ListBullet')
  doc1.add_paragraph('灰太狼',style='ListBullet')
  # 增加列表-有序
  doc1.add_paragraph('今年的学习计划:')
  doc1.add_paragraph('Python',style='ListNumber')
  doc1.add_paragraph('HTML',style='ListNumber')
  doc1.add_paragraph('JS',style='ListNumber')
  doc1.add_paragraph('Flask',style='ListNumber')
  # 增加引用
  doc1.add_paragraph('这个是一个引用内容',style='Intense Quote')
  # 保存word文档
  doc1.save('./create_data/02_增加段落.docx')
if __name__ =='__main__':
  create_word()


Word增加图片



常用方法与属性

函数名&属性 含义
doc.add_picture(path) 增加word图片
pic.height 获取word图片高度
pic.width 获取word图片宽度
doc.sections[0].page_width 获取页面的宽度
doc.sections[0].left_margin 获取页面左边距


代码

def create_word():
  from docx import Document
  # 创建一个文档
  doc1 = Document()
  # 增加图片
  pic = doc1.add_picture('./base_data/backg.jpg')
  # 获取文档的宽度
  page_width = doc1.sections[0].page_width
  # 获取文档的左边距
  page_left_width = doc1.sections[0].left_margin
  print(page_width)
  print(page_left_width)
  # 获取中间内容的宽度
  content_width = page_width-page_left_width*2
  print(content_width)
  # 获取图片应该缩小的比例
  # 如果图片或者页面宽度值太高,有可能程序无法计算,可以考虑同时缩小几倍
  sc =(content_width/100)/(pic.width/100)
  # 修改图片的宽、高
  pic.width = int(pic.width*sc)
  pic.height = int(pic.height*sc)
  # 保存文档
  doc1.save('./create_data/03_增加图片.docx')
if __name__ == '__main__':
  create_word()


Word增加表格



常用方法与属性

函数名&属性 含义
doc.add_table(rows=num,cols=num)  增加word表格
table.add_row().cells  增加一行表格
ell.text 获取/设置单元格
table.rows 获取行数据


代码

def create_table():
  from docx import Document
  # 创建word文档
  doc1 = Document()
  # 增加表格
  table = doc1.add_table(rows=1,cols=3)
  # 设置表格的内容
  cells = table.rows[0].cells
  cells[0].text = '编号'
  cells[1].text = '姓名'
  cells[2].text = '职业'
  data = (
   (1,'吕小布','将军'),
   (2,'诸葛亮','军事'),
   (3,'刘备','主攻'),
 )
  for i,n,w in data:
    # 增加一行数据
    tmp_cell = table.add_row().cells
    '''
   问题1:
   tmp_cell[0] = i
   TypeError: 'tuple' object does not support item assignment 
   有可能是直接给单元格设置内容了!需要给text属性设置内容
   '''
    '''
   问题2:
   for char in text:
   TypeError: 'int' object is not iterable
   给单元格设置值,不能是数字,需要转成str
   '''
    tmp_cell[0].text = str(i)
    tmp_cell[1].text = n
    tmp_cell[2].text = w
  # 保存文档
  doc1.save('./create_data/04_增加表格.docx')
if __name__ =='__main__':
  create_table()
目录
相关文章
|
7月前
|
SQL 关系型数据库 数据库
Python SQLAlchemy模块:从入门到实战的数据库操作指南
免费提供Python+PyCharm编程环境,结合SQLAlchemy ORM框架详解数据库开发。涵盖连接配置、模型定义、CRUD操作、事务控制及Alembic迁移工具,以电商订单系统为例,深入讲解高并发场景下的性能优化与最佳实践,助你高效构建数据驱动应用。
906 7
|
7月前
|
存储 JavaScript Java
(Python基础)新时代语言!一起学习Python吧!(四):dict字典和set类型;切片类型、列表生成式;map和reduce迭代器;filter过滤函数、sorted排序函数;lambda函数
dict字典 Python内置了字典:dict的支持,dict全称dictionary,在其他语言中也称为map,使用键-值(key-value)存储,具有极快的查找速度。 我们可以通过声明JS对象一样的方式声明dict
450 2
|
7月前
|
存储 Java 数据处理
(numpy)Python做数据处理必备框架!(一):认识numpy;从概念层面开始学习ndarray数组:形状、数组转置、数值范围、矩阵...
Numpy是什么? numpy是Python中科学计算的基础包。 它是一个Python库,提供多维数组对象、各种派生对象(例如掩码数组和矩阵)以及用于对数组进行快速操作的各种方法,包括数学、逻辑、形状操作、排序、选择、I/0 、离散傅里叶变换、基本线性代数、基本统计运算、随机模拟等等。 Numpy能做什么? numpy的部分功能如下: ndarray,一个具有矢量算术运算和复杂广播能力的快速且节省空间的多维数组 用于对整组数据进行快速运算的标准数学函数(无需编写循环)。 用于读写磁盘数据的工具以及用于操作内存映射文件的工具。 线性代数、随机数生成以及傅里叶变换功能。 用于集成由C、C++
628 1
|
7月前
|
算法 Java Docker
(Python基础)新时代语言!一起学习Python吧!(三):IF条件判断和match匹配;Python中的循环:for...in、while循环;循环操作关键字;Python函数使用方法
IF 条件判断 使用if语句,对条件进行判断 true则执行代码块缩进语句 false则不执行代码块缩进语句,如果有else 或 elif 则进入相应的规则中执行
1325 1
|
8月前
|
数据采集 机器学习/深度学习 人工智能
Python:现代编程的首选语言
Python:现代编程的首选语言
1369 102
|
8月前
|
数据采集 机器学习/深度学习 算法框架/工具
Python:现代编程的瑞士军刀
Python:现代编程的瑞士军刀
475 104
|
8月前
|
人工智能 自然语言处理 算法框架/工具
Python:现代编程的首选语言
Python:现代编程的首选语言
368 103
|
8月前
|
机器学习/深度学习 人工智能 数据挖掘
Python:现代编程的首选语言
Python:现代编程的首选语言
390 82
|
7月前
|
Python
Python编程:运算符详解
本文全面详解Python各类运算符,涵盖算术、比较、逻辑、赋值、位、身份、成员运算符及优先级规则,结合实例代码与运行结果,助你深入掌握Python运算符的使用方法与应用场景。
480 3

推荐镜像

更多