python文件操作案例及练习
处理文件结合python中的数据类型或者函数,可以做很多事情.
需求: 打印出文件中的每行及行号
思路: 文件对象是个iterator(迭代器), 是可以迭代的,通过enumerate枚举函数得到每行和索引(行号),索引从1开始 ( 第一行 )
with open('/etc/passwd') as fp: for n, line in enumerate(fp, 1): print(n, line, end='') 输出 1 root:x:0:0:root:/root:/bin/bash 2 bin:x:1:1:bin:/bin:/sbin/nologin 3 daemon:x:2:2:daemon:/sbin:/sbin/nologin 4 mail:x:8:12:mail:/var/spool/mail:/sbin/nologin 5 ftp:x:14:50:FTP User:/var/ftp:/sbin/nologin 6 nobody:x:99:99:Nobody:/:/sbin/nologin 7 avahi-autoipd:x:170:170:Avahi IPv4LL Stack:/var/lib/avahi-autoipd:/sbin/nologin 8 systemd-bus-proxy:x:999:997:systemd Bus Proxy:/:/sbin/nologin 9 systemd-network:x:998:996:systemd Network Management:/:/sbin/nologin 10 dbus:x:81:81:System message bus:/:/sbin/nologin 11 polkitd:x:997:995:User for polkitd:/:/sbin/nologin 12 tss:x:59:59:Account used by the trousers package to sandbox the tcsd daemon:/dev/null:/sbin/nologin 13 postfix:x:89:89::/var/spool/postfix:/sbin/nologin 14 sshd:x:74:74:Privilege-separated SSH:/var/empty/sshd:/sbin/nologin 15 ntp:x:38:38::/etc/ntp:/sbin/nologin 16 saslauth:x:996:76:Saslauthd user:/run/saslauthd:/sbin/nologin 17 redis:x:995:994:Redis Database Server:/var/lib/redis:/sbin/nologin 18 mysql:x:27:27:MariaDB Server:/var/lib/mysql:/sbin/nologin 19 nginx:x:994:993:Nginx web server:/var/lib/nginx:/sbin/nologin 20 rabbitmq:x:1000:1000:rabbitmq-server:/opt/rabbitmq:/bin/bash 21 unbound:x:993:992:Unbound DNS resolver:/etc/unbound:/sbin/nologin 22 zabbix:x:992:989:Zabbix Monitoring System:/var/lib/zabbix:/sbin/nologin 23 tcpdump:x:72:72::/:/sbin/nologin
需求: 将一个文件中指定的小写字母转换成大写,写入另一个文件
思路: 同时打开两个文件, 一个读另一个写, 先遍历读取每行,将每行中指定的小写字母通过replace方法替换大写,然后写入另一文件
with open_binary('passwd') as rp, # 打开读取一个文件 with open_binary('new_passwd', 'w') as wp: # 打开写入一个文件 for each_line in rp: # 遍历读取文件 new_line = each_line.replace('root','Root') # 字符串替换 wp.write(new_line) # 写入替换的行
需求: 模仿linux系统tail -f 功能
思路: 先读取文件最后10行 ( 通过deque双端队列 ),此时文件指针到末尾(等价于seek(0,2)), 然后while死循环通过readline方法读取每行, 有新内容产生就打印新的内容。考虑到while死循环占用资源比较大,所以添加循环间隔0.5s.
import sys from time import sleep from collections import deque def tail(filename, last=10): """ 模拟linux系统tail -f功能 filename: 文件名 last: 默认最后10行 """ try: with open(filename) as fp: # 打开文件得到fp对象 try: last_line = ''.join(deque(fp, last)) # deque队列取最后10行,此时seek指针已经到末尾了 print(last_line, end='') # 打印last_line except Exception: pass try: while 1: line = fp.readline() # 不停的readline() 读取 if line: print(line, end='') sleep(0.5) # 停顿0.5s, 否则系统会爆 except KeyboardInterrupt: # 如果crtl+c就表示退出 sys.exit() except Exception as e: sys.exit(e)
需求: 统计文件中每个字符串出现的次数
思路: 遍历文件,每行每个字符串出现一次就计数一次,返回一个字典
def word_count_dict(filename): """ 统计指定文件中每个字符串出现的次数 param filename: the a file return: dict """ word_count = {} with open(filename) as fp: for line in fp: words = line.strip() for word in words: word_count[word] = word_count.get(word, 0) + 1 return word_count if __name__ == '__main__': word_count_dict('/etc/passwd')
浙公网安备 33010602011771号