python文件操作案例及练习

处理文件结合python中的数据类型或者函数,可以做很多事情.

 

需求: 打印出文件中的每行及行号


思路: 文件对象是个iterator(迭代器), 是可以迭代的,通过enumerate枚举函数得到每行和索引(行号),索引从1开始 ( 第一行 )

with open('/etc/passwd') as fp:
    for n, line in enumerate(fp, 1):
        print(n, line, end='')

输出
1 root:x:0:0:root:/root:/bin/bash
2 bin:x:1:1:bin:/bin:/sbin/nologin
3 daemon:x:2:2:daemon:/sbin:/sbin/nologin
4 mail:x:8:12:mail:/var/spool/mail:/sbin/nologin
5 ftp:x:14:50:FTP User:/var/ftp:/sbin/nologin
6 nobody:x:99:99:Nobody:/:/sbin/nologin
7 avahi-autoipd:x:170:170:Avahi IPv4LL Stack:/var/lib/avahi-autoipd:/sbin/nologin
8 systemd-bus-proxy:x:999:997:systemd Bus Proxy:/:/sbin/nologin
9 systemd-network:x:998:996:systemd Network Management:/:/sbin/nologin
10 dbus:x:81:81:System message bus:/:/sbin/nologin
11 polkitd:x:997:995:User for polkitd:/:/sbin/nologin
12 tss:x:59:59:Account used by the trousers package to sandbox the tcsd daemon:/dev/null:/sbin/nologin
13 postfix:x:89:89::/var/spool/postfix:/sbin/nologin
14 sshd:x:74:74:Privilege-separated SSH:/var/empty/sshd:/sbin/nologin
15 ntp:x:38:38::/etc/ntp:/sbin/nologin
16 saslauth:x:996:76:Saslauthd user:/run/saslauthd:/sbin/nologin
17 redis:x:995:994:Redis Database Server:/var/lib/redis:/sbin/nologin
18 mysql:x:27:27:MariaDB Server:/var/lib/mysql:/sbin/nologin
19 nginx:x:994:993:Nginx web server:/var/lib/nginx:/sbin/nologin
20 rabbitmq:x:1000:1000:rabbitmq-server:/opt/rabbitmq:/bin/bash
21 unbound:x:993:992:Unbound DNS resolver:/etc/unbound:/sbin/nologin
22 zabbix:x:992:989:Zabbix Monitoring System:/var/lib/zabbix:/sbin/nologin
23 tcpdump:x:72:72::/:/sbin/nologin
代码实现

需求: 将一个文件中指定的小写字母转换成大写,写入另一个文件


思路: 同时打开两个文件, 一个读另一个写, 先遍历读取每行,将每行中指定的小写字母通过replace方法替换大写,然后写入另一文件

with open_binary('passwd') as rp,    # 打开读取一个文件
    with open_binary('new_passwd', 'w') as wp: # 打开写入一个文件
    for each_line in rp:  # 遍历读取文件
        new_line = each_line.replace('root','Root') # 字符串替换
        wp.write(new_line)   # 写入替换的行
代码实现

需求: 模仿linux系统tail -f 功能


思路: 先读取文件最后10行 ( 通过deque双端队列 ),此时文件指针到末尾(等价于seek(0,2)), 然后while死循环通过readline方法读取每行, 有新内容产生就打印新的内容。考虑到while死循环占用资源比较大,所以添加循环间隔0.5s.

import sys
from time import sleep
from collections import deque

def tail(filename, last=10):
    """
    模拟linux系统tail -f功能
    filename: 文件名
    last: 默认最后10行
    """
    try:
        with open(filename) as fp:    # 打开文件得到fp对象
            try:
                last_line = ''.join(deque(fp, last))  # deque队列取最后10行,此时seek指针已经到末尾了
                print(last_line, end='')              # 打印last_line
            except Exception:
                pass

            try:
                while 1:                              
                    line = fp.readline()        # 不停的readline() 读取
                    if line:
                        print(line, end='')
                    sleep(0.5)                  # 停顿0.5s, 否则系统会爆
            except KeyboardInterrupt:           # 如果crtl+c就表示退出
                sys.exit()
    except Exception as e:
        sys.exit(e)
代码实现

需求: 统计文件中每个字符串出现的次数


思路: 遍历文件,每行每个字符串出现一次就计数一次,返回一个字典

def word_count_dict(filename):
    """
    统计指定文件中每个字符串出现的次数
    param filename: the a file
    return: dict
    """
    word_count = {}
    with open(filename) as fp:
        for line in fp:
            words = line.strip()
            for word in words:
                word_count[word] = word_count.get(word, 0) + 1
        return word_count

if __name__ == '__main__':
    word_count_dict('/etc/passwd')
代码实现

 

posted @ 2019-06-21 18:07  opss  阅读(375)  评论(0)    收藏  举报