一周目,六日学习
字符编码
由于计算机之中自有高低电频两种状态,因此为了让计算机认识人类的语言,通过高低电频0和1的组合,来一一对应人类的字符的关系就是字符的编码。
一家独大
美国发明了计算机之后,想让计算机认识他们的语言,
美国 语言代码 ASCLL 记录了英文与数字的对应关系
各国并立
每个国家发明了自己的语言与数字的关系,如
中国 语言代码 GBK 记录英文、中文、数字的对应关系
日本 语言代码 shift_JIS码 记录英文、日文、数字的对应关系
韩国 语言代码 Ecu_kr码 记录英文、韩文、数字的对应关系
统一用码
由于各国的字符编码太多,且不同进行数据的交互,因此对各国文字进行统一的收录
万国码 语言代码 unicode吗 记录各国语言及数字的对应关系
优化万国码 语言代码 utf8 优化简化版的万国码,一般默认使用码
编码于解码
编码
编码就是按照指定的字符编码将人类的字符转换成计算机能够了是的二进制数字 方法 encode 变量名 = 变量名.encode( ' 指定字符编码 ' )
解码
解码就是按照指定的字符编码将计算机的二进制数字转换成人类能够看懂的字符 方法 decode 变量名 = 变量名.decode( ' 指定字符编码 ' )

文件操作
方法1 with open( 文件路径,读写模式,字符编码)as 变量名:
子代码
方法2 变量名=open(文件路径,读写模式,字符编码)
操作编码
变量名.close(
t 模式 文本模式 rt/wt/at
1只能操作文本文件 2必须制定encoding参数 3读写以字符串为单位
b 模式 二进制模式 rb/wb/ab
1可以操作任意类型的文件 2不需要encoding参数 3读写以bytes(二进制)为单位
读、写、追加模式用法
r为只读模式
当文件的路径不存在时会报错,文件存在则打开并读取文件内容
w为只写模式
文件不存在会自动创建,存在则清空源文件的内容然后再写入
a为只追加模式
文件不存在会自动创建,存在则在文件写入追加的内容
注 使用文件操作时可以+for循环,对文件内用逐行读取,防止文件过大,内存溢出 如
with open(r‘a.txt’,“r”,encoding=‘utf8“)as f:
for i in f