苹果IT家园

  博客园 :: 首页 :: 新随笔 :: 联系 :: 订阅 :: 管理 ::

本节内容

1. 函数基本语法及特性

2. 参数与局部变量

3. 返回值

嵌套函数

4.递归

5.匿名函数

6.函数式编程介绍

7.高阶函数

8.内置函数

上节回顾

1. 集合

主要作用: 

  1. 去重
  2. 关系测试, 交集\差集\并集\反向(对称)差集
 1 >>> a = {1,2,3,4}
 2 >>> b = {3,4,5,6}
 3 >>> a
 4 {1, 2, 3, 4}
 5 >>> type(a)
 6 <class 'set'>
 7 >>> a.symmetric_difference(b)
 8 {1, 2, 5, 6}
 9 >>> b.symmetric_difference(a)
10 {1, 2, 5, 6}
11 >>> a.difference(b)
12 {1, 2}
13 >>> a.union(b)
14 {1, 2, 3, 4, 5, 6}
15 >>> a.issubset(b)
16 False
View Code

2. 元组  

只读列表,只有count, index 2 个方法

作用:如果一些数据不想被人修改, 可以存成元组,比如身份证列表

3. 字典

key-value对

  1. 特性:
  2. 无顺序
  3. 去重
  4. 查询速度快,比列表快多了
  5. 比list占用内存多

为什么会查询速度会快呢?因为他是hash类型的,那什么是hash呢?

哈希算法将任意长度的二进制值映射为较短的固定长度的二进制值,这个小的二进制值称为哈希值。哈希值是一段数据唯一且极其紧凑的数值表示形式。如果散列一段明文而且哪怕只更改该段落的一个字母,随后的哈希都将产生不同的值。要找到散列为同一个值的两个不同的输入,在计算上是不可能的,所以数据的哈希值可以检验数据的完整性。一般用于快速查找和加密算法

dict会把所有的key变成hash 表,然后将这个表进行排序,这样,你通过data[key]去查data字典中一个key的时候,python会先把这个key hash成一个数字,然后拿这个数字到hash表中看没有这个数字, 如果有,拿到这个key在hash表中的索引,拿到这个索引去与此key对应的value的内存地址那取值就可以了。

上面依然没回答这样做查找一个数据为什么会比列表快,对不对?

4. 字符编码

 先说python2

  1. py2里默认编码是ascii
  2. 文件开头那个编码声明是告诉解释这个代码的程序 以什么编码格式 把这段代码读入到内存,因为到了内存里,这段代码其实是以bytes二进制格式存的,不过即使是2进制流,也可以按不同的编码格式转成2进制流,你懂么?
  3. 如果在文件头声明了#_*_coding:utf-8*_,就可以写中文了, 不声明的话,python在处理这段代码时按ascii,显然会出错, 加了这个声明后,里面的代码就全是utf-8格式了
  4. 在有#_*_coding:utf-8*_的情况下,你在声明变量如果写成name=u"爱护环境",那这个字符就是unicode格式,不加这个u,那你声明的字符串就是utf-8格式
  5. utf-8 to gbk怎么转,utf8先decode成unicode,再encode成gbk

再说python3

  1. py3里默认文件编码就是utf-8,所以可以直接写中文,也不需要文件头声明编码了。
  2. 你声明的变量默认是unicode编码,不是utf-8, 因为默认即是unicode了(不像在py2里,你想直接声明成unicode还得在变量前加个u), 此时你想转成gbk的话,直接your_str.encode("gbk")即可以
  3. 但py3里,你在your_str.encode("gbk")时,感觉好像还加了一个动作,就是encode的数据变成了bytes里,这是因为在py3里,str and bytes做了明确的区分,你可以理解为bytes就是2进制流,你会说,我看到的不是010101这样的2进制呀, 那是因为python为了让你能对数据进行操作而在内存级别又帮你做了一层封装,否则让你直接看到一堆2进制,你能看出哪个字符对应哪段2进制么?
  4. 那你说,在py2里好像也有bytes呀,是的,不过py2里的bytes只是对str做了个别名(python2里的str就是bytes, py3里的str是unicode),没有像py3一样给你显示的多出来一层封装,但其实其内部还是封装了的。 这么讲吧, 无论是2还是3, 从硬盘到内存,数据格式都是 010101二进制到-->b'\xe4\xbd\xa0\xe5\xa5\xbd' bytes类型-->按照指定编码转成你能看懂的文字

编码应用比较多的场景应该是爬虫了,互联网上很多网站用的编码格式很杂,虽然整体趋向都变成utf-8,但现在还是很杂,所以爬网页时就需要你进行各种编码的转换,不过生活正在变美好,期待一个不需要转码的世界。

最后,编码is a piece of fucking shit, noboby likes it.

 1.函数基本语法及特性

 

函数是什么?

 

函数一词来源于数学,但编程中的「函数」概念,与数学中的函数是有很大不同的,具体区别,我们后面会讲,编程中的函数在英文中也有很多不同的叫法。在BASIC中叫做subroutine(子过程或子程序),在Pascal中叫做procedure(过程)和function,在C中只有function,在Java里面叫做method。

 

定义: 函数是指将一组语句的集合通过一个名字(函数名)封装起来,要想执行这个函数,只需调用其函数名即可

 

特性:

 

  1. 减少重复代码
  2. 使程序变的可扩展
  3. 使程序变得易维护

 语法定义

1 def sayhi():#函数名
2     print("I am so happy!")
3 sayhi() #调用函数
View Code

可以带参数

 1 #下面这段代码
 2 a,b = 5,8
 3 c = a**b
 4 print(c)
 5 
 6 #改成用函数写
 7 def calc(x,y):
 8     res = x**y
 9     return res #返回函数执行结果
10 
11 c=calc(a,b) #结果赋值给c变量
12 print(c)
View Code

2.函数参数与局部变量 

形参变量只有在被调用时才分配内存单元,在调用结束时,即刻释放所分配的内存单元。因此,形参只在函数内部有效。函数调用结束返回主调用函数后则不能再使用该形参变量

实参可以是常量、变量、表达式、函数等,无论实参是何种类型的量,在进行函数调用时,它们都必须有确定的值,以便把这些值传送给形参。因此应预先用赋值,输入等办法使参数获得确定值

默认参数

看下面代码

 1 def stu_register(name,age,country,course):
 2     print("----注册学生信息------")
 3     print("姓名:",name)
 4     print("age:",age)
 5     print("国籍:",country)
 6     print("课程:",course)
 7 
 8 stu_register("王山炮",22,"CN","python_devops")
 9 stu_register("张叫春",21,"CN","linux")
10 stu_register("刘老根",25,"CN","linux")
View Code

发现 country 这个参数 基本都 是"CN", 就像我们在网站上注册用户,像国籍这种信息,你不填写,默认就会是 中国, 这就是通过默认参数实现的,把country变成默认参数非常简单

1 def stu_register(name,age,course,country="CN")
View Code

这样,这个参数在调用时不指定,那默认就是CN,指定了的话,就用你指定的值。

另外,你可能注意到了,在把country变成默认参数后,我同时把它的位置移到了最后面,为什么呢?

关键参数

正常情况下,给函数传参数要按顺序,不想按顺序就可以用关键参数,只需指定参数名即可,但记住一个要求就是,关键参数必须放在位置参数之后。

 

1 stu_register(age=22,name='alex',course="python")

 

非固定参数

若你的函数在定义时不确定用户想传入多少个参数,就可以使用非固定参数

 1 def stu_register(name,age,*args): # *args 会把多传入的参数变成一个元组形式
 2     print(name,age,args)
 3 
 4 stu_register("jayson",35)
 5 #输出
 6 #jayson 35 () #后面这个()就是args,只是因为没传值,所以为空
 7 
 8 stu_register("Jack",32,"CN","Python")
 9 #输出
10 # Jack 32 ('CN', 'Python')
View Code

还可以有一个**kwargs

 1 def stu_register(name,age,*args,**kwargs): # *kwargs 会把多传入的参数变成一个dict形式
 2     print(name,age,args,kwargs)
 3 
 4 stu_register("jayson",22)
 5 #输出
 6 #jayson 22 () {}#后面这个{}就是kwargs,只是因为没传值,所以为空
 7 
 8 stu_register("Jack",32,"CN","Python",sex="Male",province="Guangxi")
 9 #输出
10 # Jack 32 ('CN', 'Python') {'province': 'ShanDong', 'sex': 'Male'}
View Code

局部变量

1 name = "jayson"
2 def change_name(name):
3     print("before change:",name)
4     name = "美琪"
5     print("after change", name)
6 
7 change_name(name)
8 print("在外面看看name改了么?",name)
View Code

输出

1 before change: jayson
2 after change 美琪
3 在外面看看name改了么? jayson

全局与局部变量

在子程序中定义的变量称为局部变量,在程序的一开始定义的变量称为全局变量。
全局变量作用域是整个程序,局部变量作用域是定义该变量的子程序。
当全局变量与局部变量同名时:
在定义局部变量的子程序内,局部变量起作用;在其它地方全局变量起作用。

3.返回值 

要想获取函数的执行结果,就可以用return语句把结果返回

注意:

  1. 函数在执行过程中只要遇到return语句,就会停止执行并返回结果,so 也可以理解为 return 语句代表着函数的结束
  2. 如果未在函数中指定return,那这个函数的返回值为None 

 嵌套函数 

 1 name = "jayson1"
 2 def change_name():
 3     name = "jayson2"
 4 
 5     def change_name2():
 6         name = "jayson3"
 7         print("第3层打印",name)
 8     change_name2() #调用内层函数
 9     print("第2层打印",name)
10 change_name()
11 print("最外层打印",name)
View Code

4. 递归

 在函数内部,可以调用其他函数。如果一个函数在内部调用自身本身,这个函数就是递归函数。

1 def calc(n):
2     print(n)
3     if int(n/2) > 0:
4         return calc(int(n/2))
5     print("-->",n)
6 calc(10)

输出:

1 10
2 5
3 2
4 1
5 --> 1

递归特性:

(1). 必须有一个明确的结束条件

(2). 每次进入更深一层递归时,问题规模相比上次递归都应有所减少

(3). 递归效率不高,递归层次过多会导致栈溢出(在计算机中,函数调用是通过栈(stack)这种数据结构实现的,每当进入一个函数调用,栈就会加一层栈帧,每当函数返回,栈就会减一层栈帧。由于栈的大小不是无限的,所以,递归调用的次数过多,会导致栈溢出)

堆栈扫盲:http://www.cnblogs.com/lln7777/archive/2012/03/14/2396164.html 

 5、高阶函数

变量可以指向函数,函数的参数能接收变量,那么一个函数就可以接收另一个函数作为参数,这种函数就称之为高阶函数。

1 def add(a,b,f):
2     return f(a) + f(b)
3 res = add(3,-6,abs)
4 print(res)

输出:

9

6. 内置参数 

 

内置参数详解: https://docs.python.org/3/library/functions.html?highlight=built#ascii 

 

posted on 2017-06-13 14:29  苹果IT家园  阅读(76)  评论(0)    收藏  举报