Python爬虫、数据清洗与可视化-1 -python基础
一、数据类型
1-1.Python3 中有六个标准的数据类型:
Number(数字)
String(字符串)
List(列表)
Tuple(元组)
Set(集合)
Dictionary(字典)
Python3 的六个标准数据类型中:
不可变数据(3 个):Number(数字)、String(字符串)、Tuple(元组);
可变数据(3 个):List(列表)、Dictionary(字典)、Set(集合)。
1-2.Python 数字类型转换
有时候,我们需要对数据内置的类型进行转换,数据类型的转换,你只需要将数据类型作为函数名即可。
int(x) 将x转换为一个整数。
float(x) 将x转换到一个浮点数。
complex(x) 将x转换到一个复数,实数部分为 x,虚数部分为 0。
complex(x, y) 将 x 和 y 转换到一个复数,实数部分为 x,虚数部分为 y。x 和 y 是数字表达式。
1-3.列表
序列中的每个值都有对应的位置值,称之为索引,第一个索引是 0,第二个索引是 1,依此类推。也可以从尾部开始,最后一个元素的索引为 -1,往前一位为 -2,以此类推。
1-4元组
有序的可重复的不可变的对象集合
元组与列表类似,不同之处在于元组的元素不能修改。元组使用小括号 ( ),列表使用方括号 [ ]。
1-5字典
字典是一种可变容器模型,且可存储任意类型对象。
字典的每个键值 key=>value 对用冒号 : 分割,每个对之间用逗号(,)分割,整个字典包括在花括号 {} 中 ,格式如下所示:
d = {key1 : value1, key2 : value2, key3 : value3 }
1-6集合
集合(set)是一个无序的不重复元素序列。
可以使用大括号 { } 或者 set() 函数创建集合,注意:创建一个空集合必须用 set() 而不是 { },因为 { } 是用来创建一个空字典。
用法1:由于集合中的所有元素都不可重复,因此可以利用集合的这个特点来快速为列表去重
s.add( x )#添加元素 s.add( x )或s.update( x )
s.remove( x )#移除元素s.remove( x )或s.discard( x )
s.pop() #随机删除集合中的一个元素,对集合进行无序的排列,然后将这个无序排列集合的左面第一个元素进行删除。
len(s)#计算集合元素个数
s.clear()#清空集合
x in s#判断元素是否在集合中存在
二、条件与循环
2-1.IF语句
age = int(input("请输入你家狗狗的年龄: "))
print("")
if age <= 0:
print("你是在逗我吧!")
elif age == 1:
print("相当于 14 岁的人。")
elif age == 2:
print("相当于 22 岁的人。")
elif age > 2:
human = 22 + (age -2)*5
print("对应人类年龄: ", human)
input("点击 enter 键退出")
2-2while循环
n = 100
sum = 0
counter = 1
while counter <= n:
sum = sum + counter
counter += 1
print("1 到 %d 之和为: %d" % (n,sum))
2-3 for循环
sites = ["Baidu", "Google","Runoob","Taobao"]
for site in sites:
if site == "Runoob":
print("菜鸟教程!")
break
print("循环数据 " + site)
else:
print("没有循环数据!")
print("完成循环!")
2-4 迭代器
迭代是Python最强大的功能之一,是访问集合元素的一种方式。
迭代器是一个可以记住遍历的位置的对象。
迭代器对象从集合的第一个元素开始访问,直到所有的元素被访问完结束。迭代器只能往前不会后退。
迭代器有两个基本的方法:iter() 和 next()。
import sys # 引入 sys 模块
list=[1,2,3,4]
it = iter(list) # 创建迭代器对象
while True:
try:
print (next(it))
except StopIteration:
sys.exit()
三、语句与函数
3-1定义函数
def 关键字,一般格式如下:
def hello() :
print("Hello World!")
hello()
3-2 模块
文件1 support.py
def print_func( par ):
print ("Hello : ", par)
return
文件2 case.py
import support# 导入模块
support.print_func("Runoob")# 调用模块里包含的函数
四、文件IO
4-1 字符串格式化
print('常量 PI 的值近似为:%5.3f。' % math.pi)旧的%形式
print('{0:10} ==> {1:10d}'.format(name, number))#新的format形式
4-2 读取键盘输入
str = input("请输入:");
print ("你输入的内容是: ", str)
4-3读和写文件
open(filename, mode)
r 以只读方式打开文件。文件的指针将会放在文件的开头。这是默认模式。
w 打开一个文件只用于写入。即原有内容会被删除,
a 打开一个文件用于追加。
f.read(size), 这将读取一定数目的数据,size 是一个可选的数字类型的参数。
f.readline() 会从文件中读取单独的一行。
f.readlines() 将返回该文件中包含的所有行。
f.write(string) 将 string 写入到文件中, 然后返回写入的字符数。
f.close() 来关闭文件并释放系统的资源
with open(’/tmp/foo.txt’, ‘r’) as f:# with 关键字在结束后, 它会关闭文件。
4-4异常处理try/except
try: #执行代码
runoob()
except AssertionError as error: #发生异常时执行以下代码
print(error)
else: #没有异常时执行以下代码
try:
with open('file.log') as file:
read_data = file.read()
except FileNotFoundError as fnf_error:
print(fnf_error)
finally:#无论异常是否发生都会执行以下代码
print('这句话,无论异常是否发生都会执行。')
五、类
class people: #类定义
#定义基本属性
name = ''
age = 0
#定义私有属性,私有属性在类外部无法直接进行访问
__weight = 0
#定义构造方法
def __init__(self,n,a,w):
self.name = n
self.age = a
self.__weight = w
def speak(self):
print("%s 说: 我 %d 岁。" %(self.name,self.age))
# 实例化类
p = people('runoob',10,30)
p.speak()
更多推荐
所有评论(0)