当前位置: 首页 > news >正文

建设网站盈利分析手机制作ppt哪种软件好

建设网站盈利分析,手机制作ppt哪种软件好,天津网站建设外贸,专门看广告的网站爬虫Day3 csv和bs4 一、CSV的读和写 1. 什么是csv文件 csv文件叫做:逗号分隔值文件,像Excel文件一样以行列的形式保存数据,保存数据的时候同一行的多列数据用逗号隔开。 2. csv文件的读写操作 1) csv文件读操作 from csv import reader…

爬虫Day3 csv和bs4

一、CSV的读和写

1. 什么是csv文件

csv文件叫做:逗号分隔值文件,像Excel文件一样以行列的形式保存数据,保存数据的时候同一行的多列数据用逗号隔开。

2. csv文件的读写操作

1) csv文件读操作

from csv import reader, DictReader
a.reader

创建根据文件对象创建对应的reader,获取文件内容

with open('files/电影.csv', encoding='utf-8', newline='') as f:r1 = reader(f)print(next(r1))print(list(r1))
b.DictReader
with open('files/电影.csv', encoding='utf-8', newline='') as f:r2 = DictReader(f)print(next(r2))for x in r2:print(x)

2)csv文件写操作

from csv import writer, DictWriter
a. writer
with open('files/student1.csv', 'w', encoding='utf-8', newline='') as f:# 1.根据文件对象创建writer对象w1 = writer(f)# 2.写入数据# 1)一次写一行w1.writerow(['姓名', '性别', '年龄'])w1.writerow(['小明', '男', 22])# 2)一次写多行w1.writerows([('小花', '女', 18),['张三', '男', 30]])
b. DictWriter
with open('files/student2.csv', 'w', encoding='utf-8', newline='') as f:# 1.根据文件对象创建writer对象w2 = DictWriter(f, ['姓名', '性别', '年龄'])# 2.写入数据# 1)将字典的键作为第一行写入文件w2.writeheader()w2.writerow({'姓名': '小明', '性别': '男', '年龄': 22})w2.writerows([{'姓名': '小花', '性别': '女', '年龄': 17},{'姓名': '小红', '性别': '女', '年龄': 18},{'姓名': '张三', '性别': '男', '年龄': 30}])

二、bs4

bs4(beautifulsoup4),它基于css选择器的网页解析器

css语法:

选择器{属性名1: 属性值2; 属性名2: 属性值2; …}

常见属性:color(设置字体颜色)、 background-color(背景颜色)、font-size(字体大小)、width(宽度)、height(高度)、border(边框)

选择器:

  1. 元素选择器(标签选择器) - 将标签作为选择器,选中所有指定的标签

    a{} - 选中所有的a标签
    p{} - 选中所有的p标签
    span{} - 选中所有的span标签

  2. id选择器 - 在标签的id属性前加#作为一个选择器,选中id属性值为指定值的标签
    注意:一个网页中id属性值是唯一的

    #a{} - 选中id属性值为a的标签
    #b1{} - 选中id属性值为b1的标签

  3. class选择器 - 在标签的class属性前加.作为一个选择器,选中所有class属性值为指定值的标签
    注意:一个网页中多个标签的class属性值可以相同;同一个标签可以有多个不同的class
    只有一个class属性值标签的写法:<标签名 class=“c1”>
    有多个class属性值标签的写法:<标签名 class=“c1 c2 c3”>

    .a{} - 选中class属性值为a标签
    .c1{} - 选中class属性值为c1的标签
    .a.b{} - 选中class属性值同时为a和b标签
    a.c1{} - 选中所有class值为c1的a标签

  4. 子代选择器 - 将两个选择器用>连接成一个选择器(前后形成父子关系)

div>a{} - 选中所有在div标签中的a标签(a标签必须是div的子标签)

  1. 后代选择器 - 将两个选择器用空格连接成一个选择器(前后形成后代关系)

div a{} - 选中所有在div标签中的a标签(a标签必须是div的后代标签)

注意:安装的时候装beautifulsoup4,使用的时候用bs4

from bs4 import BeautifulSoup

1.根据网页源代码创建soup对象

BeautifulSoup(网页源代码, ‘lxml’)

f = open('files/data.html', encoding='utf-8')
soup = BeautifulSoup(f.read(), 'lxml')
f.close()

2. 获取标签

soup对象.select(css选择器) - 获取整个网页中选择器选中的所有标签,返回值是一个列表,列表中的元素是标签对象(找不到返回空列表)
soup对象.select_one(css选择器) - 获取整个网页中选择器选中的第一个标签,返回值是标签对象(找不到返回None)
标签对象.select(css选择器) - 获取指定标签中css选择器选中的所有标签
标签对象.select_one(css选择器) - 获取指定标签中css选择器选中的第一个标签

result = soup.select('p')
print(result)# result = soup.select('.c1')
# print(result)
#
# result = soup.select_one('p')
# print(result)
#
# result = soup.select('div p')
# print(result)box1 = soup.select_one('#box1')
result = box1.select('p')
print(result)p1 = soup.select_one('span>p')
a1 = box1.select_one('a')

3. 获取标签内容和标签属性

标签对象.text - 获取标签内容
标签对象.attrs[属性名] - 获取标签指定属性的值

print(p1.text)      # '我是段落5'
print(a1.text)      # '我是超链接3'
print(a1.attrs['href'])     # 'https://www.baidu.com'

应用

import requests
from bs4 import BeautifulSoup# 1. 获取网页源代码
headers = {'user-agent': 'Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_7) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/102.0.0.0 Safari/537.36'
}
response = requests.get('https://movie.douban.com/top250', headers=headers)
html = response.text# 2. 解析数据
soup = BeautifulSoup(html, 'lxml')# 获取每个电影对应的div
div_list = soup.select('.grid_view>li>div')
for x in div_list:name = x.select_one('.title').textscore = x.select_one('.rating_num').textcomment = x.select('.star>span')[-1].text[:-3]print(name, score, comment)
http://www.yayakq.cn/news/827037/

相关文章:

  • 视频教做家常菜的网站正规的招聘网站
  • 网站建设合同免费下载网页定制公司
  • 旅游网站后台模板下载php网站开发培训班
  • 网站编辑是网页制作么武夷山网站定制
  • flash网站建设教程视频网站开发文档doc
  • 西安网站制作维护中信建设有限责任公司怎么样
  • 网站建设 手机和pc外国人做的关于中国的视频网站
  • 京东门户网站怎么做提供建设服务的网络公司
  • 专业郑州做网站文字代码生成器
  • 帮忙做网站的协议wordpress微信登录插件下载
  • 网站建设要求一对一优势的网络营销方式
  • 域名空间网站如何做微商城网站
  • 架设一个网站需要多少钱网店设计方案
  • 100种找客户的方法seo流程
  • 写网站编程需要什么哈尔滨网站建设哪家好而且价格不贵
  • 做文案需要用到的网站千峰培训出来好就业吗
  • 专业建站推广服务国外医疗网站模板
  • 网站建设龙华焊工培训心得体会
  • 小男生和大人做的网站石家庄的网站公司哪家好
  • 网站做平台有哪些移动应用开发网站
  • 网站二级目录做优化改变WordPress界面
  • 个人购物网站需要备案吗常州如何进行网站推广
  • 做网站需要编程怎么搭建视频网站
  • wordpress中文主题开发框架seo的工作内容主要包括
  • 青岛制作网站软件北京上地网站建设
  • 网站seo推广怎么做网站出租目录做菠菜 有什么坏处
  • 网络销售网站外包免费建设网站软件下载
  • 网站加载慢网站建设哪里最好
  • 做质粒图谱的网站购物券网站怎么做
  • shopify做旅游网站泰州网站建设报价