| |
|
|
开发:
C++知识库
Java知识库
JavaScript
Python
PHP知识库
人工智能
区块链
大数据
移动开发
嵌入式
开发工具
数据结构与算法
开发测试
游戏开发
网络协议
系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程 数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁 |
| -> Python知识库 -> python爬虫------从丁香园疫情首页提取世界各国的疫情数据 -> 正文阅读 |
|
|
[Python知识库]python爬虫------从丁香园疫情首页提取世界各国的疫情数据 |
|
菜鸟自学python记录 初级爬虫学习(在B站上看的“黑马程序员180分钟轻松获取疫情数据,Python爬虫入门课”,此次是自己跟着写的简易代码) import requests
from bs4 import BeautifulSoup
import re
import json
# 请求,获取需要解析的文本
response = requests.get('https://ncov.dxy.cn/ncovh5/view/pneumonia')
home_page = response.content.decode()
# 从HTML中提取数据
soup = BeautifulSoup(home_page,'lxml')#lxml为解析器
scrip = soup.find(id="getListByCountryTypeService2true")
# 输出为json格式
text = scrip.text
# 从json中使用正则解析提取世界各国的疫情信息
json_str = re.findall(r'\[.+\]',text)[0]
#将json格式转换为python文件
data = json.loads(json_str)
# 打开文件,并写入,json文件命名为spider.json
with open('D:/python/spider.json','w',encoding='utf-8') as fp:
# 将python文件存入json文件中
json.dump(data,fp,ensure_ascii=False)
查找id标签的过程截图
? 最后json结果部分截图
? |
|
|
|
|
| 上一篇文章 下一篇文章 查看所有文章 |
|
|
开发:
C++知识库
Java知识库
JavaScript
Python
PHP知识库
人工智能
区块链
大数据
移动开发
嵌入式
开发工具
数据结构与算法
开发测试
游戏开发
网络协议
系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程 数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁 |
| 360图书馆 购物 三丰科技 阅读网 日历 万年历 2025年12日历 | -2025/12/3 11:45:01- |
|
| 网站联系: qq:121756557 email:121756557@qq.com IT数码 |