项目三之任务一 读写CSV数据文件_第1页
项目三之任务一 读写CSV数据文件_第2页
项目三之任务一 读写CSV数据文件_第3页
项目三之任务一 读写CSV数据文件_第4页
项目三之任务一 读写CSV数据文件_第5页
已阅读5页,还剩4页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

项目三:导入数据集中高本一体化课程体系·大数据应用技术专业核心课程Contents课程项目总览大数据应用编程——从数据采集到可视化的完整项目实践路径01任务一读写CSV数据文件02任务二读写XLSX数据文件03任务三读写JSON数据文件04任务四读写关系数据库任务一读写CSV数据文件从Python基础语法入手,建立基本的数据分析处理意识与能力大数据应用编程〖任务描述〗

巨蟒公司最近接到一个学校社团业务,该社团要为毕业生提供全面的招聘信息服务。许多企业例如腾讯,在其招聘网上提供了各种工作岗位信息,现需要巨蟒公司从网页上获取并汇总岗位数据(岗位名称、地点、岗位类别、岗位需求、岗位职责、发布时间)并存储起来。大数据应用编程〖知识准备〗1.认识CSV数据文件CSV(逗号分隔值文件格式)。逗号分隔值(Comma-SeparatedValues,CSV,有时也称为字符分隔值,因为分隔字符也可以不是逗号),其文件以纯文本形式存储表格数据(数字和文本)2.使用csv库读写CSV文件#方式一importcsvwithopen("D:\\test.csv")asf:reader=csv.reader(f)rows=[rowforrowinreader]print(rows[0])

#方式二importcsvwithopen("D:\\test.csv")asf:#1.创建阅读器对象reader=csv.reader(f)#2.读取文件第一行数据head_row=next(reader)print(head_row)大数据应用编程〖任务分析〗方法一方法二(1)搭建腾讯招聘Scrapy框架;(2)抓取数据包,分析页面结构,厘清抓取思路和抓取策略;(3)在items.py里面定义要抓取的数据字段;(4)编写爬虫文件主体逻辑,实现数据的抓取;(5)修改settings.py文件;(6)编写管道文件pipelines.py,将数据存入CSV文件中。此处由教师或学生自己思考方法实现任务大数据应用编程〖任务实施〗1.搭建腾讯招聘Scrapy爬虫框架2.爬取数据,将数据存入CSV文件中importscrapy

classTencentItem(scrapy.Item):#定义要抓取的数据结构

name=scrapy.Field()

#岗位名称location=scrapy.Field()

#地点kind=scrapy.Field()

#岗位类别duty=scrapy.Field()

#岗位需求requ=scrapy.Field()

#岗位职责release_time=scrapy.Field()#发布时间大数据应用编程〖任务检测〗一、填空题1.Python操作CSV文件时用到的库是_____________。2.Python向CSV写入中文数据发生乱码时,用到的库是_____________。二、实操题1.自建一个CSV文件,通过csv库写入如下信息到文件中,及处理中文乱码, 学号 姓名 年龄 班级 1 张三 16 1班 2 李四 17 1班 3 王五 16 1班2.通过csv库,输出题1中CSV文件的数据。大数据应用编程〖任务评价〗序号评价内容识记理解应用分析评价创造问题1应用Scrapy爬虫框架的项目搭

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论