免费发布课程
认证首页 >> 培训课程 >> 生产管理培训 >> 数据采集技术培训(北京,7月20-21日)

数据采集技术培训(北京,7月20-21日)

培训费用:¥5500

  • 授课地点:北京\北京
  • 课程分类:生产管理
  • 培训天数:2天
  • 开班时间:2017年07月20日 (授课已结束,最新课程请联系客服)
  • 浏览次数:6311 次
  • 联系电话:
  • (联系我时,请说是在认证信息网上看到的,谢谢!)
中国认证信息网
【课程大纲】

数据采集技术培训(北京,7月20-21日)
【举办单位】北京曼顿培训网  中国培训资讯网
【培训日期】2017年7月20-21日
【培训地点】北京
【培训对象】
1,系统架构师、系统分析师、高级程序员、资深开发人员。
2,牵涉到网络采集、处理和规划的负责人、设计人员。
3,政府机关,金融保险、移动等以互联网信息为数据来源单位的负责人。
4,高校、科研院所牵涉到网络数据采集与数据处理的项目负责人。
【课程背景】
Python是一种面向对象、解释型计算机程序设计语言,Python是纯粹的自由软件,源代码和解释器CPython遵循 GPL协议。是一个用于统计计算和统计制图的优秀工具,也是GNU的一个免费、源代码开放的软件。
Python语法简洁清晰,具有丰富和强大的库,能够把用其他语言制作的各种模块(尤其是C/C++)很轻松地联结在一起。 Python爬虫包括一套完整的数据采集、处理、计算系统,简便而强大的编程语言,可操纵数据的输入和输入,可实现分支、循环,用户可自定义功能。
本培训将对基于Python爬虫进行数据采集、处理、数据分析的方法深度剖析,并对Python爬虫原理及实现进行讲解。
【课程背景】
Python是一种面向对象、解释型计算机程序设计语言,Python是纯粹的自由软件,源代码和解释器CPython遵循 GPL协议。是一个用于统计计算和统计制图的优秀工具,也是GNU的一个免费、源代码开放的软件。
Python语法简洁清晰,具有丰富和强大的库,能够把用其他语言制作的各种模块(尤其是C/C++)很轻松地联结在一起。 Python爬虫包括一套完整的数据采集、处理、计算系统,简便而强大的编程语言,可操纵数据的输入和输入,可实现分支、循环,用户可自定义功能。
本培训将对基于Python爬虫进行数据采集、处理、数据分析的方法深度剖析,并对Python爬虫原理及实现进行讲解。
【学员基础】
1,对IT系统设计有一定的理论与实践经验。
2,具备信息检索IR和大数据处理的基础知识。
3,有一定的python基础知识和开发经验。
【培训目标】
1,全面了解Python爬虫的相关知识。
2,学习Python爬虫的核心技术方法以及应用特征。
3,深入使用Python在网络数据采集中的使用。
【课程大纲】
第一讲 网络爬虫基础
1.什么是网络爬虫
2.浏览网页的过程
3.URL的含义
4. 环境的配置
第二讲 Python爬虫基础知识
1.Python爬虫基础学习
2.Python urllib和urllib2 库的用法
3.Python 正则表达式
4.BeautifulSoup简介
5.爬虫框架Scrapy
第三讲 Urllib库的基本使用
1.网页爬取示例
2.网页爬取方法
3.构造Requset
4.POST和GET数据传送
第四讲 Urllib库的高级用法
1.设置Headers
2. Proxy(代理)的设置
3.Timeout 设置
4.HTTP的PUT和delete方法
5.使用DebugLog
第五讲 正则表达式
1.了解正则表达式
2.正则表达式的语法规则
3.正则表达式相关注解
4.Python Re模块
第六讲 Beautiful Soup的用法
1. Beautiful Soup的简介
2. Beautiful Soup 安装
3. 创建 Beautiful Soup 对象
4. Beautiful Soup对象种类
5. 遍历文档树
第七讲 开始采集
1.遍历单个域名
2.采集整个网站
3.通过互联网采集
4.用Scrapy采集
5.几个示例
第八讲 存储数据和读取文档
1.媒体文件
2.把数据存储到CSV
3.MySQL与Python整合
4.读取纯文本和CSV文档
5.读取Word和.docx
第九讲 自然语言处理基础
1.概括数据
2.马尔可夫模型
3.自然语言工具包
4.用NLTK做统计分析
5.用NLTK做词性分析
第十讲 用爬虫测试网站
1.测试简介
2.Python单元测试
3.Selenium单元测试
4.Python单元测试与Selenium单元测试的选择
【讲师介绍】
   杨老师,曼顿培训网()资深讲师。主要研究网络信息分析以及云计算相关技术,长期从事通信网管系统、网络信息处理、商务智能(BI)以及电信决策支持系统的研究开发工作,主持和参与了多个国家和省部级基金项目,具有丰富的工程实践及软件研发经验。
【费用及报名】
1、费用:培训费5500元(含培训费、讲义费);如需食宿,会务组可统一安排,费用自理。
2、报名咨询:鲍老师
3、报名流程:电话登记-->填写报名表-->发出培训确认函
4、备注:如课程已过期,请访问我们的网站,查询最新课程
5、详细资料请访问北京曼顿培训网:(每月在全国开设四百多门公开课,欢迎报名学习)



【讲师介绍】

杨老师,曼顿培训网()资深讲师。主要研究网络信息分析以及云计算相关技术,长期从事通信网管系统、网络信息处理、商务智能(BI)以及电信决策支持系统的研究开发工作,主持和参与了多个国家和省部级基金项目,具有丰富的工程实践及软件研发经验。



【培训对象】

,系统架构师、系统分析师、高级程序员、资深开发人员。
2,牵涉到网络采集、处理和规划的负责人、设计人员。
3,政府机关,金融保险、移动等以互联网信息为数据来源单位的负责人。
4,高校、科研院所牵涉到网络数据采集与数据处理的项目负责人。





更新时间:2017/6/29 7:15:07

标签:数据采集 
我们的优势
  • 资源丰富 上万门培训课程、上万份学习资料及教训教程
  • 覆盖面广 提供全国大中城市及覆盖各个培训领域课程
  • 专业服务 专业客服一对一及时提供在线咨询及训后服务
  • 满意率高 上千家合作企业 十多万名学员 92%高满意率
  • 赠送积分 免费赠送下载积分1000分 下载本站海量资料
  • 优惠听课 本站报名学员均可享受参加公开课培训优惠
【报名服务流程】  全国统一报名服务热线:- 0769-21664823 13538429998

<>在线报名>>课程名:数据采集技术培训(北京,7月20-21日)(课程编号:PX10923)
 
*您的姓名: 您的性别: 先生  女士
*联系电话: 传真号码:
*所在公司: 现任职务:
*电子邮箱: *手机号码:
*所在地区: 参加人数:
联系地址:
备注留言:
验 证 码:
特别提示:*为必填项!请认真详细填写,我们将在工作时间安排专人与您联系!如多人参加某一课程,请将参加人数,参加人的姓名\电话,等信息填写在备注栏内。
 



广告积分兑换-查看详情

生产管理培训课程

该机构其他培训课程

广告积分兑换-查看详情

新发布公开课

相关课程搜索

最新加入培训机构

咨询热线:
13925768373
13925767953
13925760773
在线客服