返回首页
苏宁会员
购物车 0
易付宝
手机苏宁

服务体验

店铺评分与同行业相比

用户评价:----

物流时效:----

售后服务:----

  • 服务承诺: 正品保障
  • 公司名称:
  • 所 在 地:

  • 正版新书]Scrapy网络爬虫开发实战罗刚 编9787302658580
  • 全店均为全新正版书籍,欢迎选购!新疆西藏青海(可包挂刷).港澳台及海外地区bu bao快递
    • 作者: 罗刚 编著 | 罗刚 编编 | 罗刚 编译 | 罗刚 编绘
    • 出版社: 清华大学出版社
    • 出版时间:2024-06-01
    送至
  • 由""直接销售和发货,并提供售后服务
  • 加入购物车 购买电子书
    服务

    看了又看

    商品预定流程:

    查看大图
    /
    ×

    苏宁商家

    商家:
    君凤文轩图书专营店
    联系:
    • 商品

    • 服务

    • 物流

    搜索店内商品

    商品分类

    商品参数
    • 作者: 罗刚 编著| 罗刚 编编| 罗刚 编译| 罗刚 编绘
    • 出版社:清华大学出版社
    • 出版时间:2024-06-01
    • 版次:1
    • 印次:1
    • 字数:290000
    • 页数:184
    • 开本:16开
    • ISBN:9787302658580
    • 版权提供:清华大学出版社
  • 作者: 罗刚 编
  • 著: 罗刚 编
  • 装帧: 平装
  • 印次: 1
  • 定价: 69.8
  • ISBN: 9787302658580
  • 出版社: 清华大学出版社
  • 开本: 16开
  • 印刷时间: 暂无
  • 语种: 暂无
  • 出版时间: 2024-06-01
  • 页数: 184
  • 外部编号: 五三A47593
  • 版次: 1
  • 成品尺寸: 暂无
  • 第1章网络爬虫快速入门

    1.1各种网络爬虫

    1.1.1通用爬虫

    1.1.2定向爬虫

    1.2网络爬虫基本技术

    1.3Windows命令行

    1.4上手Scrapy网络爬虫开发

    1.5本章小结

    第2章Python开发快速入门

    2.1变量

    2.2注释

    2.3简单数据类型

    2.3.1数值

    2.3.2字符串

    2.3.3数组

    2.4字面值

    2.5控制流

    2.5.1if语句

    2.5.2循环

    2.6列表

    2.7元组

    2.8集合

    2.9字典

    2.10函数

    2.11模块

    2.12检查字符串是否包含子字符串

    2.13面向对象编程

    2.14泛型

    2.15日志记录

    2.16数据库

    2.17本章小结

    第3章使用Python开发网络爬虫

    3.1使用BeautifulSoup实现定向采集

    3.2URL基础

    3.2.1URI

    3.2.2解析相对地址

    3.2.3DNS解析

    3.3网络爬虫抓取原理

    3.4爬虫架构

    3.4.1基本架构

    3.4.2分布式爬虫架构

    3.4.3垂直爬虫架构

    3.5下载网页

    3.5.1HTTP

    3.5.2HTML文档

    3.5.3使用curl命令下载网络资源

    3.5.4使用wget命令下载网页

    3.5.5下载静态网页

    3.5.6使用Selenium下载动态内容

    3.5.7重试

    3.6下载图片

    3.7网络爬虫的遍历与实现

    3.8robots协议

    3.9连接池

    3.10URL地址查新

    3.10.1Redis数据库

    3.10.2布隆过滤器

    3.11抓取RSS

    3.12网页更新

    3.13进度条

    3.14垂直行业抓取

    3.15抓取的应对方法

    3.15.1模拟浏览器访问

    3.15.2使用代理IP

    3.15.3抓取需要登录的网页

    3.16保存信息

    3.16.1SQLite数据库

    3.16.2MySQL数据库

    3.16.3MongoDB数据库

    3.16.4存入Elasticsearch搜索引擎

    3.17本章小结

    第4章从互联网提取信息

    4.1识别网页的编码

    4.1.1二进制流的编码

    4.1.2识别编码的整体流程

    4.2正则表达式

    4.3结构化信息的提取

    4.3.1解析JSON

    4.3.2解析XML

    4.3.3XML接口

    4.3.4lxml处理网页

    4.3.5使用XPath提取信息

    4.3.6在Chrome浏览器中查找Selenium WebDriver的XPath

    4.3.7CSS选择器

    4.3.8使用Parsel

    4.3.9提取文本

    4.3.10网页正文提取

    4.4从文件提取信息

    4.5本章小结

    第5章使用Scrapy开发爬虫

    5.1一个示例爬虫的演练




    5.2Scrapy Playwright指南:渲染和抓取动态JS网站




    ……




    罗刚,2004年开始创建猎兔搜索技术,10多年来一直从事搜索引擎、自然语言处理、图像识别等技术的研发和团队管理工作。 曾经担任新东方公司研究员,国防大学科研处技术顾问,工信部舆情开发顾问,红象云腾公司技术顾问,青岛大快搜索公司首席架构师,中和云技术合伙人,东南大学社会导师,北京石油化工学院社会导师。近几年同时开展了学员就业培训工作,成功培训了50多位专业的软件工程师,培养的工程师目前分布在百度、美团、Nuance、云知声、摄星等相关公司研发中心。

    售后保障

    最近浏览

    猜你喜欢

    该商品在当前城市正在进行 促销

    注:参加抢购将不再享受其他优惠活动

    x
    您已成功将商品加入收藏夹

    查看我的收藏夹

    确定

    非常抱歉,您前期未参加预订活动,
    无法支付尾款哦!

    关闭

    抱歉,您暂无任性付资格

    此时为正式期SUPER会员专享抢购期,普通会员暂不可抢购