• 关于VBA和“网抓”的一些贴



     https://zhuanlan.zhihu.com/p/20701359

    使用Excel+VBA对网页进行操作


     http://club.excelhome.net/thread-1215914-1-1.html

    自动用chrome打开网页并填入用户名


     http://blog.csdn.net/lufy_legend/article/details/25191765

    用程序来控制一个网页,实现自动输入等操作


     https://www.zhihu.com/question/27677175

    思路一般是这样:

    1、找到数据源(网页)

    2、分析源代码,找到你要的数据,看看它放在哪个标签里,从标签里取出来。vba我习惯用正则取。python的话beautifulsoup很不错。

    3、特别要说下,对于URL的分析很关键,要分析出所需的数据是通过什么方式从服务器取得的,是GET还是POST提交到服务器的,服务器返回来的数据是直接放在网页源代码中还通过是json数据。

    4、抓到后放到excel里。

    推荐的学习网站是excleHome,里面大神多,但是建议自己最好带着问题去看,不然会有大海捞针的感觉。

    有些网站采用js动态生成的数据,这个时候如果直接用xmlhttp去抓源代码的话,往往是抓不到的。这个时候思路一般就是采用模拟浏览器的访问,得到整个网页的内容,vba具体到实现上就是调用ie浏览器去访问网站,然后得到数据。但是这个其实挺无奈的,一来速度会比较慢,二来网页一直在加载那么程序就会一直循环等待,这个时候又要人工加上等待时间,以便跳出循环。


    VBA与网抓

    https://www.jianshu.com/p/059fbe8486f9


    小白也抓网——分享网抓作品

    http://club.excelhome.net/thread-1162676-1-1.html


    不懂html也来学网抓(xmlhttp/winhttp+fiddler)

    http://club.excelhome.net/thread-1159783-1-1.html


    刚学网抓,试着抓了下EH论坛的帖子

    http://club.excelhome.net/thread-1325003-1-1.html


    【网抓】请教用正则表达式提取数据

    http://www.excelpx.com/thread-332280-1-1.html


    懦夫从不启程,弱者溺与途中,只剩我们前行~
  • 相关阅读:
    下载安装Git,学习笔记
    php面试相关整理
    2.5 DQL 分组查询
    2.4 DQL 常见函数
    2.3 DQL 排序查询
    2.2 DQL 条件查询
    2.1 DQL 基础查询
    1.2 MySQL的介绍
    1.1 数据库的相关概念
    2019年JavaEE学习线路
  • 原文地址:https://www.cnblogs.com/dlsunf/p/8446009.html
Copyright © 2020-2023  润新知