从Excel 2013开始,新增了WEBSERVICE和FILTERXML函数,可用于获取网页数据,但仅限于处理XML格式。然而,当前多数网站返回的是HTML或JSON数据,难以直接提取。面对这一问题,如何高效精准地抓取所需信息成为关键。本文将以获取网络图书基本信息为例,详细介绍如何借助Excel API网络函数库,实现对JSON格式数据的解析与提取,帮助用户在无需编程的情况下,便捷地将网页中的结构化数据导入Excel表格,提升数据收集效率。
1、 首先访问网络网站的图书资料页面
2、 网络图书信息的访问地址为 https://api.douban.com/v2/book/isbn/:9787111529385,其中末尾的数字代表该书的ISBN编号,通过替换不同的ISBN号可查询对应图书的详细资料。
3、 在Firefox浏览器中访问该网址,会返回标准JSON格式的信息,其中属性名称以蓝色显示,对应的属性值则用红色标注,结构清晰,便于识别与解析。
4、 第二步是安装ExcelAPI网络函数库。
5、 前往ExcelAPI官网,根据帮助文档完成函数库安装,或参考百度经验相关教程进行操作。
6、 用Excel制作条形码
7、 用Excel制作条形码
8、 第三步是调用函数提取JSON数据。
9、 调用GetJsonSource(url,UTF-8)函数,获取指定URL的JSON原始数据,编码格式为UTF-8。
10、 通过调用GetJsonSource()函数一次性获取全部数据,再利用GetJsonByPropertyName(json_source, property_name)按需提取书籍的基本信息。这种方式减少了多次访问网页的等待时间,有效提升了数据抓取效率,避免频繁请求带来的延迟,从而显著加快处理速度,特别适用于需要从大量结构化数据中提取特定内容的场景。
评论
更多评论