【爬虫】利用 selenium 爬取动态加载页面
·
谷歌浏览器版本查询地址:chrome://version/
谷歌驱动下载地址:http://chromedriver.storage.googleapis.com/index.html
注意:驱动版本和浏览器版本要对应
from selenium import webdriver
def main():
browser = webdriver.Chrome('./chromedriver.exe')#实例化一个驱动对象
browser.implicitly_wait(10)#如果 WebDriver没有在 DOM中找到元素,将继续等待,超出设定时间后则抛出找不到元素的异常
browser.get("页面地址")#利用浏览器驱动访问
data = browser.page_source # 获取页面的源代码
print(data)
if __name__ =="__main__":
main()
魔乐社区(Modelers.cn) 是一个中立、公益的人工智能社区,提供人工智能工具、模型、数据的托管、展示与应用协同服务,为人工智能开发及爱好者搭建开放的学习交流平台。社区通过理事会方式运作,由全产业链共同建设、共同运营、共同享有,推动国产AI生态繁荣发展。
更多推荐


所有评论(0)