色综合图-色综合图片-色综合图片二区150p-色综合图区-玖玖国产精品视频-玖玖香蕉视频

您的位置:首頁技術文章
文章詳情頁

基于selenium-java封裝chrome、firefox、phantomjs實現爬蟲

瀏覽:18日期:2022-08-21 18:37:40

2017年一直以來在公司負責爬蟲項目相關工程,主要業務有預定、庫存、在開發中也遇到很多問題,隨手記錄一下,后續會持續更新。

chrome、firefox、phantomjs插件安裝和版本說明 基于selenium-java封裝chrome、firefox、phantomjs實現爬蟲

項目下載地址

maven版本說明

<!-- +++|selenium|+++ --> <dependency> <groupId>org.seleniumhq.selenium</groupId> <artifactId>selenium-java</artifactId> <version>3.5.1</version> </dependency> <!-- +++|phantomjsdriver|+++ --> <dependency> <groupId>com.github.detro.ghostdriver</groupId> <artifactId>phantomjsdriver</artifactId> <version>1.1.0</version> </dependency>

chrome插件配置

下載地址:chromedriver下載地址選擇本地系統對應的chrome版本安裝,工程下面有一個 對應的目錄是:Plugin/chromedriver_win32.zip,對應chrmoe版本是Supports Chrome v60-62

直接運行項目中示例

public class ChromeTest {public static void main(String[] args) { WebDriver webDriver = null; try { webDriver = WebDriverUtil.createChromeWebDriver('D:webdrvierchromedriver.exe');//修改路徑 webDriver.get('https://www.baidu.com/'); System.out.println(webDriver.getTitle()); } catch (Exception e) { e.printStackTrace(); } finally { if (webDriver != null) { webDriver.close(); } }}}

chrome配置插件是最簡單的,linux上面只需要把插件換成linux版本即可

firefox

下載插件地址:geckodriver下載地址,選擇本地系統對應的firefox版本安裝,工程下面有一個 對應的目錄是:Plugin/geckodriver-v0.18.0-win64.zip,對應firefox版本是Firefox Setup 50.0(64位)、其他版本沒有測試過

firefox下載地址、selenium-java版本和geckodriver版本更新迭代不一致,導致在搭建環境時很容易出現一系列問題。

直接運行項目中示例

public class FireFoxTest { public static void main(String[] args) { WebDriver webDriver = null; try { webDriver = WebDriverUtil.createFirefoxWebDriver('D:webdrvierFirefoxgeckodriver_18.exe'); webDriver.get('https://book.douban.com/tag/'); Set<String> tagSet = new HashSet<>(); //獲取豆瓣標簽 List<WebElement> divWebElement = webDriver.findElements(By.cssSelector('#content > div > div.article > div:nth-child(2) > div')); for (WebElement webElement : divWebElement) {List<WebElement> aWebElement = webElement.findElements(By.cssSelector('a'));for (WebElement element : aWebElement) { tagSet.add(element.getText());} } System.out.println(tagSet); //點擊小說標簽 WebElement webElement = webDriver.findElement(By.cssSelector('#content > div > div.article > div:nth-child(2) > div:nth-child(1) > table > tbody > tr:nth-child(1) > td:nth-child(1) > a')); webElement.click(); System.out.println(webDriver.getTitle()); } catch (Exception e) { e.printStackTrace(); } finally { if (webDriver != null) {webDriver.quit();webDriver.close(); } } }}

phantomjs

下載插件地址phantomjs插件地址1、phantomjs插件地址2、下載有些慢。phantomjs是沒有界面的,所以只需要下載插件即可。

直接運行項目中示例

public class PhantomjsTest {public static void main(String[] args) { WebDriver webDriver = null; try { webDriver = WebDriverUtil.createPhantomjsWebDriver('D:/webdrvier/phantomjs-1.9.8-windows/phantomjs.exe'); webDriver.get('https://www.baidu.com/'); System.out.println(webDriver.getTitle()); } catch (Exception e) { e.printStackTrace(); } finally { if (webDriver != null) { webDriver.close(); } }}}

到此這篇關于基于selenium-java封裝chrome、firefox、phantomjs實現爬蟲的文章就介紹到這了,更多相關selenium java封裝爬蟲內容請搜索好吧啦網以前的文章或繼續瀏覽下面的相關文章希望大家以后多多支持好吧啦網!

標簽: Java
相關文章:
主站蜘蛛池模板: 久久久www成人免费精品 | 欧美18在线 | 久久精品在线 | 亚洲精品中文字幕一区 | 国产主播精品福利19禁vip | 亚洲欧美日韩中文字幕在线 | 嫩小性性性xxxxbbbb | 国产成人综合亚洲欧美在 | 模特精品一区二区三区 | 国产亚洲精品精品国产亚洲综合 | 亚洲欧美一区二区三区综合 | 亚洲国产高清在线精品一区 | 亚洲一区欧美一区 | 亚洲波多野结衣日韩在线 | 日本一区二区高清免费不卡 | 成人综合婷婷国产精品久久免费 | 韩国美女爽快毛片免费 | 牛牛本精品99久久精品88m | 国产日本在线 | www.色亚洲| 亚洲成成品网站有线 | 国内精品自产拍在线观看91 | 欧美综合一区 | 一个人看的www日本高清视频 | 久青草免费视频手机在线观看 | 毛片在线播放网址 | 日本欧美一级aaaaa毛片 | 美女啪啪网站又黄又免费 | 2020夜夜操 | 国产亚洲美女精品久久 | 日韩美女视频在线观看 | 给我一个可以看片的www日本 | 伊人2222| 久久国内精品自在自线观看 | 美国成人免费视频 | 久久这里一区二区精品 | 91挑色| 久久免费国产精品一区二区 | 国产精品漂亮美女在线观看 | 日韩一级欧美一级毛片在线 | 欧美成人精品在线 |