企查查無頭瀏覽器無法搜索

企查查無法用selenium 無頭瀏覽器搜索

https://www.qichacha.com/

回答

編輯回答

心癌

可能有反爬蟲手段，selenium還是有些特征的，比如全局對象中會有一些特殊屬性。

2018年4月22日 23:39

編輯回答

墻頭草

看你為了爬企查查已經問了不少問題了, 這里我提醒一下:
如果使用 ChromeDriver 的無頭模式, 那么訪問網站的時候不能有通過document.write()插入的 js腳本被執(zhí)行. 參考stackoverflow 上的一個問題:
例子:

>>> from selenium import webdriver
>>> option = webdriver.ChromeOptions()
>>> option.add_argument('--headless')
>>> driver = webdriver.Chrome(chrome_options=option)
[0608/163830.206:ERROR:gpu_process_transport_factory.cc(1007)] Lost UI shared context.

DevTools listening on ws://127.0.0.1:60357/devtools/browser/36a1f861-d1ab-4cef-a5a9-3072bbada0fc
>>> driver.get('https://www.baidu.com')
[0608/163849.677:INFO:CONSOLE(715)] "A parser-blocking, cross site (i.e. different eTLD+1) script, https://ss1.bdstatic.com/5eN1bjq8AAUYm2zgoY3K/r/www/cache/static/protocol/https/global/js/all_async_search_8d20902.js, is invoked via document.write. The network request for this script MAY be blocked by the browser in this or a future page load due to poor network connectivity. If blocked in this page load, it will be confirmed in a subsequent console message. See https://www.chromestatus.com/feature/5718547946799104 for more details.", source: https://www.baidu.com/ (715)

這里 https://ss1.bdstatic.com/5eN1bjq8AAUYm2zgoY3K/r/www/cache/static/protocol/https/global/js/all_async_search_8d20902.js 是通過 document.write()寫入 html 文本中然后再加載的, 不會被執(zhí)行, 因此報錯.

但是 Firefox 沒有這個問題, 所以我推薦你使用 Firefox 的無頭模式, 或者 phantomjs 這個無頭瀏覽器.
Firefox例子:

from selenium import webdriver
option = webdriver.FirefoxOptions()
option.add_argument('--headless')
driver = webdriver.Firefox(firefox_options=option)
driver.get('https://www.qichacha.com')
# 業(yè)務代碼...

當然, 使用 Firefox 之前需要安裝 Firefox.

2018年6月9日 15:49

相關信息

熱門機構

北大青鳥昌平沙河校區(qū)

北大青鳥APTECH成立于1999年。依托北京大學優(yōu)質雄厚的教育資源和背景，秉承“教育改變生活”的發(fā)展理念，致力于培養(yǎng)中國IT技能型緊缺人才，是大數據專業(yè)的國家
北大青鳥中博軟件學院

北大青鳥中博軟件學院創(chuàng)立于2003年，作為華東區(qū)著名互聯(lián)網學院和江蘇省首批服務外包人才培訓基地，中博成功培育了近30000名軟件工程師走向高薪崗位，合作企業(yè)超4
中公教育IT品牌優(yōu)就業(yè)

中公教育集團創(chuàng)建于1999年，經過二十年潛心發(fā)展，已由一家北大畢業(yè)生自主創(chuàng)業(yè)的信息技術與教育服務機構，發(fā)展為教育服務業(yè)的綜合性企業(yè)集團，成為集合面授教學培訓、網
達內教育

達內教育集團成立于2002年，是一家由留學海歸創(chuàng)辦的高端職業(yè)教育培訓機構，是中國一站式人才培養(yǎng)平臺、一站式人才輸送平臺。2014年4月3日在美國成功上市，融資1

熱門課程

北大青鳥android課程

適合人群：大專以上學歷

開班時間：每月1號
北大青鳥java軟件工程師

適合人群：大學畢業(yè)生

開班時間：每月1號
北大青鳥ACCP初中課程

適合人群：初中以上學歷

開班時間：每月1號
北大青鳥大數據課程

適合人群：18歲以上人群

開班時間：每月1號

熱門教師

劉國斌Java講師

曾工作于聯(lián)想擔任系統(tǒng)開發(fā)工程師，曾在博彥科技股份有限公司擔任項目經理從事移動互聯(lián)網管理及研發(fā)工作，曾創(chuàng)辦藍懿科技有限責任公司從事總經理職務負責iOS教學及管理工作。
王克晶Java講師

浪潮集團項目經理。精通Java與.NET 技術，熟練的跨平臺面向對象開發(fā)經驗，技術功底深厚。授課風格授課風格清新自然、條理清晰、主次分明、重點難點突出、引人入勝。
張老師web前端講師

精通HTML5和CSS3；Javascript及主流js庫，具有快速界面開發(fā)的能力，對瀏覽器兼容性、前端性能優(yōu)化等有深入理解。精通網頁制作和網頁游戲開發(fā)。
劉蒼松Java教研總監(jiān)

具有10 年的Java 企業(yè)應用開發(fā)經驗。曾經歷任德國Software AG 技術顧問，美國Dachieve 系統(tǒng)架構師，美國AngelEngineers Inc. 系統(tǒng)架構師。

熱門資訊

熱門城市

熱門教程

熱門問題

企查查無頭瀏覽器無法搜索

相關信息

劉國斌Java講師

王克晶Java講師

張老師web前端講師

劉蒼松Java教研總監(jiān)