java 爬蟲如何獲取with（ document） with （body）中的body 內容？

用http請求一個鏈接獲取如下內容

<!DOCTYPE html>
<html>
<head>
  <meta charset="utf-8">
  <meta http-equiv="X-UA-Compatible" content="IE=edge">
  <meta http-equiv="Cache-Control" content="no-siteapp" />
  <meta name="data-spm" content="a21ag"/>
  <meta name="renderer" content="webkit">
  <meta name="description" content="">
  <meta name="viewport" content="width=device-width, initial-scale=1">
  <title>生意參謀</title>

    
  
  
      <link rel="stylesheet" href=//g.alicdn.com/dt/op-ebase/3.4.41/op-ebase.css />
    <link rel="stylesheet" href=//g.alicdn.com/dt/op-eportal/1.12.20/login.css />
    <!--[if lte IE 9]>
  <script>if (!/update\.htm/.test(location.href)) window.location = '//sycm.taobao.com/portal/update.htm'; </script>
  <![endif]-->
</head>
<body class="esycm-wrapper" data-spm="8365346"><script>
with(document)with(body)with(insertBefore(createElement("script"),firstChild))setAttribute("exparams","category=&userid=&aplus&yunid=&&asid=AQAAAADhb8xakfQWKgAAAABSM9G79i330w==",id="tb-beacon-aplus",src=(location>"https"?"http://g":"http://g")+".alicdn.com/alilog/mlog/aplus_v2.js")
</script>
  <div id="app"></div>
      <script type="text/javascript" src=//g.alicdn.com/dt/op-ebase/3.4.41/op-ebase.js crossorigin></script>
    <script type="text/javascript" src=//g.alicdn.com/dt/op-eportal/1.12.20/login.js crossorigin></script>
  </body>
</html>

body沒有顯示出來如獲取呢？

回答

編輯回答

乞許

你這種情況需要用到無頭瀏覽器才行的。相當于要等js執(zhí)行后，你再解析內容。
如果是node來寫的話，可能比較方便，使用PhantomJS實現起來比較方便。

不過，java環(huán)境下的HtmlUnit兼容性稍弱，你可以試試看

2018年3月27日 05:35

相關信息

熱門機構

北大青鳥昌平沙河校區(qū)

北大青鳥APTECH成立于1999年。依托北京大學優(yōu)質雄厚的教育資源和背景，秉承“教育改變生活”的發(fā)展理念，致力于培養(yǎng)中國IT技能型緊缺人才，是大數據專業(yè)的國家
北大青鳥中博軟件學院

北大青鳥中博軟件學院創(chuàng)立于2003年，作為華東區(qū)著名互聯網學院和江蘇省首批服務外包人才培訓基地，中博成功培育了近30000名軟件工程師走向高薪崗位，合作企業(yè)超4
中公教育IT品牌優(yōu)就業(yè)

中公教育集團創(chuàng)建于1999年，經過二十年潛心發(fā)展，已由一家北大畢業(yè)生自主創(chuàng)業(yè)的信息技術與教育服務機構，發(fā)展為教育服務業(yè)的綜合性企業(yè)集團，成為集合面授教學培訓、網
達內教育

達內教育集團成立于2002年，是一家由留學海歸創(chuàng)辦的高端職業(yè)教育培訓機構，是中國一站式人才培養(yǎng)平臺、一站式人才輸送平臺。2014年4月3日在美國成功上市，融資1

熱門課程

北大青鳥android課程

適合人群：大專以上學歷

開班時間：每月1號
北大青鳥java軟件工程師

適合人群：大學畢業(yè)生

開班時間：每月1號
北大青鳥ACCP初中課程

適合人群：初中以上學歷

開班時間：每月1號
北大青鳥大數據課程

適合人群：18歲以上人群

開班時間：每月1號

熱門教師

劉國斌Java講師

曾工作于聯想擔任系統開發(fā)工程師，曾在博彥科技股份有限公司擔任項目經理從事移動互聯網管理及研發(fā)工作，曾創(chuàng)辦藍懿科技有限責任公司從事總經理職務負責iOS教學及管理工作。
王克晶Java講師

浪潮集團項目經理。精通Java與.NET 技術，熟練的跨平臺面向對象開發(fā)經驗，技術功底深厚。授課風格授課風格清新自然、條理清晰、主次分明、重點難點突出、引人入勝。
張老師web前端講師

精通HTML5和CSS3；Javascript及主流js庫，具有快速界面開發(fā)的能力，對瀏覽器兼容性、前端性能優(yōu)化等有深入理解。精通網頁制作和網頁游戲開發(fā)。
劉蒼松Java教研總監(jiān)

具有10 年的Java 企業(yè)應用開發(fā)經驗。曾經歷任德國Software AG 技術顧問，美國Dachieve 系統架構師，美國AngelEngineers Inc. 系統架構師。

熱門資訊

熱門城市

熱門教程

熱門問題

java 爬蟲如何獲取with（ document） with （body） 中的body 內容？

相關信息

劉國斌Java講師

王克晶Java講師

張老師web前端講師

劉蒼松Java教研總監(jiān)

java 爬蟲如何獲取with（ document） with （body）中的body 內容？