javascript - node爬取微博-PHP中文網路問答

社群學習工具庫休閒

繁体中文

javascript - node爬取微博

仅有的幸福

仅有的幸福 2017-06-30 10:00:08

0

1

996

剛接觸node,想寫個爬蟲，爬取新浪微博評論，但是發現頁面是由JS動態生成的，用http模組爬取不到，然後用phantomjs爬取，（聽說會比較慢，運行了近15分鐘，這也太慢了，不知是否寫錯），還是不行，問一下有什麼辦法能夠爬取類似於新浪微博的網頁嗎？

let page=require("webpage").create();
let url="http://weibo.com/1713926427/Etq2WnSiR?filter=hot&root_comment_id=0&type=comment";
/*page.settings = {
    javascriptEnabled: true,
    loadImages: false,
    webSecurityEnabled: false,
    userAgent: 'Mozilla/5.0 (Windows NT 6.3; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/34.0.1847.137 Safari/537.36 LBBROWSER'
};*/
page.open(url,(status)=>{
    console.log("Status:"+status);
    if(status=="success"){
        let val = page.evaluate(()=>{
            var list_box=document.querySelector(".list_box");
            console.log(list_box);
            return list_box
        });
        console.log(val)
    }else{
        console.log("failed")
    }
    phantom.exit();
});

仅有的幸福

仅有的幸福

全部回覆(1)

扔个三星炸死你

扔个三星炸死你2017-06-30 10:02:08 1樓

自己寫過微博的爬取,有兩種思路

仔細看一下應該是有介面去取得對應資料的然後用正規去匹配
微博提供了開發者API介面的,雖然用著比較麻煩

點贊 +0

新增回覆

熱門專題

更多>

熱門文章

熱門教學

更多>

相關教學

熱門推薦

最新課程

最新ThinkPHP 5.1全球首發影片教學(60天成就PHP大牛線上訓練課程)

1423159
php入門教程之一週學會PHP

4268702
JAVA 初級入門影片教學

2536371

最新下載

更多>

網站特效

網站源碼

網站素材

前端模板