PHP 爬取網頁中表格數據


        public function spider_j($page)
            {
                $url="http://aaa/bbb".$page."_0/"; 
                   
                $fcontents=file_get_contents($url);  

                $table_data = preg_match_all('#<table>(.*?)</table>#si',$fcontents,$match);

                $table_data = $match[0][0];

                $table_array = explode('<tr>',$table_data);
             
                $data = array();

                for($i=2;$i<count($table_array);$i++){
                    $data[$i] = explode('</td>',$table_array[$i]);
                    for($j = 0;$j<count($data[$i]);$j++){
                        $data[$i][$j] = preg_replace('/\s(?=\s)/','',trim(strip_tags($data[$i][$j])));
                    }
                    $data[$i][6] = date('Y-m-d');
                }

                $kname = array('ID', 'GAMENAME', 'GATEGORY','BETA', 'DATA', 'DOWNLOAD','THEDATE');

                foreach($data as $key=>&$val){
                    $val = array_combine($kname,$val);
                } 
            
                for($i=2;$i<(count($data)+2);$i++){
                    $this->db06->insert('TBL_J',$data[$i]);
                }       
        
            }
                      
           public function spider()
            { 
                for($i=1;$i<11;$i++){
                    $this->spider_j($i);    
                }                                                                     
            }

邏輯:把網頁代碼讀到字符串中,通過正則表達式篩選出指定的數據,然后變成二維數組,插入到數據庫里。


免責聲明!

本站轉載的文章為個人學習借鑒使用,本站對版權不負任何法律責任。如果侵犯了您的隱私權益,請聯系本站郵箱yoyou2525@163.com刪除。



 
粵ICP備18138465號   © 2018-2025 CODEPRJ.COM