PHPのシンプルなクローラー
リリース: 2016-07-25 09:08:50
- function get_urls($url)
- {
- $url_array=array();
- $the_first_content=file_get_contents($url);
- $the_second_content=file_get_contents($url);
- $pattern1 = "/http:// [a-zA-Z0-9.?/-=&:+-_'"]+/";
- $pattern2="/http://[a-zA-Z0-9.]+/";
- preg_match_all($pattern2, $the_first_content, $matches2);
- preg_match_all($pattern1, $the_first_content, $matches1);
- $new_array1=array_unique($matches1[0]);
- $new_array2=array_unique($matches2[0]) ;
- $final_array=array_merge($new_array1,$new_array2);
- $final_array=array_unique($final_array);
- for($i=0;$i {
- echo $final_array [$i]."
";
- }
- }
- get_urls("http://www.baidu.com");
复制代
|
このウェブサイトの声明
この記事の内容はネチズンが自主的に寄稿したものであり、著作権は原著者に帰属します。このサイトは、それに相当する法的責任を負いません。盗作または侵害の疑いのあるコンテンツを見つけた場合は、admin@php.cn までご連絡ください。
著者別の最新記事
-
2024-10-22 09:46:29
-
2024-10-13 13:53:41
-
2024-10-12 12:15:51
-
2024-10-11 22:47:31
-
2024-10-11 19:36:51
-
2024-10-11 15:50:41
-
2024-10-11 15:07:41
-
2024-10-11 14:21:21
-
2024-10-11 12:59:11
-
2024-10-11 12:17:31