《PHP編程:php抓取并保存網(wǎng)站圖片的實現(xiàn)代碼》要點:
本文介紹了PHP編程:php抓取并保存網(wǎng)站圖片的實現(xiàn)代碼,希望對您有用。如果有疑問,可以聯(lián)系我們。
PHP教程此程序?qū)崿F(xiàn)了網(wǎng)頁源代碼捕獲,圖片鏈接獲取、分析、并將同樣的圖片鏈接合并功能,實現(xiàn)了圖片抓取功能.利用php強(qiáng)大的網(wǎng)絡(luò)內(nèi)容處理函數(shù)將指定的網(wǎng)站上的所有圖片抓取下來,保存在當(dāng)前目錄下,以下為代碼:
PHP教程
<?php
/*完成網(wǎng)頁內(nèi)容捕獲功能*/
function get_img_url($site_name){
$site_fd = fopen($site_name, "r");
$site_content = "";
while (!feof($site_fd)) {
$site_content .= fread($site_fd, 1024);
}
/*利用正則表達(dá)式得到圖片鏈接*/
$reg_tag = '/<img.*?\"([^\"]*(jpg|bmp|jpeg|gif)).*?>/';
$ret = preg_match_all($reg_tag, $site_content, $match_result);
fclose($site_fd);
return $match_result[1];
}
/* 對圖片鏈接進(jìn)行修正 */
function revise_site($site_list, $base_site){
foreach($site_list as $site_item) {
if (preg_match('/^http/', $site_item)) {
$return_list[] = $site_item;
}else{
$return_list[] = $base_site."/".$site_item;
}
}
return $return_list;
}
/*得到圖片名字,并將其保存在指定位置*/
function get_pic_file($pic_url_array, $pos){
$reg_tag = '/.*\/(.*?)$/';
$count = 0;
foreach($pic_url_array as $pic_item){
$ret = preg_match_all($reg_tag,$pic_item,$t_pic_name);
$pic_name = $pos.$t_pic_name[1][0];
$pic_url = $pic_item;
print("Downloading ".$pic_url." ");
$img_read_fd = fopen($pic_url,"r");
$img_write_fd = fopen($pic_name,"w");
$img_content = "";
while(!feof($img_read_fd)){
$img_content .= fread($img_read_fd,1024);
}
fwrite($img_write_fd,$img_content);
fclose($img_read_fd);
fclose($img_write_fd);
print("[OK] ");
}
return 0;
}
function main(){
/* 待抓取圖片的網(wǎng)頁地址 */
$site_name = "";
$img_url = get_img_url($site_name);
$img_url_revised = revise_site($img_url, $site_name);
$img_url_unique = array_unique($img_url_revised); //unique array
get_pic_file($img_url_unique,"./");
}
main();
?>
PHP教程此程序還有待完善的地方是,如果圖片在網(wǎng)站服務(wù)器上不同目錄下但文件名是相同的,此時圖片有可能是不一樣的,但在最后保存時,后面得到的圖片會將前面已經(jīng)保存的圖片覆蓋掉,解決辦法是在每次保存前先檢索當(dāng)前目錄下是否已有此文件名,有的話對將要保存的圖片重新命名即可.
PHP教程以上就是為大家分享的php抓取并保存網(wǎng)站圖片的辦法,以及在實踐過程中修正程序不完善的地方,希望這篇文章對大家的學(xué)習(xí)有所幫助.
歡迎參與《PHP編程:php抓取并保存網(wǎng)站圖片的實現(xiàn)代碼》討論,分享您的想法,維易PHP學(xué)院為您提供專業(yè)教程。
轉(zhuǎn)載請注明本頁網(wǎng)址:
http://www.snjht.com/jiaocheng/8504.html