实现思路
1、使用爬虫技术分析、php我们用的querylist
2、在你的框架里面引入 composer jaeger/querylist:"*"
3、分析页面,使用GuzzleHttp请求分析 (GuzzleHttp在querylist 版本4会依赖GuzzleHttp)
public function douyin($url){
$headers = [
'Connection' => 'keep-alive',
'Host' => 'aweme.snssdk.com',
'User-Agent'=>'Mozilla/5.0 (iPhone; CPU iPhone OS 12_1_4 like Mac OS X) AppleWebKit/605.1.15 (KHTML, like Gecko) Mobile/16D57 Version/12.0 Safari/604.1'
];
$client = new Client(['headers'=>$headers]);
//允许重定向获取html
$res = $client->request('GET', $url,['allow_redirects' => true]);
$html = (string)$res->getBody();
$Query = QueryList::getInstance();
$video_src = $Query->html($html)->find('video')->src;
//爬虫视频地址
$video_src = str_replace("playwm","play",$video_src);
//获取url地址之后不能让他重定向
$res = $client->request('GET', $video_src,['allow_redirects' => false]);
$data['video_src']= $res->getHeaderLine('location');
//视频封面
$video_cover = $Query->html($html)->find('.video-poster')->style;
$video_cover = str_replace("background-image:url(","",$video_cover);
$data['video_cover'] = trim($video_cover,')');
$video_title = $Query->html($html)->find('.user-title')->text();
$title = explode('@',$video_title);
for ($i=0;$i<count($title);$i++){
$video_title = str_replace('@'.$title[$i],"",$video_title);
}
$title = explode('#',$video_title);
for ($i=0;$i<count($title);$i++){
$video_title = str_replace('#'.$title[$i],"",$video_title);
}
$video_title = str_replace("抖音","",$video_title);
$data['video_title'] = trim($video_title);
return $data;
}如果各位大神觉得我写的好可以去我的简书查看详细分析原理哦:https://www.jianshu.com/p/0bf0078eaf3a
随便打赏一下,将是我解析市面上所有去水印短视频的动力哦
