主页 > 知识库 > 使用shell脚本找出网站的空页面和404错误页面

使用shell脚本找出网站的空页面和404错误页面

热门标签:旅游地图标注大全 百度地图标注图标更换 东莞电销机器人价格一览表 excel地址地图标注 陕西电销卡外呼系统怎么安装 地图标注超出范围怎么办 杭州机器人外呼系统 百度地图的地图标注 佛山高德地图标注中心

早之前记的一个笔记了,之前只是记录了两句代码,放出来的话也是一个低质量的页面,于是设置为了仅自己可见,今晚抽空补充一下。

记得当的情景应该是提交sitemap时百度老提示有错误的URL,导致sitemap不能正常被抓取,于是在想办法解决这个问题,所以才有下面这些笔记:用shell批量找出网站空页面和404错误页面。

废话不多说,直接上shell代码:

复制代码 代码如下:

time cat sitemap.txt|while read line;do curl -l $line -m 5 --connect-timeout 5 -o /dev/null -s -w "$line "%{http_code}" "%{size_download}"\n";done

前面加了一个time是为了看看代码执行所花的时间

%{http_code}意思是返回HTTP状态码,通过这个状态码我们就能知道该链接是正常的200链接,还是404错误链接;

%{size_download}意思是返回当前页面的大小,如果值太小的话,说明这些页面很有可能是低质量的空页面,得想办法剔除掉。

标签:随州 延边 青岛 朝阳 通辽 西藏 南充 雅安

巨人网络通讯声明:本文标题《使用shell脚本找出网站的空页面和404错误页面》,本文关键词  使用,shell,脚本,找出,网,;如发现本文内容存在版权问题,烦请提供相关信息告之我们,我们将及时沟通与处理。本站内容系统采集于网络,涉及言论、版权与本站无关。
  • 相关文章
  • 下面列出与本文章《使用shell脚本找出网站的空页面和404错误页面》相关的同类信息!
  • 本页收集关于使用shell脚本找出网站的空页面和404错误页面的相关信息资讯供网民参考!
  • 推荐文章