Powershell 简单爬虫示例 附,爬知乎示例 加代理
2016-12-11 11:30
1626 查看
<#
Powershell 调用.Net实现爬虫
同样调用.Net可以实现更多的功能,比如写数据库,发邮件等
#>
$request=[System.Net.WebRequest]::Create('https://www.zhihu.com/question/53415194')
#建立一个请求。也可以用webclient这个类
$proxy=[System.Net.WebProxy]::new()
#创建代理
$proxy.Address="http://xxxxxxx.com:8080"
#代理地址
$proxy.Credentials=[System.Net.NetworkCredential]::new("User","Passwd")
#代理的账户密码
$request.Proxy=$proxy
#让请求使用代理
$response=$request.GetResponse()
#接受回复
$stream=$response.GetResponseStream()
#获取回复的数据
$enc=[System.Text.ASCIIEncoding]::GetEncoding("utf-8")
#定义对数据的编码
$en_stream=[System.IO.StreamReader]::new($stream,$enc)
#对数据进行编码
$data=$en_stream.ReadToEnd()
#$data
#获取编码后的数据
#以上部分开头加上param([Parameter(Mandatory=$True)]此处应有回车[string]$URL)打包一下就是个极简的网页代码获取
$rex="<title>`n*(.*?)`n*</title>"
#定义正则
$data -match $rex
#正则匹配
$result=$Matches[1] #>C:\Users\kai\Desktop\2.txt
#获得结果。结果中的True 当输出的时候是不存在的。
$result
Powershell 调用.Net实现爬虫
同样调用.Net可以实现更多的功能,比如写数据库,发邮件等
#>
$request=[System.Net.WebRequest]::Create('https://www.zhihu.com/question/53415194')
#建立一个请求。也可以用webclient这个类
$proxy=[System.Net.WebProxy]::new()
#创建代理
$proxy.Address="http://xxxxxxx.com:8080"
#代理地址
$proxy.Credentials=[System.Net.NetworkCredential]::new("User","Passwd")
#代理的账户密码
$request.Proxy=$proxy
#让请求使用代理
$response=$request.GetResponse()
#接受回复
$stream=$response.GetResponseStream()
#获取回复的数据
$enc=[System.Text.ASCIIEncoding]::GetEncoding("utf-8")
#定义对数据的编码
$en_stream=[System.IO.StreamReader]::new($stream,$enc)
#对数据进行编码
$data=$en_stream.ReadToEnd()
#$data
#获取编码后的数据
#以上部分开头加上param([Parameter(Mandatory=$True)]此处应有回车[string]$URL)打包一下就是个极简的网页代码获取
$rex="<title>`n*(.*?)`n*</title>"
#定义正则
$data -match $rex
#正则匹配
$result=$Matches[1] #>C:\Users\kai\Desktop\2.txt
#获得结果。结果中的True 当输出的时候是不存在的。
$result
相关文章推荐
- python简单爬虫(下载知乎图片示例)
- java动态代理设计模式简单示例
- [Python]第八课笔记 简单代理爬虫
- java简单的动态代理示例
- 一个抓取知乎页面图片的简单爬虫
- 一个简单网络爬虫示例
- 最简单的代理示例
- Python爬虫设置代理IP爬取知乎图片
- Python中使用urllib2模块编写爬虫的简单上手示例
- 使用Python的Scrapy框架编写web爬虫的简单示例
- python简单爬虫示例
- 简单网络爬虫代码示例
- DAO代理工厂方法与数据库表持久化POJO操作简单示例
- 爬虫技术 -- 进阶学习(七)简单爬虫抓取示例(附c#代码)
- python 爬虫的简单示例
- 利用动态代理实现AOP的简单示例(JDK和cglib分别实现)
- 最简单的C#代理 示例
- Go语言 简单的爬虫示例(2)——编码转换
- Python中使用urllib2模块编写爬虫的简单上手示例
- Python入门简单的静态网页爬虫3.0 (爬虫的示例代码)