主页 > 国内 >

赌神

特朗普被判有罪成定局?民众压倒性支持定罪!_我的网站

古墓丽影

一 |     

     阿里云优惠券 先领券再下单        前面有写过一篇瀑布流的采集方法,今天在添加一个POST方法来采集Ajax刷新页面的教程。

二 |     

近期一项民意调查揭示了美国民众对前总统特朗普在纽约封口费案中所面临重罪指控的普遍态度,结果显示近三分之二的受访者认为特朗普将难逃法律制裁。    之前的文章请看:火车头采集动态加载Ajax数据(无分页瀑布流网站)    如果遇到POST方法来架子Ajax数据,这和我之前写的是两个类型,瀑布流是直接刷新出数据的页面。

三 |

《今日美国》与萨福克大学合作开展的最新民调显示,高达65%的美国民众预测特朗普将在涉及34项重罪指控的审判中,至少因部分指控被定罪。

四 | 该案件围绕其被控企图通过向成人片女星支付封口费并篡改商业记录以干预2016年大选的指控展开。尽管特朗普矢口否认所有指控,指称此为带有政治目的的“猎巫行动”,但公众的看法似乎并不站在他这一边。

五 |

调查中,仅23%的受访者,主要是特朗普的忠实支持者,坚信他会获判无罪,同时批评审判过程不公。
在特朗普的核心支持群体中,即他的“让美国再次伟大”(MAGA) 粉丝中,意见出现了分裂:44%的人预测会有至少部分罪名成立,而43%的人则坚信他能全身而退,免于任何罪责。
相比之下,现任总统乔·拜登的支持者们立场鲜明,86%的人认为特朗普会在封口费案中被至少判定一项罪名成立,而持相反意见的仅有7%。    采集网站分析    采集任何一个新站前我们都要对他进行一番分析才好下手。

六 |     列表页分析    这个网站的列表页,前面并不是通过Ajax加载的。CTRL+U可以直接看到列表内容,通过浏览器也看不到相关请求地址。    

    因为习惯原因,我直接看了下尾页列表页。
综合来看,民意调查数据描绘了这样的预期分布:15%的人认为特朗普会因所有指控被定罪,50%的人预测部分定罪,而23%的人则认为他能免于任何罪名。
然而,最终裁决权握在听取证词的12位陪审员手中,特朗普本人则亲自出席了曼哈顿的庭审。

七 |

特朗普对审判表示反对,指责是拜登及其纽约民主党同僚炮制的“虚假”指控。然后顺手CTRL+U看看网站代码结构有没有大的变化。防止后期采集出错。

八 | 他还因违反法庭禁令,发表可能影响陪审团的煽动性言论,被法官胡安·梅尔坎裁定蔑视法庭。梅尔坎近期警告,如特朗普再次违规,将面临监禁风险。结果就发现无法看到列表内容。浏览器可以看到一个通过post请求的地址。    

    这时候就意识到这网站列表页可能后面的应该全是通过Ajax加载的。
对于审判公正性的看法,调查参与者中44%认为不公,39%则认为公正,独立选民在此问题上则呈现37%对37%的均势。    通过笨方法,手动访问页面看看Ajax加载大概是哪些。最后找到大概从2200页左右开始Ajax加载。    那我们采集的时候,前面的列表页就可以使用普通方式去采集(速度更快)。    2200页开始到尾页就通过post请求Ajax页面数据。    抓包获取Post数据    这个Ajax地址我在浏览器看不到任何跟页码有关的数据。
即便是那些预测特朗普将被定罪的人群中,也有一部分担忧这可能会反向助力特朗普的政治生涯,激发其支持者的斗志。最后只能使用抓包工具看一下详细的请求内容了。    
    使用抓包工具Fiddler    Fiddler下载地址:OneDrive-Fiddler-Setup_v5.0.20204.45441.zip    安装设置完成后我们打开浏览器。一位来自纽约的76岁民主党人斯蒂芬·东布罗夫斯基对《今日美国》表示:“这只会让他的支持者更加团结,他们会把这看作是对特朗普的迫害,进而更加坚定地支持他。重新访问一下采集页面,Fiddler会抓到很多请求地址。    查看分析Post数据    Ctrl+F 我们搜索那个Ajax地址    
火车头使用Post方法采集Ajax页面教程
    Fiddler会以黄色将搜索到的结果显示出来,我们点击一下他。

九 |     

火车头使用Post方法采集Ajax页面教程
    在Fiddler右侧会显示这个请求地址的相关详细信息。我不认为这会让他失去任何支持。”
本次民调通过电话访问了1000名注册选民,时间为4月30日至5月3日,抽样误差约为正负3.1个百分点。    
    信息顶部可以看到是post请求方法。
。    可以看到有我们请求的页码相关内容。    
    访问不同页码的页面,经过研究发现规律。    
    currentPageIndex的值和页码相关,值等于页码减一。我们访问6139页时,currentPageIndex值是6138。    这就找到了规律,我们打开火车头采集器。    火车头采集器配置分页设置    起始网址填入Ajax请求地址    
    点“高级模式”。    
    点“分页设置”,http请求方式“post”。    
    把我们Fiddler抓包获取的内容填进去。    
    将currentPageIndex值的内容替换成火车头采集器的“分页”标签。    
    下面填入页码。    页面地址是从2200到6140,上面我们分析得出post请求内容的currentPageIndex值是实际页码减一。

十 | 所以这里面我们填2199到6139.    

    网址获取选项设置    为了筛选出我们需要的内容,我们设置一下网址获取选项。    打开浏览器F12开发工具,预览一下Ajax获取的内容。    
    可以看到链接的形式是    自考成考报名条件有哪些?    完整的链接地址是    https://域名/chengrenzikao/20200611152022.html    那我们就可以使用下面的规则提取地址。    
    我们测试一下网址采集。    测试网址采集    点击测试可能提示“post请求必须选择网页编码”我们在火车头其他设置中将编码选为“UTF8”即可。

十一 |     

    可以看到已经正确获取到了链接。

十二 | 不放心可以复制链接实际访问一下看看是否正确。    

    注意事项    采集过程注意运行线程和请求间隔时间。教程在测试时因为开的线程较多,频率过高导致对方网站开启了防CC设置。拉黑了我一个服务器IP,此教程写完用了两台服务器。    我们实际采集可以只开1个线程,并设置合适的间隔时间,比如1000ms到1500ms左右。

十三 |     本文来自2号站长网,转载请注明出处:https://www.zz2zz.com/331414.html

        
    

申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!。

Current article:http://wd1b.diuhuairandaikaomangshangnen.buzz/81zv/ukd1n.html

Published on:00:00:00


相关文章
推荐图文
最热文章