以豆瓣为例,访问https://www.douban.com/contacts/list 来查看自己关注的人,要登录才能查看。

如果用requests.get()方法获取这个http,没登录只能抓取回一个登录界面,所以我们要用Python登录网站才能抓取想要的网页。

一个简便的方法就是自己在浏览器上登录好,然后通过下图方法(Chrome为例),找到自己的Cookie和User-Agent,然后发送request时用这复制来的header替换掉待发送的request以达到登录的目的,server端会凭这个认为你是已经登录的用户。

代码如下:

import requests

headers = {
'User-Agent':'Mozilla/5.0 (Macintosh; Intel Mac OS X 10_12_6) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/63.0.3239.108 Safari/537.36',
'Cookie':'gr_user_id=1f9ea7ea-462a-4a6f-9d55-156631fc6d45; bid=vPYpmmD30-k; ll="118282"; ue="codin; __utmz=30149280.1499577720.27.14.utmcsr=douban.com|utmccn=(referral)|utmcmd=referral|utmcct=/doulist/240962/; __utmv=30149280.3049; _vwo_uuid_v2=F04099A9dd; viewed="27607246_26356432"; ap=1; ps=y; push_noty_num=0; push_doumail_num=0; dbcl2="30496987:gZxPfTZW4y0"; ck=13ey; _pk_ref.100001.8cb4=%5B%22%22%2C%22%22%2C1515153574%2C%22https%3A%2F%2Fbook.douban.com%2Fmine%22%5D; __utma=30149280.833870293.1473539740.1514800523.1515153574.50; __utmc=30149280; _pk_id.100001.8cb4=255d8377ad92c57e.1473520329.20.1515153606.1514628010.'
} #替换成自己的cookie r = requests.get('https://www.douban.com/contacts/list', headers = headers)
print(r.text)

最新文章

  1. 入门级:怎么使用C#进行套接字编程(二)
  2. Export功能 导致 页面显示很多非法字符,还可能页面显示两次
  3. Spark系列(四)整体架构分析
  4. Bzoj-2190 仪仗队 欧拉函数
  5. 反射API
  6. BZOJ 3589 动态树 树链拆分+纳入和排除定理
  7. DES对称加密算法简析
  8. PHP数组笛卡尔积组合排列
  9. 长沙学院APP之校园模块设计
  10. Kubernetes Dashboard - 每天5分钟玩转 Docker 容器技术(173)
  11. vue父子组件之间互相获取data值&调用方法(非props)
  12. netperf
  13. Confluence 6 从 WIKI 标记整合到基于 XHTML 的存储格式
  14. Codeforces510 C. Fox And Names
  15. Tex_安装_在Ubuntu系统下
  16. Cygwin使用3-修改Cygwin的默认启动路径
  17. Linux 生产实习01
  18. sonarqube 5.6
  19. 对position的认知观
  20. IP、TCP和DNS与HTTP的密切关系

热门文章

  1. NYOJ-2359: 巴什博弈?
  2. upload 上传类
  3. 预防onion比特币勒索病毒,如何快速关闭135,137,138,139,445端口
  4. redis函数总结
  5. 关于PHP新手学习的一些指导与建议,新手快到我碗里来!
  6. 零基础学习Hadoop
  7. DDD峰会归来话DDD
  8. LDA数学八卦笔记(一)Gamma函数
  9. Java----list常用方法汇总
  10. 【微服务】之六:轻松搞定SpringCloud微服务-API网关zuul