比如现在有个URL:
https://twitter.com/#!/sutar/status/170814521433276416我使用Python的urllib2库进行抓取,设定了Cookie和UA信息。
由于该页面载入的时候twitter使用了跳转,所以用urlopen读取的页面不是所需要的页面,而是一个提示登录的页面。估计是twitter为了防止采集所采取的方式吧。
可是现在的确需要抓取该页面的信息,请问我该怎么做呢?
目前对于跳转的页面完全没思路啊,看response的信息也看不到门道。。求助!
这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。
https://www.v2ex.com/t/28993
V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。
V2EX is a community of developers, designers and creative people.