python 版本: 2.7
本人能力:非程序员,有一点点喜欢 python ,想折腾一些数据采集之类的,以便今后转运营助理或者运营,方便数据记录、分析。
环境模拟:想要采集皮鞋第一页、第二页全部产品的标题、图片、价格等前端展现的内容,可能详情页也需要用代码做截图处理,可能需要采集正文和评价。
问题:淘宝里的 json 是非正常的,由于技术问题,先用 sub 替换了 jsonp232(),也不能正常解析。求前辈折腾一下。
json 地址:
https://s.taobao.com/api?_ksTS=1489731701469_231&callback=jsonp232&ajax=true&m=customized&rn=2e8936bb027bece89209046885ec042a&q=%E7%9A%AE%E9%9E%8B&imgfile=&js=1&stats_click=search_radio_all%3A1&initiative_id=staobaoz_20170317&ie=utf8&s=36&bcoffset=-3
python 不用处理就能正常 dumps 、 load 能解析的
淘宝 json
