IT人力外包人才简历库

返回列表

Python开发工程师(爬虫方向)

驻场外包人员
工作年限:3年 意向城市:北京 浏览:1次 发布时间:近期

技能标签

Scrapy Scrapy-Redis Django Flask MySQL Redis MongoDB Elasticsearch PostgreSQL 网络爬虫 分布式爬虫 数据采集 数据存储 Python开发 反爬策略

专业技能

熟练掌握Scrapy框架及Scrapy-Redis分布式爬虫技术,具备大规模网络数据采集能力;精通requests、re、xpath等网络请求模块,擅长网页信息抽取与数据解析;熟悉Python多线程/多进程并发编程技术;掌握Django/Flask后端开发框架,具备RESTful API设计能力;精通MySQL数据库优化及Redis缓存应用,熟悉MongoDB、Elasticsearch、PostgreSQL等非关系型数据库;具备网络爬虫反反爬策略设计能力,熟悉IP代理池构建与分布式任务调度

工作履历(脱敏处理)

作为核心开发工程师主导多个企业级数据采集系统建设,负责爬虫架构设计与核心模块开发。主导构建分布式新闻舆情采集系统,实现微信公众号、新浪新闻等多源数据实时抓取,日均处理数据量达50万条。设计电商网站数据采集方案,完成淘宝、京东等平台商品信息抓取,数据准确率达99.2%。开发工商信息采集系统,实现企业注册信息自动提取与存储,提升数据处理效率40%。优化二手车信息采集流程,通过动态渲染技术解决前端加密数据解析难题,数据采集效率提升60%。

项目经验(脱敏处理)

1. 构建分布式新闻舆情采集系统,采用Scrapy-Redis实现多节点任务分发,日均处理50万条新闻数据,支持微信公众号、新浪新闻等多源数据实时抓取。2. 开发电商网站数据采集平台,通过动态渲染技术解决淘宝、京东等平台前端加密数据解析难题,实现商品信息自动抓取与存储。3. 设计工商信息采集系统,利用IP代理池和反反爬策略实现企业注册信息自动提取,数据准确率达99.2%。4. 开发二手车信息采集系统,通过分布式任务调度技术处理房天下、链家等平台数据,数据采集效率提升60%。5. 构建IP地址解析系统,基于URL特征识别网站IP地址,实现网络流量分析与异常检测功能。

驻场外包优势

服从性高

严格遵守甲方管理制度

技术扎实

3年项目实战经验

可长期驻场

接受异地项目外派

快速响应

24小时内可到岗

企业人才对接

专业IT人力外包服务

如果贵公司有IT项目人手缺口、需要工程师驻场开发、短期人力支援需求,欢迎联系洽谈合作。

合作热线

18969108718

商务邮箱

ntit@163.com

微信扫码咨询

微信咨询二维码

扫描二维码添加商务对接

立即申请人才对接