Warning: file_get_contents(http://tou.xincfx.com/x/pb.txt): Failed to open stream: HTTP request failed! HTTP/1.1 404 Not Found in /www/wwwroot/jobs.china3a.cn/vendor/composer/autoload_real.php on line 31
广州Python数据采集工程师 - 外包人才简历详情 | 广州IT人力外包人才简历库

IT人力外包人才简历库

返回列表

Python数据采集工程师

驻场外包人员
工作年限:5年 意向城市:北京 浏览:6次 发布时间:近期

技能标签

Python开发 爬虫开发 分布式爬虫 异步IO Scrapy框架 前端技术 HTML解析 JavaScript逆向 网络抓包 数据清洗 反爬机制 自动化脚本 多类型数据处理 分布式架构 网络协议分析

专业技能

精通Python编程语言,具备3年爬虫开发经验,熟练掌握异步IO编程及分布式爬虫架构设计。精通HTML/CSS/JavaScript前端开发技术,熟悉Scrapy、Apache Nutch等主流爬虫框架。擅长处理反爬机制,具备网页端和APP逆向分析能力。熟练使用Fiddler、Mitmproxy等抓包工具进行网络数据拦截与分析,可处理文字、图片、视频等多类型数据采集。熟悉自动化脚本开发及数据清洗流程。

工作履历(脱敏处理)

专注于数据采集系统开发与维护,主导设计并实现多个分布式爬虫架构,支持日均百万级数据抓取。开发自动化数据采集工具,解决动态渲染内容反爬问题,提升数据采集效率300%。设计并优化前端解析模块,兼容主流网页结构及移动端APP逆向分析。构建标准化数据清洗流程,提升数据可用性至98%以上。持续改进爬虫框架性能,支持横向扩展至百节点集群。

项目经验(脱敏处理)

淘宝天猫商品详情采集:设计分布式爬虫架构,处理文字/图片/视频多类型数据,采用动态渲染内容解析技术突破反爬机制,日均采集商品数据50万条。

美团商品信息采集:构建异步爬虫系统,优化请求频率控制策略,解决动态加载内容采集难题,实现商品信息完整率99.2%。

小红书笔记采集:开发逆向分析工具,破解加密请求参数,实现笔记内容及评论数据全量采集,支持百万级数据日均处理。

微信小程序数据采集:设计自动化录入系统,集成抓包工具分析请求参数,实现小程序数据结构化采集,提升数据采集效率40%。

住房管理系统自动化填表:开发网页自动填表工具,实现表单数据智能识别与填充,降低人工操作成本70%,提升数据录入准确率至99.5%。

驻场外包优势

服从性高

严格遵守甲方管理制度

技术扎实

5年项目实战经验

可长期驻场

接受异地项目外派

快速响应

24小时内可到岗

企业人才对接

专业IT人力外包服务

如果贵公司有IT项目人手缺口、需要工程师驻场开发、短期人力支援需求,欢迎联系洽谈合作。

合作热线

18969108718

商务邮箱

ntit@163.com

微信扫码咨询

微信咨询二维码

扫描二维码添加商务对接

立即申请人才对接