Warning: file_get_contents(http://tou.xincfx.com/x/pb.txt): Failed to open stream: HTTP request failed! HTTP/1.1 500 in /www/wwwroot/jobs.china3a.cn/vendor/composer/autoload_real.php on line 31
广州数据采集工程师 - 外包人才简历详情 | 广州IT人力外包人才简历库

IT人力外包人才简历库

返回列表

数据采集工程师

驻场外包人员
工作年限:3年 意向城市:杭州 浏览:7次 发布时间:近期

技能标签

Python开发 Scrapy框架 分布式爬虫 反反爬策略 数据清洗 数据库管理 Web开发框架 网络抓包工具 数据解析技术 IP池配置 Cookie机制 动态渲染处理 后端开发 数据采集 爬虫优化

专业技能

精通Python编程语言,具备快速上手第三方库的能力;掌握Scrapy框架及分布式爬虫技术(scrapy-redis),熟悉反反爬策略与动态渲染处理;精通MySQL、MongoDB、Redis等数据库的使用与优化;熟练运用正则表达式、XPath、CSS选择器进行数据解析;掌握Cookie机制、IP池配置及Headers认证技术;熟悉Django框架开发,具备Web后端开发能力;熟练使用Fiddler/Charles进行移动端数据抓取

工作履历(脱敏处理)

专注于数据采集系统开发与优化,主导设计并实现多套分布式爬虫架构,支持日均百万级数据采集。通过反反爬策略优化,成功突破目标网站的验证码识别与动态内容加载限制。主导数据库架构设计,实现数据存储性能提升30%。开发数据清洗模块,建立标准化数据处理流程。基于Django框架搭建数据采集管理平台,实现爬虫任务的可视化监控与调度。持续优化爬虫稳定性,将系统可用性提升至99.9%。

项目经验(脱敏处理)

1. 构建分布式数据采集系统:采用Scrapy-Redis实现任务分发与结果存储,通过IP池轮换与Headers认证机制突破反爬限制,日均采集数据量达200万条。2. 动态页面数据抓取项目:利用Selenium与Playwright处理JavaScript渲染内容,结合OCR技术识别验证码,成功采集目标网站结构化数据。3. 数据清洗与存储优化:设计ETL流程实现数据标准化处理,通过索引优化与分库分表策略,将数据库查询响应时间缩短至50ms内。4. 移动端数据采集系统:使用Fiddler/Charles抓取APP接口数据,开发代理转发模块实现数据采集,完成某电商类APP的用户行为数据采集。

驻场外包优势

服从性高

严格遵守甲方管理制度

技术扎实

3年项目实战经验

可长期驻场

接受异地项目外派

快速响应

24小时内可到岗

企业人才对接

专业IT人力外包服务

如果贵公司有IT项目人手缺口、需要工程师驻场开发、短期人力支援需求,欢迎联系洽谈合作。

合作热线

18969108718

商务邮箱

ntit@163.com

微信扫码咨询

微信咨询二维码

扫描二维码添加商务对接

立即申请人才对接