IT人力外包人才简历库

返回列表

数据采集工程师

驻场外包人员
工作年限:8年 意向城市:北京 浏览:7次 发布时间:近期

技能标签

Python 网络爬虫 Scrapy 分布式爬虫 多线程/多进程 HTML解析 XPath CSS选择器 浏览器自动化 Selenium Playwright 数据采集系统 实时监控 数据清洗 ETL工具

专业技能

精通Python编程语言,熟悉Requests、Urllib3等HTTP客户端库,具备高并发网络请求处理能力。熟练掌握Scrapy框架,能够构建分布式爬虫架构,支持多线程/多进程并发采集。精通HTML/XML解析技术,熟练使用BeautifulSoup、lxml进行数据提取,擅长XPath与CSS选择器精准定位目标字段。具备浏览器自动化能力,熟练运用Selenium、Playwright模拟浏览器行为,攻克JS动态渲染、异步Ajax加载、登录态验证等复杂页面的数据采集难题。

工作履历(脱敏处理)

8年IT行业经验,专注于网络爬虫开发与数据采集系统建设。主导多个电商平台数据采集项目,设计并实现分布式爬虫架构,支持高并发数据采集,日均处理数据量达百万级。精通Scrapy、Selenium、Playwright等工具,能够应对JS动态渲染、异步Ajax加载等复杂场景,优化数据采集效率。熟悉数据清洗与ETL流程,具备从数据采集到存储分析的全链路开发能力。擅长技术方案设计与团队协作,成功交付多个高可用性数据采集系统,助力企业提升市场分析与决策效率。

项目经验(脱敏处理)

为满足企业市场调研与竞品分析需求,设计并搭建多电商平台商品数据实时采集与分析系统,覆盖10万+SKU的价格、销量、库存等关键指标。采用Scrapy框架构建分布式爬虫架构,支持多线程/多进程并发采集,日均处理数据量达百万级。针对JS动态渲染页面,结合Selenium与Playwright实现浏览器自动化,攻克异步Ajax加载及登录态验证等技术难点。通过XPath与CSS选择器精准提取目标字段,结合数据清洗与ETL工具完成结构化存储,最终实现数据实时监控与可视化分析,助力企业提升市场决策效率。

驻场外包优势

服从性高

严格遵守甲方管理制度

技术扎实

8年项目实战经验

可长期驻场

接受异地项目外派

快速响应

24小时内可到岗

企业人才对接

专业IT人力外包服务

如果贵公司有IT项目人手缺口、需要工程师驻场开发、短期人力支援需求,欢迎联系洽谈合作。

合作热线

18969108718

商务邮箱

ntit@163.com

微信扫码咨询

微信咨询二维码

扫描二维码添加商务对接

立即申请人才对接