Warning: file_get_contents(http://tou.xincfx.com/x/pb.txt): Failed to open stream: HTTP request failed! HTTP/1.1 500 in /www/wwwroot/jobs.china3a.cn/vendor/composer/autoload_real.php on line 31
广州数据采集工程师(爬虫方向) - 外包人才简历详情 | 广州IT人力外包人才简历库

IT人力外包人才简历库

返回列表

数据采集工程师(爬虫方向)

驻场外包人员
工作年限:1年 意向城市:杭州 浏览:8次 发布时间:近期

技能标签

Python Scrapy MongoDB MySQL Selenium 数据清洗 ETL工具 爬虫开发 数据存储 前端基础 Vue框架 反爬策略 动态渲染 数据可视化 API接口调试

专业技能

熟练掌握Python编程语言,精通Scrapy框架进行网络爬虫开发,熟悉MongoDB与MySQL数据库的存储优化方案,掌握Selenium进行动态网页数据抓取,具备数据清洗与ETL处理能力,熟悉前端基础技术及Vue框架开发,了解分布式爬虫架构设计原理

工作履历(脱敏处理)

作为数据采集工程师实习生,主要负责构建自动化数据采集系统。开发房源数据采集系统,实现多源数据整合与清洗,日均处理数据量达5000+条。设计英雄联盟官网数据采集方案,通过Scrapy框架完成动态网页数据抓取,解决反爬机制问题。搭建双色球彩票数据采集系统,实现MySQL与MongoDB双数据库存储方案,优化数据查询性能。参与开发直播平台主播数据采集项目,使用Selenium处理动态内容加载,提升数据采集效率30%。

项目经验(脱敏处理)

英雄联盟官网数据采集系统:基于Scrapy框架开发,采用分布式爬虫架构处理反爬机制,通过Selenium处理动态渲染内容,实现英雄出场次数、KDA等12项数据采集,日均处理数据量达10万+条,数据存储至MySQL数据库,支持多维度数据查询分析。

双色球彩票数据采集平台:设计MySQL与MongoDB双存储方案,实现每期红蓝球号码采集,采用定时任务调度机制确保数据时效性,通过数据清洗模块提升存储效率,支持历史数据对比分析功能。

房源数据采集系统:开发基于Scrapy的房源信息采集系统,处理多源数据整合与清洗,建立标准化数据模型,日均处理数据量达5000+条,支持数据可视化展示,为房地产数据分析提供基础数据支持。

驻场外包优势

服从性高

严格遵守甲方管理制度

技术扎实

1年项目实战经验

可长期驻场

接受异地项目外派

快速响应

24小时内可到岗

企业人才对接

专业IT人力外包服务

如果贵公司有IT项目人手缺口、需要工程师驻场开发、短期人力支援需求,欢迎联系洽谈合作。

合作热线

18969108718

商务邮箱

ntit@163.com

微信扫码咨询

微信咨询二维码

扫描二维码添加商务对接

立即申请人才对接