IT人力外包人才简历库

返回列表

Python数据采集工程师

驻场外包人员
工作年限:3年 意向城市:北京 浏览:2次 发布时间:近期

技能标签

Python Django Flask Vue Scrapy Redis MySQL 异步编程 网络协议 数据采集 XPath解析 分布式爬虫 高并发处理 超时重试机制 Cookie管理 数据缓存

专业技能

后端开发:Django/Flask/Tornado框架;前端开发:Vue/React框架;数据存储:MySQL/Redis;开发工具:PyCharm/VSCode;网络协议:HTTP/TCP/IP/WebSocket;爬虫技术:Scrapy/asyncio/aiohttp;数据处理:XPath解析/PyMySQL;系统优化:异步编程/分布式架构

工作履历(脱敏处理)

深耕Python全栈开发领域,专注于数据采集与处理方向。主导设计并实现多套分布式爬虫系统,采用Scrapy框架结合Redis缓存机制,日均处理百万级数据量。开发异步爬虫架构,通过asyncio/aiohttp实现高并发请求,采用超时重试机制保障数据完整性,创新性使用Cookie管理策略应对反爬策略。精通MySQL数据库优化,设计合理索引结构提升数据查询效率。熟悉前端技术栈,能够实现前后端数据交互与可视化展示。具备良好的代码规范意识,注重系统稳定性与可维护性,成功交付多个企业级数据采集项目。

项目经验(脱敏处理)

1. HGMD数据采集系统:采用asyncio+aiohttp构建异步爬虫架构,通过超时重试机制保障数据完整性,创新性使用Cookie管理策略应对反爬策略,结合XPath解析技术实现数据结构化存储。2. 北京企业信用信息网采集:基于Scrapy框架开发分布式爬虫,通过XPath匹配信息块构建请求链,采用Redis缓存中间件实现数据分批次处理,最终通过PyMySQL完成MySQL数据库同步。3. 多源新闻数据采集:整合搜狐新闻/豆瓣/腾讯新闻网等多平台数据,设计统一数据采集框架,通过异步任务调度实现多源数据同步采集,采用分库分表策略优化数据存储性能。

驻场外包优势

服从性高

严格遵守甲方管理制度

技术扎实

3年项目实战经验

可长期驻场

接受异地项目外派

快速响应

24小时内可到岗

企业人才对接

专业IT人力外包服务

如果贵公司有IT项目人手缺口、需要工程师驻场开发、短期人力支援需求,欢迎联系洽谈合作。

合作热线

18969108718

商务邮箱

ntit@163.com

微信扫码咨询

微信咨询二维码

扫描二维码添加商务对接

立即申请人才对接