北京汇创思拓数字科技有限公司 · 河北分公司
- 基于影刀 RPA 构建电商数据自动化采集平台,面向抖音电商生态,批量采集达人、商品及短视频内容数据。
- 覆盖粉丝量、带货能力、销售数据、互动率等多维度核心指标,搭建标准化的数据采集链路。
- 设计并优化自动化流程,攻克登录鉴权、分页遍历、动态渲染与详情页解析等关键环节,提升采集效率、降低人工干预。
- 完成数据清洗、去重与结构化落库(ETL),支撑运营选品、达人筛选与市场分析,显著提升数据获取效率与业务决策能力。
$ py-resume --init# 正在加载候选人档案 ...✓ 已加载身份信息 姓名="邱鑫宇"✓ 已加载岗位定位 目标="Python 爬虫工程师 / 数据采集工程师"✓ 已加载经验数据 年限=1.5 年经历=3 段✓ 核心亮点:百度 · 解析准确率 88%→97% · 动态覆盖率 +35pp $ cat ./profile.json | jq '.focus'"爬虫 · 数据采集 · 数据工程"
软件工程本科,1 年+ Python 爬虫与数据采集经验,曾任职百度从事移动端抓取与收录研发。擅长从 HTTP 爬虫到 Headless Chrome 渲染爬虫的架构演进,熟悉数据采集、清洗、存储到可视化的完整链路。
基于 Java 的 AI 应用开发项目,依托 Spring Boot + Spring AI 对接大模型,结合 RAG 检索增强与 PgVector 向量数据库,通过接口调用、POI 文档解析获取简历与面试知识库数据,循环批量处理业务数据,最终打包生成 PDF / TXT 格式面试评测文档。
基于前端技术构建的商务数据可视化平台,部署于 Cloudflare Pages,面向商务运营团队。通过数据清洗、格式转换与多维度计算,将 Excel 原始商务数据转化为直观的可视化仪表盘,支持多时间段数据展示与品牌 / 达人 / 商务排行分析。
基于 Python 的数据抓取与分析脚本,通过访问艺恩娱数提供的 API 接口获取中国大陆电影票房排行榜数据,随后进行清洗、统计与可视化,直观展示票房年度占比与变化趋势。
// 深入理解 HTTP 协议,熟练模拟浏览器行为(Cookies、Headers);熟练运用 requests、urllib、PySpider 进行网络请求;掌握 BeautifulSoup、正则表达式等数据解析技术;具备 Java 调试、Maven 环境搭建及 Spring Boot 项目经验。
数据结构、Java、Python、数据库原理、软件测试技术、Web 企业级开发、Linux 系统、计算机组成原理
高级软件工程师 · Web 安全渗透测试 · 鸿蒙 OpenHarmony 人才认证
担任志愿者协会实践部部长,多次组织校园志愿活动并完成校外对接,获「优秀志愿者」荣誉证书。