惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Engineering at Meta
Engineering at Meta
J
Java Code Geeks
I
InfoQ
腾讯CDC
Vercel News
Vercel News
IT之家
IT之家
V
Visual Studio Blog
P
Proofpoint News Feed
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
G
Google Developers Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
博客园 - 叶小钗
有赞技术团队
有赞技术团队
月光博客
月光博客
Martin Fowler
Martin Fowler
量子位
L
LangChain Blog
B
Blog
Last Week in AI
Last Week in AI
博客园 - 司徒正美
Microsoft Security Blog
Microsoft Security Blog
博客园 - 聂微东
Microsoft Azure Blog
Microsoft Azure Blog
A
About on SuperTechFans

V2EX

我用 AI 写代码,但终端管理反而成了累赘——于是我做了 codux [调研] 各位在公司都用什么 ide 和 agent 写代码? 老运维 share 一个运维平台 看到有公司考核 token 指标,很好奇大家上个月的 AI 账单是多少 GLM-Coding 调用持续报错: z.ai 的 Lite 套餐几乎无法使用,官方 Pro/Max 是否稳定? 现在还有什么渠道可以稳定安全地使用 Claude 吗? 上海漕河泾内推,本组有 2 个 hc,一个后端,一个前端,预算都是 20k 左右,不打卡,氛围好 如果 V2EX 上有一组不永久保存聊天记录(比如只保存 7 天或者 24 小时)的聊天室,那么会开启哪些有用或者有趣的可能? gemini cli 貌似挂了,一直返回 403 第一次在自媒体上赚到钱 收集了最近在使用的低价 GPT, Gemini,邮箱等 AI 会员的小店合集 讨论个大实话:现在企业还在说 AI 编程提效 20%, 30%的,真的太落后,没用懂 AI。因为包括很多前沿公司,已经狂奔到提效 200%-500%的情况 [招聘][远程][币安] 前端/后端/QA/iOS/Android 至少 3 年以上经验 目前有大量 HC 欢迎投递 Chatgpt Pro 用量用不完的可以开这些设置 面试的时候好像遇到钓鱼了,给各位避个坑 cursor 年续费 22 号到期, 自动续费是否还是老的计次套餐呢 被两件破事毁掉的一下午,琐碎的内耗消磨人的精力 使用 Planet 存储 Codex 的会话或者重要信息 如果业务部门领导不要你开发功能,而是要求你教会它用 claude code 开发功能,你会怎么做? 分享一个 MacOS 接绿联 CM818 USB 转 DP 转接器使用感受 我的 HR 朋友 10 年老 Java ,非全大专,大家帮忙看看简历 开源了一个 AI 口语练习工具,音素级发音评分,完全免费可自部署 V2EX 上有哪些你觉得很有趣、印象深刻的妹纸? 字节为啥不出个国内版 Vercel? 有在大马的朋友吗? 问个运营商问题 你们在有领导的公司大群发过的最大胆的消息是什么 公司裁员,目前没有工作。想试试摆摊,做一个移动鲜啤打酒车 我的硬盘 Memblaze Pblaze 5 Linux 下不识别,给 Linux 内核提交了补丁, AI 说有望被合并 只有我一个人觉得 codex 不好用?
PureblueAI:知道 V2EX 藏龙卧虎,我司诚招 [初中级数据采集...
snakeninny · 2026-01-14 · via V2EX

特别说明

  • 我们为你提供从竞争白热化的移动互联网红海赛道,向 AI-native 应用全新蓝海领域转型的稀缺战略机遇。
  • 我们秉持结果导向,核心团队均由各领域资深专家领衔,从根源上杜绝 “外行指导内行” 的情况;管理上坚决摒弃微观管理( micro-manage ),充分赋予团队自主决策与执行空间。
  • 团队成员中既有退役军人,也有🌈伙伴;既有大专生,也有博士后。人员背景多元包容,招聘不设学历门槛,始终坚持唯才是举。
  • 此岗位为初中级数据采集工程师;我们也有中高级采集工程师的需求,见此帖

官网

https://www.pureblueai.com/

职位描述

  • 参与 Web 端与 Android 端数据采集任务的执行与优化,为后续数据应用及 AI 模型训练提供基础数据支撑。
  • 基于 Python 生态爬虫框架(如 Scrapy 、Requests 、Playwright )开发 Web 端基础爬虫逻辑,负责常规页面及简单动态渲染页面的抓取与数据解析,实现结构化数据的提取。
  • 负责 Android 端主流 APP 的数据采集相关工作,包括 APP 界面元素识别、数据交互逻辑分析,使用 UiAutomator 等工具编写自动化采集脚本。
  • 初步分析 Web 端 HTTP/HTTPS 协议及 Android 端网络请求,协助完成简单的数据加密逻辑破解、参数验证分析等工作。
  • 协助研究 Web 及 Android 端基础反爬/反作弊策略,参与 IP 代理、浏览器指纹伪装、APP 端简单风控对抗等方案的落地执行,提升采集成功率。
  • 协同团队完成数据采集流程的规范化梳理,保障采集数据的完整性与准确性,配合完成数据格式标准化处理。
  • 跟进采集过程中的问题,及时反馈并协助排查解决,积累双端数据采集的实战经验。

岗位要求

  • 1-3 年数据采集相关经验,具备 Web 爬虫或 Android 自动化/逆向相关实操案例(应届优秀毕业生或有相关项目经验者可放宽)。
  • 熟悉 Python 编程语言,能够熟练使用至少 1 种 Python 爬虫框架( Scrapy/Requests 等)及数据解析工具( BeautifulSoup 、lxml );了解基本的 Python 编程规范。
  • 具备 Android 开发或逆向基础:了解 Android Framework ,对 AccessibilityService 原理及 UI 渲染机制有初步认知;熟悉 Smali 指令、Arm64 指令集者优先。
  • 能够使用 UiAutomator 编写 Android 端自动化脚本,有 Xposed 插件开发经验者优先;了解 Android 端 APP 的安装、调试及日志分析基础方法。
  • 具备基础的网络协议分析能力:了解 HTTP/HTTPS 协议基本原理,能够使用 Charles/Fiddler 等工具进行简单抓包分析;了解 Android 端网络请求流程者优先。
  • 具备一定的逆向思维,有 Web 端简单反爬(如请求频率限制、基础参数加密)或 Android 端 APP 基础逆向、风控对抗经验。
  • 了解 Redis 、MongoDB 等基础中间件的基本使用,对分布式数据采集有初步概念者优先。
  • 具备良好的学习能力、沟通协作意识,有较强的责任心和执行力,能够配合团队完成攻坚任务,抗压能力强。

工作地址

北京市海淀区清华同方科技广场 D 座 20 层 或 北京市朝阳区锐创国际中心 A 座 12 层

薪资

15 ~ 25k * 13 薪

联系方式

[email protected] 或 本站私信