惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

L
LangChain Blog
V
V2EX
爱范儿
爱范儿
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
Martin Fowler
Martin Fowler
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Apple Machine Learning Research
Apple Machine Learning Research
WordPress大学
WordPress大学
有赞技术团队
有赞技术团队
宝玉的分享
宝玉的分享
Last Week in AI
Last Week in AI
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
罗磊的独立博客
小众软件
小众软件
Vercel News
Vercel News
博客园 - 司徒正美
阮一峰的网络日志
阮一峰的网络日志
V
Visual Studio Blog
J
Java Code Geeks
P
Proofpoint News Feed
MongoDB | Blog
MongoDB | Blog
B
Blog
美团技术团队
量子位

V2EX

我用 AI 写代码,但终端管理反而成了累赘——于是我做了 codux [调研] 各位在公司都用什么 ide 和 agent 写代码? 老运维 share 一个运维平台 看到有公司考核 token 指标,很好奇大家上个月的 AI 账单是多少 GLM-Coding 调用持续报错: z.ai 的 Lite 套餐几乎无法使用,官方 Pro/Max 是否稳定? 现在还有什么渠道可以稳定安全地使用 Claude 吗? 上海漕河泾内推,本组有 2 个 hc,一个后端,一个前端,预算都是 20k 左右,不打卡,氛围好 如果 V2EX 上有一组不永久保存聊天记录(比如只保存 7 天或者 24 小时)的聊天室,那么会开启哪些有用或者有趣的可能? gemini cli 貌似挂了,一直返回 403 第一次在自媒体上赚到钱 收集了最近在使用的低价 GPT, Gemini,邮箱等 AI 会员的小店合集 讨论个大实话:现在企业还在说 AI 编程提效 20%, 30%的,真的太落后,没用懂 AI。因为包括很多前沿公司,已经狂奔到提效 200%-500%的情况 [招聘][远程][币安] 前端/后端/QA/iOS/Android 至少 3 年以上经验 目前有大量 HC 欢迎投递 Chatgpt Pro 用量用不完的可以开这些设置 面试的时候好像遇到钓鱼了,给各位避个坑 cursor 年续费 22 号到期, 自动续费是否还是老的计次套餐呢 被两件破事毁掉的一下午,琐碎的内耗消磨人的精力 使用 Planet 存储 Codex 的会话或者重要信息 如果业务部门领导不要你开发功能,而是要求你教会它用 claude code 开发功能,你会怎么做? 分享一个 MacOS 接绿联 CM818 USB 转 DP 转接器使用感受 我的 HR 朋友 10 年老 Java ,非全大专,大家帮忙看看简历 开源了一个 AI 口语练习工具,音素级发音评分,完全免费可自部署 V2EX 上有哪些你觉得很有趣、印象深刻的妹纸? 字节为啥不出个国内版 Vercel? 有在大马的朋友吗? 问个运营商问题 你们在有领导的公司大群发过的最大胆的消息是什么 公司裁员,目前没有工作。想试试摆摊,做一个移动鲜啤打酒车 我的硬盘 Memblaze Pblaze 5 Linux 下不识别,给 Linux 内核提交了补丁, AI 说有望被合并 只有我一个人觉得 codex 不好用?
[社招] [杭州] 蚂蚁集团-网络爬虫技术专家
GreatSword · 2026-03-16 · via V2EX

联系方式

邮箱: [email protected] Wechat:15382397794 ,备注应聘

亮点:

  • 搞数据的,支持 LLM&智能应用,数据是决定模型能力的水位核心要素,这块的积累长期看在都是非常有市场价值的。希望你有中、大型互联网工作经验,做过全网爬虫、搜索数据等更佳,对 ai 技术有好奇心和研究热情。
  • 团队稳定,氛围好。强度相对更平衡,合理健康。

职级:

视面试而定,P6/P7/P8 都可以。Package 可以聊,范围参考脉脉。

职位描述:

  1. 负责全网高价值互联网数据源发现,涵盖网页、PDF 、音视频等多模态来源,分析评估数据天花板,支持金融等核心领域数据全面覆盖;
  2. 负责全网数据采集相关系统架构设计和开发工作,持续优化提升数据任务和系统能力水位,充分支持模型训练、RAG 搜索等数据需求;
  3. 持续提升技术竞争力,在数据覆盖、数据时效、下载渲染成功率、采集成本方面做到行业领先水位;
  4. 保障系统稳定性,预判并解决系统潜在技术风险,持续降低技术负债。

职位要求:

  1. 精通数据采集/网络爬虫领域,具备解决全网爬虫核心问题实战经验,3 年以上大型互联网公司开发经验;
  2. 熟练掌握 Java/Python/Go 当中至少一种编程语言,具备主导复杂系统架构设计能力;
  3. 熟悉分布式架构和并发编程,熟悉业界主流大数据计算存储引擎 Spark/Flink/MaxCompute 等,具有数据密集型应用开发经验;
  4. 有运用 LLM 能力解决生产问题案例可加分,熟悉网络协议及代理、浏览器引擎和移动端技术可加分。