惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

U
Unit 42
A
About on SuperTechFans
J
Java Code Geeks
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Stack Overflow Blog
Stack Overflow Blog
Recent Announcements
Recent Announcements
GbyAI
GbyAI
F
Fortinet All Blogs
Blog — PlanetScale
Blog — PlanetScale
MongoDB | Blog
MongoDB | Blog
MyScale Blog
MyScale Blog
aimingoo的专栏
aimingoo的专栏
H
Help Net Security
月光博客
月光博客
博客园 - Franky
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Apple Machine Learning Research
Apple Machine Learning Research
The Cloudflare Blog
WordPress大学
WordPress大学
S
SegmentFault 最新的问题
T
Tailwind CSS Blog
Jina AI
Jina AI
有赞技术团队
有赞技术团队
博客园_首页

V2EX

我用 AI 写代码,但终端管理反而成了累赘——于是我做了 codux [调研] 各位在公司都用什么 ide 和 agent 写代码? 老运维 share 一个运维平台 看到有公司考核 token 指标,很好奇大家上个月的 AI 账单是多少 GLM-Coding 调用持续报错: z.ai 的 Lite 套餐几乎无法使用,官方 Pro/Max 是否稳定? 现在还有什么渠道可以稳定安全地使用 Claude 吗? 上海漕河泾内推,本组有 2 个 hc,一个后端,一个前端,预算都是 20k 左右,不打卡,氛围好 如果 V2EX 上有一组不永久保存聊天记录(比如只保存 7 天或者 24 小时)的聊天室,那么会开启哪些有用或者有趣的可能? gemini cli 貌似挂了,一直返回 403 第一次在自媒体上赚到钱 收集了最近在使用的低价 GPT, Gemini,邮箱等 AI 会员的小店合集 讨论个大实话:现在企业还在说 AI 编程提效 20%, 30%的,真的太落后,没用懂 AI。因为包括很多前沿公司,已经狂奔到提效 200%-500%的情况 [招聘][远程][币安] 前端/后端/QA/iOS/Android 至少 3 年以上经验 目前有大量 HC 欢迎投递 Chatgpt Pro 用量用不完的可以开这些设置 面试的时候好像遇到钓鱼了,给各位避个坑 cursor 年续费 22 号到期, 自动续费是否还是老的计次套餐呢 被两件破事毁掉的一下午,琐碎的内耗消磨人的精力 使用 Planet 存储 Codex 的会话或者重要信息 如果业务部门领导不要你开发功能,而是要求你教会它用 claude code 开发功能,你会怎么做? 分享一个 MacOS 接绿联 CM818 USB 转 DP 转接器使用感受 我的 HR 朋友 10 年老 Java ,非全大专,大家帮忙看看简历 开源了一个 AI 口语练习工具,音素级发音评分,完全免费可自部署 V2EX 上有哪些你觉得很有趣、印象深刻的妹纸? 字节为啥不出个国内版 Vercel? 有在大马的朋友吗? 问个运营商问题 你们在有领导的公司大群发过的最大胆的消息是什么 公司裁员,目前没有工作。想试试摆摊,做一个移动鲜啤打酒车 我的硬盘 Memblaze Pblaze 5 Linux 下不识别,给 Linux 内核提交了补丁, AI 说有望被合并 只有我一个人觉得 codex 不好用?
阿里云智能-AI 可观测高级研发工程师-杭州
mailto1587 · 2026-01-14 · via V2EX

[职位描述]

负责阿里集团、阿里云可观测平台建设,打造日增百 PB 级数据的实时数据分析平台。 通过实时采集、数据建模等技术,实时处理来自千万设备的海量可观测数据,并进行智能分析与洞察。加入该岗位,您将有机会在国内超大规模的可观测平台上,构建面向各类 AI 应用场景的 AIOps 平台,打造新一代的 AI 基础设施。

  1. 参与阿里云云监控数据链路建设,打造日吞吐 PB 级的高性能实时计算平台。负责海量监控指标与告警的采集、清洗、聚合与存储,保障秒级报警延迟与高可用性;
  2. 深度参与云监控 2.0 战略落地,构建指标、日志、链路深度融合的统一可观测数据底座。打破数据孤岛,设计基于 UModel 的资源关联建模,实现从基础设施到应用层的全链路诊断能力;
  3. 结合 AI/LLM 能力,研发新一代智能报警与根因分析引擎。针对 AI 训练集群等新场景,提供特定优化的监控解决方案,实现从“被动告警”到“主动预防”的跨越;
  4. 负责云监控采集探针( Agent )及云产品接入层的建设。拥抱开源生态,支持 Prometheus 、OpenTelemetry 等标准协议的无缝接入,打造多元、兼容的监控生态体系,,让云上百万企业能够零门槛接入并监控异构环境。

[职位要求]

  1. 扎实的算法基础和良好的编码习惯,精通 Go 、Python 、Java 、C++、Rust 中任何一门语言;
  2. 熟悉异步 IO 、内存管理、多线程同步等技术,有 Linux 内核研究经验更佳;
  3. 有分布式系统,包括调度、分布式锁、负载均衡等经验更佳;
  4. 对技术有强烈的进取心,有较强的学习能力,保持对前沿技术的关注和学习;
  5. 具有良好的沟通能力和团队合作精神、优秀的问题分析和解决能力。
  6. 熟悉 LLM 、Prompt 设计、Agent 框架(如 LangGraph 、Dify 、AutoGen 、Google ADK 、工具链集成等)者优先。
  7. 对 OpenTelemetry 、Neo4j 、Skywalking 、Datadog 、Sentry 、Clickhouse 源代码有深入研究者优先。
  8. 深入理解分布式系统原理,熟悉分布式存储、消息队列( Kafka/RocketMQ )、流式计算( Flink/Spark )等技术。有时序数据库研发或使用经验者优先。
  9. 熟悉 AWS CloudWatch, Datadog, Prometheus, Zabbix, OpenTelemetry 等监控系统架构者优先。
  10. 熟悉 LLM Agent 开发,以及有 AIOps 在运维场景落地经验者优先。

[联系方式]

  • 微信号:echo eGRhcnRodXIK | base64 -d
  • 工作邮箱:echo emh1eGlhZG9uZy56eGRAYWxpYmFiYS1pbmMuY29tCg== | base64 -d