惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Martin Fowler
Martin Fowler
大猫的无限游戏
大猫的无限游戏
J
Java Code Geeks
罗磊的独立博客
雷峰网
雷峰网
G
Google Developers Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
爱范儿
爱范儿
B
Blog RSS Feed
腾讯CDC
Apple Machine Learning Research
Apple Machine Learning Research
D
Docker
Recent Announcements
Recent Announcements
T
Tailwind CSS Blog
博客园 - 聂微东
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
Vercel News
Vercel News
小众软件
小众软件
人人都是产品经理
人人都是产品经理
云风的 BLOG
云风的 BLOG
IT之家
IT之家
Blog — PlanetScale
Blog — PlanetScale
I
InfoQ
S
SegmentFault 最新的问题

StudyingLover's Blog

Diffusion Policy笔记 rwkv笔记 act笔记 nanovllm-block_manager opencode多智能体 nanobot-pre-train nanobot-rl nanobot-sft nanobot-checkpoint_manager nanobot-gpt nanobot-mid-train Vision Mamba (Vim)笔记 BPE演示 最后一遍学习Transformer YOLOv5 目标检测笔记 下载根服务器解析记录 Dynaseal A Backend-Controlled LLM API Key Distribution Scheme with Constrained Invocation Parameters 判断链表有环 王道25数据结构勘误 关于perplexity的open-sourcing-r1-1776 AI为什么不像人类一样进行多轮对话 新博客改造日记和功能测试 linuxqq只显示登陆背景图 数字设计和计算机体系结构(机械工业出版社)勘误(自制) Dynaseal:面向未来端侧llm agent的llm api key分发机制 A Definitive Guide to Markdown Style This post is using MDX, Where you can embed JSX and Astro components RT-Patch学习 pydantic实现的LLM ReAct fastapi 和 uvicorn 设置监听 ipv6
基于Venn-Abers预测器的系统日志异常检测方法_顾兆军
About the Author StudyingLover · 2024-01-16 · via StudyingLover's Blog

基于Venn-Abers预测器的系统日志异常检测方法_顾兆军

收集日志信息、日志解析和日志的特征化提,包括收集日志信息、日志解析和日志的特征化提取。

每条日志都包含时间戳、日志优先级、系统组件和日志条目本身等信息的非结构化数据。日志解析会生成一个生成事件计数矩阵,每个日志事件模板对应一个标识符 block_id,用于日志异常检测模型推理。在事件计数矩阵中,将具有相同 block 的事件模板放在一行,即每一行代表一个块 block,将每一行的事件模板统计出次数,即每一列代表一种事件类型。(因为日志是非结构化的,这样子实际上就合并了不同事件的日志,将其变成一个矩阵用于推理). Xi,jX_{i,j} 单元格中的值记录事件 j 在块 i 上发生的次数。TF-IDF是信息检索中一种公认的启发式方法,它通常用作信息检索和文本挖掘中文档的特征表示。

日志异常检测部分是推理一个二分类问题,然后获取分类概率(论文这里说的很复杂,实际上就是做一个二分类然后给一个概率),接下来成对相邻违反者算法得到一个保序回归 函 数 f()f() 0 和 1 用于测试对象 xnx_n,s0=(z1,z2,⋯ ,zn−1,(xn,0))s_0 = (\begin{matrix}z_1,z_2,\cdots,z_{n-1,}&(x_n,0)\end{matrix})s0s_0评分函数,s1=(z1,z2⋯ ,zn−1,(xn,1))s_1 = (z_1,z_2 \cdots,z_{n-1,}(x_n,1))s1s_1的评分函数.模型输出(p0,p1)(\begin{matrix}p_0,p_1\\\end{matrix}),p0=f0(s0(x))p_{0}=f_{0}\left(s_{0}\left(x\right)\right) ,p1=f1(s1(x))p_{1}=f_{1}\left(s_{1}\left(x\right)\right)

运行效率优化 实验过程中,发现由训练集标签和训练集对象得到的保序回归序列分布过于密集,不符合预期。HDFS 记录的日志行为单一[18] 使不同特征向量之间的差异较小,特征向量高度相似或重复。对于重复的得分,将其标签 yiy_i 累积求和并取平均值作为该得分新的标签.

算法有效性评估是平方损失,评估指标是f1