惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

C
Check Point Blog
宝玉的分享
宝玉的分享
V
Visual Studio Blog
B
Blog RSS Feed
G
Google Developers Blog
U
Unit 42
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
P
Palo Alto Networks Blog
月光博客
月光博客
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
L
LINUX DO - 最新话题
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
小众软件
小众软件
GbyAI
GbyAI
L
LangChain Blog
A
About on SuperTechFans
Attack and Defense Labs
Attack and Defense Labs
T
Tor Project blog
AWS News Blog
AWS News Blog
S
Security @ Cisco Blogs
H
Hacker News: Front Page
S
SegmentFault 最新的问题
Engineering at Meta
Engineering at Meta
The Register - Security
The Register - Security
Recorded Future
Recorded Future
D
Darknet – Hacking Tools, Hacker News & Cyber Security
Hacker News - Newest:
Hacker News - Newest: "LLM"
V2EX - 技术
V2EX - 技术
H
Heimdal Security Blog
Simon Willison's Weblog
Simon Willison's Weblog
Y
Y Combinator Blog
Spread Privacy
Spread Privacy
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
WordPress大学
WordPress大学
P
Privacy International News Feed
I
Intezer
W
WeLiveSecurity
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Help Net Security
Help Net Security
NISL@THU
NISL@THU
D
DataBreaches.Net
Stack Overflow Blog
Stack Overflow Blog
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
V
Vulnerabilities – Threatpost
N
News | PayPal Newsroom
Security Archives - TechRepublic
Security Archives - TechRepublic
Google DeepMind News
Google DeepMind News
The Hacker News
The Hacker News
L
Lohrmann on Cybersecurity
Schneier on Security
Schneier on Security

中文博客 on 范叶亮 | Leo Van

多智能体系统 (Multi-Agent System) 确定性和掌控欲 - 你的 AI 不是你的 AI LLM Token 消耗节省计划 (How to Save Token for LLM) 智能体的角色定位和身份演化 (Agent Role Orientation and Identity Evolution) 本地部署 OpenClaw,QwenPaw 和 Hermes Agent (Local Deployment of OpenClaw, QwenPaw and Hermes Agent) 本地部署智能体 - OpenClaw,QwenPaw,Hermes Agent ... 部署 Matrix 服务器 Synapse (Deployment of Matrix Server Synapse) 部署 frp 内网穿透服务 (Deployment of frp NAT Traversal Service) 本地部署大模型服务 (Local Deployment of LLM Services) AI 时代的生产力和生产关系 (Forces and Relations of Production in AI Era) 业余无线电入门 - CQ, CQ, CQ, this is BD1CZP. Calling CQ and standing by. 重构 - 之于代码、之于工作、之于生活 大语言模型微调 (Fine-tuning Large Language Models) 提升图片分辨率和质量 - Invoke AI 101 教程 使用画布创建和组合生成新的图片 - Invoke AI 101 教程 探索 AI 模型和概念适配器 - Invoke AI 101 教程 理解图像到图像和降噪过程 - Invoke AI 101 教程 使用控制层和指示控制图片的生成 - Invoke AI 101 教程 使用 Invoke 创作你的第一张图片 - Invoke AI 101 教程 在 OpenWrt 和群晖中自动申请和部署证书 凡人歌 - 凡人,但不要烦心 Shell 调用方式 fork,exec 和 source (Run Shell with fork, exec and source) 重定向和管道 (Redirect and Pipe) 模型压缩和推理加速 (Model Compression and Inference Acceleration) 我们需要多少种编程语言 (How Many Programming Languages do We Need) 数据可视化小贴士 - 面向动态文档生成,秉承规范、统一和实用的理念 从 rm -rf * 说起 - 喜新、怀旧、再出发 当我谈摄影时,我谈些什么 - 色彩篇 Part 1 CSS 布局和定位 (CSS Layout and Position) 当我谈修图时,我谈些什么 - 色彩篇 Part 1 在 Windows 下利用 WSL2 和 Ubuntu 配置 GPU 机器学习环境 文学编程和可重复性研究 (Literate Programming and Reproducible Research) 在 OpenWrt 中安装 Jellyfin 搭建家庭影音中心 自私和贪婪 (Selfish and Greedy) 评分和排名算法 (Rating & Ranking Algorithms) 小记这一波裁员浪潮 基于内容的图像检索 (Content-based Image Retrieval, CBIR) 你所应该知道的 A/B 测试 (A/B Test You Should Know) 一个人的摩旅 (Travel with My Motorcycle Alone) 设计语言初探 (A Glimpse of Design Language) Spark 集群搭建 (Spark Cluster Setup) Hive 安装和配置 (Hive Setup) Hadoop 集群搭建 (Hadoop Cluster Setup) 虚拟环境准备 (Virtual Environment Preparation) 大数据 SQL 性能调优 (Big Data SQL Performance Tuning) SQL 样式指南 (SQL Style Guide) 进程,线程和协程 (Process, Thread and Coroutine) - 实现篇 进程,线程和协程 (Process, Thread and Coroutine) - 理论篇 胶囊网络 (Capsule Network) 投票公平合理吗? 图存储与计算 (Network Storage and Computing) - 复杂网络系列 网络算法 (Network Algorithms) - 复杂网络系列 网络表示,测度和度量 (Network Representation, Measures and Metrics) - 复杂网络系列 文本相似度 (Text Similarity) 而立之前 (Life before 30) 最近邻搜索 (Nearest Neighbor Search) 无模型策略预测和控制 - 时序差分学习 (Model-Free Policy Prediction and Control - Temporal Difference Learning) - 强化学习系列 无模型策略预测和控制 - 蒙特卡洛方法 (Model-Free Policy Prediction and Control - Monte-Carlo Learning) - 强化学习系列 利用动态规划求解马尔可夫决策过程 (Planning by Dynamic Programming) - 强化学习系列 贝叶斯优化 (Bayesian Optimization) 马尔可夫决策过程 (Markov Decision Process) - 强化学习系列 多臂赌博机 (Multi-armed Bandit) - 强化学习系列 强化学习简介 (Introduction of Reinforcement Learning) - 强化学习系列 在群晖 NAS 上编译安装 tmux 隐马尔可夫,条件随机场和序列标注 (Hidden Markov Model, Conditional Random Fields and Sequence Labeling) 图嵌入和图神经网络 (Graph Embedding and Graph Neural Network) 预训练自然语言模型 (Pre-trained Models for NLP) toB 产品用户权限 (User Privileges of toB Products) 京东数科 HIPO 学习之旅 (JDD HIPO Learning Journey) 杭州和东京之旅 (Tour of Hangzhou and Tokyo) 国际智慧温室种植挑战赛 (International Autonomous Greenhouse Challenge) 记忆中的儿时 (My Childhood in Memory) 启发式算法 (Heuristic Algorithms) 关不掉的浏览器标签页 (Browser Tabs You do not Close) 贝塞尔曲线 (Bézier Curve) 如何阅读一本书 (How to Read a Book) 相似性和距离度量 (Similarity and Distance Measurement) 集成学习算法 (Ensemble Learning) 计算复杂性与动态规划 (Computational Complexity and Dynamic Programming) 利用 Flask 和 Google App Engine 部署模型服务 序列到序列和注意力机制 (Seq2Seq and Attention Machanism) 词向量 (Word Embeddings) 循环神经网络 (Recurrent Neural Network, RNN) 泰国之行 (Tour of Thailand) 媒介之战 (War of Medias) 卷积神经网络 (Convolutional Neural Network, CNN) 买书,囤书,看书 (Buy Books, Hoard Books and Read Books) Play Safe, Smart Choice & Yuppie 基于 PyQt5/PySide2 和 QML 的跨平台 GUI 程序开发 流形学习 (Manifold Learning) 深度学习优化算法 (Optimization Methods for Deep Learning) 深度学习优化算法 (Optimization Methods for Deeplearning) 生成对抗网络简介 (GAN Introduction) Ising 模型,Hopfield 网络和受限的玻尔兹曼机 (Ising, Hopfield and RBM) 马尔科夫链蒙特卡洛方法和吉布斯采样 (MCMC and Gibbs Sampling) 特征值分解,奇异值分解和主成分分析 (EVD, SVD and PCA) 墨尔本之行 (Trip to Melbourne)
真实世界网络结构 (Structure of Real-World Network) - 复杂网络系列
范叶亮 · 2020-11-28 · via 中文博客 on 范叶亮 | Leo Van

真实世界网络结构

Structure of Real-World Network

复杂网络系列

分类: 机器学习, 复杂网络 / 字数: 1746 / 标签: 复杂网络, 分支, Components, 弱连通分支, Weakly Connected Component, 强连通分支, Strongly Connected Component, 外向分支, In-component, 内向分支, Out-component, 领结图, Bow Tie Diagram, 小世界效应, Small-world Effect, 度分布, Degree Distribution, 度序列, Degree Sequence, 幂律, Power Law, 无标度网络, Scale-free Network, 聚类系数


本文为《复杂网络系列》文章
本文内容主要参考自:《网络科学引论》1

分支

在无向网络中,一个典型的现象是很多网络都有一个分支,该分支占据了网络的绝大部分,而剩余部分则被划分为大量的小分支,这些小分支之间彼此并不相连。如下图所示:

一个网络通常不能有两个或更多占据网络大部分的大分支。如果将一个 $n$ 个顶点的网络分解为两个分支,每个分支约为 $\dfrac{1}{2} n$ 个顶点,则两个分支的顶点之间会有 $\dfrac{1}{4} n^2$ 个顶点对,这些顶点对有可能一个顶点在一个大分支中,而另一个顶点在另外一个大分支中。如果在任何一个顶点对之间有一条边,那么这两个分支就会合并为一个分支。

有向图中分支分为两种:弱连通分支强连通分支。弱连通分支的定义与无向网络的分支定义类似,强连通分支是指网络顶点的一个最大子集,该子集中的顶点能够通过有向路径到达其余所有顶点,同时也能够通过有向路径从其余所有顶点到达。

每个连通分支拥有外向分支(即从强连通分支中的任意顶点出发,沿着有向路径能够到达的所有顶点的集合)和内向分支(即沿着有向路径能够到达强连通分支的所有顶点的集合)。利用**“领结”图**可以很好地刻画有向网络的总体情况,万维网的“领结”图如下所示:

小世界效应

小世界效应(small-world effect)是指对于大多数网络而言,网络顶点之间的测地距离都惊人的小,例如:六度分隔理论。网络的数学模型显示出网络测地路径长度的数量级通常与网络定点数 $n$ 成对数关系 ,即 $\log n$

度分布

顶点的度是指连接到它的边的数量。度分布(degree distribution)$p_k$ 是指网络中节点度的概率分布,也可以理解为从网络中随机选择一个顶点,其度为 $k$ 的概率。度序列(degree sequence)是指所有顶点度的集合。

根据度 $k$ 描述出大型网络的度分布有着非常重要的作用,下图给出了 Internet 的度分布:

现实世界中,几乎所有网络的度分布都有类似的由度较大的核心顶点构成的尾部,统计上称为右偏(right-skewed)的。

幂律和无标度网络

以 Internet 为例,下图给出了度分布的一个有趣特征,下图使用了对数标度重新绘制了上图的直方图:

如上图所示,对数处理后,分布大致遵循一条直线。度分布 $p_k$ 的对数与度 $k$ 的对数之间具有线性函数关系:

$$ \ln p_k = - \alpha \ln k + c $$

对两侧同时做指数运算,有:

$$ p_k = C k^{- \alpha} $$

其中,$C = e^c$ 是一个常数。这种形式的分布,即按照 $k$ 的幂变化,称为幂律(power law)。在不同类型的网络中,幂律度分布是普遍存在的,常数 $\alpha$ 是幂律的指数,该值的典型取值区间为 $2 \leq \alpha \leq 3$。通常,度分布并非在整个区间都遵循幂律分布,当 $k$ 较小时,度分布并不是单调的。具有幂律度分布的网络也称为无标度网络(scale-free network)。

观察幂律分布的另外一种方式是构建累积分布函数,定义如下:

$$ P_k = \sum_{k' = k}^{\infty} p_{k'} $$

假设度分布 $p_k$ 在尾部服从幂律,确切地讲,对于某个 $k_{\min}$,当 $k \geq k_{\min}$ 时有 $p_k = C k^{- \alpha}$,则对于 $k \geq k_{\min}$,有:

$$ P_{k}=C \sum_{k^{\prime}=k}^{\infty} k^{\prime-\alpha} \simeq C \int_{k}^{\infty} k^{\prime-\alpha} \mathrm{d} k^{\prime}=\frac{C}{\alpha-1} k^{-(\alpha-1)} $$

这里通过积分来近似求和是合理的,因为当 $k$ 值较大时,幂律函数的变化率较小。所以,如果度分布 $p_k$ 服从幂律,那么 $p_k$ 的累积分布函数也服从幂律。

聚类系数

聚类系数是度量某个顶点的两个邻居顶点也互为邻居的平均概率。该测度计算值与随机条件下得到的期望值之间有较大的差异,这种巨大差异可能也显示出了真正发挥作用的社会效应。在合作网络中,与随机选择合作者相比,实际的合作网络中包含更多的三角形结构。这种现象背后有很多原因,其中一个原因可能是人们会介绍其合作者认识,而这些合作者两两之间也开始进行合作。

随着度的增加,局部聚类系数不断减少,这种现象的一个可能的解释是顶点分成紧密的群组或社团,同一个群组内部的顶点之间连接较多。在表现出此类行为的网络中,属于小型群组的顶点的度较小,因为这种群组的成员也相对较少,但在较大的群组中的顶点的度较大。同时,小型群组中的顶点的局部聚类系数较高。出现这种情况是因为将每个群组与网络的其余部分隔离开之后,每个群组大体上相当于一个小型网络,较小的网络会有更大的聚类系数。当对不同规模的网络取平均之后,会发现度小的顶点具有较高的聚类系数,如下图所示: