惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

B
Blog RSS Feed
J
Java Code Geeks
H
Help Net Security
Google DeepMind News
Google DeepMind News
博客园 - 司徒正美
Microsoft Security Blog
Microsoft Security Blog
宝玉的分享
宝玉的分享
Stack Overflow Blog
Stack Overflow Blog
D
DataBreaches.Net
The GitHub Blog
The GitHub Blog
S
SegmentFault 最新的问题
U
Unit 42
博客园 - 三生石上(FineUI控件)
Last Week in AI
Last Week in AI
M
MIT News - Artificial intelligence
WordPress大学
WordPress大学
小众软件
小众软件
博客园 - 叶小钗
D
Docker
量子位
P
Proofpoint News Feed
博客园_首页
T
Tailwind CSS Blog
F
Fortinet All Blogs

博客园 - Ready!

Next.js 开发指南 路由篇 | 动态路由、路由组、平行路由和拦截路由 Next.js 开发指南 路由篇 | App Router Next.js 开发指南 初始篇 | Next.js CLI 设计百万日活用户手游实时排行榜 windows下,chmod 444 .. 的等价操作:操作文件的【安全】属性,保留当前用户的读取和执行权限。 HBase Storage Layout 模拟死锁 3,turicreate入门 - 优化回归模型,使得预测更准确 2,turicreate入门 - 一个简单的回归模型 flink 配置 maven打包,带依赖jar python缓存所在目录 docker基础 yum安装 python3 flink 安装 分布式存储与传统数据库存储 nginx配置 - 反向代理,转发配置 解决nested exception is java.lang.NoClassDefFoundError: 问题的思路 JetBrains系列破解方法(以idea为主)
BDAS - Berkeley Data Analytics Stack
Ready! · 2021-03-04 · via 博客园 - Ready!

BDAS, the Berkeley Data Analytics Stack, is an open source software stack that integrates software components being built by the AMPLab to make sense of Big Data.

BDAS consists of the components shown below. Components shown in Blue or Green are available for download now. Click on a title to go that project’s homepage.

In-house Apps
Access and
Interfaces
Processing Engine
Storage
Resource Virtualization
  AMPLab Initiated     Spark Community     3rd Party     In Development

蓝色: AMPLab已发布 绿色: Spark社区已发布 灰色: 第三方已发布 黄色: 开发中

  • Mesos/Yarn 资源分配与管理。资源分配程度不同。Mesos仅提供资源,具体分配由计算框架自己负责;而Yarn全权负责资源的分配和调度管理。
  • HDFD 分布式文件系统
  • Alluxio 早期叫Tachyon,分布式内存存储系统。将Spark本身的内存管理功能独立出来,使得Spark专注于计算。计算与存储分离。 Succinct 内存管理优化。
  • Spark 计算。基于Resilient Distributed Datasets 弹性分布式数据集进行计算。包括:构建,转换(map, flatMap, filter, union ... ), 行动(count, top, reduce, foreach, saveAs...) (早期的Hadoop....只有MapReduce)
  • SparkSQL 使用SQL语法查询结构性的数据。使用统一的方式访问Hive、json、JDBC ...
  • Spark Streaming  高容错实时流数据处理框架。输入: Kafka, HDFS ...   输出: HDFS, Database, Dashboard ...   它的机制与Flink有些类似。
  • BlinkDB 近似计算。 容许用户在数据准确性和响应时间间平衡。
  • SampleClean 数据清洗
  • SparkR R语言的一个实现
  • GraphX 分布式图处理框架
  • Splash 随机学习算法并行计算框架
  • ML.. 机器学习
  • Velox 机器学习预测

posted @ 2021-03-04 14:24  Ready!  阅读(215)  评论()    收藏  举报