惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

aimingoo的专栏
aimingoo的专栏
B
Blog RSS Feed
Recent Announcements
Recent Announcements
Vercel News
Vercel News
M
MIT News - Artificial intelligence
阮一峰的网络日志
阮一峰的网络日志
L
LangChain Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Microsoft Security Blog
Microsoft Security Blog
H
Help Net Security
T
The Blog of Author Tim Ferriss
Y
Y Combinator Blog
G
Google Developers Blog
罗磊的独立博客
爱范儿
爱范儿
宝玉的分享
宝玉的分享
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园_首页
S
SegmentFault 最新的问题
WordPress大学
WordPress大学
月光博客
月光博客
人人都是产品经理
人人都是产品经理
Apple Machine Learning Research
Apple Machine Learning Research

博客园 - Ready!

Next.js 开发指南 路由篇 | 动态路由、路由组、平行路由和拦截路由 Next.js 开发指南 路由篇 | App Router Next.js 开发指南 初始篇 | Next.js CLI 设计百万日活用户手游实时排行榜 windows下,chmod 444 .. 的等价操作:操作文件的【安全】属性,保留当前用户的读取和执行权限。 HBase Storage Layout 模拟死锁 3,turicreate入门 - 优化回归模型,使得预测更准确 2,turicreate入门 - 一个简单的回归模型 flink 配置 maven打包,带依赖jar python缓存所在目录 docker基础 yum安装 python3 flink 安装 分布式存储与传统数据库存储 nginx配置 - 反向代理,转发配置 解决nested exception is java.lang.NoClassDefFoundError: 问题的思路 JetBrains系列破解方法(以idea为主)
BDAS - Berkeley Data Analytics Stack
Ready! · 2021-03-04 · via 博客园 - Ready!

BDAS, the Berkeley Data Analytics Stack, is an open source software stack that integrates software components being built by the AMPLab to make sense of Big Data.

BDAS consists of the components shown below. Components shown in Blue or Green are available for download now. Click on a title to go that project’s homepage.

In-house Apps
Access and
Interfaces
Processing Engine
Storage
Resource Virtualization
  AMPLab Initiated     Spark Community     3rd Party     In Development

蓝色: AMPLab已发布 绿色: Spark社区已发布 灰色: 第三方已发布 黄色: 开发中

  • Mesos/Yarn 资源分配与管理。资源分配程度不同。Mesos仅提供资源,具体分配由计算框架自己负责;而Yarn全权负责资源的分配和调度管理。
  • HDFD 分布式文件系统
  • Alluxio 早期叫Tachyon,分布式内存存储系统。将Spark本身的内存管理功能独立出来,使得Spark专注于计算。计算与存储分离。 Succinct 内存管理优化。
  • Spark 计算。基于Resilient Distributed Datasets 弹性分布式数据集进行计算。包括:构建,转换(map, flatMap, filter, union ... ), 行动(count, top, reduce, foreach, saveAs...) (早期的Hadoop....只有MapReduce)
  • SparkSQL 使用SQL语法查询结构性的数据。使用统一的方式访问Hive、json、JDBC ...
  • Spark Streaming  高容错实时流数据处理框架。输入: Kafka, HDFS ...   输出: HDFS, Database, Dashboard ...   它的机制与Flink有些类似。
  • BlinkDB 近似计算。 容许用户在数据准确性和响应时间间平衡。
  • SampleClean 数据清洗
  • SparkR R语言的一个实现
  • GraphX 分布式图处理框架
  • Splash 随机学习算法并行计算框架
  • ML.. 机器学习
  • Velox 机器学习预测

posted @ 2021-03-04 14:24  Ready!  阅读(215)  评论()    收藏  举报