• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >云计算 > Apache Flink简介,apacheflink简介

Apache Flink简介,apacheflink简介

作者:网友 字体:[增加 减小] 来源:互联网

本文主要包含apache flink,flink,flink平台,flink是什么意思,dede:flink等服务器相关知识,网友希望可以进行参考

Apache Flink简介,apacheflink简介


Apache Flink简介


Apache Flink是一个可伸缩的开源批处理和流处理平台。其核心模块是一个数据流引擎,该引擎在分布式的流数据处理的基础上提供数据分发、交流、以及容错的功能,其架构图如下:

apache flink 架构图

该引擎包含如下APIs:
1. DataSet API for static data embedded in Java, Scala, and Python
2. DataStream API for unbounded streams embedded in Java and Scala, and
3. Table API with a SQL-like expression language embedded in Java and Scala.

Flink也包含了一些其他领域的组件:
1.Machine Learning library
2.Gelly, a graph processing API and library

Flink系统概览

Flink支持java和scala语言的数据处理API,有一个优化的分布式运行自定义内存管理。

Flink系统概览

Flink特点

1、Fast,Flink在运行时利用内存数据流和集成迭代处理,这样对于数据密集型计算和迭代计算变的很快

Flink Fast

grep
2、高可靠性和高伸缩性。Flink包含自己的内存管理组件,序列化组件和type inference组件。

3、优雅美观的API设计

workcount scala示例

case class Word (word: String, frequency: Int)
val counts = text
.flatMap {line => line.split(" ").map(
word => Word(word,1))}
.groupBy("word").sum("frequency"

Closure代码示例

case class Path (from: Long, to: Long)
val tc = edges.iterate(10) { paths: DataSet[Path] =>
    val next = paths
    .join(edges).where("to").equalTo("from") {
    (path, edge) => Path(path.from, edge.to)
    }
    .union(paths).distinct()
    next
}

4、可兼容Hadoop,可在YARN上运行

参考

Apache Flink

分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • Apache Flink简介,apacheflink简介

相关文章

  • 启动Hive的时候有很多WARN和INFO信息,hivewarninfo信息
  • Hadoop之——Partitioner编程,hadooppartitioner
  • 机器学习算法-K-means聚类,算法-k-means聚类
  • openstack中nova组件Hypervisors、Floating_ips的所有python API 汇总,openstackpython
  • -bash:jps:command not found,-bashjps
  • 你真的了解OpenStack吗?学过的人,都知道!,了解openstack
  • Spark Core and Cluster Managers(翻译自Learning.Spark.Lightning-Fast.Big.Data.Analysis),
  • Spark的日志配置,Spark日志配置
  • 通过 Web Service 调用Pentaho BI 的API,pentahobi
  • hive sql,hive

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • chinapub读书会第4期:企业级大数据应用与实践,chinapub读书会
    • Twitter发布新的大数据实时分析系统Heron,
    • 深入理解Scala 标识符,命名和域,深入理解scala
    • 联想台式机启天m4350 启用intel vt-x,m4350vt-x
    • Spark jar包找不到解决方法,sparkjar
    • ElasticSearch的分布式安装
    • Centos 安装R 集成 Hadoop、RHive 配置安装手册,centoshadoop
    • 深度学习工具caffe详细安装指南,深度caffe安装指南
    • CMDBuild安装及webservice接口的获取,cmdbuildwebservice
    • 首届中国大数据技术沙龙会议邀请函,首届沙龙

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有