Advertisement

presto的应用介绍

阅读量:

Presto定义与概述

Presto是一款开源的分布式查询处理系统,其运行基于内存架构,本身并不直接存储数据,而是能够对接多种数据来源,如Hive、Mysql、Kafka、MongoDB等。通过Presto执行的查询操作,可以实现对多个数据源的数据进行联合检索。Presto主要适用于OLAP场景,而非OLTP环境,因此不应将其视作传统数据库进行使用。

Presto性能优势分析

具备低延迟特性、支持高并发处理、采用纯内存计算架构的引擎,其查询效率较Hive提升了数十倍。

presto查询速度规模

从数G级别的规模扩展至数P级别的规模

Presto数据模型解析

整体架构划分为三个层级,即Catalog、Schema与Table

Catalog:代表数据来源,如Hive数据库或Mysql数据库等
Schema:对应数据库
Table:指代数据表

Presto架构解析

preso采用Master-Slave架构设计,其系统结构包含一个Coordinator节点、一个Discovery Server节点以及若干Worker节点。其中,Coordinator主要承担query的解析与分发工作,并对Worker节点及元数据进行统一管理。Discovery Server用于监控节点状态,其默认集成于Coordinator内

全部评论 (0)

还没有任何评论哟~