先把一句话说清楚:Druid(阿里连接池):是JDBC 连接池,管的是“应用 ↔ 关系型数据库”的连接复用(MySQL/Oracle/PostgreSQL…)。Impala(Apache Impala):是大数据 MPP SQL 查询引擎,本身不是数据库、也不是连接池;它管的是“在 Hadoop 上跑快 SQL”。一、Impala 到底是什么?你可以把它理解成:Hadoop 世界里的“超快 Hive”。底层数据存在HDFS、HBase、Kudu,Impala 不存数据,只负责算。对外用SQL,语法和 Hive 几乎一样。架构是MPP(分布式并行),查询被拆成多段,多节点一起算,速度比 Hive 快很多(秒级/亚秒级)。二、Impala 和“多数据库”是什么关系?它不是用来“管理多个数据库连接”的,和 Druid 完全不是一类东西。1)Impala 能“连”哪些东西?