hdfs_fdw
概览
| 扩展包名 | 版本 | 分类 | 许可证 | 语言 |
|---|---|---|---|---|
hdfs_fdw | 2.0.5 | FDW | PostgreSQL | C |
| ID | 扩展名 | Bin | Lib | Load | Create | Trust | Reloc | 模式 |
|---|---|---|---|---|---|---|---|---|
| 8740 | hdfs_fdw | 否 | 是 | 否 | 是 | 否 | 是 | - |
| 相关扩展 | aws_s3 duckdb_fdw kafka_fdw pg_clickhouse pg_parquet file_fdw pg_lake pg_bulkload pg_duckdb pg_ducklake |
|---|
Package/source version 2.3.3; SQL extension version 2.0.5. Live queries require a compatible Hive JDBC driver and Hadoop/Hive service.
版本
| 类型 | 仓库 | 版本 | PG 大版本 | 包名 | 依赖 |
|---|---|---|---|---|---|
| EXT | MIXED | 2.0.5 | 1817161514 | hdfs_fdw | - |
| RPM | PGDG | 2.3.3 | 1817161514 | hdfs_fdw_$v | - |
| DEB | PIGSTY | 2.3.3 | 1817161514 | postgresql-$v-hdfs-fdw | default-jre-headless |
构建
您可以使用 pig build 命令构建 hdfs_fdw 扩展的 DEB 包:
安装
您可以直接安装 hdfs_fdw 扩展包的预置二进制包,首先确保 PGDG 和 PIGSTY 仓库已经添加并启用:
使用 pig 或者是 apt/yum/dnf 安装扩展:
创建扩展:
用法
创建服务器
服务器选项: host(默认 localhost)、port(默认 10000)、client_type(hiveserver2 或 spark,默认 hiveserver2)、auth_type(NOSASL 或 LDAP)、connect_timeout(默认 300)、fetch_size(默认 10000)、log_remote_sql(默认 false)、use_remote_estimate(默认 false)、enable_join_pushdown(默认 true)、enable_aggregate_pushdown(默认 true)、enable_order_by_pushdown(默认 true)。
创建用户映射
对于 NOSASL 认证,完全省略 OPTIONS 子句。
创建外部表
表选项: dbname(默认 default)、table_name(默认为外部表名)、enable_join_pushdown、enable_aggregate_pushdown、enable_order_by_pushdown。
查询
Spark 示例
下推特性
hdfs_fdw 将 WHERE 子句、JOIN、聚合函数、ORDER BY 和 LIMIT/OFFSET 下推到远程 Hive/Spark 服务器。在会话级别控制下推: