1 Star 0 Fork 0

shampoo6 / cjsf-20dsj1

加入 Gitee
与超过 1200万 开发者一起发现、参与优秀开源项目,私有仓库也完全免费 :)
免费加入
该仓库未声明开源许可证文件(LICENSE),使用请关注具体项目描述及其代码上游依赖。
克隆/下载
导入MapReduce结果到hive中.md 990 Bytes
一键复制 编辑 原始数据 按行查看 历史
shampoo6 提交于 2023-05-26 16:56 . update

导入MapReduce结果到hive中

显示表头

为了在 select 语句中看到表头信息,我们可以使用如下命令:

set hive.cli.print.header=true;

创建导入用的临时表

use hive;

# 临时表是不带id的表
CREATE TABLE tmp (
  name STRING,
  count INT
)
ROW FORMAT DELIMITED
FIELDS TERMINATED BY '\t'
LINES TERMINATED BY '\n'
NULL DEFINED AS '';

# 然后导入数据
# '/output/part-r-00000' 路径是 mapreduce 的结果文件
LOAD DATA INPATH '/output/part-r-00000' INTO TABLE tmp;

创建带id的结果表

# result 表包含 id 字段
CREATE TABLE result (
  id INT,
  name STRING,
  count INT
)
ROW FORMAT DELIMITED
FIELDS TERMINATED BY ','
LINES TERMINATED BY '\n';

# 拷贝 tmp 表到 result 表并添加行号为 id
INSERT INTO TABLE result
SELECT ROW_NUMBER() OVER (), name, count
FROM tmp;

# 查看结果
SELECT * FROM result;

善后

可以把 tmp 临时表删除掉

DROP TABLE tmp;
1
https://gitee.com/shampoo6/cjsf-20dsj1.git
git@gitee.com:shampoo6/cjsf-20dsj1.git
shampoo6
cjsf-20dsj1
cjsf-20dsj1
master

搜索帮助