hive查询任务出现no reduce operator错误解决办法
·
1 分钟阅读
·
大数据
在执行简单的SELECT LIMIT查询时,可能会遇到”Number of reduce tasks is set to 0 since there’s no reduce operator”的错误。解决方法是配置Hive的fetch任务转换参数。
执行下列命令来设置参数:
hive (default)> set hive.fetch.task.conversion=more;
然后重新执行查询:
hive (default)> select regexp_extract(src_ip,'(\\d+\\.\\d+)\\.(\\d+\\.\\d+)',1) from
u_wsd.t_sd_beacon_term_ip_port_new_raw limit 2;
设置此参数后,简单的查询(如只有SELECT和LIMIT的操作)会直接从HDFS读取数据,而不需要经过reduce阶段。
#hadoop
相关文章
-
大数据技术生态的全景解读。从存储(HDFS)、计算(MapReduce/Spark/Tez)、查询(Hive/Impala)、学习(Mahout)多角度讲解技术栈及演进路线。
大数据 · 19 分钟阅读
-
基于 Spark 构建的文本情感分析系统实现。从数据预处理、特征提取、模型训练到分类预测的完整流程,使用 Naïve Bayes 和 SVM 算法。
大数据 · 28 分钟阅读
-
MongoDB 与 Spark 的完整大数据解决方案。包括 Spark 生态系统架构、MongoDB vs HDFS 对比、Spark-MongoDB 连接器、实时运价系统案例。
大数据 · 25 分钟阅读
-
在数据处理工厂中遇到的常见问题和解决方法记录,涉及空值过滤、粘贴操作陷阱、LEFT JOIN条件使用和任务重跑等问题。
大数据 · 4 分钟阅读