Hive SQL 日常工作使用总结

开发者福利!热门AI工具限时免费用 购周边即赠Coding Plan Lite,Claude Code、Cursor等20+工具畅享,效率翻倍! 阅读详情

写写日常在使用Hive SQL做分析时经常使用的一些函数或者方法


like

  • like用于指定特定的字符串,或结合正则做模糊匹配
select uid from dw.today where tunittype like '%wew.%'
  • rlike是hive中对like的扩展,将原先多个like才能完成的任务,使用一个rlike就可以搞定。
select uid from dw.today where tunittype rlike '.*(you|me).*'

点号(.):表示和任意字符串匹配,星号(*):表示重复“左边的字符串”,(x|y)表示和x或者y匹配

  • 对like取反
    一般,like的语法形式是: A LIKE B,取反的语法形式:NOT A LIKE B
select uid from dw.today where not tunittype like '%wew.%'

时间区间

工作中,需要查询某个区间的用户量,这个时候就需要对时间做处理,以便快速搞定

  • 30分钟作为一个区间段
SELECT DISTINCT FROM_UNIXTIME(60*30*CAST(UNIX_TIMESTAMP("2017-11-11 13:23:23")/(60*30) AS BIGINT), 'yyyy-MM-dd HH:mm:ss')
FROM test_table

这里便将时间转化为13:00:00,记录的是13:00:00至13:30:00这段时间的数据量

  • 10分钟作为一个区间段
SELECT DISTINCT FROM_UNIXTIME(60*10*CAST(UNIX_TIMESTAMP("2017-11-11 13:23:23")/(60*10) AS BIGINT), 'yyyy-MM-dd HH:mm:ss')
FROM test_table

总结:一个小时60分钟,一分钟60秒,按照时间单位的秒来转化为相应的区间

排序

  • oder by

  • 得到rank

语法形式:

row_number() over (partition by 字段 a order by 计算项 b desc ) rank

rank 排序的名称;partition by:类似 hive 的建表,分区的意思;order by :排序,默认是升序,加 desc 降序;这里按字段 a 分区,对计算项 b 进行降序排序

例子:
https://blog.csdn.net/jobschen/art

HiveSQL常见函数及使用方法(含代码示例) HiveSQLHive SQL)是Apache Hive使用SQL方言,专门用于在Hadoop上进行大规模数据处理。 阅读详情

相关推荐

Spark-SQL连接Hive 的五种方法

Spark-SQL连接Hive 的五种方法

qq_53114527的博客 5174

hive实验报告.docx

完成Hive工具的安装和配置 Hive工具能够正常启动运行 Hive控制台命令能够正常使用 够正常操作数据库,表,数据

Hive SQL语句操作

本实验任务主要完成基于Hive环境执行一些常用的Hive SQL语句操作,通过完成本实验任务,要求学生熟练掌握Hive SQL的常用语句,掌握Hive的基础和操作。掌握Hive的数据类型   掌握hive的数据类型的使用   掌握hive的DDL语句的操作本次环境是:Ubuntu16.04+hadoop-2.7.3.+apache-hive-1.2.2-bin数据量巨大且保存时间长; 在大量数据上进行复杂的批量运算; 数据在计算之前已经完全到位,不会发生变化; 能够方便的查询批量计算的结果; 不像在线计算当

需要远程指导仿真实验、代码有问题的,请后台私信或者关注公众号 2728

HiveSQL详细和优化

HiveSQL详细和优化,以及部分个人点评 This is a brief tutorial that provides an introduction on how to use Apache Hive HiveQL with Hadoop Distributed File System. This tutorial can be your first step towards becoming a successful Hadoop Developer with Hive.

hive like 和正则 效率_[知识讲解篇-20]Hive的几种like详解

最近公司使用hive sql 的情况较多,也碰到了不少hive sqlhive 调优相关的问题,本篇文章分享一下个人对 hive like 的理解like使用详解语法规则:格式是 A like B,其中A是字符串,B是表达式,表示能否用B去完全匹配A的内容,换句话说能否用B这个表达式去表示A的全部内容,注意这个和rlike是有区别的。返回的结果是True/False.B只能使用简单匹配符号 ...

weixin_30477489的博客 2131

Hive中rlike,like,not like,regexp区别与使用详解

1.like使用详解 1.语法规则: 格式是A like B,其中A是字符串,B是表达式,表示能否用B去完全匹配A的内容,换句话说能否用B这个表达式去表示A的全部内容,注意这个和rlike是有区别的。返回的结果是True/False. B只能使用简单匹配符号_和%,”_”表示任意单个字符,字符”%”表示任意数量的字符 like的匹配是按字符逐一匹配的,使用B从A的第一个字符开始匹配,所...

涤生大数据 18万+

大数据学习之HiveSQL

HiveSQL

weixin_48205015的博客 3008

HIVE相关操作

HIVE有两种启动方式。

Kilig___的博客 931

hive常用操作

1. 文件导入到hdfs 从本地/tmp/path下拷贝文件上传到hive表test中的CHINA分区中。 LOAD DATA LOCAL INPATH '/tmp/path/' OVERWRITE INTO TABLE test PARTITION (country='CHINA') 2. hive -f 带参数 ⭐️注意⭐️:使用hive -e 查询时,查询结果是写入不了hive表中的......

硅谷工具人 148

HIVE- SPARK

日常记录备忘 Hive修改字段类型之后(varchar->string)Hive可以查到数据,Presto查询报错; 分区字段数据类型和表结构字段类型不一样; spark-sql分区表和非分区表兼容问题, 不能关联 可以建临时表把分区数据导入,用完数据将表删除; count有数据,select没数据 可能是压缩格式所导致; 优化合全量任务,之前是row_number()函数 先插入当天增量,取出最新的数据插入全量表 改成:昨日增量+ (loan_id前天全量中不在昨天增量中的)建议用

weixin_44367066的博客 742

Flink SQL操作Hudi并同步Hive使用总结

记录总结自己第一次如何使用Flink SQL读写Hudi并同步Hive,以及遇到的问题及解决过程。关于Flink SQL客户端如何使用可以参考:Flink SQL 客户端查询Hive配置及问题解决Flink 1.14.3 Hudi 0.12.0/0.12.1本文采用Flink yarn-session模式,不会的可以参考之前的文章。下载地址:https://repo1.maven.org/maven2/org/apache/hudi/hudi-flink1.14-bundle/0.12.1/hudi-fli

主要分享大数据相关的知识,如Spark、Hudi 7800

一文学完所有的Hive SQL(两万字最全详解)

Hive SQL 大全本文基本涵盖了Hive日常使用的所有SQL,因为SQL太多,所以将SQL进行了如下分类:一、DDL语句(数据定义语句):对数据库的操作:包含创建、修改数据库对数据表的操作:分为内部表及外部表,分区表和分桶表二、DQL语句(数据查询语句):单表查询、关联查询hive函数:包含聚合函数,条件函数,日期函数,字符串函数等行转列及列转行:lateral view 与 explode ...

大数据星球-浪尖 1万+

HiveHive架构及工作原理】

本文介绍了Hive的基本概念、架构和工作原理。Hive是构建在Hadoop之上的数据分析工具,将SQL转换为MapReduce程序,主要用于海量结构化数据的离线处理。文章详细分析了Hive的优缺点,与数据库的差异,以及其核心架构组件。Hive通过元数据存储实现数据映射,由Driver完成SQL解析、编译优化和执行流程,最终在YARN集群上运行计算任务。文章还探讨了Hive的安全性设计、客户端连接方式以及生产环境中的元数据存储方案。Hive适用于日志分析、离线数仓等大数据处理场景,是数据仓库领域的重要工具。

yang_xs的博客(只讲干货) 1536

Hive日常工作常用语句

** Hive日常工作常用语句 ** 1、分区别没有数据写入空分区 alter table 表名 add if not exists partition(pt=’${hiveconf:runDt}’); 举例: ALTER TABLE dw_zhangxin.dw_newuser_source_detail_d_incr_flag add if not exists partition(pt=‘2022-03-15’); ...

life is short,I love data analysis的博客 2468

Hive进阶】-- Hive SQL、Spark SQLHive on Spark SQL

Hive由Facebook开发,用于解决海量结构化日志的数据统计,于2008年贡献给 Apache 基金会。Hive是基于Hadoop的数据仓库工具,可以将结构化数据映射为一张表,提供类似SQL语句查询功能本质:将Hive SQL转化成MapReduce程序。Spark SQL主要用于结构型数据处理,它的前身为Shark,在Spark 1.3.0版本后才成长为正式版,可以彻底摆脱之前Shark必须依赖HIVE的局面。

欢迎来到我的博客,一起探索代码里的世界! 3889

IDEA中使用Spark SQL 连接Hive

IDEA中使用Spark SQL 连接HiveSpark SQL命令行模式是可以直接连接Hive的,Hive的安装和mysql作为metastore配置可以参考文章。将hive-site.xml复制到Spark-Home/conf目录下即可。但是通常我们需要使用IDEA开发调试程序,在IDEA中连接Hive有些需要注意的地方,这里记录一下,折腾了一下午。1. 复制hive-site.xml将Spar

炼剑 2万+

6Hive Sql 大全

本节基本涵盖了Hive日常使用的所有SQL,因为SQL太多,所以将SQL进行了如下分类:一、DDL语句(数据定义语句):对数据库的操作:包含创建、修改数据库对数据表的操作:分为内部表及外部表,分区表和分桶表二、DQL语句(数据查询语句):单表查询、关联查询hive函数:包含聚合函数,条件函数,日期函数,字符串函数等行转列及列转行:lateral view 与 explode 以及 reflect窗口函数与分析函数其他一些窗口函数。

qq_45972323的博客 1409

Spark SQL读取Hive数据配置及使用Thrift JDBC/ODBC Server访问Spark SQL

[TOC] Spark SQL可以读取hive中的数据,开启Thrift JDBC/ODBC Server服务可以使其他语言客户端使用Spark SQL.关于Spark SQL中对hive的支持,官方文档说明让人疑惑,好像没有把hive编译进去,需要自己手动编译,官方文档提及: Spark SQL also supports reading and writing data stored in

Fang的博客 1万+
上一篇: Scrapy爬虫自学笔记(一)
下一篇: HIVE窗口函数
茁壮小草
博客等级 码龄11年 374粉丝 185原创
评论 1
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值