百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术教程 > 正文

数仓|HQL隐藏错误的坑,你遇到过吗?

csdh11 2025-03-26 11:12 28 浏览

主要描述了几种书写SQL时常见的一些隐藏错误,主要包括:在运算符中使用null值、在聚合数据时使用null值、求平均值时使用判断条件、滤条件中使用and和or、查询的列字段之间缺少逗号分隔、inner join与left join

都是一些比较细节的点,希望本文对你有所帮助。

在SQL中常见的运算符有算术运算符(+,-),逻辑运算符(in,not in),比较运算符(>,<)等等。但是,如果参与运算的数据中存在null值,这个时候我们就要小心了,因为对于null值参与的运算可能会返回null值

  • 情况1:与null值列相加

比如有如下表:



当我们对每行的列字段相加时,会出现null

SELECT
    Jan + Feb + Mar as total_amount -- 结果为null
FROM stores
WHERE store = 1

比如:

SELECT 100 + null + 190; -- 结果为null

其实,我们计算的时候希望null值变为0,但是SQL并没有帮我们转换,所以遇到这种存在null值的情况,要加以小心,我们可以通过判断进行处理,比如:

SELECT 100 + coalesce(null,0) + 190; -- 结果为290
  • 情况2:not in 操作

比如有如下表:



当我们使用下面语句进行查询时:

SELECT
     *
FROM scores
WHERE tag not in ("优")

结果输出为:



其实对于id=3的数据,也应该出现在结果里,但是没有出现,是因为null判断之后返回null值,比如:

select null not in ("tag1","tag2"); -- 返回null值
select coalesce(null,"") not in ("tag1","tag2"); -- 返回true

所以避免上述情况发生,需要使用判断进行处理,比如如果为NULL值,则取值空字符串。

一般使用聚合函数时,需要特别注意聚合的字段是否包含null值。当然,如果是求和,比如sum,应该不会有所影响,因为null值不参与求和。但是,在我们求平均值的时候,需要格外注意null值,看下面的例子:



当我们对amount求平均时:

SELECT
    avg(amount) as avg_amount
FROM orders

上面的结果会是什么呢?是150还是100呢?答案是:(150+150)/2=150,这个数据显示不是正确的,因为忽略了一行数据,解决上述问题我们可以使用判断当为null值时,取值0,,比如:

SELECT
    avg(coalesce(amount,0)) as avg_amount
FROM orders
-- 结果为(150+150+0)/3=100

求平均值时使用判断条件

还有一种情况是,当我们使用条件判断进行求平均值时,也要加以小心,稍不留神就会得到错误的结果,看下面的例子:如下表



当我们使用条件判断,求平均值时:

SELECT
avg(if(status = 1,amount,0)) as avg_complete_amount
FROM orders

猜一下上面的结果会是什么呢?100还是150呢?答案是100,这个结果显然不是我们想要的,因为status=1的数据只有两行,正确结果应该是:(150+150)/2=150.

那么怎么才能得到上面的结果呢?因为null值不参与计算,所以我们可以通过判断,当不满足条件时,取null值即可,SQL如下:下面SQL的判断是:if(status = 1,amount,null),这样就可以输出正确结果150了。

SELECT
avg(if(status = 1,amount,null)) as avg_complete_amount
FROM orders

滤条件中使用and和or

当我们使用一个复杂的条件语句时,很容易犯一个运算符优先级的错误。其中最为常见的就是:当编写SQL时,and先于or进行处理

比如有下面的表:



当我们要查询,用户等级rating为A或者B时,并且amount大于100的数据时:

SELECT
    *
FROM
    user_amount
WHERE rating = "A" OR rating = "B" AND amount > 100;

上面的结果会输出:

1       A       50 
4       A       150
5       B       126

很显然结果是错误的,这是什么原因的,细心的你会发现,由于AND条件的优先级高于OR,所以上面的SQL语句会先筛选条件为rating = "B" AND amount > 100的数据,然后在筛选条件为**rating = "A"**的数据。解决上面的问题只需要加一个括号,区分一下优先级即可。如下:

SELECT
*
FROM
user_amount
WHERE (rating = "A" OR rating = "B") AND amount > 100;
-- 结果为:
4       A       150
5       B       126

查询的列字段之间缺少逗号分隔

如果不细心,会造成这种情况出现,就是一个字段作为了前面字段的别名,比如:

SELECT
     clo1,
     clo2 clo3
FROM tbl

上面的sql语句是可以被执行的,但是结果是col2的值对应的别名为clo3,并且数据会少一列,会让人感觉很诧异。

inner join与left join

这种情况一般在没有搞清楚表之间的关系时,或者主表选择不清楚时会出现,一旦使用了错误的JOIN类型,得到的结果可能会多也可能会少。所以在进行连接查询时,区分JOIN类型也是值得注意的,下图是JOIN类型之间的区别。

相关推荐

NUS邵林团队发布DexSinGrasp基于强化学习实现物体分离与抓取统一

本文的作者均来自新加坡国立大学LinSLab。本文的共同第一作者为新加坡国立大学实习生许立昕和博士生刘子轩,主要研究方向为机器人学习和灵巧操纵,其余作者分别为硕士生桂哲玮、实习生郭京翔、江泽宇以及...

「PLC进阶」如何通过编写SCL语言程序实现物料分拣?

01、前言SCL作为IEC61131-3编程语言的一种,由于其高级语言的特性,特别适合复杂运算、复杂数学函数应用的场合。本文以FactoryIO软件中的物料分拣案例作为硬件基础,介绍如何通过SCL来实...

zk源码—5.请求的处理过程一(http1.1请求方法)

大纲1.服务器的请求处理链...

自己动手从0开始实现一个分布式 RPC 框架

前言为什么要自己写一个RPC框架,我觉得从个人成长上说,如果一个程序员能清楚的了解RPC框架所具备的要素,掌握RPC框架中涉及的服务注册发现、负载均衡、序列化协议、RPC通信协议、Socket通信、异...

MLSys’25 | 极低内存消耗:用SGD的内存成本实现AdamW的优化性能

AIxiv专栏是机器之心发布学术、技术内容的栏目。过去数年,机器之心AIxiv专栏接收报道了2000多篇内容,覆盖全球各大高校与企业的顶级实验室,有效促进了学术交流与传播。如果您有优秀的工作想要分享,...

线程池误用导致系统假死(线程池会自动销毁吗)

背景介绍在项目中,为了提高系统性能使用了RxJava实现异步方案,其中异步线程池是自建的。但是当QPS稍微增大之后却发现系统假死、无响应和返回,调用方出现大量超时现象。但是通过监控发现,系统线程数正常...

大型乘用车工厂布局规划(六大乘用车基地)

乘用车工厂的布局规划直接影响生产效率、物流成本、安全性和未来扩展能力。合理的布局应确保生产流程顺畅、物流高效、资源优化,并符合现代化智能制造和绿色工厂的要求。以下是详细的工厂布局规划要点:1.工厂布...

西门子 S7-200 SMART PLC 连接Factory IO的方法

有很多同学不清楚如何西门子200smart如何连接FactoryIO,本教程为您提供了如何使用西门子S7-200SMARTPLC连接FactoryIO的说明。设置PC和PLC之间的...

西门子博图高级仿真软件的应用(西门子博途软件仿真)

1.博图高级仿真软件(S7-PLCSIMAdvancedV2.0)S7-PLCSIMAdvancedV2.0包含大量仿真功能,通过创建虚拟控制器对S7-1500和ET200SP控制器进行仿真...

PLC编程必踩的6大坑——请对号入座,评论区见

一、缺乏整体规划:面条式代码问题实例:某快递分拣线项目初期未做流程图设计,工程师直接开始编写传送带控制程序。后期增加质检模块时发现I/O地址冲突,电机启停逻辑与传感器信号出现3处死循环,导致项目延期2...

统信UOS无需开发者模式安装软件包
统信UOS无需开发者模式安装软件包

原文链接:统信UOS无需开发者模式安装软件包...

2025-05-05 14:55 csdh11

100个Java工具类之76:数据指纹DigestUtils

为了提高数据安全性,保证数据的完整性和真实性,DigestUtils应运而生。正确恰当地使用DigestUtils的加密算法,可以实现数据的脱敏,防止数据泄露或篡改。...

麒麟KYLINIOS软件仓库搭建02-软件仓库添加新的软件包

#秋日生活打卡季#原文链接:...

Java常用工具类技术文档(java中工具类的作用)

一、概述Java工具类(UtilityClasses)是封装了通用功能的静态方法集合,能够简化代码、提高开发效率。本文整理Java原生及常用第三方库(如ApacheCommons、GoogleG...

软路由的用法(自动追剧配置)(软路由教学)

本内容来源于@什么值得买APP,观点仅代表作者本人|作者:值友98958248861环境和需求...