SQL之LIMIT子句踩坑记录

部分场景下,我们可能希望从一个大表 unparsed 中抽取前100行并对这些行应用UDF,一种容易想到的SQL语句如下:

sql 复制代码
@pyspark
insert into table parsed
select url, parse_func(content) as parsed_content from unparsed
limit 100;

但这个语句实际上会对 unparsed 中的所有行先应用UDF然后再抽取前100行,不符合我们的期望,为此可以作出如下修改

sql 复制代码
@pyspark
insert into table parsed
select url, parse_func(content) as parsed_content
from (
    select url, content from unparsed
    limit 100
);

注意,以下这种语句是无效的,速度并不会有任何改变:

sql 复制代码
@pyspark
insert into table parsed
(select url, parse_func(content) as parsed_content from unparsed limit 100);
相关推荐
祈禾8 小时前
Redis三大缓存问题与分布式锁
运维·数据库·redis·笔记·分布式·缓存
Csvn8 小时前
📊 SQL 入门 Day 18:索引原理
后端·sql
DBA小马哥8 小时前
关系型数据库核心概念手册:SQL、事务与存储引擎的技术脉络
数据库·sql
丫头,冲鸭!!!8 小时前
记账网站3-连数据库
数据库·个人开发
灯澜忆梦9 小时前
【MySQL12】进阶篇 | SQL优化
数据库·sql·mysql·性能优化
IvorySQL9 小时前
PostgreSQL 日报|PG18.5 回归测试崩溃问题(8 月 12 日)
大数据·数据库·人工智能·postgresql
ltl9 小时前
学习型查询优化器:Neo、Bao、Balsa 与 LLM-CBO
数据库
ltl9 小时前
持久内存退场之后:ZNS SSD 与下一代非易失内存
数据库
故乡dee云12 小时前
AWS 产品太多不会选?按“网站、数据库、文件、日志”4 类需求快速匹配
数据库·云计算·aws
曹牧13 小时前
C#:问号
前端·数据库·c#