当前位置:首页 > 文章列表 > 数据库 > MySQL > MySQL 窗口函数 ROWS 与 RANGE 边界有什么区别

MySQL 窗口函数 ROWS 与 RANGE 边界有什么区别

来源:17golang原创 2026-10-04 07:08:39 0浏览 收藏

区别可以先记成一句话:ROWS 按排序后的行位置划边界,RANGE 按 ORDER BY 表达式的值划边界。所以,ROWS 1 PRECEDING 指前一行;RANGE 5 PRECEDING 指排序值落在“当前值减 5”到当前值之间的所有行。遇到重复排序值时,RANGE ... CURRENT ROW 会把与当前行排序值相同的 peer rows 一起纳入,而 ROWS ... CURRENT ROW 只停在当前物理行位置。

MySQL 8.4 官方说明:https://dev.mysql.com/doc/refman/8.4/en/window-functions-frames.html

快速判断
  • 固定取前 N 行、后 N 行:用 ROWS。
  • 按数值差或时间间隔取范围:用 RANGE。
  • 累计值不希望重复排序值一起跳:显式写 ROWS,并给排序键补稳定的唯一列。

一、先准备一组能看出边界的数据

我第一次碰到这个问题,是累计金额在两个相同分数上同时跳变。只看窗口函数语法,很容易以为 ROWS 和 RANGE 是两种等价写法。下面这组数据故意同时放入重复值和不连续值,便于观察边界。

-- 建立最小实验表,只保留排序值与聚合值
CREATE TABLE frame_demo (
    id INT PRIMARY KEY,
    score INT NOT NULL,
    amount INT NOT NULL
);

-- score=10 用于观察同值行,17 到 30 的间隔用于观察数值范围
INSERT INTO frame_demo (id, score, amount) VALUES
    (1, 10, 5),
    (2, 10, 7),
    (3, 12, 3),
    (4, 17, 4),
    (5, 30, 6);

窗口框架始终是当前分区的子集。框架会随着当前行在分区中的位置移动,聚合窗口函数以及 FIRST_VALUE()、LAST_VALUE()、NTH_VALUE() 等函数会读取当前框架内的行。

二、同一行上,ROWS 看位置,RANGE 看值

先比较“前一个位置”与“前 5 个值域单位”。这两种写法表面都带 PRECEDING,但参照物完全不同。

-- rows_sum 每次最多读取当前行和前一行
-- range_sum 读取 score 位于 [当前 score - 5, 当前 score] 的全部行
SELECT
    id,
    score,
    amount,
    SUM(amount) OVER (
        ORDER BY score, id
        ROWS BETWEEN 1 PRECEDING AND CURRENT ROW
    ) AS rows_sum,
    SUM(amount) OVER (
        ORDER BY score
        RANGE BETWEEN 5 PRECEDING AND CURRENT ROW
    ) AS range_sum
FROM frame_demo
ORDER BY score, id;

到 score=30 时,ROWS 仍可把排序后的上一行 score=17 纳入;RANGE 的下界是 25,因而只包含值为 30 的当前行。反过来,到 score=12 时,RANGE 会包含两个 10 和当前的 12,数量可能超过两行。对于带数值偏移的 RANGE,MySQL 要求 ORDER BY 使用数值表达式;使用时间间隔时则对应时间表达式。

MySQL ROWS 行位置边界与 RANGE 排序值边界的静态结构说明图
图1:ROWS 与 RANGE 边界参照物结构图;左侧按行位置取框架,右侧按排序值及同值行取框架。

三、重复排序值为什么会让累计值一起跳

真正容易踩坑的是 CURRENT ROW。在 ROWS 中,它就是当前这一行;在 RANGE 中,它代表当前排序值的同值集合。下面只按 score 排序,两个 score=10 互为 peer rows。

-- 显式比较行位置累计与排序值累计
SELECT
    id,
    score,
    amount,
    SUM(amount) OVER (
        ORDER BY score
        ROWS BETWEEN UNBOUNDED PRECEDING AND CURRENT ROW
    ) AS rows_running,
    SUM(amount) OVER (
        ORDER BY score
        RANGE BETWEEN UNBOUNDED PRECEDING AND CURRENT ROW
    ) AS range_running
FROM frame_demo
ORDER BY score, id;

RANGE 在任意一个 score=10 行上都会把两个同值行一起算入,所以累计值都包含 5+7。ROWS 则一行一行扩展,但如果窗口 ORDER BY 只有 score,同值行内部的先后没有保证,两个 ROWS 累计值落在哪个 id 上可能变化。若业务要求稳定的逐行累计,应使用 ORDER BY score, id ROWS ...;这既补了唯一排序条件,也明确了物理行框架。

MySQL 重复排序值、CURRENT ROW 与默认 RANGE 框架的静态关系图
图2:重复排序值与默认框架结构图;RANGE 的 CURRENT ROW 对应当前排序值的同值集合。

四、默认框架与选择规则

还有一个不太直观的地方:窗口定义有 ORDER BY、但没有显式 frame clause 时,MySQL 默认使用 RANGE BETWEEN UNBOUNDED PRECEDING AND CURRENT ROW,并包含当前行的所有 peer rows;没有 ORDER BY 时,默认框架覆盖整个分区。因此,只给累计窗口补一个 ORDER BY,就可能改变 SUM 的结果。

需求建议边界理由
逐行累计ROWS UNBOUNDED PRECEDING每移动一个物理行位置扩展一次
固定前后 N 行均值ROWS BETWEEN N PRECEDING AND N FOLLOWING行数固定,分布间隔不影响窗口
当前值附近的数值区间RANGE BETWEEN N PRECEDING AND CURRENT ROW按排序值差距纳入多行
最近若干天RANGE BETWEEN INTERVAL N DAY PRECEDING AND CURRENT ROW按时间范围而不是记录条数

我的经验是:只要结果必须逐记录稳定,就把唯一列写进 ORDER BY,并显式写 ROWS;只有需求本身就是“值域”或“时间域”时才选 RANGE。这样 SQL 的意图比依赖默认框架清楚得多。

五、相关问题

RANGE CURRENT ROW 为什么可能包含多行?

因为 RANGE 的边界参照 ORDER BY 值。与当前行排序值相同的行属于 peer rows,都会被 CURRENT ROW 边界包含。

ROWS 加了 ORDER BY 就一定稳定吗?

不一定。若 ORDER BY 列存在重复值,同值行内部顺序仍可能不确定。需要把主键等唯一列加入窗口 ORDER BY,形成完整排序。

所有窗口函数都会受 frame clause 影响吗?

不会。MySQL 对 RANK、ROW_NUMBER、LAG、LEAD 等按整个分区工作的函数即使允许写框架,也会忽略它。比较 ROWS 与 RANGE 时,应重点看聚合窗口函数和读取当前框架的值函数。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
Go cipher.NewGCMWithTagSize 怎么兼容不同认证标签长度Go cipher.NewGCMWithTagSize 怎么兼容不同认证标签长度
上一篇
Go cipher.NewGCMWithTagSize 怎么兼容不同认证标签长度
mifun乐园电脑端和TV端开放了吗?手机、PC与电视端状态说明
下一篇
mifun乐园电脑端和TV端开放了吗?手机、PC与电视端状态说明
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    324次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    382次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    376次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    339次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    165次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议 和 隐私政策
返回登录
  • 重置密码