mysql排名函式使用
1.percent_rank()函式
PERCENT_RANK()函式計算分割槽或結果集中行的百分位數排名
這PERCENT_RANK()是一個視窗函式,
用於計算分割槽或結果集中行的百分位數。
以下顯示了PERCENT_RANK()函式的語法:
PERCENT_RANK()
OVER (
PARTITION BY expr,...
ORDER BY expr [ASC|DESC],...
)
PERCENT_RANK()函式返回一個從0到1的數字。
對於指定的行,PERCENT_RANK()計算行的等級減1,
除以評估的分割槽或查詢結果集中的行數減1:
(rank - 1) / (total_rows - 1)
在此公式中,rank是指定行的等級,total_rows是要計算的行數。
PERCENT_RANK()對於分割槽或結果集中的第一行,
函式始終返回零。重複的列值將接收相同的PERCENT_RANK()值。
與其他視窗函式類似,PARTITION BY子句將行分配到分割槽中,
ORDER BY子句指定每個分割槽中行的邏輯順序。
PERCENT_RANK()為每個有序分割槽獨立計算函式。
兩個PARTITION BY和ORDER BY子句都是可選項。
但是,它PERCENT_RANK()是一個順序敏感函式,
因此,您應始終使用ORDER BY子句。(注意)
入門實戰:(4. 未完成率較高的50%使用者近三個月答卷情況 )
https://blog.csdn.net/weixin_44464850/article/details/124698259
讓我們建立一個名為新表productLineSales基礎上的orders,orderDetails以及products從表中示例資料庫:
CREATE TABLE productLineSales
SELECT
productLine,
YEAR(orderDate) orderYear,
quantityOrdered * priceEach orderValue
FROM
orderDetails
INNER JOIN
orders USING (orderNumber)
INNER JOIN
products USING (productCode)
GROUP BY
productLine ,
YEAR(orderDate);
productLineSales表儲存銷售資料的摘要,包括產品系列,訂單年份和訂單值。
+------------------+-----------+------------+
| productLine | orderYear | orderValue |
+------------------+-----------+------------+
| Vintage Cars | 2013 | 4080.00 |
| Classic Cars | 2013 | 5571.80 |
| Trucks and Buses | 2013 | 3284.28 |
| Trains | 2013 | 2770.95 |
| Ships | 2013 | 5072.71 |
| Planes | 2013 | 4825.44 |
| Motorcycles | 2013 | 2440.50 |
| Classic Cars | 2014 | 8124.98 |
| Vintage Cars | 2014 | 2819.28 |
| Trains | 2014 | 4646.88 |
| Ships | 2014 | 4301.15 |
| Planes | 2014 | 2857.35 |
| Motorcycles | 2014 | 2598.77 |
| Trucks and Buses | 2014 | 4615.64 |
| Motorcycles | 2015 | 4004.88 |
| Classic Cars | 2015 | 5971.35 |
| Vintage Cars | 2015 | 5346.50 |
| Trucks and Buses | 2015 | 6295.03 |
| Trains | 2015 | 1603.20 |
| Ships | 2015 | 3774.00 |
| Planes | 2015 | 4018.00 |
+------------------+-----------+------------+
21 rows in set (0.02 sec)
percent_rank()在查詢結果集上使用Mysql
以下查詢按訂單值查詢每個產品系列的百分位數排名:
WITH t AS (
SELECT
productLine,
SUM(orderValue) orderValue
FROM
productLineSales
GROUP BY
productLine
)
SELECT
productLine,
orderValue,
ROUND(
PERCENT_RANK()
OVER (
ORDER BY orderValue
)
,2) percentile_rank
FROM
t;
在這個例子中:
- 首先,我們使用公用表表達式按產品線彙總訂單值。
- 其次,我們用它
PERCENT_RANK()來計算每種產品的訂單價值的百分等級。此外,我們使用ROUND()函式將值舍入為2十進位制,以獲得更好的表示。
這是輸出:
+------------------+------------+-----------------+
| productLine | orderValue | percentile_rank |
+------------------+------------+-----------------+
| Trains | 9021.03 | 0.00 |
| Motorcycles | 9044.15 | 0.17 |
| Planes | 11700.79 | 0.33 |
| Vintage Cars | 12245.78 | 0.50 |
| Ships | 13147.86 | 0.67 |
| Trucks and Buses | 14194.95 | 0.83 |
| Classic Cars | 19668.13 | 1.00 |
+------------------+------------+-----------------+
7 rows in set (0.01 sec)
以下是輸出中的一些分析:
- 訂單價值
Trains並不比任何其他產品線更好,後者用零表示。 Vintage Cars表現優於50%的其他產品。Classic Cars表現優於任何其他產品系列,因此其百分比等級為1或100%
percent_rank()在分割槽上使用MySQL
以下語句按年度中的訂單值返回產品系列的百分位數排名:
SELECT
productLine,
orderYear,
orderValue,
ROUND(
PERCENT_RANK()
OVER (
PARTITION BY orderYear
ORDER BY orderValue
),2) percentile_rank
FROM
productLineSales;
這是輸出:
+------------------+-----------+------------+-----------------+
| productLine | orderYear | orderValue | percentile_rank |
+------------------+-----------+------------+-----------------+
| Motorcycles | 2013 | 2440.50 | 0.00 |
| Trains | 2013 | 2770.95 | 0.17 |
| Trucks and Buses | 2013 | 3284.28 | 0.33 |
| Vintage Cars | 2013 | 4080.00 | 0.50 |
| Planes | 2013 | 4825.44 | 0.67 |
| Ships | 2013 | 5072.71 | 0.83 |
| Classic Cars | 2013 | 5571.80 | 1.00 |
| Motorcycles | 2014 | 2598.77 | 0.00 |
| Vintage Cars | 2014 | 2819.28 | 0.17 |
| Planes | 2014 | 2857.35 | 0.33 |
| Ships | 2014 | 4301.15 | 0.50 |
| Trucks and Buses | 2014 | 4615.64 | 0.67 |
| Trains | 2014 | 4646.88 | 0.83 |
| Classic Cars | 2014 | 8124.98 | 1.00 |
| Trains | 2015 | 1603.20 | 0.00 |
| Ships | 2015 | 3774.00 | 0.17 |
| Motorcycles | 2015 | 4004.88 | 0.33 |
| Planes | 2015 | 4018.00 | 0.50 |
| Vintage Cars | 2015 | 5346.50 | 0.67 |
| Classic Cars | 2015 | 5971.35 | 0.83 |
| Trucks and Buses | 2015 | 6295.03 | 1.00 |
+------------------+-----------+------------+-----------------+
21 rows in set (0.01 sec)
在此示例中,我們按訂單年劃分產品線的訂單值。將PERCENT_RANK()然後被施加到每個分割槽。
例如,2013年Vintage Cars 表現優於其他產品線的50%,而在2014年,船舶表現優於其他產品的50%。
在本教程中,您學習瞭如何使用MySQL PERCENT_RANK()函式計算分割槽或結果集中行的百分位數。
2.rank()函式
RANK()函式為結果集的分割槽中的每一行分配一個排名。行的等級由一加上前面的等級數指定。
以下顯示了RANK()函式的語法:
RANK() OVER (
PARTITION BY <expression>[{,<expression>...}]
ORDER BY <expression> [ASC|DESC], [{,<expression>...}]
)
在這個語法中:
- 首先,
PARTITION BY子句將結果集劃分為分割槽。RANK()功能在分割槽內執行,並在跨越分割槽邊界時重新初始化。 - 其次,
ORDER BY子句按一個或多個列或表示式對分割槽內的行進行排序。
與ROW_NUMBER()函式不同,RANK()函式並不總是返回連續的整數。
CREATE TABLE rankDemo (
val INT
);
INSERT INTO rankDemo(val)
VALUES(1),(2),(2),(3),(4),(4),(5);
SELECT *
FROM rankDemo
+------+
| val |
+------+
| 1 |
| 2 |
| 2 |
| 3 |
| 4 |
| 4 |
| 5 |
+------+
7 rows in set (0.01 sec)
以下語句使用RANK()函式為rankDemo表中結果集的每一行分配一個排名:
SELECT
val,
RANK() OVER (
ORDER BY val
) my_rank
FROM
rankDemo;
+------+---------+
| val | my_rank |
+------+---------+
| 1 | 1 |
| 2 | 2 |
| 2 | 2 |
| 3 | 4 |
| 4 | 5 |
| 4 | 5 |
| 5 | 7 |
+------+---------+
7 rows in set (0.02 sec)
如您所見,第二行和第三行具有相同的關係,因此它們獲得相同的等級2。
第四行具有等級4,因為RANK()功能跳過等級3。
MySQL RANK() 函式示例
讓我們使用sales我們在視窗函式教程中建立的表進行演示。
以下是sales表:
+----------------+-------------+--------+
| sales_employee | fiscal_year | sale |
+----------------+-------------+--------+
| Alice | 2016 | 150.00 |
| Alice | 2017 | 100.00 |
| Alice | 2018 | 200.00 |
| Bob | 2016 | 100.00 |
| Bob | 2017 | 150.00 |
| Bob | 2018 | 200.00 |
| John | 2016 | 200.00 |
| John | 2017 | 150.00 |
| John | 2018 | 250.00 |
+----------------+-------------+--------+
9 rows in set (0.01 sec)
以下宣告使用RANK()功能按銷售額按每年的銷售額排名:
SELECT
sales_employee,
fiscal_year,
sale,
RANK( ) OVER (
PARTITION BY fiscal_year
ORDER BY sale DESC
) sales_rank
FROM
sales;
輸出結果:
+----------------+-------------+--------+------------+
| sales_employee | fiscal_year | sale | sales_rank |
+----------------+-------------+--------+------------+
| John | 2016 | 200.00 | 1 |
| Alice | 2016 | 150.00 | 2 |
| Bob | 2016 | 100.00 | 3 |
| Bob | 2017 | 150.00 | 1 |
| John | 2017 | 150.00 | 1 |
| Alice | 2017 | 100.00 | 3 |
| John | 2018 | 250.00 | 1 |
| Alice | 2018 | 200.00 | 2 |
| Bob | 2018 | 200.00 | 2 |
+----------------+-------------+--------+------------+
9 rows in set (0.01 sec)
在這個例子中:
- 首先,
PARTITION BY子句按財務年度將結果集分成多個分割槽。 - 然後,
ORDER BY子句按銷售額按降序對銷售員工進行排序。
MySQL RANK函式與CTE示例
以下語句使用RANK()函式查詢每年最高的三個最高價值訂單:
WITH order_values AS(
SELECT
orderNumber,
YEAR(orderDate) order_year,
quantityOrdered*priceEach AS order_value,
RANK() OVER (
PARTITION BY YEAR(orderDate)
ORDER BY quantityOrdered*priceEach DESC
) order_value_rank
FROM
orders
INNER JOIN orderDetails USING (orderNumber)
)
SELECT
*
FROM
order_values
WHERE
order_value_rank <=3;
這是輸出:
+-------------+------------+-------------+------------------+
| orderNumber | order_year | order_value | order_value_rank |
+-------------+------------+-------------+------------------+
| 10196 | 2013 | 9571.08 | 1 |
| 10206 | 2013 | 9568.73 | 2 |
| 10201 | 2013 | 9394.28 | 3 |
| 10312 | 2014 | 10286.40 | 1 |
| 10348 | 2014 | 9974.40 | 2 |
| 10304 | 2014 | 9467.68 | 3 |
| 10403 | 2015 | 11503.14 | 1 |
| 10405 | 2015 | 11170.52 | 2 |
| 10407 | 2015 | 10723.60 | 3 |
+-------------+------------+-------------+------------------+
9 rows in set (0.04 sec)
在這個例子中:
- 首先,我們使用公用表表達式(CTE)來獲取訂單號,訂單年份和排名。為了按照每年的訂單價值對訂單進行排名,我們使用按
RANK()行年劃分行的功能,並按降序對訂單值進行排序。 - 然後,我們只選擇排名小於或等於3的訂單。
3.row_number() over()函式
MySQL ROW_NUMBER() 語法
MySQL ROW_NUMBER()從8.0版開始引入了功能。這ROW_NUMBER()是一個視窗函式或分析函式,它為從1開始應用的每一行分配一個序號。
請注意,如果你使用MySQL版本低於8.0,你可以效仿的一些功能ROW_NUMBER()函式使用各種技術。
以下顯示了ROW_NUMBER()函式的語法:
ROW_NUMBER() OVER (<partition_definition> <order_definition>)
partition_definition
partition_definition語法如下:
PARTITION BY <expression>,[{,<expression>}...]
PARTITION BY子句將行分成更小的集合。表示式可以是將在GROUP BY子句中使用的任何有效表示式。您可以使用以逗號分隔的多個表示式。
PARTITION BY條款是可選項。如果省略它,則整個結果集被視為分割槽。但是,當您使用PARTITION BY子句時,每個分割槽也可以被視為一個視窗。
order_definition
的order_definition語法如下所示:
ORDER BY <expression> [ASC|DESC],[{,<expression>}...]
ORDER BY子句的目的是設定行的順序。此ORDER BY子句獨立ORDER BY於查詢的子句。
MySQL ROW_NUMBER() 函式示例
讓我們使用示例資料庫中的products表進行演示:
1)為行分配序號
以下語句使用ROW_NUMBER()函式為products表中的每一行分配一個序號:
SELECT
ROW_NUMBER() OVER (
ORDER BY productName
) row_num,
productName,
msrp
FROM
products
ORDER BY
productName;
這是輸出:
+---------+---------------------------------------------+--------+
| row_num | productName | msrp |
+---------+---------------------------------------------+--------+
| 1 | 18th century schooner | 122.89 |
| 2 | 18th Century Vintage Horse Carriage | 104.72 |
| 3 | 1900s Vintage Bi-Plane | 68.51 |
| 4 | 1900s Vintage Tri-Plane | 72.45 |
| 5 | 1903 Ford Model A | 136.59 |
| 6 | 1904 Buick Runabout | 87.77 |
| 7 | 1911 Ford Town Car | 60.54 |
| 8 | 1912 Ford Model T Delivery Wagon | 88.51 |
| 9 | 1913 Ford Model T Speedster | 101.31 |
| 10 | 1917 Grand Touring Sedan | 170.00 |
| 11 | 1917 Maxwell Touring Car | 99.21 |
| 12 | 1926 Ford Fire Engine | 60.77 |
| 13 | 1928 British Royal Navy Airplane | 109.42 |
...
2)找到每組的前N行
您可以將ROW_NUMBER()功能用於查詢每個組的前N行的查詢,例如,每個銷售渠道的前三名銷售員工,每個類別的前五名高效能產品。
以下語句查詢每個產品系列中庫存最高的前三種產品:
WITH inventory
AS (SELECT
productLine,
productName,
quantityInStock,
ROW_NUMBER() OVER (
PARTITION BY productLine
ORDER BY quantityInStock DESC) row_num
FROM
products
)
SELECT
productLine,
productName,
quantityInStock
FROM
inventory
WHERE
row_num <= 3;
在這個例子中,
- 首先,我們使用
ROW_NUMER()函式對每個產品系列中的所有產品的庫存進行排序,方法是按產品線劃分所有產品,並按庫存數量按降序排序。結果,每個產品根據其庫存數量分配一個等級。併為每個產品系列重置排名。 - 然後,我們只選擇等級小於或等於3的產品。
以下顯示輸出:
+------------------+----------------------------------------+-----------------+
| productLine | productName | quantityInStock |
+------------------+----------------------------------------+-----------------+
| Classic Cars | 1995 Honda Civic | 9772 |
| Classic Cars | 2002 Chevy Corvette | 9446 |
| Classic Cars | 1976 Ford Gran Torino | 9127 |
| Motorcycles | 2002 Suzuki XREO | 9997 |
| Motorcycles | 1982 Ducati 996 R | 9241 |
| Motorcycles | 1969 Harley Davidson Ultimate Chopper | 7933 |
| Planes | America West Airlines B757-200 | 9653 |
| Planes | American Airlines: MD-11S | 8820 |
| Planes | ATA: B757-300 | 7106 |
| Ships | The USS Constitution Ship | 7083 |
| Ships | The Queen Mary | 5088 |
| Ships | 1999 Yamaha Speed Boat | 4259 |
| Trains | 1950's Chicago Surface Lines Streetcar | 8601 |
| Trains | Collectable Wooden Train | 6450 |
| Trains | 1962 City of Detroit Streetcar | 1645 |
| Trucks and Buses | 1964 Mercedes Tour Bus | 8258 |
| Trucks and Buses | 1957 Chevy Pickup | 6125 |
| Trucks and Buses | 1980鈥檚 GM Manhattan Express | 5099 |
| Vintage Cars | 1932 Model A Ford J-Coupe | 9354 |
| Vintage Cars | 1912 Ford Model T Delivery Wagon | 9173 |
| Vintage Cars | 1937 Lincoln Berline | 8693 |
+------------------+----------------------------------------+-----------------+
21 rows in set (0.03 sec)
3)刪除重複的行
您可以使用ROW_NUMBER()它將非唯一行轉換為唯一行,然後刪除重複行。請考慮以下示例。
首先,建立一個包含一些重複值的表:
DROP TABLE IF EXISTS rowNumberDemo;
CREATE TABLE rowNumberDemo (
id INT,
name VARCHAR(10) NOT NULL
);
INSERT INTO rowNumberDemo(id,name)
VALUES(1,'A'),
(2,'B'),
(3,'B'),
(4,'C'),
(5,'C'),
(6,'C'),
(7,'D');
其次,使用ROW_NUMBER()函式將行劃分為所有列的分割槽。對於每個唯一的行集,將重新開始行號。
SELECT
id,
name,
ROW_NUMBER() OVER (PARTITION BY name ORDER BY name) AS row_num
FROM rowNumberDemo;
+------+------+---------+
| id | name | row_num |
+------+------+---------+
| 1 | A | 1 |
| 2 | B | 1 |
| 3 | B | 2 |
| 4 | C | 1 |
| 5 | C | 2 |
| 6 | C | 3 |
| 7 | D | 1 |
+------+------+---------+
7 rows in set (0.02 sec)
從輸出中可以看出,唯一的行是行號等於1的行。
第三,您可以使用公用表表達式(CTE)返回要刪除的重複行和delete語句:
WITH dups AS (SELECT
id,
name,
ROW_NUMBER() OVER(PARTITION BY name ORDER BY name) AS row_num
FROM rowNumberDemo)
DELETE rowNumberDemo FROM rowNumberDemo INNER JOIN dups ON rowNumberDemo.id = dups.id
WHERE dups.row_num <> 1;
+------+------+
| id | name |
+------+------+
| 1 | A |
| 2 | B |
| 4 | C |
| 7 | D |
+------+------+
4 rows in set (0.01 sec)
請注意,MySQL不支援基於CTE的刪除,因此,我們必須將原始表與CTE一起作為一種解決方法。
4)使用
ROW_NUMBER()函式分頁
因為ROW_NUMBER()為結果集中的每一行指定一個唯一的數字,所以可以將其用於分頁。
假設您需要顯示每頁包含10個產品的產品列表。要獲取第二頁的產品,請使用以下查詢:
SELECT *
FROM
(SELECT productName,
msrp,
row_number()
OVER (order by msrp) AS row_num
FROM products) t
WHERE row_num BETWEEN 11 AND 20;
這是輸出:
+------------------------------------------+-------+---------+
| productName | msrp | row_num |
+------------------------------------------+-------+---------+
| 1936 Mercedes-Benz 500K Special Roadster | 53.91 | 11 |
| 1954 Greyhound Scenicruiser | 54.11 | 12 |
| Pont Yacht | 54.60 | 13 |
| 1970 Dodge Coronet | 57.80 | 14 |
| 1962 City of Detroit Streetcar | 58.58 | 15 |
| 1911 Ford Town Car | 60.54 | 16 |
| 1936 Harley Davidson El Knucklehead | 60.57 | 17 |
| 1926 Ford Fire Engine | 60.77 | 18 |
| 1971 Alpine Renault 1600s | 61.23 | 19 |
| 1950's Chicago Surface Lines Streetcar | 62.14 | 20 |
+------------------------------------------+-------+---------+
10 rows in set (0.02 sec)
在本教程中,您學習瞭如何使用MySQL ROW_NUMBER()函式為結果集中的每一行生成***。
入門實戰:( 3.找出每個學校GPA最低的同學)
https://blog.csdn.net/weixin_44464850/article/details/124386872
4. dense_rank()函式
DENSE_RANK()是一個視窗函式,它為分割槽或結果集中的每一行分配排名,而排名值沒有間隙。
行的等級從行前的不同等級值的數量增加1。
DENSE_RANK() 函式的語法如下:
DENSE_RANK() OVER (
PARTITION BY <expression>[{,<expression>...}]
ORDER BY <expression> [ASC|DESC], [{,<expression>...}]
)
在這個語法中:
- 首先,
PARTITION BY子句將FROM子句生成的結果集劃分為分割槽。DENSE_RANK()函式應用於每個分割槽。 - 其次,
ORDER BY子句指定DENSE_RANK()函式操作的每個分割槽中的行順序。
如果分割槽具有兩個或更多具有相同排名值的行,則將為這些行中的每一行分配相同的排名。
與RANK()函式不同,DENSE_RANK()函式始終返回連續的排名值。
假設我們有一個t包含一些樣本資料的表,如下所示:
CREATE TABLE rankDemo (
val INT
);
INSERT INTO rankDemo(val)
VALUES(1),(2),(2),(3),(4),(4),(5);
SELECT
*
FROM
rankDemo;
+------+
| val |
+------+
| 1 |
| 2 |
| 2 |
| 3 |
| 4 |
| 4 |
| 5 |
+------+
7 rows in set (0.02 sec)
以下語句使用DENSE_RANK()函式為每行分配排名:
SELECT
val,
DENSE_RANK() OVER (
ORDER BY val
) my_rank
FROM
rankDemo;
這是輸出:
+------+---------+
| val | my_rank |
+------+---------+
| 1 | 1 |
| 2 | 2 |
| 2 | 2 |
| 3 | 3 |
| 4 | 4 |
| 4 | 4 |
| 5 | 5 |
+------+---------+
7 rows in set (0.03 sec)
MySQL DENSE_RANK() 函式示例
我們將使用視窗函式教程sales中建立的表進行演示。
mysql> select * from sales;
+----------------+-------------+--------+
| sales_employee | fiscal_year | sale |
+----------------+-------------+--------+
| Alice | 2016 | 150.00 |
| Alice | 2017 | 100.00 |
| Alice | 2018 | 200.00 |
| Bob | 2016 | 100.00 |
| Bob | 2017 | 150.00 |
| Bob | 2018 | 200.00 |
| John | 2016 | 200.00 |
| John | 2017 | 150.00 |
| John | 2018 | 250.00 |
+----------------+-------------+--------+
9 rows in set (0.00 sec)
以下宣告使用DENSE_RANK()功能按銷售額對銷售員工進行排名。
SELECT
sales_employee,
fiscal_year,
sale,
DENSE_RANK() OVER (PARTITION BY
fiscal_year
ORDER BY
sale DESC
) sales_rank
FROM
sales;
輸出如下:
+----------------+-------------+--------+------------+
| sales_employee | fiscal_year | sale | sales_rank |
+----------------+-------------+--------+------------+
| John | 2016 | 200.00 | 1 |
| Alice | 2016 | 150.00 | 2 |
| Bob | 2016 | 100.00 | 3 |
| Bob | 2017 | 150.00 | 1 |
| John | 2017 | 150.00 | 1 |
| Alice | 2017 | 100.00 | 2 |
| John | 2018 | 250.00 | 1 |
| Alice | 2018 | 200.00 | 2 |
| Bob | 2018 | 200.00 | 2 |
+----------------+-------------+--------+------------+
9 rows in set (0.01 sec)
在這個例子中:
- 首先,
PARTITION BY子句使用會計年度將結果集劃分為分割槽。 - 其次,
ORDER BY條款按銷售額的降序指定了銷售員工的順序。 - 第三,
DENSE_RANK()函式應用於具有ORDER BY子句指定的行順序的每個分割槽。
在本教程中,您學習瞭如何使用MySQL DENSE_RANK()函式對結果集的每個分割槽中的行進行排名。
入門實戰:(3.近三個月未完成試卷數為0的使用者完成情況)
https://blog.csdn.net/weixin_44464850/article/details/124698259
瞭解更多:MySQL官網
https://www.begtut.com/mysql/mysql-lead-function.html
