From 454522ed5008ad352809d340322b11f29e5b6cbf Mon Sep 17 00:00:00 2001 From: Ybond Date: Mon, 28 Mar 2022 16:09:54 +0800 Subject: [PATCH] fix: typo in sort-the-query-strings-by-counts.md (#256) --- docs/big-data/sort-the-query-strings-by-counts.md | 2 +- 1 file changed, 1 insertion(+), 1 deletion(-) diff --git a/docs/big-data/sort-the-query-strings-by-counts.md b/docs/big-data/sort-the-query-strings-by-counts.md index d8705a0..842fb3a 100644 --- a/docs/big-data/sort-the-query-strings-by-counts.md +++ b/docs/big-data/sort-the-query-strings-by-counts.md @@ -14,7 +14,7 @@ #### 方法二:分治法 -分治法需要根据数据量大小以及可用内存的大小来确定问题划分的规模。对于这道题,可以顺序遍历 10 个文件中的 query,通过 Hash 函数 `hash(query) % 10` 把这些 query 划分到 10 个小文件中。之后对每个小文件使用 HashMap 统计 query 出现次数,根据次数排序并写入到零外一个单独文件中。 +分治法需要根据数据量大小以及可用内存的大小来确定问题划分的规模。对于这道题,可以顺序遍历 10 个文件中的 query,通过 Hash 函数 `hash(query) % 10` 把这些 query 划分到 10 个小文件中。之后对每个小文件使用 HashMap 统计 query 出现次数,根据次数排序并写入到另外一个单独文件中。 接着对所有文件按照 query 的次数进行排序,这里可以使用归并排序(由于无法把所有 query 都读入内存,因此需要使用外排序)。