在 SQL 中,基数(cardinality)的定义为一个数据列中举世无双数据的数量。
高基数(High-Cardinality)的定义为在一个数据列中的数据基本上不反复,或者说反复率非常低。
例如咱们常见的辨认号,邮件地址,用户名等都能够被认为是高基数数据。例如咱们常定义的 USERS 数据表中的 USER_ID 字段,这个字段中的数据通常被定义为 1 到 n。
每一次一个新的用户被作为记录插入到 USERS 表中,一个新的记录将会被创立,字段 USER_ID 将会应用一个新的数据来标识这个被插入的数据。
因为 USER_ID 中插入的数据是举世无双的,因而这个字段的数据技术就能够被思考认为是 高基数(High-Cardinality)数据。
https://www.ossez.com/t/topic…