寻找近邻
很明显,局部离群因子(local outlier factor)算法高度依赖"最近邻"的概念,而"最近邻"又取决于所选的距离度量。因此,您决定在上一课介绍的肝炎数据集上再做一些实验。您将得到 3 个样本,存放在 features 中,其类别存放在 labels 中。您需要分别使用 3 种不同的距离度量(Euclidean、Hamming 和 Chebyshev)来找到第一个样本(索引为 0 的行)的最近邻,并据此选择要使用的距离度量。您将在练习中导入所需的模块;pandas 和 numpy 已可用,features 及其标签 labels 也已准备好。
本练习是课程的一部分