加权聚类集成与抑制模糊C均值算法解析
在数据聚类领域,为了提高聚类的准确性和效率,研究者们不断探索新的算法和方法。本文将深入介绍两种聚类相关的技术:加权聚类集成使用核共识函数和抑制模糊C均值算法。
加权聚类集成使用核共识函数
在聚类集成中,我们常常需要将多个不同的聚类结果整合为一个共识分区。这就涉及到共识函数的概念。
共识函数
共识函数是一个将给定的分区集合 Զ 映射到单个共识分区 ࣪כ 的函数。在共识过程中,我们要寻找一个能整合聚类集成中各个分区的分区。通过为每个分区 ࣪ 关联一个权重 ߣ,我们将 ࣪כ 定义为:
[
࣪כ ൌ ܽݎ݃\max_{\mathcal{P} \in \mathcal{Z} x} \sum {i = 1}^{m} \lambda_i \mathcal{H}(\mathcal{P}, \mathcal{P}_i)
]
其中,࣪ 遍历数据 ߯ 的所有可能分区,߁(࣪, ࣪) 是两个分区之间的相似度度量。我们的共识函数基于分区之间新核的定义,通过具有特定结构的图来表示每个分区。
用图表示分区
对于每个分区 ࣪,我们定义一个图 ܩ_࣪ = (ܸ, ܧ),其中 ܸ = {ݒ_ई₁, ݒ_ई₂, …, ݒ_ईₙ},ݒ_௫ᵢ 是与 ݔᵢ 相关联的节点。在这种图中,当且仅当对象 ݔᵢ 和 ݔⱼ 在分区 ࣪ 中属于同一聚类时,节点 ݒ_௫ᵢ 和 ݒ_௫ⱼ 之间存在一条边。这样,从分区 Զ 得到的所有图中,每个连通分量都是一个完全图。
设 ࣡: Զ → ॳ 是从 Զ 到空间 ॳ(通过对对象 ߯ 进行分区得到的所有图的空
超级会员免费看
订阅专栏 解锁全文

415

被折叠的 条评论
为什么被折叠?



