You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

K-means++聚类算法中概率求和参数m的含义问询

K-means++概率表达式中参数m的含义

m代表数据集的总样本数量。

在公式D(X(i))^2/Sum(D(X(j))^2)(j从1到m)里,求和项是遍历数据集中所有m个样本,把每个样本与已选最近质心的距离平方D(X(j))^2全部累加起来,作为概率计算的分母。这种机制能让离现有质心越远的样本,被选为下一个质心的概率越高,以此提升K-means初始质心的合理性。

内容的提问来源于stack exchange,提问作者Harsh Yadav

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.22 21:06:24