大规模数据集元素分组最优方案咨询:算法及替代方案选型
大规模数据集元素分组问题
示例说明
输入数据
pairs = [[1,2],[8,10],[4,8],[3,4],[2,3],[5,6],[6,7],[9,4],[11,12],[13,10],[16,1],[78,79],[61,3],[93,94]]
分组规则
若任意元素存在于另一组中,则两组合并,遍历所有组后生成最终分组。
输出示例
[{1, 2, 3, 4, 8, 9, 10, 13, 16, 61}, {5, 6, 7}, {11, 12}, {78, 79}, {93, 94}]
待解答问题
- 解决该问题的最优方案是什么?例如图数据库(Neo4j)或特定现成算法?
- 除上述示例方案外,还有哪些替代方案?
要求:方案需在处理大规模数据集时耗时较少,预期输出与示例一致。
内容的提问来源于stack exchange,提问作者amit shah
相关产品推荐
相关产品推荐

