如何在Julia DataFrame中按引用搜索列子集,避免数据复制?
避免DataFrame切片复制,实现按引用搜索
要让findfirst在不复制数据的情况下搜索目标区域,你可以用以下两种方法:
使用
@view宏生成切片视图
把原代码中的x[1:(y-1), 2]替换为@view x[1:(y-1), 2],@view会创建原DataFrame数据的视图(SubArray类型),而非复制切片内容。修改后的代码:findfirst(==(x[y, 1]), @view x[1:(y-1), 2])直接引用列的子范围
先通过x[!, 2]按引用取出第二列(避免复制整列),再取该列的子范围,同样会生成视图而非副本:col2 = x[!, 2] findfirst(==(x[y, 1]), col2[1:(y-1)])
这两种方法都能让findfirst直接在原数据的引用上执行搜索,完全避免切片复制带来的内存开销。
内容的提问来源于stack exchange,提问作者user
相关产品推荐
相关产品推荐

