如何以更函数式风格改写Scala重复参数的方法调用代码?
解决Scala扩展方法的函数式批量调用问题
你的困扰完全合理——既然两个方法签名完全一致,重复写参数确实不够优雅。问题出在你直接尝试引用featuresGroup1和featuresGroup2,但它们是DataFrameExtensions这个隐式类的成员方法,必须通过DataFrame实例才能访问,没法直接作为独立值引用。下面是几种函数式风格的解决方案:
方案1:绑定DataFrame后的函数批量调用
这是最简洁的方式:先把两个方法转换成绑定了当前df的函数值,再放到序列里统一传参:
// 把df的两个扩展方法转换成函数值,绑定df但保留参数位 val featureMethods = Seq( df.featuresGroup1(_, _), // 类型是 (Seq[String], LocalDate) => DataFrame df.featuresGroup2(_, _) ) // 统一传递参数,生成DataFrame序列 val dataFrames = featureMethods.map(_(groupBy, asAt))
方案2:通用化的函数序列(支持任意DataFrame)
如果你希望这个函数序列能复用在不同的DataFrame上,可以定义接收DataFrame并返回对应方法的函数:
// 定义通用函数:输入DataFrame,返回它的featuresGroup方法 val featureFunctions: Seq[DataFrame => (Seq[String], LocalDate) => DataFrame] = Seq( _.featuresGroup1, _.featuresGroup2 ) // 针对当前df调用,传递参数 val dataFrames = featureFunctions.map(f => f(df)(groupBy, asAt))
为什么你的尝试失败?
当你写Seq(featuresGroup1, featuresGroup2)时,Scala会把这两个名字当作顶级变量/函数查找,但它们只存在于DataFrameExtensions类的实例中(而隐式类的实例是Scala自动为df创建的),所以编译器找不到它们。必须通过_.featuresGroupX或df.featuresGroupX(_,_)的方式,把成员方法转换成独立的函数值,才能放进序列里。
内容的提问来源于stack exchange,提问作者jamiet
相关产品推荐
相关产品推荐

