基于AirportFrom列与参考字典创建DataFrame新列遇报错求助
解决机场代码映射到州的问题
直接用airportState[dataset['AirportFrom']]会报错,因为字典无法直接接收pandas Series作为索引参数。正确做法是用pandas的map()方法,它会对Series里的每个元素单独执行映射:
dataset['StateFrom'] = dataset['AirportFrom'].map(airportState)
如果AirportFrom列存在不在airportState字典中的代码,map()会返回NaN。你可以用fillna()填充默认值,比如:
# 将未知州填充为'Unknown' dataset['StateFrom'] = dataset['AirportFrom'].map(airportState).fillna('Unknown')
若要排查哪些机场代码没有对应州的映射,可先找出缺失项:
# 提取AirportFrom中不在字典键集合里的唯一代码 missing_airports = dataset[~dataset['AirportFrom'].isin(airportState.keys())]['AirportFrom'].unique() print("无对应州的机场代码:", missing_airports)
内容的提问来源于stack exchange,提问作者ojandali
相关产品推荐
相关产品推荐

