Python循环迭代报错KeyError:1,URL域名提取循环遍历异常求助
问题分析与修复方案
你的代码问题在于循环逻辑混乱:你用for l in list_links遍历列表,但始终通过固定索引list_links[f](初始为0)获取链接,且f只在整个for循环结束后才加1,导致所有迭代都重复处理第一个URL。
修复方案(两种可选)
方案1:直接遍历每个链接(推荐,更简洁高效)
直接利用for循环遍历list_links中的每个元素,无需手动维护索引:
from urllib.parse import urlparse clinks = [] for link in list_links: # 直接使用当前遍历到的link,而非固定索引 domain = urlparse(link).netloc clinks.append(domain)
如果追求更简洁的写法,可使用列表推导式:
from urllib.parse import urlparse clinks = [urlparse(link).netloc for link in list_links]
方案2:基于索引的循环(适合需要手动控制索引的场景)
如果一定要用索引遍历,需用while循环正确维护索引变量f,每次迭代后递增:
from urllib.parse import urlparse clinks = [] f = 0 # 用while循环替代if+for的错误组合 while f < len(list_links): domain = urlparse(list_links[f]).netloc clinks.append(domain) # 每次处理完一个链接后,索引加1 f += 1
关键错误点回顾
原代码中if f<=len(list_links)的判断毫无意义(因为f初始为0必然满足),且for循环内部未更新f,导致所有迭代都重复处理list_links[0],最终输出全是重复域名。
内容的提问来源于stack exchange,提问作者ariasllaguno
相关产品推荐
相关产品推荐

