You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python简化arguments[0].scrollTop循环 仅修改次数即可生效

如何简化arguments[0].scrollTop相关的滚动循环逻辑

核心需求:实现滚动逻辑复用,需要执行N次滚动操作时,仅修改循环次数参数即可完成配置,无需重复编写冗余代码段。


原始冗余代码

原代码每轮循环重复编写了4次完全一致的滚动+等待逻辑:

for i in range(1, loops_count + 1):
    browser.execute_script("arguments[0].scrollTop = arguments[0].scrollHeight", followers_ul)
    time.sleep(random.randrange(6, 10))
    browser.execute_script("arguments[0].scrollTop = arguments[0].scrollHeight", followers_ul)
    time.sleep(random.randrange(6, 10))
    browser.execute_script("arguments[0].scrollTop = arguments[0].scrollHeight", followers_ul)
    time.sleep(random.randrange(6, 10))
    browser.execute_script("arguments[0].scrollTop = arguments[0].scrollHeight", followers_ul)
    time.sleep(random.randrange(6, 10))
    

    all_div = followers_ul.find_elements_by_tag_name("li")
    for us in all_div:
        us = us.find_element_by_tag_name("a").get_attribute("href")
        if result == 'usernames':
            us1 = us.replace("https://www.instagram.com/", "")
            us = us1.replace("/", "")
        followers_list.append(us)
    time.sleep(4)
    f3 = open('userlist.txt', 'w')
    for list in followers_list:
        f3.write(list + '\n')
    print(f'Got: {len(followers_list)} usernames of {amount}. Saved to file.')
time.sleep(random.randrange(5, 7))

用户尝试的简化方案

用户尝试通过嵌套循环消除重复代码,实现如下:

for i in range(1, loops_count + 1):
    for j in range(1,31):
        browser.execute_script(f"arguments[0].scrollTop = arguments[0].scrollHeight", followers_ul)

方案评估与规范实现

对尝试方案的判断

嵌套循环的核心思路是合理的,但存在3个明显问题:

  • 遗漏了每次滚动后的随机等待逻辑:滚动后页面需要时间加载新内容,去掉等待会因为DOM未更新导致后续元素抓取失败
  • 内层循环次数硬编码为31,没有抽为可配置参数,依然无法实现单参数控制滚动次数的需求
  • execute_script的脚本字符串没有需要插值的变量,没必要用f-string修饰,反而会增加不必要的解析开销和转义风险

规范实现代码

把可变参数全部抽为顶部可配置项,滚动逻辑通过内层循环复用,不需要重复编写:

# ========== 仅需修改此处配置即可控制滚动逻辑 ==========
SCROLL_COUNT_PER_ROUND = 4  # 每轮大循环下的滚动次数,需要20次直接修改该值即可
SCROLL_WAIT_MIN = 6         # 每次滚动后的最小等待秒数
SCROLL_WAIT_MAX = 10        # 每次滚动后的最大等待秒数
# =====================================================

for i in range(1, loops_count + 1):
    # 复用滚动+等待逻辑,无需重复写代码
    for _ in range(SCROLL_COUNT_PER_ROUND):
        browser.execute_script("arguments[0].scrollTop = arguments[0].scrollHeight", followers_ul)
        time.sleep(random.randrange(SCROLL_WAIT_MIN, SCROLL_WAIT_MAX))

    # 后续元素抓取、存储逻辑保持原有功能不变
    all_div = followers_ul.find_elements_by_tag_name("li")
    for us in all_div:
        us = us.find_element_by_tag_name("a").get_attribute("href")
        if result == 'usernames':
            us1 = us.replace("https://www.instagram.com/", "")
            us = us1.replace("/", "")
        followers_list.append(us)
    time.sleep(4)
    # 改用上下文管理器操作文件,自动处理文件关闭,避免资源泄漏
    with open('userlist.txt', 'w') as f:
        for follower in followers_list:
            f.write(follower + '\n')
    print(f'Got: {len(followers_list)} usernames of {amount}. Saved to file.')

time.sleep(random.randrange(5, 7))

优化说明

  • 所有可变配置集中在代码顶部,调整滚动次数、等待时长不需要修改业务循环逻辑
  • 用不到的循环变量统一用_命名,符合Python编码规范
  • 文件写入改用with上下文管理器,不需要手动调用close(),避免异常场景下文件句柄泄漏
  • 移除了不必要的f-string修饰,脚本执行更稳定

内容的提问来源于stack exchange,提问作者Bobby Wibowo

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.30 18:01:03