You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用python-twitter库获取指定地区趋势的1000条非转推最新推文?

解决python-twitter库获取趋势对应推文的问题

我来帮你梳理下问题所在,以及给出可行的解决方案:

问题分析

你的代码里有几个关键问题导致无法正常获取趋势对应的推文:

  1. 趋势对象处理错误:api.GetTrendsWoeid(WOEID)返回的是Trend对象列表,不是直接的关键词字符串。你需要提取每个趋势对象的name属性作为搜索词,而非直接把整个对象传给GetSearch。
  2. 无法一次性获取1000条推文:Twitter搜索API单次请求最多返回100条结果,要拿到1000条需要分页循环请求,利用max_id参数获取更早的推文。
  3. 未实现转推剔除:可以通过搜索词过滤规则,或者在结果中筛选掉带retweeted_status属性的推文。

修正后的代码

import twitter
from vaderSentiment.vaderSentiment import SentimentIntensityAnalyzer

ACCESS_TOKEN = 'XXXX'
ACCESS_TOKEN_SECRET = 'XXXX'
CONSUMER_KEY = 'XXXX'
CONSUMER_SECRET = 'XXXX'

# Define the location id for the UK
WOEID = 23424975
# Define language of tweets
LANG = "en"
# Define type of tweets we are after
TWEETS_TYPE = "recent"
# Define max number of tweets per trend
MAX_STATUSES = 1000

# API config
api = twitter.Api(CONSUMER_KEY, CONSUMER_SECRET, ACCESS_TOKEN, ACCESS_TOKEN_SECRET, sleep_on_rate_limit=True)
print(api.VerifyCredentials())

# Query the Twitter API for the current top 10 trends in the UK.
uk_trends = api.GetTrendsWoeid(WOEID)
print("UK Top 10 Trends:")
for idx, trend in enumerate(uk_trends[:10], 1):
    print(f"{idx}. {trend.name}")

# Fetch 1000 most recent non-retweet tweets for each trend
for trend in uk_trends[:10]:
    trend_name = trend.name
    print(f"\n===== Fetching tweets for: {trend_name} =====")
    
    all_tweets = []
    max_id = None
    remaining = MAX_STATUSES
    
    while remaining > 0:
        # 单次最多请求100条,同时通过搜索词过滤转推
        search_results = api.GetSearch(
            term=f"{trend_name} -filter:retweets",
            count=min(remaining, 100),
            lang=LANG,
            result_type=TWEETS_TYPE,
            max_id=max_id
        )
        
        if not search_results:
            print("No more tweets available for this trend.")
            break
        
        all_tweets.extend(search_results)
        # 更新max_id为最后一条推文ID减1,避免重复获取
        max_id = search_results[-1].id - 1
        remaining -= len(search_results)
        print(f"Got {len(search_results)} tweets, still need {remaining}")
    
    print(f"Total non-retweet tweets fetched: {len(all_tweets)}\n")
    # 这里可以添加对推文的后续处理,比如情感分析等

关于是否直接使用Twitter API的建议

其实python-twitter本身就是官方Twitter API的封装,它已经帮你处理了认证、请求格式、速率限制等繁琐细节,完全不需要直接调用原生API,继续使用这个库就能完成你的需求。不过要注意几个限制:

  • 搜索API只能返回最近7天内的推文,无法获取更早的内容
  • 即使开启了sleep_on_rate_limit=True,大规模获取数据仍需要耐心等待API速率恢复
  • 部分小众趋势可能无法凑够1000条非转推推文,这取决于该趋势的实际传播热度

内容的提问来源于stack exchange,提问作者PapaSmurf

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.28 06:40:12