当前位置:首页 >  站长 >  网站运营 >  正文

GSC 界面只有 1000 行?用官方 API 把查询数据全量拉下来

 2026-09-09 14:30  来源: 互联网   我来投稿 撤稿纠错

  一键部署OpenClaw

Search Console 的效果报表界面只能翻到 1000 行,界面导出 CSV 也有限制——站点过了几百个内容页之后,查询词数据根本看不全。官方早就留了正门:Search Console API 的 searchAnalytics 接口,单次最多返回 25000 行,翻页可以继续往后拿,前面几篇讲的排名追踪、CTR 筛查、蚕食检测,数据源头都可以换成它,一步到位。

接入分三步:Google Cloud 建项目并启用 Search Console API、创建服务账号把 JSON 密钥下载下来、在 GSC 资源设置里把这个服务账号的邮箱添加为协作者(漏了这步会一直报 403 权限错误)。然后装官方客户端库直接调。配额官方写得清楚:搜索分析接口单站单用户每分钟 1200 次查询,另有按 10 分钟和按天计的负载配额——按页面加查询词分组的请求成本最高,日期范围越长越贵,所以每次请求把日期范围收窄、别反复重查同样的历史数据,正常使用根本碰不到配额墙。

# pip install google-api-python-client google-auth
from google.oauth2 import service_account
from googleapiclient.discovery import build

SCOPES = ["https://www.googleapis. com/auth/webmasters.readonly"]
creds = service_account.Credentials.from_service_account_file(
"sa.json", scopes=SCOPES)
svc = build("searchconsole", "v1", credentials=creds)

body = {"startDate": "2026-08-01", "endDate": "2026-08-31",
"dimensions": ["query"], "rowLimit": 25000}

rows, start = [], 0
while True:
body["startRow"] = start
resp = svc.searchanalytics().query(
siteUrl="sc-domain:example.com", body=body).execute()
batch = resp.get("rows", [])
rows += batch
if len(batch) < 25000:
break
start += 25000

print(f"共 {len(rows)} 行")
for r in rows[:5]:
print(r["keys"], r["clicks"], r["impressions"],
round(r["ctr"], 4), round(r["position"], 1))

返回的每行带 clicks、impressions、ctr、position 四个指标,dimensions 要什么 keys 里就是什么,换个 dimensions 列表就是页面报告、设备报告、国家报告。几个坑提前踩平:siteUrl 写法分两种,域名级资源用 sc-domain:example.com,网址级用完整的 https:// 前缀,写错直接报 400;单次 rowLimit 上限 25000,翻页用 startRow 递增;官方说明每日每个搜索类型最多暴露 5 万行,站点查询词真超过这个量,去资源设置里配 BigQuery 大批量导出,那才是全量数据的正规出口。遇到 429 配额错误就加指数退避重试,官方文档给的正是这个方案。

# 常见 dimensions 组合

# ["query"]              关键词报告

# ["page"]               页面报告

# ["query", "page"]      蚕食检测(成本最高,日期收窄)

# ["device"]             移动端/桌面端拆分

# ["date", "query"]      按天追踪排名趋势

验证分两层:拉出来的总行数和界面效果报表对量级(界面显示的是截断样本,API 数只会多不会少);抽五个词和界面数值核对 clicks 和 position 是否一致。跑通之后,把每月一次的全量拉取挂进 crontab,查询词快照按月存档——223 的排名日志、226 的 CTR 清单、228 的蚕食扫描,从此都吃这份最权威的数据源。官方 API 免费且配额宽裕,唯一缺的还是那批匿名化查询词,官方的批量导出同样不含它们,这是隐私红线,绕不过去也不该绕。

相关阅读:全量数据是报表的地基。《SEO 自动化总清单:日、周、月、季各该跑什么》里日报月报的数据源都指向本篇的导出脚本,总纲建议收藏,按节奏跑数。

申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!

相关文章

热门排行

信息推荐