news 2026/9/26 14:58:56

谷歌图片搜索 API:字段口径、外链防盗链与成本纪律

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
谷歌图片搜索 API:字段口径、外链防盗链与成本纪律

图片端点是六个端点里最贵的:每次成功请求 2 credits,是搜索端点的两倍;它的返回结构也最容易踩坑——你以为有title,它经常没有;你以为数组一定在,它可能整个缺席。这篇把字段口径、请求路径和成本纪律一次讲清,给一个能直接跑的采集脚本。

先说两个最容易栽的点:端点路径是/google/image/search(单数 image),不是直觉上的 images;以及结果里只有rank、link、image_url三个字段是必填,其余全是可选,口径见 SerpBase 官方文档的图片端点字段表。

字段口径

每次成功请求 2 credits,失败自动退款(credits_charged为 0)。入参四个:q必填,hl/gl/page可选(默认 en/us/1)。返回顶层images数组是可选的——"当解析到图片结果时"才有,零结果时可能整个键都不存在。

字段必要性文档原话
rank必填“本响应内 1 起算位次”
link必填“解析器返回的主链接”
image_url必填“完整图片 URL”
title可选“当解析到图片标题或 alt 文本时”
position可选“rank 的别名,可用时”
url / display_url / source_url可选视归一化与重定向情况
thumbnail_url / thumbnail可选“当 Google 暴露缩略图时”
source / domain可选“当解析到来源文本/域名时”

文档还明确提醒:“部分 Google Images 载荷形态只暴露 rank/link,不暴露每个归一化别名”——所以解析器一律.get()兜底,别裸取。

脚本

importcsv,requests API="https://api.serpbase.dev/google/image/search"KEY="你的 API Key"defimage_search(q:str,page:int=1)->list:resp=requests.post(API,headers={"X-API-Key":KEY,"Content-Type":"application/json"},json={"q":q,"hl":"zh-CN","gl":"cn","page":page},timeout=30)data=resp.json()ifdata.get("status")!=0:raiseRuntimeError(f"{data.get('status')}:{data.get('error')}")returndata.get("images",[])# 数组本身是可选的rows=[]forkwin["机械键盘 产品图","静音键盘 白色"]:foriteminimage_search(kw)[:10]:rows.append({"关键词":kw,"位次":item["rank"],"图片URL":item["image_url"],"标题":item.get("title",""),# 可能为空"来源":item.get("source",""),"域名":item.get("domain",""),})withopen("images.csv","w",newline="",encoding="utf-8-sig")asf:w=csv.DictWriter(f,fieldnames=["关键词","位次","图片URL","标题","来源","域名"])w.writeheader()w.writerows(rows)print(f"共{len(rows)}条 → images.csv")

三条实践纪律

  1. 先判 status 再碰 images。零结果查询可能返回status: 0且根本没有images键;用data.get("images", []),别写data["images"]——那是线上脚本最常见的 KeyError。
  2. 外链防盗链要当回事。image_url是第三方站点上的图片地址,直接<img src>热链到你自己页面,对方换域名、加 referer 校验或下架,你的页面就是一片碎图。稳妥做法是下载到自己存储再引用,并保留来源字段备查;商用前确认对方站点的使用条款。
  3. 2 credits 一次,重复查询是最大的浪费。同一个 (q, hl, gl, page) 的结果短期内稳定,采集前先按这个四元组去重;缓存到本地磁盘,第二次访问零成本。20 个关键词一轮就是 40 credits,重复跑三遍就够吃掉免费额度的一半。

成本账

每关键词每次请求 2 credits:10 个关键词一轮 20 credits,100 次免费额度够跑五轮——但带着缓存跑,实际只会用掉 10 credits,剩下的是留给调试的。标准包按 $10/20k($0.50/1k)算,一次成功请求合一美分,监控类需求一天两轮也就几毛钱。

FAQ

为什么我的 title 全是空的?它本来就可选——大量真实页面没有 alt 文本,解析器无从填充。展示逻辑要能在无标题时正常工作,别把它当主字段用。

link 和 image_url 哪个能直接放进 img 标签?image_url是完整图片地址,放 src 用它;link是解析器的主结果链接,可能是来源页面而不是图片文件本身。两者都建议先 HEAD 一下确认可达再落库。

有 device 参数吗?没有。device 只属于搜索端点;图片端点入参就是 q/hl/gl/page 四个。

返回的图片有版权风险吗?接口只返回公开可索引的结果,不改变图片本身的版权状态。批量商用前走自己的合规审查,保留来源域名字段就是为这个准备的。

把脚本里的关键词换成你的监测对象,先跑一轮看title/source在你这个行业的填充率,再决定展示层怎么写。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/26 14:58:08

WorkBuddy Enterprise 企业级 AI 平台与 Agent 生态实战指南

1. 从零理解 WorkBuddy Enterprise 的定位与核心价值 1.1 这个平台到底解决什么问题 WorkBuddy Enterprise 是腾讯云推出的一套企业级 AI 平台与 Agent 生态产品。说白了&#xff0c;它要解决的核心问题是&#xff1a;企业想用 AI&#xff0c;但不知道怎么把 AI 能力安全、可控…

作者头像 李华
网站建设 2026/9/26 14:57:58

风光联合出力场景生成:Copula建模在Matlab中的完整实现

搞新能源并网计算的同学&#xff0c;大概率都撞过这么一堵墙&#xff1a;手上明明有风电场和光伏电站的实测功率数据&#xff0c;做随机优化的时候要生成风光出力场景&#xff0c;脑子里第一反应就是把风电、光伏当成两个互不干扰的独立变量&#xff0c;分别采样再随机拼在一起…

作者头像 李华
网站建设 2026/9/26 14:55:51

Atlas 300V 24G部署YOLO全攻略:从硬件定位到调优避坑

前阵子有个朋友在群里问我&#xff1a;Atlas 300V 24G到底算不算运算加速卡&#xff1f;他手头正好有预算&#xff0c;想在一台闲置服务器上做视频结构化&#xff0c;纠结了半天要不要选这张卡&#xff0c;又看到网上全是拿它部署YOLO的教程&#xff0c;反而更蒙了。这个问题其…

作者头像 李华
网站建设 2026/9/26 14:54:18

AIGC全栈性能优化实战:从模型推理到云渲染的延迟与成本控制

1. 大模型落地为什么总卡在“算力”和“延迟”这两道坎上 做过AIGC项目的人都有一个共同感受&#xff1a;模型效果本身已经不是最头疼的事了&#xff0c;真正让人夜不能寐的是两件事——算力成本压不住&#xff0c;互动延迟下不来。我参与过几个从零到一的AIGC应用搭建&#xf…

作者头像 李华