新闻详情

新闻详情

首页 / 资讯中心 / 详情

谷歌图片搜索 API:字段口径、外链防盗链与成本纪律

发布时间:2026/9/28 4:37:27来源:尧图网络
谷歌图片搜索 API:字段口径、外链防盗链与成本纪律
图片端点是六个端点里最贵的:每次成功请求 2 credits,是搜索端点的两倍;它的返回结构也最容易踩坑——你以为有title,它经常没有;你以为数组一定在,它可能整个缺席。这篇把字段口径、请求路径和成本纪律一次讲清,给一个能直接跑的采集脚本。先说两个最容易栽的点:端点路径是/google/image/search(单数 image),不是直觉上的 images;以及结果里只有rank、link、image_url三个字段是必填,其余全是可选,口径见 SerpBase 官方文档的图片端点字段表。字段口径每次成功请求 2 credits,失败自动退款(credits_charged为 0)。入参四个:q必填,hl/gl/page可选(默认 en/us/1)。返回顶层images数组是可选的——当解析到图片结果时才有,零结果时可能整个键都不存在。字段必要性文档原话rank必填“本响应内 1 起算位次”link必填“解析器返回的主链接”image_url必填“完整图片 URL”title可选“当解析到图片标题或 alt 文本时”position可选“rank 的别名,可用时”url / display_url / source_url可选视归一化与重定向情况thumbnail_url / thumbnail可选“当 Google 暴露缩略图时”source / domain可选“当解析到来源文本/域名时”文档还明确提醒:“部分 Google Images 载荷形态只暴露 rank/link,不暴露每个归一化别名”——所以解析器一律.get()兜底,别裸取。脚本importcsv,requests APIhttps://api.serpbase.dev/google/image/searchKEY你的 API Keydefimage_search(q:str,page:int1)-list:resprequests.post(API,headers{X-API-Key:KEY,Content-Type:application/json},json{q:q,hl:zh-CN,gl:cn,page:page},timeout30)dataresp.json()ifdata.get(status)!0:raiseRuntimeError(f{data.get(status)}:{data.get(error)})returndata.get(images,[])# 数组本身是可选的rows[]forkwin[机械键盘 产品图,静音键盘 白色]:foriteminimage_search(kw)[:10]:rows.append({关键词:kw,位次:item[rank],图片URL:item[image_url],标题:item.get(title,),# 可能为空来源:item.get(source,),域名:item.get(domain,),})withopen(images.csv,w,newline,encodingutf-8-sig)asf:wcsv.DictWriter(f,fieldnames[关键词,位次,图片URL,标题,来源,域名])w.writeheader()w.writerows(rows)print(f共{len(rows)}条 → images.csv)三条实践纪律先判 status 再碰 images。零结果查询可能返回status: 0且根本没有images键;用data.get(images, []),别写data[images]——那是线上脚本最常见的 KeyError。外链防盗链要当回事。image_url是第三方站点上的图片地址,直接img src热链到你自己页面,对方换域名、加 referer 校验或下架,你的页面就是一片碎图。稳妥做法是下载到自己存储再引用,并保留来源字段备查;商用前确认对方站点的使用条款。2 credits 一次,重复查询是最大的浪费。同一个 (q, hl, gl, page) 的结果短期内稳定,采集前先按这个四元组去重;缓存到本地磁盘,第二次访问零成本。20 个关键词一轮就是 40 credits,重复跑三遍就够吃掉免费额度的一半。成本账每关键词每次请求 2 credits:10 个关键词一轮 20 credits,100 次免费额度够跑五轮——但带着缓存跑,实际只会用掉 10 credits,剩下的是留给调试的。标准包按 $10/20k($0.50/1k)算,一次成功请求合一美分,监控类需求一天两轮也就几毛钱。FAQ为什么我的 title 全是空的?它本来就可选——大量真实页面没有 alt 文本,解析器无从填充。展示逻辑要能在无标题时正常工作,别把它当主字段用。link 和 image_url 哪个能直接放进 img 标签?image_url是完整图片地址,放 src 用它;link是解析器的主结果链接,可能是来源页面而不是图片文件本身。两者都建议先 HEAD 一下确认可达再落库。有 device 参数吗?没有。device 只属于搜索端点;图片端点入参就是 q/hl/gl/page 四个。返回的图片有版权风险吗?接口只返回公开可索引的结果,不改变图片本身的版权状态。批量商用前走自己的合规审查,保留来源域名字段就是为这个准备的。把脚本里的关键词换成你的监测对象,先跑一轮看title/source在你这个行业的填充率,再决定展示层怎么写。
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

WholeBodyWAM:基于 WBC-协同将预训练“世界-动作”先验泛化至人形机器人的移动与操作任务 2026/9/28 4:37:23

WholeBodyWAM:基于 WBC-协同将预训练“世界-动作”先验泛化至人形机器人的移动与操作任务

26年9月来自港中文、港大和英国牛津大学的人类未来研究所(Future of Humanity Institute,FHI)的论文“WholeBodyWAM: Generalizing Pre-trained World–Action Priors to Humanoid Loco-Manipulation via WBC-Grounded Coordination”。 这篇论文 WholeBodyWAM 研究如何把预…

阅读更多 →
基于 JMeter 的 SSE LLM 插件:轻松进行大模型性能测试 2026/9/28 4:37:23

基于 JMeter 的 SSE LLM 插件:轻松进行大模型性能测试

文章目录🚀 项目背景📦 什么是 jmeter-sse-llm-plugin?✨ 核心功能🛠️ 快速上手1. 安装插件2. 配置 SSE-LLM Stream Sampler📊 典型使用场景场景一:压测 GPT-4 响应速度场景二:Dify 工作流性能…

阅读更多 →
从“抵押品”到“现金流”:8·28新政下存量商业资产的价值重估与合规出路 2026/9/28 4:37:23

从“抵押品”到“现金流”:8·28新政下存量商业资产的价值重估与合规出路

2026年8月28日,住建部、央行、金融监管总局、自然资源部、证监会五部门同日集中发布八份重磅文件,覆盖商品住房销售、房地产信贷、资本市场融资三大领域。对住宅端,政策着力于“保交付、稳需求”;但对商业地产而言,这场…

阅读更多 →
learning blogs 2 2026/9/28 4:37:23

learning blogs 2

260922 !!!注意这个,不然你scanf连着直接让你暴雷信不信 空格空格空格!!!3.scanf 读取char用%c,%c会读取空格,如要取消其对空格的读取,在%c前加上空格 即可ch…

阅读更多 →
【老计带你懂AI算法】10:经典时间序列预测,从移动平均到ARIMA和Prophet 2026/9/28 4:37:23

【老计带你懂AI算法】10:经典时间序列预测,从移动平均到ARIMA和Prophet

【老计带你懂AI算法】10:经典时间序列预测,从移动平均到ARIMA和Prophet开头:带时间顺序的数据,是另一个物种 前面讲的所有模型,处理的数据有个共同特点,样本之间是独立的、没有先后顺序。这套房和那套房、这…

阅读更多 →
RAG进阶-RAG的十个优化技巧 2026/9/28 4:37:17

RAG进阶-RAG的十个优化技巧

为什么RAG不是算法问题而是工程问题? RAG 进阶:10 个优化技巧RAG 的基础流程并不复杂,真正困难的是让它在真实业务中同时做到:检索准确、上下文完整、生成可信、延迟可控、成本可接受。一、为什么说 RAG 是工程问题? 一…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉