主题
ai_optimization/gemini/llm_scraper/live/html
POST /v3/ai_optimization/gemini/llm_scraper/live/html
接口说明
POST https://api.seermartech.cn/v3/ai_optimization/gemini/llm_scraper/live/html
本接口根据指定的、语言和地理位置,实时抓取 Gemini 大语言模型结果页面,并返回原始 HTML。
每个请求只能提交 1 个任务。平台限流以认证说明中的 30/60/120 次/分钟规则为准。请求体使用 UTF-8 编码的 JSON 数组格式。
参考价约 ¥0.0288 / 次。扣费以响应头 X-SeerMarTech-Charge-CNY 为准。
请求参数
请求体格式:
json
[
{
"keyword": "albert einstein",
"language_code": "en",
"location_code": 2840
}
]| 参数 | 类型 | 填 | 说明 |
|---|---|---|---|
keyword 平台限流以认证说明中的 30/60/120 次/分钟规则为准个字符。请求中的百分号编码会被解码,字符 + 会被解码为空格。<br><br>如需传递 %,请编码为 %25;如需传递 +,请编码为 %2B。 | |||
location_name | string | 条件填 | 搜索引擎地理位置的完整名称。未指定 location_code 或 location_coordinate 时填。使用该参数后,无需再传递另外两个位置参数。<br><br>可通过位置列表接口获取可用值:/v3/ai_optimization/gemini/llm_scraper/locations<br><br>示例:United States |
location_code | integer | 条件填 | 搜索引擎地理位置代码。未指定 location_name 或 location_coordinate 时填。使用该参数后,无需再传递另外两个位置参数。<br><br>可通过位置列表接口获取可用值:/v3/ai_optimization/gemini/llm_scraper/locations<br><br>示例:2840 |
location_coordinate | string | 条件填 | 地理位置 GPS 坐标,格式为 纬度,经度,半径。未指定 location_name 或 location_code 时填。<br><br>纬度和经度最多支持 7 位小数;半径最小值为 199 毫米,最大值为 199999 毫米。<br><br>示例:53.476225,-2.243572,200 |
language_name | string | 条件填 | 搜索引擎语言的完整名称。未指定 language_code 时填。使用该参数后,无需再传递 language_code。<br><br>可通过语言列表接口获取可用值:/v3/ai_optimization/gemini/llm_scraper/languages<br><br>示例:English |
language_code | string | 条件填 | 搜索引擎语言代码。未指定 language_name 时填。使用该参数后,无需再传递 language_name。<br><br>可通过语言列表接口获取可用值:/v3/ai_optimization/gemini/llm_scraper/languages<br><br>示例:en |
expand_citations | boolean | 否 | 是否返回 HTML 结果中的展开式引用栏。默认值为 false。设置为 true 后,响应会展开引用栏中的 HTML 数据。 |
tag | string | 否 | 用户自定义任务标识,最长 255 个字符。可用于标记任务并匹响应结果。提交的值会原样返回在响应的 data 对象中。 |
location_name、location_code、location_coordinate 三至少传递一个,且只能使用一个。
language_name 和 language_code须至少传递一个,且只能使用一个。
响应字段
接口返回 JSON 数据 tasks 任务数组。
顶层字段
| 字段 | 类型 | 说明 |
|---|---|---|
version | string | 当前 API 版本。 |
status_code | integer | 请求级状态码。 |
status_message | string | 请求级状态说明。 |
time | string | 请求执行耗时,单位为秒。 |
cost | float | 平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。 |
tasks_count | integer | tasks 数组中的任务数量。 |
tasks_error | integer | tasks 数组中返回错误的任务数量。 |
tasks | array | 任务结果数组。 |
tasks 字段
| 字段 | 类型 | 说明 |
|---|---|---|
id | string | 任务唯一标识,采用 UUID 格式。 |
status_code | integer | 任务状态码,通常为 10000 至 60000。 |
status_message | string | 任务状态说明。 |
time | string | 任务执行耗时,单位为秒。 |
cost | float | 平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。 |
result_count | integer | result 数组中的数量。 |
path | array | 请求 URL 路径。 |
data | object | 创建任务时提交的参数。 |
result | array | 当前任务的结果数组。 |
result 字段
| 字段 | 类型 | 说明 |
|---|---|---|
keyword | string | 请求中的。返回时会对 %## 编码进行解码,字符 + 会被解码为空格。 |
location_code | integer | 请求中的地理位置代码。 |
language_code | string | 请求中的语言代码。 |
datetime | string | 获取结果的日期和时间,采用 UTC 格式:yyyy-mm-dd hh-mm-ss +00:00。<br><br>示例:2019-11-15 12:57:46 +00:00 |
items_count | integer | items 数组中的结果数量。 |
items | array | 抓取到的结果项数组。 |
items 字段
| 字段 | 类型 | 说明 |
|---|---|---|
page | integer | 返回的 HTML 页面序号。 |
date | string | HTML 页面扫描时间,格式为:yyyy-mm-dd hh:mm:ss +UTC时差小时:UTC时差分钟。<br><br>示例:2019-11-15 12:57:46 +00:00 |
html | string | 抓取到的原始 HTML 页面。 |
请求示例
curl
bash
curl --location --request POST \
"https://api.seermartech.cn/v3/ai_optimization/gemini/llm_scraper/live/html" \
--header "Authorization: Bearer smt_live_YOUR_KEY" \
--header "Content-Type: application/json" \
--data-raw '[
{
"language_code": "en",
"location_code": 2840,
"keyword": "albert einstein"
}
]'Python
python
import requests
url = "https://api.seermartech.cn/v3/ai_optimization/gemini/llm_scraper/live/html"
headers = {
"Authorization": "Bearer smt_live_YOUR_KEY",
"Content-Type": "application/json"
}
# 每次请求只能提交一个任务
payload = [
{
"language_code": "en",
"location_code": 2840,
"keyword": "albert einstein"
}
]
response = requests.post(url, headers=headers, json=payload)
result = response.json()
if result.get("status_code") == 20000:
print(result)
else:
print(
"请求失败,状态码:{},消息:{}".format(
result.get("status_code"),
result.get("status_message")
)
)TypeScript
typescript
import axios from "axios";
const url =
"https://api.seermartech.cn/v3/ai_optimization/gemini/llm_scraper/live/html";
const payload = [
{
language_code: "en",
location_code: 2840,
keyword: "albert einstein",
},
];
axios
.post(url, payload, {
headers: {
Authorization: "Bearer smt_live_YOUR_KEY",
"Content-Type": "application/json",
},
})
.then((response) => {
// 处理接口返回结果
console.log(response.data);
})
.catch((error) => {
console.error("请求失败:", error.response?.data || error.message);
});PHP
php
<?php
$url = 'https://api.seermartech.cn/v3/ai_optimization/gemini/llm_scraper/live/html';
$payload = [
[
'language_code' => 'en',
'location_code' => 2840,
'keyword' => 'albert einstein'
]
];
$ch = curl_init($url);
curl_setopt_array($ch, [
CURLOPT_POST => true,
CURLOPT_RETURNTRANSFER => true,
CURLOPT_HTTPHEADER => [
'Authorization: Bearer smt_live_YOUR_KEY',
'Content-Type: application/json'
],
CURLOPT_POSTFIELDS => json_encode($payload, JSON_UNESCAPED_UNICODE)
]);
$response = curl_exec($ch);
if ($response === false) {
echo '请求失败:' . curl_error($ch);
} else {
$result = json_decode($response, true);
print_r($result);
}
curl_close($ch);响应示例
json
{
"version": "0.1.20260209",
"status_code": 20000,
"status_message": "Ok.",
"time": "25.1849 sec.",
"cost": 0.0288,
"tasks_count": 1,
"tasks_error": 0,
"tasks": [
{
"id": "01234567-89ab-cdef-0123-456789abcdef",
"status_code": 20000,
"status_message": "Ok.",
"time": "25.1849 sec.",
"cost": 0.0288,
"result_count": 1,
"path": [
"v3",
"ai_optimization",
"gemini",
"llm_scraper",
"live",
"html"
],
"data": {
"api": "ai_optimization",
"function": "llm_scraper",
"se": "gemini",
"language_code": "en",
"location_code": 2840,
"keyword": "albert einstein",
"postback_data": "html",
"device": "desktop",
"os": "windows"
},
"result": [
{
"keyword": "albert einstein",
"location_code": 2840,
"language_code": "en",
"datetime": "2026-02-09 12:57:46 +00:00",
"items_count": 1,
"items": [
{
"page": 1,
"date": "2026-02-09 12:57:46 +00:00",
"html": "<html>...</html>"
}
]
}
]
}
]
}状态码与错误处理
status_code 和 status_message 会同时出现在响应顶层和任务对象中:
- 顶层状态码用于判断整个请求是否成功。
- 任务级状态码用于判断单个任务是否成功。
20000通常表示请求成功。- 当
tasks_error大于0时,应逐项检查tasks中的任务状态。 - 建议在业务系统中实现时、网络异常、参数错误和任务级失败的处理逻辑。
实用场景
- 抓取指定的 Gemini 原始结果页面,还原完整 HTML 结构,便于建立模型结果归档和审计系统。
- 对比不同国家、地区和语言下的模型回答页面,评估化 SEO在不同市场中的呈现差异。
- 开启引用栏扩展并提取引用,分析品牌或网站在大语言模型回答中的引用来源与。
- 按定期采集模型结果快,监测品牌可见度、竞品提及率和 AI 搜索表现变化。
- 结合自定义
tag管理批量任务,将抓取结果到分组、客户项目或 SEO 实验批次。