Skip to content

ai_optimization/gemini/llm_scraper/live/html

POST /v3/ai_optimization/gemini/llm_scraper/live/html

接口说明

POST https://api.seermartech.cn/v3/ai_optimization/gemini/llm_scraper/live/html

本接口根据指定的、语言和地理位置,实时抓取 Gemini 大语言模型结果页面,并返回原始 HTML。

每个请求只能提交 1 个任务。平台限流以认证说明中的 30/60/120 次/分钟规则为准。请求体使用 UTF-8 编码的 JSON 数组格式。

参考价约 ¥0.0288 / 次。扣费以响应头 X-SeerMarTech-Charge-CNY 为准。

请求参数

请求体格式:

json
[
  {
    "keyword": "albert einstein",
    "language_code": "en",
    "location_code": 2840
  }
]
参数类型说明
keyword 平台限流以认证说明中的 30/60/120 次/分钟规则为准个字符。请求中的百分号编码会被解码,字符 + 会被解码为空格。<br><br>如需传递 %,请编码为 %25;如需传递 +,请编码为 %2B
location_namestring条件填搜索引擎地理位置的完整名称。未指定 location_codelocation_coordinate 时填。使用该参数后,无需再传递另外两个位置参数。<br><br>可通过位置列表接口获取可用值:/v3/ai_optimization/gemini/llm_scraper/locations<br><br>示例:United States
location_codeinteger条件填搜索引擎地理位置代码。未指定 location_namelocation_coordinate 时填。使用该参数后,无需再传递另外两个位置参数。<br><br>可通过位置列表接口获取可用值:/v3/ai_optimization/gemini/llm_scraper/locations<br><br>示例:2840
location_coordinatestring条件填地理位置 GPS 坐标,格式为 纬度,经度,半径。未指定 location_namelocation_code 时填。<br><br>纬度和经度最多支持 7 位小数;半径最小值为 199 毫米,最大值为 199999 毫米。<br><br>示例:53.476225,-2.243572,200
language_namestring条件填搜索引擎语言的完整名称。未指定 language_code 时填。使用该参数后,无需再传递 language_code。<br><br>可通过语言列表接口获取可用值:/v3/ai_optimization/gemini/llm_scraper/languages<br><br>示例:English
language_codestring条件填搜索引擎语言代码。未指定 language_name 时填。使用该参数后,无需再传递 language_name。<br><br>可通过语言列表接口获取可用值:/v3/ai_optimization/gemini/llm_scraper/languages<br><br>示例:en
expand_citationsboolean是否返回 HTML 结果中的展开式引用栏。默认值为 false。设置为 true 后,响应会展开引用栏中的 HTML 数据。
tagstring用户自定义任务标识,最长 255 个字符。可用于标记任务并匹响应结果。提交的值会原样返回在响应的 data 对象中。

location_namelocation_codelocation_coordinate 三至少传递一个,且只能使用一个。

language_namelanguage_code须至少传递一个,且只能使用一个。

响应字段

接口返回 JSON 数据 tasks 任务数组。

顶层字段

字段类型说明
versionstring当前 API 版本。
status_codeinteger请求级状态码。
status_messagestring请求级状态说明。
timestring请求执行耗时,单位为秒。
costfloat平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。
tasks_countintegertasks 数组中的任务数量。
tasks_errorintegertasks 数组中返回错误的任务数量。
tasksarray任务结果数组。

tasks 字段

字段类型说明
idstring任务唯一标识,采用 UUID 格式。
status_codeinteger任务状态码,通常为 1000060000
status_messagestring任务状态说明。
timestring任务执行耗时,单位为秒。
costfloat平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。
result_countintegerresult 数组中的数量。
patharray请求 URL 路径。
dataobject创建任务时提交的参数。
resultarray当前任务的结果数组。

result 字段

字段类型说明
keywordstring请求中的。返回时会对 %## 编码进行解码,字符 + 会被解码为空格。
location_codeinteger请求中的地理位置代码。
language_codestring请求中的语言代码。
datetimestring获取结果的日期和时间,采用 UTC 格式:yyyy-mm-dd hh-mm-ss +00:00。<br><br>示例:2019-11-15 12:57:46 +00:00
items_countintegeritems 数组中的结果数量。
itemsarray抓取到的结果项数组。

items 字段

字段类型说明
pageinteger返回的 HTML 页面序号。
datestringHTML 页面扫描时间,格式为:yyyy-mm-dd hh:mm:ss +UTC时差小时:UTC时差分钟。<br><br>示例:2019-11-15 12:57:46 +00:00
htmlstring抓取到的原始 HTML 页面。

请求示例

curl

bash
curl --location --request POST \
  "https://api.seermartech.cn/v3/ai_optimization/gemini/llm_scraper/live/html" \
  --header "Authorization: Bearer smt_live_YOUR_KEY" \
  --header "Content-Type: application/json" \
  --data-raw '[
    {
      "language_code": "en",
      "location_code": 2840,
      "keyword": "albert einstein"
    }
  ]'

Python

python
import requests

url = "https://api.seermartech.cn/v3/ai_optimization/gemini/llm_scraper/live/html"

headers = {
    "Authorization": "Bearer smt_live_YOUR_KEY",
    "Content-Type": "application/json"
}

# 每次请求只能提交一个任务
payload = [
    {
        "language_code": "en",
        "location_code": 2840,
        "keyword": "albert einstein"
    }
]

response = requests.post(url, headers=headers, json=payload)
result = response.json()

if result.get("status_code") == 20000:
    print(result)
else:
    print(
        "请求失败,状态码:{},消息:{}".format(
            result.get("status_code"),
            result.get("status_message")
        )
    )

TypeScript

typescript
import axios from "axios";

const url =
  "https://api.seermartech.cn/v3/ai_optimization/gemini/llm_scraper/live/html";

const payload = [
  {
    language_code: "en",
    location_code: 2840,
    keyword: "albert einstein",
  },
];

axios
  .post(url, payload, {
    headers: {
      Authorization: "Bearer smt_live_YOUR_KEY",
      "Content-Type": "application/json",
    },
  })
  .then((response) => {
    // 处理接口返回结果
    console.log(response.data);
  })
  .catch((error) => {
    console.error("请求失败:", error.response?.data || error.message);
  });

PHP

php
<?php

$url = 'https://api.seermartech.cn/v3/ai_optimization/gemini/llm_scraper/live/html';

$payload = [
    [
        'language_code' => 'en',
        'location_code' => 2840,
        'keyword' => 'albert einstein'
    ]
];

$ch = curl_init($url);

curl_setopt_array($ch, [
    CURLOPT_POST => true,
    CURLOPT_RETURNTRANSFER => true,
    CURLOPT_HTTPHEADER => [
        'Authorization: Bearer smt_live_YOUR_KEY',
        'Content-Type: application/json'
    ],
    CURLOPT_POSTFIELDS => json_encode($payload, JSON_UNESCAPED_UNICODE)
]);

$response = curl_exec($ch);

if ($response === false) {
    echo '请求失败:' . curl_error($ch);
} else {
    $result = json_decode($response, true);
    print_r($result);
}

curl_close($ch);

响应示例

json
{
  "version": "0.1.20260209",
  "status_code": 20000,
  "status_message": "Ok.",
  "time": "25.1849 sec.",
  "cost": 0.0288,
  "tasks_count": 1,
  "tasks_error": 0,
  "tasks": [
    {
      "id": "01234567-89ab-cdef-0123-456789abcdef",
      "status_code": 20000,
      "status_message": "Ok.",
      "time": "25.1849 sec.",
      "cost": 0.0288,
      "result_count": 1,
      "path": [
        "v3",
        "ai_optimization",
        "gemini",
        "llm_scraper",
        "live",
        "html"
      ],
      "data": {
        "api": "ai_optimization",
        "function": "llm_scraper",
        "se": "gemini",
        "language_code": "en",
        "location_code": 2840,
        "keyword": "albert einstein",
        "postback_data": "html",
        "device": "desktop",
        "os": "windows"
      },
      "result": [
        {
          "keyword": "albert einstein",
          "location_code": 2840,
          "language_code": "en",
          "datetime": "2026-02-09 12:57:46 +00:00",
          "items_count": 1,
          "items": [
            {
              "page": 1,
              "date": "2026-02-09 12:57:46 +00:00",
              "html": "<html>...</html>"
            }
          ]
        }
      ]
    }
  ]
}

状态码与错误处理

status_codestatus_message 会同时出现在响应顶层和任务对象中:

  • 顶层状态码用于判断整个请求是否成功。
  • 任务级状态码用于判断单个任务是否成功。
  • 20000 通常表示请求成功。
  • tasks_error 大于 0 时,应逐项检查 tasks 中的任务状态。
  • 建议在业务系统中实现时、网络异常、参数错误和任务级失败的处理逻辑。

实用场景

  • 抓取指定的 Gemini 原始结果页面,还原完整 HTML 结构,便于建立模型结果归档和审计系统。
  • 对比不同国家、地区和语言下的模型回答页面,评估化 SEO在不同市场中的呈现差异。
  • 开启引用栏扩展并提取引用,分析品牌或网站在大语言模型回答中的引用来源与。
  • 按定期采集模型结果快,监测品牌可见度、竞品提及率和 AI 搜索表现变化。
  • 结合自定义 tag 管理批量任务,将抓取结果到分组、客户项目或 SEO 实验批次。

统一入口:官网 · LLM API · 控制台