Skip to content

ChatGPT LLM 抓取器实时高级接口

POST /v3/ai_optimization/chat_gpt/llm_scraper/live/advanced

接口概述

本接口通过实时方式获取 ChatGPT 搜索结果。返回取决于请求中指定的搜索位置和语言,可通过以下接口获取可用选项:

  • 位置列表:/v3/ai_optimization/chat_gpt/llm_scraper/locations
  • 语言列表:/v3/ai_optimization/chat_gpt/llm_scraper/languages

请求方法: POST
请求路径: /v3/ai_optimization/chat_gpt/llm_scraper/live/advanced

完整请求地址:

text
https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/live/advanced

所有 POST 数据使用 UTF-8 编码的 JSON 格式,并将任务参数放顶层 JSON 数组中。平台限流以认证说明中的 30/60/120 次/分钟规则为准。

> 实时任务的执行时间最长约为 120 秒,请为客户端设置足够的时时间。

计费说明

参考价约 ¥0.0288 / 次

扣费以响应头 X-SeerMarTech-Charge-CNY 为准。

请求参数

任务级参数

参数类型说明
keywordstring要提交给搜索模型的或问题。平台限流以认证说明中的 30/60/120 次/分钟规则为准个字符。参数中的 %## 会被解码,字符 + 会被解码为空格。若中需要使用 %,请编码为 %25;需要使用 +,请编码为 %2B
location_namestring条件填搜索位置的完整名称。未指定 location_code 时填。使用此参数后无需同时传 location_code
location_codeinteger条件填搜索位置代码。未指定 location_name 时填。使用此参数后无需同时传 location_name
language_namestring条件填搜索语言的完整名称。未指定 language_code 时填。使用此参数后无需同时传 language_code
language_codestring条件填搜索语言代码。未指定 language_name 时填。使用此参数后无需同时传 language_name
force_web_searchboolean是否强制 AI 代理执行网页搜索。启用后,模型会尝试访问并引用当前网页信息。默认值为 false。即使设置为 true,也不能保证最终回答一定引用网页来源。
tagstring用户自定义任务标识,最长 255 个字符。可用于任务与结果。传的值会原样返回在响应任务的 data 对象中。

location_namelocation_code 二选一;language_namelanguage_code 二选一。

获取位置和语言代码

获取可用搜索位置:

text
GET https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/locations

获取可用搜索语言:

text
GET https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/languages

示例位置:

  • location_nameUnited States
  • location_code2840

请求示例

cURL

bash
curl --location --request POST \
  "https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/live/advanced" \
  --header "Authorization: Bearer smt_live_YOUR_KEY" \
  --header "Content-Type: application/json" \
  --data-raw '[
    {
      "language_code": "en",
      "location_code": 2840,
      "keyword": "albert einstein",
      "force_web_search": true,
      "tag": "demo-001"
    }
  ]'

Python

python
import requests

url = "https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/live/advanced"

headers = {
    "Authorization": "Bearer smt_live_YOUR_KEY",
    "Content-Type": "application/json",
}

payload = [
    {
        "language_code": "en",
        "location_code": 2840,
        "keyword": "albert einstein",
    }
]

response = requests.post(
    url,
    headers=headers,
    json=payload,
    timeout=150,
)

response.raise_for_status()
result = response.json()
print(result)

TypeScript

typescript
import axios from "axios";

const response = await axios.post(
  "https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/live/advanced",
  [
    {
      language_code: "en",
      location_code: 2840,
      keyword: "albert einstein",
    },
  ],
  {
    headers: {
      Authorization: "Bearer smt_live_YOUR_KEY",
      "Content-Type": "application/json",
    },
    timeout: 150000,
  },
);

console.log(response.data);

响应结构

API 返回 JSON 对象顶层 tasks 数组。

顶层响应字段

字段类型说明
versionstring当前 API 版本。
status_codeinteger通用响应状态码。
status_messagestring通用状态说明。
timestring请求执行耗时,单位为秒。
costfloat平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。
tasks_countintegertasks 数组中的任务数量。
tasks_errorintegertasks 数组中执行失败的任务数量。
tasksarray任务结果数组。

任务字段

字段类型说明
idstring任务唯一标识,UUID 格式。
status_codeinteger任务状态码,通常为 1000060000
status_messagestring任务状态说明。
timestring任务执行耗时。
costfloat平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。
result_countintegerresult 数组中的数量。
patharray请求路径信息。
dataobject创建任务时提交的参数。
resultarray任务结果数组。

结果字段

基础结果字段

字段类型说明
keywordstring请求中的。返回时已对编码后的 %## 进行解码,+ 会还原为空格。
location_codeinteger请求中的位置代码。
language_codestring请求中的语言代码。
modelstring使用的模型版本。
check_urlstring搜索结果页面的直接 URL,可用于核验返回结果。
datetimestring获取结果的时间,UTC 格式:yyyy-mm-dd hh-mm-ss +00:00
markdownstringMarkdown 格式的完整回答。
search_resultsarray模型检索到的网页搜索结果,可能重复项或最终回答未使用的结果。
sourcesarray模型在最终回答中引用或依赖的来源。
fan_out_queriesarray从主查询扩展出的搜索查询。
brand_entitiesarray回答中识别出的品牌实体。
se_results_countinteger搜索结果总数。
item_typesarray返回结果类型。
items_countintegeritems 数组中的数量。
itemsarrayChatGPT 结果。

item_types 可能以下值:

  • chat_gpt_text
  • chat_gpt_table
  • chat_gpt_navigation_list
  • chat_gpt_images
  • chat_gpt_local_businesses
  • chat_gpt_products

search_results 字段

字段类型说明
typestring固定为 chatgpt_search_result
urlstring搜索结果 URL。
domainstring搜索结果域名。
titlestring搜索结果标题。
descriptionstring搜索结果描述。
breadcrumbstring面屑路径。

sources 字段

字段类型说明
typestring固定为 chat_gpt_source
titlestring来源标题。
snippetstring来源描述或摘要。
domainstring来源域名。
urlstring来源 URL。
thumbnailstring来源缩略图 URL。
source_namestring来源名称。
publication_datestring发布时间,格式示例:2019-11-15 12:57:46 +00:00
markdownstringMarkdown 格式的来源。

brand_entities 字段

字段类型说明
typestring固定为 chat_gpt_brand_entity
titlestring品牌名称。
categorystring品牌类别。
markdownstringMarkdown 格式的品牌名称。
urlsarray与该品牌的 URL 和域名。

urls 数组字段:

字段类型说明
urlstringURL。
domainstring域名。

items素类型

chat_gpt_text

文本。

字段类型说明
typestring固定为 chat_gpt_text
rank_groupinteger同类型中的分组排名。不同类型之间不会影响该字段。
rank_absoluteinteger在结果中的绝对排名。
markdownstringMarkdown 格式的文本。
sourcesarray该文本的来源。
brand_entitiesarray该文本中识别出的品牌实体。

chat_gpt_table

表格。

字段类型说明
typestring固定为 chat_gpt_table
rank_groupinteger同类型中的分组排名。
rank_absoluteinteger在结果中的绝对排名。
textstring表格文本。
markdownstringMarkdown 格式的表格。
tableobject表格结构。
brand_entitiesarray表格中识别出的品牌实体。

table 对象字段:

字段类型说明
table_headerarray表头。
table_contentarray表格,每个数组代表一行。

chat_gpt_navigation_list

导航列表或推荐列表。

字段类型说明
typestring固定为 chat_gpt_navigation_list
rank_groupinteger同类型中的分组排名。
rank_absoluteinteger在结果中的绝对排名。
titlestring导航列表标题。
sourcesarray导航列表的来源。

chat_gpt_images

图片结果。

字段类型说明
typestring固定为 chat_gpt_images
rank_groupinteger同类型中的分组排名。
rank_absoluteinteger在结果中的绝对排名。
markdownstringMarkdown 格式的图片。
itemsarray图片项目数组。

图片项目字段:

字段类型说明
typestring固定为 chat_gpt_images_element
altstring图片替代文本。
urlstring页面 URL。
image_urlstring图片 URL。若原始图片不可用,可能返回存储副本地址。
markdownstringMarkdown 格式的图片。

chat_gpt_local_businesses

本地商家结果。

字段类型说明
typestring固定为 chat_gpt_local_businesses
rank_groupinteger同类型中的分组排名。
rank_absoluteinteger在结果中的绝对排名。
markdownstringMarkdown 格式的本地商家。
itemsarray本地商家项目数组。

商家项目字段:

字段类型说明
typestring固定为 chat_gpt_local_businesses_element
titlestring商家名称。
descriptionstring商家描述。
addressstring商家地址。
phonestring商家电话。
reviews_countinteger评论总数。
urlstring商家网站 URL。
domainstring商家域名。
ratingobject商家评分信息。

rating 对象字段:

字段类型说明
rating_typestring评分类型,可为 Max5PercentsCustomMax
valuefloat基于评论计算的平均评分。
votes_countinteger投票或评分数量。
rating_maxinteger当前评分类型的最大值。

chat_gpt_products

商品结果。

字段类型说明
typestring固定为 chat_gpt_products
rank_groupinteger同类型中的分组排名。
rank_absoluteinteger在结果中的绝对排名。
itemsarray商品项目数组。

商品项目字段:

字段类型说明
typestring固定为 chat_gpt_products_element
product_idstring商品 ID。
merchantsstring提供该商品的商家。
id_to_token_mapstring商品标识令牌,通常为 Base64 编码数据,购物商品 ID。
titlestring商品标题。
ratingobject商品评分信息,字段结构与本地商家 rating 相同。
pricefloat商品价格。
currencystring商品价格的 ISO 货币代码。
tagstring商品标签或补说明。
urlstring商品结果 URL。
domainstring商品结果域名。
imagesarray商品图片 URL 数组。
product_idsarray与商品的购物商品标识。

商品项目中还可能以下购物数据字段:

字段类型说明
typestring固定为 chat_gpt_google_shopping_product
eistring部事件标识。
product_idstring商品标识,可用于购物接口中的 data_docid
catalog_idstring商品目录标识,可用于购物接口中的 product_id
gpcidstring商品集群标识,可用于购物接口中的 gid
headline_offer_docidstring主报价文档标识,可用于购物接口中的 data_docid
image_docidstring商品展示图片标识。
rdsstring商品在购物索引中的资源描述字符串。
querystring模型用于检索该商品的搜索查询。
midstring商家或卖家标识。
pvtstring商品展示类型参数。
uulestring编码后的位置参数。
glstring国家代码。
hlstring搜索结果使用的语言代码。

广告结果

chat_gpt_ad

广告可能出现在 items 数组中。

字段类型说明
typestring固定为 chat_gpt_ad
rank_groupinteger同类型中的分组排名。
rank_absoluteinteger在结果中的绝对排名。
is_renderedboolean广告是否展示给用户。true 表示已展示,false 表示结果中存在但未展示。
titlestring广告标题。
snippetstring广告描述文本。
urlstring广告落地页 URL。
domainstring广告落地页域名。
image_urlstring广告图片 URL。
advertiserobject广告主信息。

advertiser 对象字段:

字段类型说明
namestring广告主名称。
urlstring广告主网站 URL。
favicon_urlstring广告主网站图标 URL。

响应示例

以下为简化后的响应结构,返回会根据、位置、语言和模型结果动态变化:

json
{
  "version": "0.1.20250724",
  "status_code": 20000,
  "status_message": "Ok.",
  "time": "15.0903 sec.",
  "cost": 0.0288,
  "tasks_count": 1,
  "tasks_error": 0,
  "tasks": [
    {
      "id": "9c7d2b2e-0000-0000-0000-000000000001",
      "status_code": 20000,
      "status_message": "Ok.",
      "time": "15.0903 sec.",
      "cost": 0.0288,
      "result_count": 1,
      "data": {
        "api": "ai_optimization",
        "function": "llm_scraper",
        "se": "chat_gpt",
        "force_web_search": true,
        "language_code": "en",
        "location_code": 2840,
        "keyword": "albert einstein",
        "device": "desktop",
        "os": "windows"
      },
      "result": [
        {
          "keyword": "albert einstein",
          "location_code": 2840,
          "language_code": "en",
          "model": "current",
          "check_url": "https://example.com/search",
          "datetime": "2025-07-24 12:57:46 +00:00",
          "markdown": "Here is a summary of Albert Einstein...",
          "search_results": [],
          "sources": [],
          "fan_out_queries": [],
          "brand_entities": [],
          "se_results_count": 0,
          "item_types": [
            "chat_gpt_text",
            "chat_gpt_table"
          ],
          "items_count": 2,
          "items": [
            {
              "type": "chat_gpt_text",
              "rank_group": 1,
              "rank_absolute": 1,
              "markdown": "Here is a summary of Albert Einstein.",
              "sources": [],
              "brand_entities": []
            },
            {
              "type": "chat_gpt_table",
              "rank_group": 1,
              "rank_absolute": 2,
              "text": null,
              "markdown": "| Contribution | Impact |\n|---|---|\n| Relativity | Changed modern physics |",
              "table": {
                "table_header": [
                  "Contribution",
                  "Impact"
                ],
                "table_content": [
                  [
                    "Relativity",
                    "Changed modern physics"
                  ]
                ]
              },
              "brand_entities": []
            }
          ]
        }
      ]
    }
  ]
}

状态码与错误处理

请根据 status_codestatus_message 判断请求及任务是否成功:

  • 顶层 status_code 用于判断整个请求。
  • 任务级 status_code 用于判断单个任务。
  • tasks_error 大于 0 时,表示至少有一个任务执行失败。
  • 建议对时、参数缺失、位置或语言代码无效、平台搜索失败等异常进行重试或记录。

错误码请参考本平台的错误码文档:/v3/appendix/errors

实用场景

  • 监测品牌在 AI 搜索回答中的出现:批量提交品牌问题,统计品牌实体、引用来源和出现位置,评估品牌在生成式搜索中的可见度。
  • 追踪 AI 回答的引用来源:开启 force_web_search 获取搜索结果与引用来源,用于分析哪些页面被模型采信并指导优化。
  • 分析竞品在生成式搜索中的:按不同、国家和语言抓取结果,比较竞品品牌实体、排名及来源覆盖。
  • 提取本地商家推荐结果:针对“附近服务商”“城市+品类”等查询获取商家名称、地址、评分和评论数,支持本地 SEO 与门店运营分析。
  • 研究 AI 搜索中的商品展示:获取商品标题、价格、商家、评分、图片和购物标识,比较商品在 AI 购物结果中的与竞争。

统一入口:官网 · LLM API · 控制台