Skip to content

获取 ChatGPT LLM 抓取任务高级结果

接口说明

GET https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/task_get/advanced/$id

根据任务 ID 获取 ChatGPT LLM 抓取任务的高级结果。任务发布成功后,可在 30 天重复请求任务结果,获取结果本身不额外收费。

扣费以响应头 X-SeerMarTech-Charge-CNY 为准。

请求参数

接口通过路径参数传任务 ID,无请求体。

参数类型说明
idstring任务唯一标识符,UUID 格式。任务发布后可在 30 天使用该 ID 获取结果。

认证

请求头需要携带以下认证信息:

http
Authorization: Bearer smt_live_YOUR_KEY
Content-Type: application/json

请求示例

cURL

bash
curl --location --request GET \
  "https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/task_get/advanced/02261816-2027-0066-0000-c27d02864073" \
  --header "Authorization: Bearer smt_live_YOUR_KEY" \
  --header "Content-Type: application/json"

TypeScript

typescript
import axios from "axios";

const taskId = "02231256-2604-0066-2000-57133b8fc54e";

axios
  .get(
    `https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/task_get/advanced/${taskId}`,
    {
      headers: {
        Authorization: "Bearer smt_live_YOUR_KEY",
        "Content-Type": "application/json",
      },
    }
  )
  .then((response) => {
    console.log(response.data);
  })
  .catch((error) => {
    console.error(error.response?.data || error.message);
  });

Python

python
import requests

task_id = "02231256-2604-0066-0000-c27d02864073"

response = requests.get(
    f"https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/task_get/advanced/{task_id}",
    headers={
        "Authorization": "Bearer smt_live_YOUR_KEY",
        "Content-Type": "application/json",
    },
)

print(response.json())

响应结构

接口返回 JSON 对象 tasks 数组。

顶层字段

字段类型说明
versionstring当前 API 版本。
status_codeinteger通用响应状态码。完整状态码列表请参考错误码文档。
status_messagestring通用提示信息。
timestring接口执行耗时,单位为秒。
costfloat平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。
tasks_countintegertasks 数组中的任务数量。
tasks_errorintegertasks 数组中返回错误的任务数量。
tasksarray任务结果数组。

> 建议客户端对 HTTP 错误、通用状态码以及任务级状态码分别进行处理。

tasks 任务字段

字段类型说明
idstring任务唯一标识符,UUID 格式。
status_codeinteger任务状态码,通常处于 1000060000 范围。
status_messagestring任务级提示信息。
timestring任务执行耗时,单位为秒。
costfloat平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。
result_countintegerresult 数组中的数量。
patharray请求 URL 路径。
dataobject创建任务时提交的参数。
resultarray任务结果数组。

result 结果字段

字段类型说明
keywordstring创建任务时提交的。返回时会对编码后的 %##进行解码,+ 会被解码为空格。
location_codeinteger创建任务时提交的位置代码。
language_codestring创建任务时提交的语言代码。
modelstring使用的模型版本。
check_urlstring搜索结果页面的直接 URL,可用于核验返回结果。
datetimestring获取结果的日期和时间,UTC 格式,例如 2019-11-15 12:57:46 +00:00
markdownstring使用 Markdown 格式返回的主要。
search_resultsarray模型检索到的网页搜索结果重复结果和未被最终答案使用的结果。
sourcesarray模型在最终答案中引用或依赖的来源。
fan_out_queriesarray从主查询派生出的搜索查询,用于扩展检索范围。
brand_entitiesarray答案中提及的品牌实体。
se_results_countinteger搜索结果总数。
item_typesarray返回结果类型。可能:chat_gpt_textchat_gpt_tablechat_gpt_navigation_listchat_gpt_imageschat_gpt_local_businesseschat_gpt_products
items_countintegeritems 数组中的数量。
itemsarrayChatGPT 结果。

搜索结果字段

search_results 中的每个以下字段:

字段类型说明
typestring素类型,固定为 chatgpt_search_result
urlstring结果 URL。
domainstring结果域名。
titlestring结果标题。
descriptionstring结果描述。
breadcrumbstring面屑导航。

来源字段

sources 数组中的每个来源以下字段:

字段类型说明
typestring素类型,固定为 chat_gpt_source
titlestring来源标题。
snippetstring来源描述或摘要。
domainstring来源在搜索结果中的域名。
urlstring来源 URL。
thumbnailstring来源缩略图 URL。
source_namestring来源名称。
publication_datestring来源发布时间,格式为 年-月-日 时:分:秒 +UTC时差,例如 2019-11-15 12:57:46 +00:00
markdownstring使用 Markdown 格式返回的来源。

品牌实体字段

brand_entities 数组中的每个以下字段:

字段类型说明
typestring素类型,固定为 chat_gpt_brand_entity
titlestring品牌名称。
categorystring品牌所属类别。
markdownstringMarkdown 格式的品牌名称。
urlsarray与该品牌的 URL 和域名。

urls 数组中的字段:

字段类型说明
urlstringURL。
domainstring域名。

items素类型

chat_gpt_text

文本字段如下:

字段类型说明
typestring固定为 chat_gpt_text
rank_groupinteger组排名。同一 type素使用组排名,不同类型之间不计该排名。
rank_absoluteinteger在结果中的绝对排名。
markdownstringMarkdown 格式的文本。
sourcesarray该文本的来源,字段结构同“来源字段”。
brand_entitiesarray该文本中提及的品牌实体,字段结构同“品牌实体字段”。

chat_gpt_table

表格字段如下:

字段类型说明
typestring固定为 chat_gpt_table
rank_groupinteger组排名。
rank_absoluteinteger在结果中的绝对排名。
textstring表格文本。
markdownstringMarkdown 格式的表格。
tableobject表格结构。
brand_entitiesarray表格中提及的品牌实体。

table 对象字段:

字段类型说明
table_headerarray表头。
table_contentarray表格。数组中的每个代表一行。

chat_gpt_navigation_list

导航列表字段如下:

字段类型说明
typestring固定为 chat_gpt_navigation_list
rank_groupinteger组排名。
rank_absoluteinteger在结果中的绝对排名。
titlestring导航列表标题。
sourcesarray导航列表的来源,字段结构同“来源字段”。

chat_gpt_images

图片字段如下:

字段类型说明
typestring固定为 chat_gpt_images
rank_groupinteger组排名。
rank_absoluteinteger在结果中的绝对排名。
markdownstringMarkdown 格式的图片。
itemsarray图片项目数组。

items 中的图片字段:

字段类型说明
typestring固定为 chat_gpt_images_element
altstring图片的替代文本。
urlstring页面 URL。
image_urlstring图片 URL,可能指向原始资源,也可能指向本平台存储的图片。
markdownstringMarkdown 格式的图片。

chat_gpt_local_businesses

本地商家字段如下:

字段类型说明
typestring固定为 chat_gpt_local_businesses
rank_groupinteger组排名。
rank_absoluteinteger在结果中的绝对排名。
markdownstringMarkdown 格式的本地商家。
itemsarray本地商家项目数组。

items 中的本地商家字段:

字段类型说明
typestring固定为 chat_gpt_local_businesses_element
titlestring本地商家名称。
descriptionstring商家描述。
addressstring商家地址。
phonestring商家电话。
reviews_countinteger评论总数。
urlstring商家网站 URL。
domainstring商家域名。
ratingobject商家评分信息。

rating 对象字段:

字段类型说明
rating_typestring评分类型,可为 Max5PercentsCustomMax
valuefloat基于评论计算的平均评分。
votes_countinteger投票或评分数量。
rating_maxinteger对应评分类型的最大值。

chat_gpt_products

商品字段如下:

字段类型说明
typestring固定为 chat_gpt_products
rank_groupinteger组排名。
rank_absoluteinteger在结果中的绝对排名。
itemsarray商品项目数组。

items 中的商品字段:

字段类型说明
typestring固定为 chat_gpt_products_element
product_idstring商品 ID。
merchantsstring提供该商品的商家。
id_to_token_mapstring商品标识令牌。该字段为 Base64 编码,的购物商品 ID。
titlestring商品标题。
ratingobject商品评分信息,字段结构同本地商家的 rating
pricefloat商品价格。
currencystring价格货币的 ISO 代码。
tagstring商品标签文本。
urlstring商品结果 URL。
domainstring商品结果域名。
imagesarray商品图片 URL 数组。URL 可能指向原始资源,也可能指向本平台存储的图片。
product_idsarray与商品的购物商品标识符数组。

product_ids 中的商品标识字段:

字段类型说明
typestring固定为 chat_gpt_google_shopping_product
eistring事件标识符,供使用。
product_idstring商品标识符,可作为购物 API 接口中的 data_docid 使用。
catalog_idstring购物目录标识符,可作为购物 API 接口中的 product_id 使用。
gpcidstringGoogle 商品集群标识符,可作为购物 API 接口中的 gid 使用。
headline_offer_docidstring主展示报价的文档标识符,可作为购物 API 接口中的 data_docid 使用。
image_docidstring展示商品图片的标识符。
rdsstring资源描述字符串,用于在购物索引中标识商品。
querystring用于检索该商品的搜索查询。
midstring商家或卖家账户标识符。
pvtstring商品视图类型参数。
uulestring编码后的位置参数。
glstring国家或地区代码,表示结果展示位置。
hlstring宿主语言代码,表示结果展示语言。

chat_gpt_ad

广告字段如下:

字段类型说明
typestring固定为 chat_gpt_ad
rank_groupinteger组排名。
rank_absoluteinteger在结果中的绝对排名。
is_renderedboolean广告是否向用户展示。true 表示已展示,false 表示广告存在但未展示。
titlestring广告标题。
snippetstring广告描述文本。
urlstring广告落地页 URL。
domainstring广告落地页域名。
image_urlstring广告中展示的图片 URL。
advertiserobject广告主信息。

advertiser 对象字段:

字段类型说明
namestring广告主名称。
urlstring广告主网站 URL。
favicon_urlstring广告主网站图标 URL。

响应示例

json
{
  "version": "0.1.20250723",
  "status_code": 20000,
  "status_message": "Ok.",
  "time": "0.1703 sec.",
  "cost": 0,
  "tasks_count": 1,
  "tasks_error": 0,
  "tasks": [
    {
      "id": "02261816-2027-0066-0000-c27d02864073",
      "status_code": 20000,
      "status_message": "Ok.",
      "time": "0.1450 sec.",
      "cost": 0,
      "result_count": 1,
      "path": [
        "v3",
        "ai_optimization",
        "chat_gpt",
        "llm_scraper",
        "task_get",
        "advanced"
      ],
      "data": {
        "api": "ai_optimization",
        "function": "llm_scraper",
        "se": "chat_gpt",
        "language_code": "en",
        "location_code": 2840,
        "keyword": "albert einstein",
        "device": "desktop",
        "os": "windows"
      },
      "result": [
        {
          "keyword": "albert einstein",
          "location_code": 2840,
          "language_code": "en",
          "model": "最新模型版本",
          "check_url": "https://example.com/search",
          "datetime": "2019-11-15 12:57:46 +00:00",
          "markdown": "Albert Einstein was a theoretical physicist...",
          "search_results": [],
          "sources": [],
          "fan_out_queries": [],
          "brand_entities": [],
          "se_results_count": 0,
          "item_types": [
            "chat_gpt_text",
            "chat_gpt_table",
            "chat_gpt_images"
          ],
          "items_count": 3,
          "items": [
            {
              "type": "chat_gpt_text",
              "rank_group": 1,
              "rank_absolute": 1,
              "markdown": "Here is an overview of Albert Einstein.",
              "sources": [],
              "brand_entities": []
            },
            {
              "type": "chat_gpt_table",
              "rank_group": 1,
              "rank_absolute": 2,
              "text": null,
              "markdown": "| Contribution | Impact |\n|---|---|\n| Relativity | Changed modern physics |",
              "table": {
                "table_header": [
                  "Contribution",
                  "Impact"
                ],
                "table_content": [
                  [
                    "Relativity",
                    "Changed modern physics"
                  ]
                ]
              },
              "brand_entities": []
            },
            {
              "type": "chat_gpt_images",
              "rank_group": 1,
              "rank_absolute": 3,
              "markdown": "Einstein image",
              "items": [
                {
                  "type": "chat_gpt_images_element",
                  "alt": "Albert Einstein",
                  "url": "https://example.com/einstein",
                  "image_url": "https://example.com/einstein.jpg",
                  "markdown": "![Albert Einstein](https://example.com/einstein.jpg)"
                }
              ]
            }
          ]
        }
      ]
    }
  ]
}

错误处理

响应中的 status_codestatus_message 用于判断请求及任务执行状态。请根据通用状态码和任务级状态码处理异常,例如:

  • 检查顶层 status_code 是否为 20000
  • 检查 tasks_error 是否大于 0
  • 检查每个任务的 status_code 是否为成功状态。
  • 当任务失败或 result 为空时,记录对应的 status_message
  • 任务结果保留 30 天,期限后无法继续通过任务 ID 获取。

实用场景

  • 监测在 ChatGPT 中的回答,评估品牌、产品或主题在生成式搜索结果中的表现。
  • 分析模型引用的网页来源,识别被频繁引用的竞争对手页面,为选题和权威性建设提供依据。
  • 提取文本、表格、图片、商品和本地商家结果,构建生成式搜索结果结构化数据集,支持 SEO 监控和竞品分析。
  • 识别回答中的品牌实体及域名,统计品牌提及,品牌声量和实体优化。
  • 跟踪商品、商家和广告展示信息,分析生成式搜索中的商业结果、价格、评分及落地页竞争。

统一入口:官网 · LLM API · 控制台