主题
获取 ChatGPT LLM 抓取任务高级结果
接口说明
GET https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/task_get/advanced/$id
根据任务 ID 获取 ChatGPT LLM 抓取任务的高级结果。任务发布成功后,可在 30 天重复请求任务结果,获取结果本身不额外收费。
扣费以响应头 X-SeerMarTech-Charge-CNY 为准。
请求参数
接口通过路径参数传任务 ID,无请求体。
| 参数 | 类型 | 填 | 说明 |
|---|---|---|---|
id | string | 是 | 任务唯一标识符,UUID 格式。任务发布后可在 30 天使用该 ID 获取结果。 |
认证
请求头需要携带以下认证信息:
http
Authorization: Bearer smt_live_YOUR_KEY
Content-Type: application/json请求示例
cURL
bash
curl --location --request GET \
"https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/task_get/advanced/02261816-2027-0066-0000-c27d02864073" \
--header "Authorization: Bearer smt_live_YOUR_KEY" \
--header "Content-Type: application/json"TypeScript
typescript
import axios from "axios";
const taskId = "02231256-2604-0066-2000-57133b8fc54e";
axios
.get(
`https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/task_get/advanced/${taskId}`,
{
headers: {
Authorization: "Bearer smt_live_YOUR_KEY",
"Content-Type": "application/json",
},
}
)
.then((response) => {
console.log(response.data);
})
.catch((error) => {
console.error(error.response?.data || error.message);
});Python
python
import requests
task_id = "02231256-2604-0066-0000-c27d02864073"
response = requests.get(
f"https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/task_get/advanced/{task_id}",
headers={
"Authorization": "Bearer smt_live_YOUR_KEY",
"Content-Type": "application/json",
},
)
print(response.json())响应结构
接口返回 JSON 对象 tasks 数组。
顶层字段
| 字段 | 类型 | 说明 |
|---|---|---|
version | string | 当前 API 版本。 |
status_code | integer | 通用响应状态码。完整状态码列表请参考错误码文档。 |
status_message | string | 通用提示信息。 |
time | string | 接口执行耗时,单位为秒。 |
cost | float | 平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。 |
tasks_count | integer | tasks 数组中的任务数量。 |
tasks_error | integer | tasks 数组中返回错误的任务数量。 |
tasks | array | 任务结果数组。 |
> 建议客户端对 HTTP 错误、通用状态码以及任务级状态码分别进行处理。
tasks 任务字段
| 字段 | 类型 | 说明 |
|---|---|---|
id | string | 任务唯一标识符,UUID 格式。 |
status_code | integer | 任务状态码,通常处于 10000 至 60000 范围。 |
status_message | string | 任务级提示信息。 |
time | string | 任务执行耗时,单位为秒。 |
cost | float | 平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。 |
result_count | integer | result 数组中的数量。 |
path | array | 请求 URL 路径。 |
data | object | 创建任务时提交的参数。 |
result | array | 任务结果数组。 |
result 结果字段
| 字段 | 类型 | 说明 |
|---|---|---|
keyword | string | 创建任务时提交的。返回时会对编码后的 %##进行解码,+ 会被解码为空格。 |
location_code | integer | 创建任务时提交的位置代码。 |
language_code | string | 创建任务时提交的语言代码。 |
model | string | 使用的模型版本。 |
check_url | string | 搜索结果页面的直接 URL,可用于核验返回结果。 |
datetime | string | 获取结果的日期和时间,UTC 格式,例如 2019-11-15 12:57:46 +00:00。 |
markdown | string | 使用 Markdown 格式返回的主要。 |
search_results | array | 模型检索到的网页搜索结果重复结果和未被最终答案使用的结果。 |
sources | array | 模型在最终答案中引用或依赖的来源。 |
fan_out_queries | array | 从主查询派生出的搜索查询,用于扩展检索范围。 |
brand_entities | array | 答案中提及的品牌实体。 |
se_results_count | integer | 搜索结果总数。 |
item_types | array | 返回结果类型。可能:chat_gpt_text、chat_gpt_table、chat_gpt_navigation_list、chat_gpt_images、chat_gpt_local_businesses、chat_gpt_products。 |
items_count | integer | items 数组中的数量。 |
items | array | ChatGPT 结果。 |
搜索结果字段
search_results 中的每个以下字段:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 素类型,固定为 chatgpt_search_result。 |
url | string | 结果 URL。 |
domain | string | 结果域名。 |
title | string | 结果标题。 |
description | string | 结果描述。 |
breadcrumb | string | 面屑导航。 |
来源字段
sources 数组中的每个来源以下字段:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 素类型,固定为 chat_gpt_source。 |
title | string | 来源标题。 |
snippet | string | 来源描述或摘要。 |
domain | string | 来源在搜索结果中的域名。 |
url | string | 来源 URL。 |
thumbnail | string | 来源缩略图 URL。 |
source_name | string | 来源名称。 |
publication_date | string | 来源发布时间,格式为 年-月-日 时:分:秒 +UTC时差,例如 2019-11-15 12:57:46 +00:00。 |
markdown | string | 使用 Markdown 格式返回的来源。 |
品牌实体字段
brand_entities 数组中的每个以下字段:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 素类型,固定为 chat_gpt_brand_entity。 |
title | string | 品牌名称。 |
category | string | 品牌所属类别。 |
markdown | string | Markdown 格式的品牌名称。 |
urls | array | 与该品牌的 URL 和域名。 |
urls 数组中的字段:
| 字段 | 类型 | 说明 |
|---|---|---|
url | string | URL。 |
domain | string | 域名。 |
items素类型
chat_gpt_text
文本字段如下:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_text。 |
rank_group | integer | 组排名。同一 type素使用组排名,不同类型之间不计该排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
markdown | string | Markdown 格式的文本。 |
sources | array | 该文本的来源,字段结构同“来源字段”。 |
brand_entities | array | 该文本中提及的品牌实体,字段结构同“品牌实体字段”。 |
chat_gpt_table
表格字段如下:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_table。 |
rank_group | integer | 组排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
text | string | 表格文本。 |
markdown | string | Markdown 格式的表格。 |
table | object | 表格结构。 |
brand_entities | array | 表格中提及的品牌实体。 |
table 对象字段:
| 字段 | 类型 | 说明 |
|---|---|---|
table_header | array | 表头。 |
table_content | array | 表格。数组中的每个代表一行。 |
chat_gpt_navigation_list
导航列表字段如下:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_navigation_list。 |
rank_group | integer | 组排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
title | string | 导航列表标题。 |
sources | array | 导航列表的来源,字段结构同“来源字段”。 |
chat_gpt_images
图片字段如下:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_images。 |
rank_group | integer | 组排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
markdown | string | Markdown 格式的图片。 |
items | array | 图片项目数组。 |
items 中的图片字段:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_images_element。 |
alt | string | 图片的替代文本。 |
url | string | 页面 URL。 |
image_url | string | 图片 URL,可能指向原始资源,也可能指向本平台存储的图片。 |
markdown | string | Markdown 格式的图片。 |
chat_gpt_local_businesses
本地商家字段如下:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_local_businesses。 |
rank_group | integer | 组排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
markdown | string | Markdown 格式的本地商家。 |
items | array | 本地商家项目数组。 |
items 中的本地商家字段:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_local_businesses_element。 |
title | string | 本地商家名称。 |
description | string | 商家描述。 |
address | string | 商家地址。 |
phone | string | 商家电话。 |
reviews_count | integer | 评论总数。 |
url | string | 商家网站 URL。 |
domain | string | 商家域名。 |
rating | object | 商家评分信息。 |
rating 对象字段:
| 字段 | 类型 | 说明 |
|---|---|---|
rating_type | string | 评分类型,可为 Max5、Percents 或 CustomMax。 |
value | float | 基于评论计算的平均评分。 |
votes_count | integer | 投票或评分数量。 |
rating_max | integer | 对应评分类型的最大值。 |
chat_gpt_products
商品字段如下:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_products。 |
rank_group | integer | 组排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
items | array | 商品项目数组。 |
items 中的商品字段:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_products_element。 |
product_id | string | 商品 ID。 |
merchants | string | 提供该商品的商家。 |
id_to_token_map | string | 商品标识令牌。该字段为 Base64 编码,的购物商品 ID。 |
title | string | 商品标题。 |
rating | object | 商品评分信息,字段结构同本地商家的 rating。 |
price | float | 商品价格。 |
currency | string | 价格货币的 ISO 代码。 |
tag | string | 商品标签文本。 |
url | string | 商品结果 URL。 |
domain | string | 商品结果域名。 |
images | array | 商品图片 URL 数组。URL 可能指向原始资源,也可能指向本平台存储的图片。 |
product_ids | array | 与商品的购物商品标识符数组。 |
product_ids 中的商品标识字段:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_google_shopping_product。 |
ei | string | 事件标识符,供使用。 |
product_id | string | 商品标识符,可作为购物 API 接口中的 data_docid 使用。 |
catalog_id | string | 购物目录标识符,可作为购物 API 接口中的 product_id 使用。 |
gpcid | string | Google 商品集群标识符,可作为购物 API 接口中的 gid 使用。 |
headline_offer_docid | string | 主展示报价的文档标识符,可作为购物 API 接口中的 data_docid 使用。 |
image_docid | string | 展示商品图片的标识符。 |
rds | string | 资源描述字符串,用于在购物索引中标识商品。 |
query | string | 用于检索该商品的搜索查询。 |
mid | string | 商家或卖家账户标识符。 |
pvt | string | 商品视图类型参数。 |
uule | string | 编码后的位置参数。 |
gl | string | 国家或地区代码,表示结果展示位置。 |
hl | string | 宿主语言代码,表示结果展示语言。 |
chat_gpt_ad
广告字段如下:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_ad。 |
rank_group | integer | 组排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
is_rendered | boolean | 广告是否向用户展示。true 表示已展示,false 表示广告存在但未展示。 |
title | string | 广告标题。 |
snippet | string | 广告描述文本。 |
url | string | 广告落地页 URL。 |
domain | string | 广告落地页域名。 |
image_url | string | 广告中展示的图片 URL。 |
advertiser | object | 广告主信息。 |
advertiser 对象字段:
| 字段 | 类型 | 说明 |
|---|---|---|
name | string | 广告主名称。 |
url | string | 广告主网站 URL。 |
favicon_url | string | 广告主网站图标 URL。 |
响应示例
json
{
"version": "0.1.20250723",
"status_code": 20000,
"status_message": "Ok.",
"time": "0.1703 sec.",
"cost": 0,
"tasks_count": 1,
"tasks_error": 0,
"tasks": [
{
"id": "02261816-2027-0066-0000-c27d02864073",
"status_code": 20000,
"status_message": "Ok.",
"time": "0.1450 sec.",
"cost": 0,
"result_count": 1,
"path": [
"v3",
"ai_optimization",
"chat_gpt",
"llm_scraper",
"task_get",
"advanced"
],
"data": {
"api": "ai_optimization",
"function": "llm_scraper",
"se": "chat_gpt",
"language_code": "en",
"location_code": 2840,
"keyword": "albert einstein",
"device": "desktop",
"os": "windows"
},
"result": [
{
"keyword": "albert einstein",
"location_code": 2840,
"language_code": "en",
"model": "最新模型版本",
"check_url": "https://example.com/search",
"datetime": "2019-11-15 12:57:46 +00:00",
"markdown": "Albert Einstein was a theoretical physicist...",
"search_results": [],
"sources": [],
"fan_out_queries": [],
"brand_entities": [],
"se_results_count": 0,
"item_types": [
"chat_gpt_text",
"chat_gpt_table",
"chat_gpt_images"
],
"items_count": 3,
"items": [
{
"type": "chat_gpt_text",
"rank_group": 1,
"rank_absolute": 1,
"markdown": "Here is an overview of Albert Einstein.",
"sources": [],
"brand_entities": []
},
{
"type": "chat_gpt_table",
"rank_group": 1,
"rank_absolute": 2,
"text": null,
"markdown": "| Contribution | Impact |\n|---|---|\n| Relativity | Changed modern physics |",
"table": {
"table_header": [
"Contribution",
"Impact"
],
"table_content": [
[
"Relativity",
"Changed modern physics"
]
]
},
"brand_entities": []
},
{
"type": "chat_gpt_images",
"rank_group": 1,
"rank_absolute": 3,
"markdown": "Einstein image",
"items": [
{
"type": "chat_gpt_images_element",
"alt": "Albert Einstein",
"url": "https://example.com/einstein",
"image_url": "https://example.com/einstein.jpg",
"markdown": ""
}
]
}
]
}
]
}
]
}错误处理
响应中的 status_code 和 status_message 用于判断请求及任务执行状态。请根据通用状态码和任务级状态码处理异常,例如:
- 检查顶层
status_code是否为20000。 - 检查
tasks_error是否大于0。 - 检查每个任务的
status_code是否为成功状态。 - 当任务失败或
result为空时,记录对应的status_message。 - 任务结果保留 30 天,期限后无法继续通过任务 ID 获取。
实用场景
- 监测在 ChatGPT 中的回答,评估品牌、产品或主题在生成式搜索结果中的表现。
- 分析模型引用的网页来源,识别被频繁引用的竞争对手页面,为选题和权威性建设提供依据。
- 提取文本、表格、图片、商品和本地商家结果,构建生成式搜索结果结构化数据集,支持 SEO 监控和竞品分析。
- 识别回答中的品牌实体及域名,统计品牌提及,品牌声量和实体优化。
- 跟踪商品、商家和广告展示信息,分析生成式搜索中的商业结果、价格、评分及落地页竞争。