主题
ChatGPT LLM 抓取器实时高级接口
POST /v3/ai_optimization/chat_gpt/llm_scraper/live/advanced
接口概述
本接口通过实时方式获取 ChatGPT 搜索结果。返回取决于请求中指定的搜索位置和语言,可通过以下接口获取可用选项:
- 位置列表:
/v3/ai_optimization/chat_gpt/llm_scraper/locations - 语言列表:
/v3/ai_optimization/chat_gpt/llm_scraper/languages
请求方法: POST
请求路径: /v3/ai_optimization/chat_gpt/llm_scraper/live/advanced
完整请求地址:
text
https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/live/advanced所有 POST 数据使用 UTF-8 编码的 JSON 格式,并将任务参数放顶层 JSON 数组中。平台限流以认证说明中的 30/60/120 次/分钟规则为准。
> 实时任务的执行时间最长约为 120 秒,请为客户端设置足够的时时间。
计费说明
参考价约 ¥0.0288 / 次。
扣费以响应头 X-SeerMarTech-Charge-CNY 为准。
请求参数
任务级参数
| 参数 | 类型 | 填 | 说明 |
|---|---|---|---|
keyword | string | 是 | 要提交给搜索模型的或问题。平台限流以认证说明中的 30/60/120 次/分钟规则为准个字符。参数中的 %## 会被解码,字符 + 会被解码为空格。若中需要使用 %,请编码为 %25;需要使用 +,请编码为 %2B。 |
location_name | string | 条件填 | 搜索位置的完整名称。未指定 location_code 时填。使用此参数后无需同时传 location_code。 |
location_code | integer | 条件填 | 搜索位置代码。未指定 location_name 时填。使用此参数后无需同时传 location_name。 |
language_name | string | 条件填 | 搜索语言的完整名称。未指定 language_code 时填。使用此参数后无需同时传 language_code。 |
language_code | string | 条件填 | 搜索语言代码。未指定 language_name 时填。使用此参数后无需同时传 language_name。 |
force_web_search | boolean | 否 | 是否强制 AI 代理执行网页搜索。启用后,模型会尝试访问并引用当前网页信息。默认值为 false。即使设置为 true,也不能保证最终回答一定引用网页来源。 |
tag | string | 否 | 用户自定义任务标识,最长 255 个字符。可用于任务与结果。传的值会原样返回在响应任务的 data 对象中。 |
location_name 与 location_code 二选一;language_name 与 language_code 二选一。
获取位置和语言代码
获取可用搜索位置:
text
GET https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/locations获取可用搜索语言:
text
GET https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/languages示例位置:
location_name:United Stateslocation_code:2840
请求示例
cURL
bash
curl --location --request POST \
"https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/live/advanced" \
--header "Authorization: Bearer smt_live_YOUR_KEY" \
--header "Content-Type: application/json" \
--data-raw '[
{
"language_code": "en",
"location_code": 2840,
"keyword": "albert einstein",
"force_web_search": true,
"tag": "demo-001"
}
]'Python
python
import requests
url = "https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/live/advanced"
headers = {
"Authorization": "Bearer smt_live_YOUR_KEY",
"Content-Type": "application/json",
}
payload = [
{
"language_code": "en",
"location_code": 2840,
"keyword": "albert einstein",
}
]
response = requests.post(
url,
headers=headers,
json=payload,
timeout=150,
)
response.raise_for_status()
result = response.json()
print(result)TypeScript
typescript
import axios from "axios";
const response = await axios.post(
"https://api.seermartech.cn/v3/ai_optimization/chat_gpt/llm_scraper/live/advanced",
[
{
language_code: "en",
location_code: 2840,
keyword: "albert einstein",
},
],
{
headers: {
Authorization: "Bearer smt_live_YOUR_KEY",
"Content-Type": "application/json",
},
timeout: 150000,
},
);
console.log(response.data);响应结构
API 返回 JSON 对象顶层 tasks 数组。
顶层响应字段
| 字段 | 类型 | 说明 |
|---|---|---|
version | string | 当前 API 版本。 |
status_code | integer | 通用响应状态码。 |
status_message | string | 通用状态说明。 |
time | string | 请求执行耗时,单位为秒。 |
cost | float | 平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。 |
tasks_count | integer | tasks 数组中的任务数量。 |
tasks_error | integer | tasks 数组中执行失败的任务数量。 |
tasks | array | 任务结果数组。 |
任务字段
| 字段 | 类型 | 说明 |
|---|---|---|
id | string | 任务唯一标识,UUID 格式。 |
status_code | integer | 任务状态码,通常为 10000 至 60000。 |
status_message | string | 任务状态说明。 |
time | string | 任务执行耗时。 |
cost | float | 平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。 |
result_count | integer | result 数组中的数量。 |
path | array | 请求路径信息。 |
data | object | 创建任务时提交的参数。 |
result | array | 任务结果数组。 |
结果字段
基础结果字段
| 字段 | 类型 | 说明 |
|---|---|---|
keyword | string | 请求中的。返回时已对编码后的 %## 进行解码,+ 会还原为空格。 |
location_code | integer | 请求中的位置代码。 |
language_code | string | 请求中的语言代码。 |
model | string | 使用的模型版本。 |
check_url | string | 搜索结果页面的直接 URL,可用于核验返回结果。 |
datetime | string | 获取结果的时间,UTC 格式:yyyy-mm-dd hh-mm-ss +00:00。 |
markdown | string | Markdown 格式的完整回答。 |
search_results | array | 模型检索到的网页搜索结果,可能重复项或最终回答未使用的结果。 |
sources | array | 模型在最终回答中引用或依赖的来源。 |
fan_out_queries | array | 从主查询扩展出的搜索查询。 |
brand_entities | array | 回答中识别出的品牌实体。 |
se_results_count | integer | 搜索结果总数。 |
item_types | array | 返回结果类型。 |
items_count | integer | items 数组中的数量。 |
items | array | ChatGPT 结果。 |
item_types 可能以下值:
chat_gpt_textchat_gpt_tablechat_gpt_navigation_listchat_gpt_imageschat_gpt_local_businesseschat_gpt_products
search_results 字段
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chatgpt_search_result。 |
url | string | 搜索结果 URL。 |
domain | string | 搜索结果域名。 |
title | string | 搜索结果标题。 |
description | string | 搜索结果描述。 |
breadcrumb | string | 面屑路径。 |
sources 字段
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_source。 |
title | string | 来源标题。 |
snippet | string | 来源描述或摘要。 |
domain | string | 来源域名。 |
url | string | 来源 URL。 |
thumbnail | string | 来源缩略图 URL。 |
source_name | string | 来源名称。 |
publication_date | string | 发布时间,格式示例:2019-11-15 12:57:46 +00:00。 |
markdown | string | Markdown 格式的来源。 |
brand_entities 字段
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_brand_entity。 |
title | string | 品牌名称。 |
category | string | 品牌类别。 |
markdown | string | Markdown 格式的品牌名称。 |
urls | array | 与该品牌的 URL 和域名。 |
urls 数组字段:
| 字段 | 类型 | 说明 |
|---|---|---|
url | string | URL。 |
domain | string | 域名。 |
items素类型
chat_gpt_text
文本。
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_text。 |
rank_group | integer | 同类型中的分组排名。不同类型之间不会影响该字段。 |
rank_absolute | integer | 在结果中的绝对排名。 |
markdown | string | Markdown 格式的文本。 |
sources | array | 该文本的来源。 |
brand_entities | array | 该文本中识别出的品牌实体。 |
chat_gpt_table
表格。
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_table。 |
rank_group | integer | 同类型中的分组排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
text | string | 表格文本。 |
markdown | string | Markdown 格式的表格。 |
table | object | 表格结构。 |
brand_entities | array | 表格中识别出的品牌实体。 |
table 对象字段:
| 字段 | 类型 | 说明 |
|---|---|---|
table_header | array | 表头。 |
table_content | array | 表格,每个数组代表一行。 |
chat_gpt_navigation_list
导航列表或推荐列表。
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_navigation_list。 |
rank_group | integer | 同类型中的分组排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
title | string | 导航列表标题。 |
sources | array | 导航列表的来源。 |
chat_gpt_images
图片结果。
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_images。 |
rank_group | integer | 同类型中的分组排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
markdown | string | Markdown 格式的图片。 |
items | array | 图片项目数组。 |
图片项目字段:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_images_element。 |
alt | string | 图片替代文本。 |
url | string | 页面 URL。 |
image_url | string | 图片 URL。若原始图片不可用,可能返回存储副本地址。 |
markdown | string | Markdown 格式的图片。 |
chat_gpt_local_businesses
本地商家结果。
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_local_businesses。 |
rank_group | integer | 同类型中的分组排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
markdown | string | Markdown 格式的本地商家。 |
items | array | 本地商家项目数组。 |
商家项目字段:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_local_businesses_element。 |
title | string | 商家名称。 |
description | string | 商家描述。 |
address | string | 商家地址。 |
phone | string | 商家电话。 |
reviews_count | integer | 评论总数。 |
url | string | 商家网站 URL。 |
domain | string | 商家域名。 |
rating | object | 商家评分信息。 |
rating 对象字段:
| 字段 | 类型 | 说明 |
|---|---|---|
rating_type | string | 评分类型,可为 Max5、Percents 或 CustomMax。 |
value | float | 基于评论计算的平均评分。 |
votes_count | integer | 投票或评分数量。 |
rating_max | integer | 当前评分类型的最大值。 |
chat_gpt_products
商品结果。
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_products。 |
rank_group | integer | 同类型中的分组排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
items | array | 商品项目数组。 |
商品项目字段:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_products_element。 |
product_id | string | 商品 ID。 |
merchants | string | 提供该商品的商家。 |
id_to_token_map | string | 商品标识令牌,通常为 Base64 编码数据,购物商品 ID。 |
title | string | 商品标题。 |
rating | object | 商品评分信息,字段结构与本地商家 rating 相同。 |
price | float | 商品价格。 |
currency | string | 商品价格的 ISO 货币代码。 |
tag | string | 商品标签或补说明。 |
url | string | 商品结果 URL。 |
domain | string | 商品结果域名。 |
images | array | 商品图片 URL 数组。 |
product_ids | array | 与商品的购物商品标识。 |
商品项目中还可能以下购物数据字段:
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_google_shopping_product。 |
ei | string | 部事件标识。 |
product_id | string | 商品标识,可用于购物接口中的 data_docid。 |
catalog_id | string | 商品目录标识,可用于购物接口中的 product_id。 |
gpcid | string | 商品集群标识,可用于购物接口中的 gid。 |
headline_offer_docid | string | 主报价文档标识,可用于购物接口中的 data_docid。 |
image_docid | string | 商品展示图片标识。 |
rds | string | 商品在购物索引中的资源描述字符串。 |
query | string | 模型用于检索该商品的搜索查询。 |
mid | string | 商家或卖家标识。 |
pvt | string | 商品展示类型参数。 |
uule | string | 编码后的位置参数。 |
gl | string | 国家代码。 |
hl | string | 搜索结果使用的语言代码。 |
广告结果
chat_gpt_ad
广告可能出现在 items 数组中。
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 固定为 chat_gpt_ad。 |
rank_group | integer | 同类型中的分组排名。 |
rank_absolute | integer | 在结果中的绝对排名。 |
is_rendered | boolean | 广告是否展示给用户。true 表示已展示,false 表示结果中存在但未展示。 |
title | string | 广告标题。 |
snippet | string | 广告描述文本。 |
url | string | 广告落地页 URL。 |
domain | string | 广告落地页域名。 |
image_url | string | 广告图片 URL。 |
advertiser | object | 广告主信息。 |
advertiser 对象字段:
| 字段 | 类型 | 说明 |
|---|---|---|
name | string | 广告主名称。 |
url | string | 广告主网站 URL。 |
favicon_url | string | 广告主网站图标 URL。 |
响应示例
以下为简化后的响应结构,返回会根据、位置、语言和模型结果动态变化:
json
{
"version": "0.1.20250724",
"status_code": 20000,
"status_message": "Ok.",
"time": "15.0903 sec.",
"cost": 0.0288,
"tasks_count": 1,
"tasks_error": 0,
"tasks": [
{
"id": "9c7d2b2e-0000-0000-0000-000000000001",
"status_code": 20000,
"status_message": "Ok.",
"time": "15.0903 sec.",
"cost": 0.0288,
"result_count": 1,
"data": {
"api": "ai_optimization",
"function": "llm_scraper",
"se": "chat_gpt",
"force_web_search": true,
"language_code": "en",
"location_code": 2840,
"keyword": "albert einstein",
"device": "desktop",
"os": "windows"
},
"result": [
{
"keyword": "albert einstein",
"location_code": 2840,
"language_code": "en",
"model": "current",
"check_url": "https://example.com/search",
"datetime": "2025-07-24 12:57:46 +00:00",
"markdown": "Here is a summary of Albert Einstein...",
"search_results": [],
"sources": [],
"fan_out_queries": [],
"brand_entities": [],
"se_results_count": 0,
"item_types": [
"chat_gpt_text",
"chat_gpt_table"
],
"items_count": 2,
"items": [
{
"type": "chat_gpt_text",
"rank_group": 1,
"rank_absolute": 1,
"markdown": "Here is a summary of Albert Einstein.",
"sources": [],
"brand_entities": []
},
{
"type": "chat_gpt_table",
"rank_group": 1,
"rank_absolute": 2,
"text": null,
"markdown": "| Contribution | Impact |\n|---|---|\n| Relativity | Changed modern physics |",
"table": {
"table_header": [
"Contribution",
"Impact"
],
"table_content": [
[
"Relativity",
"Changed modern physics"
]
]
},
"brand_entities": []
}
]
}
]
}
]
}状态码与错误处理
请根据 status_code 和 status_message 判断请求及任务是否成功:
- 顶层
status_code用于判断整个请求。 - 任务级
status_code用于判断单个任务。 tasks_error大于0时,表示至少有一个任务执行失败。- 建议对时、参数缺失、位置或语言代码无效、平台搜索失败等异常进行重试或记录。
错误码请参考本平台的错误码文档:/v3/appendix/errors。
实用场景
- 监测品牌在 AI 搜索回答中的出现:批量提交品牌问题,统计品牌实体、引用来源和出现位置,评估品牌在生成式搜索中的可见度。
- 追踪 AI 回答的引用来源:开启
force_web_search获取搜索结果与引用来源,用于分析哪些页面被模型采信并指导优化。 - 分析竞品在生成式搜索中的:按不同、国家和语言抓取结果,比较竞品品牌实体、排名及来源覆盖。
- 提取本地商家推荐结果:针对“附近服务商”“城市+品类”等查询获取商家名称、地址、评分和评论数,支持本地 SEO 与门店运营分析。
- 研究 AI 搜索中的商品展示:获取商品标题、价格、商家、评分、图片和购物标识,比较商品在 AI 购物结果中的与竞争。