主题
批量页面摘要(实时)
接口说明
该接口用于一次性获取最多 1000 个目标的外链汇总信息,目标可以是:
- 域名
- 子域名
- 页面 URL
当目标为单个页面时,接口会返回该页面所有外链的综合摘要数据。
请求方式:
POST https://api.seermartech.cn/v3/backlinks/bulk_pages_summary/live
计费说明
该接口按请求计费。
参考价约 ¥0.3210 / 次。 扣费以响应头 X-SeerMarTech-Charge-CNY 为准。
请求体格式
所有 POST 数据均需使用 UTF-8 编码的 JSON 格式提交。 请求体为 JSON 数组:
json
[
{
"targets": [
"https://example.com/",
"example.org"
]
}
]请求参数
| 字段名 | 类型 | 说明 |
|---|---|---|
targets | array | 需要查询摘要数据的域名、子域名或网页地址。填。域名或子域名请不要带 https:// 和 www.;页面使用完整绝对 URL( http:// 或 https://)。单次请求最多支持 1000 个目标,且同一请求中的 URL 不能分属 100 个不同主域。 |
include_subdomains | boolean | 是否在搜索中子域名。可选;设为 false 时忽略子域名。默认值:true。 |
rank_scale | string | 定义 rank、domain_from_rank、page_from_rank 等排名值的展示尺度。可选。可选值:one_hundred(0–100)、one_thousand(0–1000)。默认值:one_thousand。 |
tag | string | 自定义任务标识。可选,最长 255 个字符。可用于在响应结果中识别和匹任务;返回时会出现在响应的 data 对象中。 |
响应结构
接口返回 JSON 编码数据, tasks 数组。
顶层字段
| 字段名 | 类型 | 说明 |
|---|---|---|
version | string | 当前 API 版本。 |
status_code | integer | 通用状态码。完整错误码请参考 /v3/appendix/errors。建议在业务系统中做好异常与错误处理。 |
status_message | string | 通用状态信息。 |
time | string | 执行耗时,单位秒。 |
cost | float | 本次请求总费用,单位 USD。 |
tasks_count | integer | tasks 数组中的任务数量。 |
tasks_error | integer | 返回错误的任务数量。 |
tasks | array | 任务结果数组。 |
tasks 数组字段
| 字段名 | 类型 | 说明 |
|---|---|---|
id | string | 任务唯一标识,UUID 格式。 |
status_code | integer | 任务状态码,范围通常为 10000–60000。完整错误码请参考 /v3/appendix/errors。 |
status_message | string | 任务状态信息。 |
time | string | 任务执行耗时,单位秒。 |
cost | float | 当前任务费用,单位 USD。 |
result_count | integer | result 数组中的数量。 |
path | array | 请求路径。 |
data | object | 与提交的 POST 参数一致。 |
result | array | 结果数组。 |
result 数组字段
| 字段名 | 类型 | 说明 |
|---|---|---|
total_count | integer | 数据库中结果的总数。 |
items_count | integer | 当前结果中的 items 数量。 |
items | array | 结果项数组。 |
items 数组字段
| 字段名 | 类型 | 说明 |
|---|---|---|
type | string | 素类型,固定为 backlinks_page_summary。 |
url | string | 页面 URL。 |
rank | integer | 页面在目标网站上的排名值。该值基于链接数据库中的节点排序方法计算,原理类似早期 PageRank。 |
main_domain_rank | integer | 主域名排名值,计算原理同样基于链接图谱中的节点排序。 |
backlinks | integer | 外链总数。 |
first_seen | string | 爬虫首次发现指向该页面外链的时间,UTC 格式:yyyy-mm-dd hh:mm:ss +00:00。例如:2019-11-15 12:57:46 +00:00 |
lost_date | string | 最后一条外链丢失的时间,或爬虫访问页面时返回 4xx/5xx 状态码的时间。UTC 格式:yyyy-mm-dd hh:mm:ss +00:00。例如:2017-01-24 13:20:59 +00:00 |
backlinks_spam_score | integer | 指向该页面的外链平均垃圾分值。 |
broken_backlinks | integer | 失效外链数量。 |
broken_pages | integer | 被外链指向但返回 4xx/5xx 的失效页面数量。 |
referring_domains | integer | 引用该页面的域名数量。 |
referring_domains_nofollow | integer | 至少一条 nofollow 链接的引用域名数量。 |
referring_main_domains | integer | 引用该页面的主域名数量。 |
referring_main_domains_nofollow | integer | 至少一条 nofollow 链接的引用主域名数量。 |
referring_ips | integer | 引用该页面的 IP 地址数量。 |
referring_subnets | integer | 引用该页面的子网数量。 |
referring_pages | integer | 指向该 url 的页面数量。 |
referring_pages_nofollow | integer | 至少一条 nofollow 链接的引用页面数量。 |
referring_links_tld | object | 引用链接的顶级域分布,以及各顶级域的链接数量。 |
referring_links_types | object | 引用链接类型分布及数量。可能值:anchor、image、link、meta、canonical、alternate、redirect。 |
referring_links_attributes | object | 引用链接属性分布及数量。 |
referring_links_platform_types | object | 引用来源平台类型分布及数量。可能值:cms、blogs、ecommerce、message-boards、wikis、news、organization。 |
referring_links_semantic_locations | object | 引用链接在 HTML 语义结构中的位置分布及数量,例如 article、section、footer。 |
referring_links_countries | object | 引用链接所在域名的 ISO 国家代码分布及对应链接数量。 |
请求示例
cURL
bash
curl --location --request POST "https://api.seermartech.cn/v3/backlinks/bulk_pages_summary/live" \
--header "Authorization: Bearer smt_live_YOUR_KEY" \
--header "Content-Type: application/json" \
--data-raw '[
{
"targets": [
"https://example.com/",
"https://example.com/about",
"example.org"
],
"include_subdomains": true,
"rank_scale": "one_thousand",
"tag": "bulk-pages-summary-demo"
}
]'Python
python
import requests
url = "https://api.seermartech.cn/v3/backlinks/bulk_pages_summary/live"
headers = {
"Authorization": "Bearer smt_live_YOUR_KEY",
"Content-Type": "application/json"
}
payload = [
{
"targets": [
"https://example.com/",
"https://example.com/about",
"example.org"
],
"include_subdomains": True,
"rank_scale": "one_thousand",
"tag": "bulk-pages-summary-demo"
}
]
response = requests.post(url, headers=headers, json=payload)
print(response.json)TypeScript
typescript
const response = await fetch("https://api.seermartech.cn/v3/backlinks/bulk_pages_summary/live", {
method: "POST",
headers: {
"Authorization": "Bearer smt_live_YOUR_KEY",
"Content-Type": "application/json"
},
body: JSON.stringify([
{
targets: [
"https://example.com/",
"https://example.com/about",
"example.org"
],
include_subdomains: true,
rank_scale: "one_thousand",
tag: "bulk-pages-summary-demo"
}
])
});
const data = await response.json;
console.log(data);响应示例
json
{
"version": "0.1.20240422",
"status_code": 20000,
"status_message": "Ok.",
"time": "0.1566 sec.",
"cost": 0.02006,
"tasks_count": 1,
"tasks_error": 0,
"tasks": [
{
"id": "xxxxxxxx-xxxx-xxxx-xxxx-xxxxxxxxxxxx",
"status_code": 20000,
"status_message": "Ok.",
"time": "0.1566 sec.",
"cost": 0.02006,
"result_count": 1,
"path": [
"v3",
"backlinks",
"bulk_pages_summary",
"live"
],
"data": {
"api": "backlinks",
"function": "bulk_pages_summary",
"targets": [
"https://example.com/",
"example.org"
]
},
"result": [
{
"total_count": 2,
"items_count": 2,
"items": [
{
"type": "backlinks_page_summary",
"url": "https://example.com/",
"rank": 523,
"main_domain_rank": 612,
"backlinks": 1840,
"first_seen": "2019-11-15 12:57:46 +00:00",
"lost_date": null,
"backlinks_spam_score": 12,
"broken_backlinks": 24,
"broken_pages": 3,
"referring_domains": 410,
"referring_domains_nofollow": 95,
"referring_main_domains": 380,
"referring_main_domains_nofollow": 84,
"referring_ips": 352,
"referring_subnets": 297,
"referring_pages": 1280,
"referring_pages_nofollow": 260,
"referring_links_tld": {
"com": 920,
"org": 180,
"net": 95
},
"referring_links_types": {
"anchor": 1100,
"image": 90,
"redirect": 25
},
"referring_links_attributes": {
"dofollow": 1020,
"nofollow": 260,
"ugc": 35,
"sponsored": 8
},
"referring_links_platform_types": {
"blogs": 420,
"cms": 510,
"news": 95
},
"referring_links_semantic_locations": {
"article": 640,
"section": 210,
"footer": 75
},
"referring_links_countries": {
"US": 540,
"GB": 120,
"DE": 60
}
}
]
}
]
}
]
}状态码与错误处理
- 顶层
status_code表示整个请求的处理状态 tasks[].status_code表示单个任务的执行状态- 建议同时校验:
- HTTP 状态码
- 顶层
status_code tasks_error- 各任务的
status_code
常见成功状态:
| 状态码 | 说明 |
|---|---|
20000 | 请求成功 |
完整错误码与说明请参考:/v3/appendix/errors
使用要点
- 单次请求最多传 1000 个目标。
- 同一请求中的所有目标,最多只能覆盖 100 个不同主域。
- 域名/子域名查询时,不要带协议头和
www.。 - 页面查询时,传完整绝对 URL。
- 若希望结果覆盖子域,请保持
include_subdomains=true;如只看主目标本身,可设为false。 rank_scale影响排名值的展示尺度,不改变底层数据来源。
实用场景
- 批量评估落地页外链质量:一次对数百个页面汇总外链数量、引用域名、垃圾分值,快速识别高价值页面与薄弱页面。
- 排查失效页面的外链浪费:结合
broken_pages与broken_backlinks,定位仍被外部大量链接指向但已报错的页面,制定 301 重定向或修复方案。 - 比较不同目录或站点的链接资产:对主站、子站、栏目页、专题页批量拉取摘要,横向比较
rank、referring_domains、referring_pages等指标。 - 识别外链来源结构异常:利用
referring_links_tld、referring_links_countries、referring_links_platform_types判断链接来源是否过度集中,风控与外链审计。 - 监控 nofollow 与平台分布变化:通过
referring_pages_nofollow、referring_domains_nofollow以及平台类型分布,评估外链建设策略是否偏向单一渠道、是否备自然增长特征。