主题
域名页面概览(实时)
POST /v3/backlinks/domain_pages/live
接口说明
该接口用于获取指定域名或子域名下页面的详细概览,并返回每个页面对应的外链统计数据。
- 请求方式:
POST - 接口地址:
https://api.seermartech.cn/v3/backlinks/domain_pages/live
计费说明
该接口按请求计费。
由于参考文档未给出固定单价,无法直接换算参考人民币价格。扣费以响应头 X-SeerMarTech-Charge-CNY 为准。
请求格式
所有 POST 数据均需使用 JSON(UTF-8 编码)提交。
请求体格式为 JSON 数组:
json
[
{
"target": "forbes.com",
"limit": 5
}
]请求参数
| 字段名 | 类型 | 说明 |
|---|---|---|
target | string | 填。目标域名或子域名,不要 https:// 和 www.。示例:forbes.com |
limit | integer | 返回页面的最大数量。默认值:100;最大值:1000 |
offset | integer | 结果数组的偏移量。默认值:0。例如设置为 10 时,将跳过前 10 个页面并返回后续结果 |
internal_list_limit | integer | 部数组的最大返回数量。可限制以下字段中的数:referring_links_tld、referring_links_types、referring_links_attributes、referring_links_platform_types、referring_links_semantic_locations。默认值:10;最大值:1000 |
backlinks_status_type | string | 指定返回和统计哪类外链。可选值:all(外链)、live(最近一次检查仍存在的外链)、lost(已丢失外链)。默认值:live |
filters | array | 结果过滤条件数组,可同时添加多个过滤条件,最多 8 个过滤器。条件之间需使用逻辑运算符 and 或 or 连接 |
order_by | array | 结果排序规则。排序字段可使用与 filters 相同的字段路径;排序方式支持 asc(升序)和 desc(降序)。单次请求最多设置 3 条排序规则 |
backlinks_filters | array | 对 target 的原始外链集合进行过滤。该过滤结果会用于构建聚合指标数据集。可使用 /v3/backlinks/backlinks/live 响应中的所有字段进行过滤,例如统计 dofollow 外链 |
include_subdomains | boolean | 是否在查询中 target 的子域名。默认值:true;若设为 false,将忽略子域名 |
exclude_internal_backlinks | boolean | 是否排除来自同一主域名子域名的外链。默认值:true;若设为 false,将链接 |
rank_scale | string | 定义 rank、domain_from_rank、page_from_rank 的显示和计算尺度。可选值:one_hundred(0–100)、one_thousand(0–1000)。默认值:one_thousand |
tag | string | 用户自定义任务标识,最大长度 255 字符。响应中的 data 对象会原样返回该值,便于任务对账和追踪 |
filters 支持说明
filters 支持以下运算符:
regexnot_regex=<>innot_inlikenot_likeilikenot_ilikematchnot_match
补说明:
like/not_like支持使用%匹任意长度字符串- 多个条件之间使用
and/or连接 - 可用过滤字段请参考:
/v3/backlinks/filters/
filters 示例
json
[
{
"target": "forbes.com",
"filters": [
["page_summary.backlinks", ">", 5],
"and",
["page", "like", "%sites%"]
],
"limit": 5
}
]order_by 示例
json
[
{
"target": "forbes.com",
"order_by": ["page_summary.backlinks,desc", "page,asc"],
"limit": 10
}
]backlinks_filters 示例
通过该参数可以筛选参与统计的外链,再计算页面级聚合指标。例如只统计 dofollow 外链:
json
[
{
"target": "forbes.com",
"backlinks_filters": [
["dofollow", "=", true]
],
"limit": 10
}
]响应结构
接口返回 JSON 数据,顶层 tasks 数组。
顶层字段
| 字段名 | 类型 | 说明 |
|---|---|---|
version | string | 当前 API 版本 |
status_code | integer | 通用状态码 |
status_message | string | 通用信息消息 |
time | string | 执行时间,单位秒 |
cost | float | 本次请求总费用,单位 USD |
tasks_count | integer | tasks 数组中的任务数量 |
tasks_error | integer | 返回错误的任务数量 |
tasks | array | 任务结果数组 |
建议在业务系统中实现完整的异常与错误处理机制。错误码可参考:
/v3/appendix/errors
tasks字段
| 字段名 | 类型 | 说明 |
|---|---|---|
id | string | 任务唯一标识,UUID 格式 |
status_code | integer | 任务状态码,范围通常为 10000–60000 |
status_message | string | 任务信息消息 |
time | string | 任务执行时间,单位秒 |
cost | float | 该任务费用,单位 USD |
result_count | integer | result 数组数量 |
path | array | URL 路径 |
data | object | 与请求中提交的参数一致 |
result | array | 结果数组 |
result字段
| 字段名 | 类型 | 说明 |
|---|---|---|
target | string | 请求中的 target |
total_count | integer | 数据库中符合条件的总记录数 |
items_count | integer | items 数组中的数量 |
items | array | 页面结果列表 |
items 字段说明
每个 items素表示一个页面对象。
| 字段名 | 类型 | 说明 |
|---|---|---|
type | string | 素类型,固定为 backlinks_domain_page |
main_domain | string | 主域名,不子域名 |
domain | string | 发现该页面的域名 |
tld | string | 顶级域名 |
page | string | 页面 URL |
ip | string | 页面对应的 IP 地址 |
first_visited | string | 爬虫首次访问该页面的时间,UTC 格式:yyyy-mm-dd hh-mm-ss +00:00 |
prev_visited | string | 最近一次访问之前的访问时间,UTC 格式 |
fetch_time | string | 最近一次访问页面的时间,UTC 格式 |
status_code | integer | 页面 HTTP 状态码 |
location | string | 重定向目标地址;如果页面存在跳转则返回该值 |
size | integer | 页面大小,单位字节 |
encoded_size | integer | 编码后的页面大小,单位字节 |
content_encoding | string | 编码类型 |
media_type | string | 页面媒体类型 |
server | string | 服务器信息 |
meta | object | 页面数据 |
page_summary | object | 当前页面的外链聚合指标摘要 |
meta 字段说明
| 字段名 | 类型 | 说明 |
|---|---|---|
title | string | 页面标题 |
canonical | string | canonical 地址 |
internal_links_count | integer | 页面链接数量 |
external_links_count | integer | 页面外部链接数量 |
images_count | integer | 图片数量 |
words_count | integer | 页面词数 |
page_spam_score | integer | 页面垃圾分值 |
social_media_tags | object | 页面中的社交媒体标签及,支持但不限于 Open Graph、Twitter Card |
h1 | array | 页面中 h1 标签 |
h2 | array | 页面中 h2 标签 |
h3 | array | 页面中 h3 标签 |
images_alt | array | 图片 alt 标签 |
powered_by | array | CMS 或建站系统信息 |
language | string | 页面语言,例如 en |
charset | string | 字符编码,例如 utf-8 |
platform_type | array | 平台类型 |
technologies | object | 网站技术栈信息 |
cms | string | 管理系统 |
blogs | string | 博客管理系统 |
cdn | string | 分发网络 |
page_summary 字段说明
| 字段名 | 类型 | 说明 |
|---|---|---|
first_seen | string | 爬虫首次发现该页面存在外链的时间,UTC 格式 |
lost_date | string | 该页面最后一个外链丢失的时间。通常表示页面返回 4xx/5xx,或最后一个外链已被移除 |
rank | integer | 页面等级值 |
backlinks | integer | 指向该页面的外链数量 |
backlinks_spam_score | integer | 指向该页面外链的平均垃圾分值 |
broken_backlinks | integer | 指向该页面的失效外链数量 |
broken_pages | integer | 被外链指向、但返回 4xx 或 5xx 的页面数量 |
referring_domains | integer | 引荐域名数量 |
referring_domains_nofollow | integer | 至少含有一条 nofollow 外链的引荐域名数量 |
referring_main_domains | integer | 引荐主域名数量 |
referring_main_domains_nofollow | integer | 至少含有一条 nofollow 外链的引荐主域名数量 |
referring_ips | integer | 引荐 IP 数量 |
referring_subnets | integer | 引荐子网数量 |
referring_pages | integer | 引荐页面数量 |
referring_links_tld | object | 引荐链接的顶级域名分布及对应数量 |
referring_links_types | object | 引荐链接类型分布及数量。可能值:anchor、image、link、meta、canonical、alternate、redirect |
referring_links_attributes | object | 引荐链接属性分布及数量 |
referring_links_platform_types | object | 引荐平台类型分布及数量。可能值:cms、blogs、ecommerce、message-boards、wikis、news、organization |
referring_links_semantic_locations | object | 引荐链接所在 HTML 语义区域分布及数量,如 article、section、summary |
referring_links_countries | object | 引荐链接所在域名的 ISO 国家代码分布及数量 |
referring_pages_nofollow | integer | 至少指向一条 nofollow 外链的引荐页面数量 |
排名尺度说明
rank_scale 可控制返回的排名值尺度:
one_hundred:按 0–100 返回one_thousand:按 0–1000 返回
默认值为 one_thousand。
时间格式说明
以下字段通常使用 UTC 时间格式:
first_visitedprev_visitedfetch_timepage_summary.first_seenpage_summary.lost_date
格式示例:
text
2017-01-24 13:20:59 +00:00请求示例
cURL
bash
curl --location --request POST "https://api.seermartech.cn/v3/backlinks/domain_pages/live" \
--header "Authorization: Bearer smt_live_YOUR_KEY" \
--header "Content-Type: application/json" \
--data-raw '[
{
"target": "forbes.com",
"filters": [
["page_summary.backlinks", ">", 5],
"and",
["page", "like", "%sites%"]
],
"limit": 5
}
]'Python
python
import requests
url = "https://api.seermartech.cn/v3/backlinks/domain_pages/live"
headers = {
"Authorization": "Bearer smt_live_YOUR_KEY",
"Content-Type": "application/json"
}
payload = [
{
"target": "forbes.com",
"filters": [
["page_summary.backlinks", ">", 5],
"and",
["page", "like", "%sites%"]
],
"limit": 5
}
]
response = requests.post(url, json=payload, headers=headers)
print(response.json)TypeScript
typescript
import axios from "axios";
const postArray = [
{
target: "forbes.com",
limit: 5,
filters: [
["page_summary.backlinks", ">", 5],
"and",
["page", "like", "%sites%"]
]
}
];
axios({
method: "post",
url: "https://api.seermartech.cn/v3/backlinks/domain_pages/live",
headers: {
"Authorization": "Bearer smt_live_YOUR_KEY",
"Content-Type": "application/json"
},
data: postArray
}).then((response) => {
console.log(response.data);
}).catch((error) => {
console.error(error);
});响应示例
json
{
"version": "0.1.20230825",
"status_code": 20000,
"status_message": "Ok.",
"time": "2.5415 sec.",
"cost": 0.02015,
"tasks_count": 1,
"tasks_error": 0,
"tasks": [
{
"data": {
"api": "backlinks",
"function": "domain_pages",
"target": "forbes.com",
"limit": 5,
"filters": [
["page_summary.backlinks", ">", 5],
"and",
["page", "like", "%sites%"]
]
},
"result": [
{
"target": "forbes.com",
"items": [
{
"type": "backlinks_domain_page",
"main_domain": "forbes.com",
"domain": "www.forbes.com",
"tld": "com",
"page": "https://www.forbes.com/sites/emmawoollacott/2021/12/29/cryptomining-malware-found-in-spider-man-no-way-home-torrents/amp/",
"ip": "151.101.1.55",
"first_visited": "2022-01-17 17:34:00 +00:00",
"prev_visited": "2023-02-13 20:18:46 +00:00",
"fetch_time": "2023-05-01 10:29:05 +00:00",
"status_code": 200,
"location": null,
"size": 236313,
"encoded_size": 39458,
"content_encoding": "gzip",
"media_type": "text/html",
"server": "rhino-core-shield",
"meta": {
"title": "Cryptomining Malware Found In Spider-Man: No Way Home Torrents",
"canonical": "https://www.forbes.com/sites/emmawoollacott/2021/12/29/cryptomining-malware-found-in-spider-man-no-way-home-torrents/",
"internal_links_count": 0,
"external_links_count": 0,
"images_count": 0,
"words_count": 0,
"page_spam_score": 0,
"social_media_tags": {
"og:title": "Cryptomining Malware Found In Spider-Man: No Way Home Torrents",
"og:site_name": "Forbes",
"og:type": "article",
"og:url": "https://www.forbes.com/sites/emmawoollacott/2021/12/29/cryptomining-malware-found-in-spider-man-no-way-home-torrents/",
"image": "https://imageio.forbes.com/specials-images/imageserve/61cc55975f4b84c12b90a845/0x0.jpg?format=jpg&width=1200"
},
"h1": null,
"h2": null,
"h3": null,
"images_alt": null,
"powered_by": null,
"language": "en",
"charset": "utf-8",
"platform_type": null,
"technologies": null
},
"page_summary": {
"first_seen": "2022-01-17 17:34:00 +00:00",
"lost_date": null,
"rank": 406,
"backlinks": 16,
"backlinks_spam_score": 0,
"broken_backlinks": 0,
"broken_pages": 0,
"referring_domains": 1,
"referring_domains_nofollow": 0,
"referring_main_domains": 1,
"referring_main_domains_nofollow": 0,
"referring_ips": 1,
"referring_subnets": 1,
"referring_pages": 16,
"referring_links_tld": {
"com": 16
},
"referring_links_types": {
"anchor": 16
},
"referring_links_attributes": null,
"referring_links_platform_types": {
"unknown": 16
},
"referring_links_semantic_locations": {
"main": 16
},
"referring_links_countries": {
"": 16
},
"referring_pages_nofollow": 1
}
}
]
}
]
}
]
}状态码与错误处理
- 顶层
status_code表示整个请求的执行状态 tasks[].status_code表示单个任务的执行状态- 建议同时校验:
- HTTP 状态码
- 顶层
status_code - 任务级
tasks[].status_code
常见处理建议:
- HTTP 请求失败时,优处理网络或鉴权问题
tasks_error > 0时,遍历tasks检查失败任务- 按
status_message和错误码进行重试、告警或降级处理
错误码参考路径:/v3/appendix/errors
使用建议
- 若要查看页面级高价值外链,可按
page_summary.backlinks或page_summary.referring_domains排序 - 若只仍有效的外链,请使用默认的
backlinks_status_type=live - 若要评估历史丢链影响,可设置
backlinks_status_type=lost - 若需要更精准的指标口径,建议结合
backlinks_filters保留指定属性的外链后再做统计
实用场景
- 筛选高外链页面:找出站外链数最高的页面,定位最有链接资产价值的资产,用于重点维护和再分发
- 排查失效落地页:结合
status_code、location、broken_pages识别已跳转或异常页面,减少外链权重流失 - 分析引荐结构:查看
referring_links_tld、referring_links_platform_types、referring_links_countries,评估外链来源分布是否健康、是否过度集中 - 监控垃圾外链风险:利用
backlinks_spam_score与page_spam_score识别高风险页面,外链洗和风控判断 - 发现链接机会:通过
page、meta.title、h1等页面信息定位更易获得外链的主题和页面类型,指导选题与数字投放