主题
反向链接域名页面实时查询
POST /v3/backlinks/domain_pages/live
接口概述
POST /v3/backlinks/domain_pages/live
本接口用于查询指定域名或子域名下的页面,并返回每个页面的详细信息及反向链接数据页面状态、数据、技术栈、反向链接数量、引用域名和链接来源分布等。
请求体使用 UTF-8 编码的 JSON 数组。每次实时调用只能提交 1 个任务;平台限流以认证说明中的 30/60/120 次/分钟规则为准,同时并发请求数最多为 30。
本接口按请求计费,扣费以响应头 X-SeerMarTech-Charge-CNY 为准。
请求参数
请求体格式:
json
[
{
"target": "forbes.com",
"limit": 5
}
]| 参数 | 类型 | 填 | 说明 |
|---|---|---|---|
target | string | 是 | 查询目标,可以是域名或子域名。不得 https:// 和 www.。例如:forbes.com。 |
limit | integer | 否 | 返回的最大页面数量。默认值为 100,最大值为 1000。 |
offset | integer | 否 | 结果数组的偏移量。默认值为 0。例如设置为 10 时,将跳过前 10 条结果并返回后续页面。 |
internal_list_limit | integer | 否 | 限制数组的最大数量。适用于 referring_links_tld、referring_links_types、referring_links_attributes、referring_links_platform_types、referring_links_semantic_locations。默认值为 10,最大值为 1000。 |
backlinks_status_type | string | 否 | 指定返回并统计的反向链接类型。可选值:all:返回并统计反向链接;live:返回并统计最近一次检查时仍存在的反向链接;lost:返回并统计已丢失的反向链接。默认值为 live。 |
filters | array | 否 | 页面结果过滤条件。最多添加 8 个过滤条件,条件之间使用 and 或 or 连接。 |
order_by | array | 否 | 结果排序规则。最多设置 3 条排序规则,使用逗号分隔排序方向。 |
backlinks_filters | array | 否 | 过滤目标页面的初始反向链接数据。过滤后的链接将用于计算聚合指标。支持反向链接明细接口返回的字段,可用于统计 dofollow 链接等场景。 |
include_subdomains | boolean | 否 | 是否在查询中目标域名的子域名。false 表示忽略子域名。默认值为 true。 |
exclude_internal_backlinks | boolean | 否 | 是否排除同一主域名下子域名指向目标的反向链接。true 表示排除,false 表示保留。默认值为 true。 |
rank_scale | string | 否 | rank、domain_from_rank 和 page_from_rank 的计算及展示量表。可选值:one_hundred:0–100;one_thousand:0–1000。默认值为 one_thousand。 |
tag | string | 否 | 用户自定义任务标识,最长 255 个字符。该值会原样返回在响应任务的 data 对象中,便于请求与结果。 |
filters 支持的运算符
支持以下运算符:
regexnot_regex=<>innot_inlikenot_likeilikenot_ilikematchnot_match
使用 like 或 not_like 时,可以使用 % 匹零个或多个字符。
示例:
json
[
{
"target": "forbes.com",
"filters": [
["page_summary.backlinks", ">", 5],
"and",
["page", "like", "%sites%"]
],
"limit": 5
}
]order_by 示例
json
[
{
"target": "forbes.com",
"order_by": [
"page_summary.backlinks,desc",
"page_summary.referring_domains,desc"
]
}
]排序方向支持:
asc:升序desc:降序
请求示例
cURL
bash
curl --location --request POST \
"https://api.seermartech.cn/v3/backlinks/domain_pages/live" \
--header "Authorization: Bearer smt_live_YOUR_KEY" \
--header "Content-Type: application/json" \
--data-raw '[
{
"target": "forbes.com",
"limit": 5,
"filters": [
["page_summary.backlinks", ">", 5],
"and",
["page", "like", "%sites%"]
]
}
]'Python
python
import requests
url = "https://api.seermartech.cn/v3/backlinks/domain_pages/live"
headers = {
"Authorization": "Bearer smt_live_YOUR_KEY",
"Content-Type": "application/json",
}
post_data = [
{
"target": "forbes.com",
"limit": 5,
"filters": [
["page_summary.backlinks", ">", 5],
"and",
["page", "like", "%sites%"],
],
}
]
response = requests.post(url, headers=headers, json=post_data)
result = response.json()
if result.get("status_code") == 20000:
print(result)
else:
print(
"请求失败,错误码:%s,错误信息:%s"
% (result.get("status_code"), result.get("status_message"))
)TypeScript
typescript
import axios from "axios";
const postData = [
{
target: "forbes.com",
limit: 5,
filters: [
["page_summary.backlinks", ">", 5],
"and",
["page", "like", "%sites%"],
],
},
];
axios
.post(
"https://api.seermartech.cn/v3/backlinks/domain_pages/live",
postData,
{
headers: {
Authorization: "Bearer smt_live_YOUR_KEY",
"Content-Type": "application/json",
},
}
)
.then((response) => {
// 处理接口返回结果
console.log(response.data);
})
.catch((error) => {
// 处理请求异常
console.error(error.response?.data || error.message);
});响应结构
接口返回 JSON 对象 tasks 数组。
顶层字段
| 字段 | 类型 | 说明 |
|---|---|---|
version | string | 当前 API 版本。 |
status_code | integer | 通用响应状态码。成功时通常为 20000。 |
status_message | string | 通用状态信息。 |
time | string | 接口执行耗时,单位为秒。 |
cost | float | 平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。 |
tasks_count | integer | tasks 数组中的任务总数。 |
tasks_error | integer | tasks 数组中返回错误的任务数量。 |
tasks | array | 任务结果数组。 |
任务字段
| 字段 | 类型 | 说明 |
|---|---|---|
id | string | 任务唯一标识,采用 UUID 格式。 |
status_code | integer | 任务状态码,通常位于 10000–60000 范围。 |
status_message | string | 任务状态信息。 |
time | string | 任务执行耗时。 |
cost | float | 平台原始 USD 成本兼容字段;人民币实扣以 X-SeerMarTech-Charge-CNY 为准。 |
result_count | integer | result 数组中的数量。 |
path | array | 请求 URL 路径。 |
data | object | 请求时提交的任务参数。 |
result | array | 查询结果数组。 |
result 字段
| 字段 | 类型 | 说明 |
|---|---|---|
target | string | 请求中的目标域名或子域名。 |
total_count | integer | 数据库中符合条件的项目总数。 |
items_count | integer | items 数组中的数量。 |
items | array | 页面明细数组。 |
页面明细字段
每个 items素的类型为 backlinks_domain_page。
页面基础信息
| 字段 | 类型 | 说明 |
|---|---|---|
type | string | 素类型,固定为 backlinks_domain_page。 |
main_domain | string | 主网站域名,不子域名。 |
domain | string | 页面所在域名。 |
tld | string | 顶级域名,例如 com。 |
page | string | 页面 URL。 |
ip | string | 页面 IP 地址。 |
first_visited | string | 爬虫首次访问该页面的时间,使用 UTC 格式:yyyy-mm-dd hh-mm-ss +00:00。 |
prev_visited | string | 爬虫最近一次访问之前的访问时间,使用 UTC 格式。 |
fetch_time | string | 爬虫最近一次访问该页面的时间,使用 UTC 格式。 |
status_code | integer | 页面 HTTP 状态码。 |
location | string | Location 响应头的值,表示页面存在重定向时的目标 URL。 |
size | integer | 页面大小,单位为字节。 |
encoded_size | integer | 页面编码后的大小,单位为字节。 |
content_encoding | string | 编码类型,例如 gzip。 |
media_type | string | 页面媒体类型,例如 text/html。 |
server | string | 服务器版本或标识。 |
meta 页面数据
| 字段 | 类型 | 说明 |
|---|---|---|
title | string | 页面标题。 |
canonical | string | 页面规范 URL。 |
internal_links_count | integer | 页面链接数量。 |
external_links_count | integer | 页面外部链接数量。 |
images_count | integer | 页面图片数量。 |
words_count | integer | 页面词数。 |
page_spam_score | integer | 页面垃圾评分。 |
social_media_tags | object | 页面中发现的社交媒体标签及,支持 Open Graph、Twitter Card 等标签。 |
h1 | array | 页面中的 h1 标签。 |
h2 | array | 页面中的 h2 标签。 |
h3 | array | 页面中的 h3 标签。 |
images_alt | array | 页面图片 alt 属性。 |
powered_by | array | 页面使用的 CMS 等系统信息。 |
language | string | 页面语言,例如 en。 |
charset | string | 页面字符编码,例如 utf-8。 |
platform_type | array | 平台类型。 |
technologies | object | 网站技术信息。 |
technologies 技术信息
| 字段 | 类型 | 说明 |
|---|---|---|
cms | string | 管理系统。 |
blogs | string | 博客管理系统。 |
cdn | string | 分发网络。 |
page_summary 页面反向链接汇总
| 字段 | 类型 | 说明 |
|---|---|---|
first_seen | string | 爬虫首次发现该页面反向链接的时间,使用 UTC 格式。 |
lost_date | string | 页面最后一次丢失反向链接的时间。当页面返回 4xx/5xx,或最后一个反向链接被移除时可能产生该值。 |
rank | integer | 页面排名值,根据链接数据库节点排名方法计算。原理与早期 PageRank 算法类似,量表由 rank_scale 控制。 |
backlinks | integer | 指向该页面的反向链接数量。 |
backlinks_spam_score | integer | 指向该页面的反向链接平均垃圾评分。 |
broken_backlinks | integer | 指向该页面的失效反向链接数量。 |
broken_pages | integer | 返回 4xx 或 5xx 状态码、且存在反向链接指向的页面数量。 |
referring_domains | integer | 引用域名数量。 |
referring_domains_nofollow | integer | 至少一个 nofollow 链接指向该页面的域名数量。 |
referring_main_domains | integer | 引用主域名数量。 |
referring_main_domains_nofollow | integer | 至少一个 nofollow 链接指向该页面的主域名数量。 |
referring_ips | integer | 指向该页面的引用 IP 地址数量。 |
referring_subnets | integer | 引用子网数量。 |
referring_pages | integer | 指向该页面的引用页面数量。 |
referring_links_tld | object | 引用链接所在的顶级域名及对应链接数量。 |
referring_links_types | object | 引用链接类型及对应数量。可能的类型:anchor、image、link、meta、canonical、alternate、redirect。 |
referring_links_attributes | object | 引用链接属性及对应数量,例如 nofollow、noopener、noreferrer。 |
referring_links_platform_types | object | 引用平台类型及对应数量。可能的类型:cms、blogs、ecommerce、message-boards、wikis、news、organization。 |
referring_links_semantic_locations | object | 引用链接所在 HTML 语义位置及对应数量,例如 article、section、summary、main。 |
referring_links_countries | object | 引用链接所在域名的 ISO 国家代码及对应数量。 |
referring_pages_nofollow | integer | 至少一个 nofollow 链接指向该页面的引用页面数量。 |
响应示例
json
{
"version": "0.1.20230825",
"status_code": 20000,
"status_message": "Ok.",
"time": "2.5415 sec.",
"cost": 0.02015,
"tasks_count": 1,
"tasks_error": 0,
"tasks": [
{
"id": "118f4f2a-7c5f-4d4d-9c0a-123456789abc",
"status_code": 20000,
"status_message": "Ok.",
"time": "2.5300 sec.",
"cost": 0.02015,
"result_count": 1,
"path": [
"v3",
"backlinks",
"domain_pages",
"live"
],
"data": {
"api": "backlinks",
"function": "domain_pages",
"target": "forbes.com",
"limit": 5,
"filters": [
["page_summary.backlinks", ">", 5],
"and",
["page", "like", "%sites%"]
]
},
"result": [
{
"target": "forbes.com",
"total_count": 5,
"items_count": 5,
"items": [
{
"type": "backlinks_domain_page",
"main_domain": "forbes.com",
"domain": "www.forbes.com",
"tld": "com",
"page": "https://www.forbes.com/sites/example/",
"ip": "151.101.1.55",
"first_visited": "2022-01-17 17:34:00 +00:00",
"prev_visited": "2023-02-13 20:18:46 +00:00",
"fetch_time": "2023-05-01 10:29:05 +00:00",
"status_code": 200,
"location": null,
"size": 236313,
"encoded_size": 39458,
"content_encoding": "gzip",
"media_type": "text/html",
"server": "rhino-core-shield",
"meta": {
"title": "Cryptomining Malware Found In Spider-Man: No Way Home Torrents",
"canonical": "https://www.forbes.com/sites/example/",
"internal_links_count": 0,
"external_links_count": 0,
"images_count": 0,
"words_count": 0,
"page_spam_score": 0,
"social_media_tags": {
"og:title": "Cryptomining Malware Found In Spider-Man: No Way Home Torrents",
"og:type": "article",
"twitter:card": "summary_large_image"
},
"h1": null,
"h2": null,
"h3": null,
"images_alt": null,
"powered_by": null,
"language": "en",
"charset": "utf-8",
"platform_type": null,
"technologies": null
},
"page_summary": {
"first_seen": "2022-01-17 17:34:00 +00:00",
"lost_date": null,
"rank": 406,
"backlinks": 16,
"backlinks_spam_score": 0,
"broken_backlinks": 0,
"broken_pages": 0,
"referring_domains": 1,
"referring_domains_nofollow": 0,
"referring_main_domains": 1,
"referring_main_domains_nofollow": 0,
"referring_ips": 1,
"referring_subnets": 1,
"referring_pages": 16,
"referring_links_tld": {
"com": 16
},
"referring_links_types": {
"anchor": 16
},
"referring_links_attributes": {
"nofollow": 4,
"noopener": 8,
"noreferrer": 8
},
"referring_links_platform_types": {
"blogs": 8,
"news": 8
},
"referring_links_semantic_locations": {
"article": 12,
"section": 4
},
"referring_links_countries": {
"US": 12,
"GB": 4
},
"referring_pages_nofollow": 1
}
}
]
}
]
}
]
}状态码与异常处理
请根据顶层 status_code 和任务级 status_code 判断请求是否成功。成功状态码通常为 20000。发生错误时,应同时记录 status_code 与 status_message,并针对网络异常、限流、参数错误和数据为空等设计重试或降级逻辑。
完整错误码可参考:/v3/appendix/errors
实用场景
- 定位高价值落地页:按
page_summary.backlinks、referring_domains和rank筛选页面,优识别获得高质量外链最多的资产。 - 排查失效页面与外链损失:结合
status_code、location、broken_backlinks和lost_date,发现 4xx/5xx 页面及由此造成的外链流失。 - 评估竞争对手页面的外链结构:查询竞争域名的页面级反向链接数据,比较引用域名、链接类型、国家和平台来源。
- 筛选高风险外链页面:使用
page_spam_score和backlinks_spam_score识别垃圾评分较高的页面,为外链理和风险控制提供依据。 - 优化与页面技术质量:分析
title、canonical、h1、images_alt、language、technologies等字段,结合外链表现制定页面优化计划。