KNOWLEDGE / 01LAYER 2当前核心

站点架构与发现路径

Site Architecture & Discovery Paths

用业务对象、用户任务和可抓取链接构建层级,让重要页面从稳定 hub 获得清晰上下文,而不是机械追求“三次点击”。

先修知识URL 与 HTTP 状态契约
解锁能力抓取预算与日志分析主题集群与内容组合内部链接系统
默认基础无需额外背景
本页目录 · 11 个学习环节
01

学习契约与正确模型

先明确为什么学、学完能做什么,以及如何证明自己真的掌握。

为什么现在要学

B2B 站常把功能、行业、用例、集成与资源分散在不同 CMS,形成孤页、导航冲突和不可维护的 URL 树。

完成本页后,你应能
  • 能绘制页面类型与链接关系图
  • 能识别孤页、死端和过深页面
  • 能把 ICP 任务映射到导航与 hub
建议节奏

精读 27 分钟 → 引导练习 18 分钟 → 实战任务 70 分钟。实战时间单列,不再把浏览页面和项目操作混成一个数字。

它是什么
站点架构是页面类型、URL、导航、层级和链接之间的可维护关系。
为什么重要
链接提供发现路径、语义上下文和优先级线索,也决定用户能否继续任务。
什么时候使用
新站规划、内容扩张、CMS 合并或核心页面长期低抓取时。
什么时候不要套用
不要为浅层级把所有页面塞进主导航,也不要把 URL 目录等同真实链接图。
边界与不确定性
架构改善发现与理解,但不会让无需求、无价值页面自动排名。
02

机制精讲

先读完整因果链,再看每个环节留下什么可观察信号。

站点架构不是 URL 看起来有几层目录,而是页面类型、业务对象、用户任务和真实链接形成的关系系统。搜索引擎从可解析链接发现地址,用户也依靠导航、面包屑、聚合页与上下文推荐推进任务。一个路径短却放在无关页脚的链接,未必比从高度相关 hub 经过四步的路径更有帮助;因此“所有页面三次点击内到达”只能作为排查提示,不能当作固定排名规则。

B2B 网站往往同时拥有功能、行业、角色、集成、案例与知识内容,如果每个团队各自建分类,就会出现孤页、重复 hub、死端和无法扩展的导航。架构设计要先明确对象与任务,再定义每种模板从哪里被发现、向哪里继续、为什么值得独立存在。本课以链接图和任务流为共同语言,让你能把视觉菜单偏好转成可以抓取、计算、原型测试和长期维护的规则。

01

页面类型与对象模型

先定义产品、能力、行业、集成和资源各自代表什么对象,以及一对一、一对多关系;分类名称只是界面,稳定对象关系才决定可扩展链接。

观察什么制作模板清单并为每种模板抽样 URL、父级、子级和相邻对象。
02

发现路径与链接图

真实 a[href] 构成有向图。入链数量、来源相关性、点击深度与孤立状态可帮助发现风险,但不能单独等同页面重要性或排名。

观察什么从稳定入口爬取,计算 inlinks、depth、orphan 与只在 sitemap 出现的 URL。
03

用户任务连续性

好架构让用户从理解问题、评估方案、核验证据到转化自然前进。每个链接应回答“为什么此时推荐这个目标”,而不是为了分配某种虚构的权重。

观察什么为典型 ICP 任务做路径走查,记录每一步是否有明确下一动作。
03

关键概念

掌握术语之间的关系,才能迁移到不同网站、行业和工具。

01

Hub 与 spoke

Hub 聚合用户任务并给子页上下文;spoke 反向连接形成可导航集合。

02

点击深度

从稳定入口到目标的链接步数是诊断指标,不是固定排名规则。

03

孤页

只有 Sitemap 或外链、没有站内可抓取入口的页面难以持续发现。

04

完整示范

跟随一次“输入 → 分析 → 中间产物 → 结论”,看见专家是怎样做判断的。

WORKED EXAMPLE

重构数据平台的内容关系

教学用合成数据:站点有 12 个功能页、9 个行业页、40 个集成页与 200 篇文章;抓取发现 38 个孤页,销售访谈显示用户常从行业问题跳到功能比较。

前提与样例口径
  • 每类页面有明确 owner
  • 不在本练习中改变 URL,只先重构链接与 hub
  1. 建立对象清单

    输入
    URL、模板、业务对象和目标任务。
    分析
    区分“数据治理”这样的持续问题 hub、“金融行业”场景页、“元数据管理”功能页与具体集成,删除只因关键词存在而创建的重复分类。
    输出
    对象—页面类型—用户任务矩阵。
  2. 画目标关系

    输入
    矩阵与用户访谈。
    分析
    问题 hub 链向解释与评估内容,行业页链向相关能力和案例,功能页链向集成与演示;每条边写出推荐理由。
    输出
    带边语义的目标链接图。
  3. 比较现实图

    输入
    站点爬取数据。
    分析
    找出孤页、只被页脚链接的商业页、无返回路径的文章和过度链接的通用 hub,按业务价值与故障规模排序。
    输出
    现实—目标差距清单。
  4. 模板化验收

    输入
    目标图和 CMS 能力。
    分析
    把关系转换为导航、面包屑和上下文模块规则,在原型上完成三条 ICP 任务,再爬取验证 href、深度与孤页。
    输出
    模板规则、原型测试记录和回归爬取。

结论:重构重点不是把所有 URL 搬到浅目录,而是让每种页面有稳定入口、清楚上下文和合理下一步。链接图指标发现异常,用户任务与业务对象决定应建立哪些关系。

迁移到真实项目:新增市场、产品线或内容计划前,先把新对象放入关系模型并验证模板规则,可避免每次扩张都重新设计导航。

05

决策规则与证据边界

把“看到什么、意味着什么、下一步做什么”连起来,同时区分公开事实、实践推断和未知项。

信号解释行动限制
页面只在 sitemap 中出现且无站内入链它可被提交但缺乏持续的站内发现与语义上下文。若页面有独立价值,从最相关 hub 建立真实入口;否则重新评估保留。不要为了消灭孤页给所有页面随意加链接。
主导航需要容纳数百个具体页面对象层级或 hub 设计可能缺失。按稳定任务建立聚合层,并让具体页从相关集合进入。浅并不等于好;过宽导航会增加认知负担。
文章有流量但没有通往产品或下一学习步骤内容形成死端,任务连续性断裂。加入与当下问题直接相关的指南、功能、案例或评估动作。CTA 相关性优先于商业强度,不能每段都硬推演示。
可确认
  • HTML 中的 href、爬取可达路径和用户测试任务都能被直接观察。
工作推断
  • 更清晰的 hub 与上下文链接可能改善发现和任务完成,需要分模板验证。
不要声称已知
  • 公开资料不提供某个链接位置或点击深度对应的固定排名增益。
06

引导练习

先独立完成,再按提示修正,最后展开参考解法并用 0–4 级量规评分。

YOUR TURN

为教学用合成数据中的网络安全 SaaS 设计最小架构:现有“平台、行业、博客”三类入口,新增 6 个功能、4 个行业、12 个集成和 30 篇指南。

给定材料

  • 用户任务:安全负责人先理解攻击面,再比较能力、核验集成,最后申请演示。
  • 现状:所有集成只可从站内搜索访问;指南仅按发布日期列出;行业页只链接首页。
需要提示时再展开
  1. 先画页面对象和关系,不先讨论 URL 命名。
  2. 每条链接写出它帮助用户完成的下一任务,并说明模板如何自动维护。
完成后核对参考解法

应建立一个围绕“攻击面管理”持续问题的主题 hub,向核心解释指南、能力总览和行业入口分流;功能页连接适用行业、相关集成、证据案例和演示动作;行业页从该行业任务出发连接必要能力与案例;集成目录按真实产品关系提供可抓取的列表,每个集成详情反向连接能力;指南按问题阶段进入主题集合,而非只按日期。先从稳定入口爬取,确保每个保留页至少有一个相关 href,并用安全负责人任务测试从理解、比较到核验集成是否连续。点击深度和入链用于发现异常,不被宣称为固定排名因果。

自评分量规

0 级只重新命名 URL 目录,没有设计页面关系。
1 级列出导航栏目,但集成与指南仍无上下文入口。
2 级建立主要 hub、功能、行业、集成和指南之间的基本链接。
3 级每条关系有任务理由、模板规则并通过爬取和用户路径验收。
4 级进一步处理扩展、孤页治理、owner、未知项与迭代监测。
07

真实项目实战

把理解变成一个可以检查、复核和复用的工作产物。

FIELD LAB

重构 B2B 平台信息架构

网站有 12 个功能、9 个行业、40 个集成和 200 篇文章,主导航与博客分类互不相连。

  1. 建立页面类型和业务对象清单
  2. 用用户任务定义一级/二级 hub
  3. 抓取内链并计算孤页和深度
  4. 设计导航、面包屑和上下文模块
  5. 用原型测试任务路径
需要交付页面类型地图、目标链接图与模板级导航规则。

验收条件

  • 每个可索引页至少一个相关可抓取入口
  • 商业页从稳定 hub 可达
  • 未把筛选参数当主架构
  • 用户可完成比较、理解和转化任务
08

诊断练习

目标不是猜中答案,而是提出竞争假设并选择能区分它们的证据。

SCENARIO

一批高质量行业页被提交但很少抓取。

竞争假设

  1. 只有 Sitemap 入口
  2. 导航链接由 JS 事件生成
  3. hub 页 canonical/noindex 错误
  4. 锚文本未表达行业关系

应该检查的证据

  1. 爬虫的 inlinks、深度与孤页报告
  2. 源 HTML 的 href
  3. 日志中抓取间隔
  4. 从首页和功能页的用户路径

常见陷阱:只缩短 URL 字符串或目录,却不改变实际链接关系。

完成后用本页决策规则复核
  1. 若观察到:页面只在 sitemap 中出现且无站内入链
    应优先:若页面有独立价值,从最相关 hub 建立真实入口;否则重新评估保留。
    不要为了消灭孤页给所有页面随意加链接。
  2. 若观察到:主导航需要容纳数百个具体页面
    应优先:按稳定任务建立聚合层,并让具体页从相关集合进入。
    浅并不等于好;过宽导航会增加认知负担。
  3. 若观察到:文章有流量但没有通往产品或下一学习步骤
    应优先:加入与当下问题直接相关的指南、功能、案例或评估动作。
    CTA 相关性优先于商业强度,不能每段都硬推演示。
09

自测与误区

先口头回答,再展开检查。无法给出例外与证据,说明还没真正掌握。

你应该能回答

1. 页面属于哪个业务对象与用户任务?

参考答案:先写页面代表的业务对象、目标 ICP 和要完成的任务,再决定它属于功能、行业、集成、案例或教育资源等类型。

为什么:对象与任务比 URL 目录更稳定,也决定页面是否应独立存在。

2. 最自然的上游 hub 和下一步是什么?

参考答案:选择能解释目标对象来源的相关 hub,并提供用户完成当前任务后的自然下一步;二者都应通过真实 href 相连。

为什么:相关上下文同时服务发现和用户连续性;抓取图与任务走查可验证链接是否真正发挥作用。

3. 新增 500 页后规则还能维护吗?

参考答案:把关系做成模板级规则,使用对象字段驱动链接,并在加入样本后自动爬取检查孤页、错误关联和导航宽度。

为什么:依靠编辑手工维护的链接图在规模扩大后容易腐化。

需要避开的误区

  • 所有页面必须三次点击内到达
  • URL 层级就是站点架构
  • 页脚全站链接能替代上下文链接
10

术语与复盘

用自己的话复述术语和结论;如果只能认出、不能解释,就还没有形成可调用的知识。

页面类型
共享对象语义、任务和模板规则的一组页面。
Hub
围绕稳定问题或对象组织并解释子页面关系的聚合入口。
Spoke
解决更具体子任务并与 hub 双向连接的独立页面。
孤页
没有可抓取站内入链、只能从外部或 sitemap 发现的页面。
点击深度
从指定稳定入口沿链接到目标所需的最少步数。

离开本页前记住

  1. 架构是对象、任务与链接关系,不是目录外观。
  2. 真实 href 决定可复现的发现路径。
  3. 图指标用于诊断,不是排名公式。
  4. 每个页面都要有来路与合理下一步。
  5. 模板规则让架构在规模扩大后仍可维护。
11

资料与证据

优先采用官方和一手资料。实践材料用于补充工作方法,不替代机制证据。