学习契约与正确模型
先明确为什么学、学完能做什么,以及如何证明自己真的掌握。
B2B 站常把功能、行业、用例、集成与资源分散在不同 CMS,形成孤页、导航冲突和不可维护的 URL 树。
- 能绘制页面类型与链接关系图
- 能识别孤页、死端和过深页面
- 能把 ICP 任务映射到导航与 hub
精读 27 分钟 → 引导练习 18 分钟 → 实战任务 70 分钟。实战时间单列,不再把浏览页面和项目操作混成一个数字。
- 它是什么
- 站点架构是页面类型、URL、导航、层级和链接之间的可维护关系。
- 为什么重要
- 链接提供发现路径、语义上下文和优先级线索,也决定用户能否继续任务。
- 什么时候使用
- 新站规划、内容扩张、CMS 合并或核心页面长期低抓取时。
- 什么时候不要套用
- 不要为浅层级把所有页面塞进主导航,也不要把 URL 目录等同真实链接图。
- 边界与不确定性
- 架构改善发现与理解,但不会让无需求、无价值页面自动排名。
机制精讲
先读完整因果链,再看每个环节留下什么可观察信号。
站点架构不是 URL 看起来有几层目录,而是页面类型、业务对象、用户任务和真实链接形成的关系系统。搜索引擎从可解析链接发现地址,用户也依靠导航、面包屑、聚合页与上下文推荐推进任务。一个路径短却放在无关页脚的链接,未必比从高度相关 hub 经过四步的路径更有帮助;因此“所有页面三次点击内到达”只能作为排查提示,不能当作固定排名规则。
B2B 网站往往同时拥有功能、行业、角色、集成、案例与知识内容,如果每个团队各自建分类,就会出现孤页、重复 hub、死端和无法扩展的导航。架构设计要先明确对象与任务,再定义每种模板从哪里被发现、向哪里继续、为什么值得独立存在。本课以链接图和任务流为共同语言,让你能把视觉菜单偏好转成可以抓取、计算、原型测试和长期维护的规则。
页面类型与对象模型
先定义产品、能力、行业、集成和资源各自代表什么对象,以及一对一、一对多关系;分类名称只是界面,稳定对象关系才决定可扩展链接。
发现路径与链接图
真实 a[href] 构成有向图。入链数量、来源相关性、点击深度与孤立状态可帮助发现风险,但不能单独等同页面重要性或排名。
用户任务连续性
好架构让用户从理解问题、评估方案、核验证据到转化自然前进。每个链接应回答“为什么此时推荐这个目标”,而不是为了分配某种虚构的权重。
关键概念
掌握术语之间的关系,才能迁移到不同网站、行业和工具。
Hub 与 spoke
Hub 聚合用户任务并给子页上下文;spoke 反向连接形成可导航集合。
点击深度
从稳定入口到目标的链接步数是诊断指标,不是固定排名规则。
孤页
只有 Sitemap 或外链、没有站内可抓取入口的页面难以持续发现。
完整示范
跟随一次“输入 → 分析 → 中间产物 → 结论”,看见专家是怎样做判断的。
重构数据平台的内容关系
教学用合成数据:站点有 12 个功能页、9 个行业页、40 个集成页与 200 篇文章;抓取发现 38 个孤页,销售访谈显示用户常从行业问题跳到功能比较。
- 每类页面有明确 owner
- 不在本练习中改变 URL,只先重构链接与 hub
建立对象清单
- 输入
- URL、模板、业务对象和目标任务。
- 分析
- 区分“数据治理”这样的持续问题 hub、“金融行业”场景页、“元数据管理”功能页与具体集成,删除只因关键词存在而创建的重复分类。
- 输出
- 对象—页面类型—用户任务矩阵。
画目标关系
- 输入
- 矩阵与用户访谈。
- 分析
- 问题 hub 链向解释与评估内容,行业页链向相关能力和案例,功能页链向集成与演示;每条边写出推荐理由。
- 输出
- 带边语义的目标链接图。
比较现实图
- 输入
- 站点爬取数据。
- 分析
- 找出孤页、只被页脚链接的商业页、无返回路径的文章和过度链接的通用 hub,按业务价值与故障规模排序。
- 输出
- 现实—目标差距清单。
模板化验收
- 输入
- 目标图和 CMS 能力。
- 分析
- 把关系转换为导航、面包屑和上下文模块规则,在原型上完成三条 ICP 任务,再爬取验证 href、深度与孤页。
- 输出
- 模板规则、原型测试记录和回归爬取。
决策规则与证据边界
把“看到什么、意味着什么、下一步做什么”连起来,同时区分公开事实、实践推断和未知项。
- HTML 中的 href、爬取可达路径和用户测试任务都能被直接观察。
- 更清晰的 hub 与上下文链接可能改善发现和任务完成,需要分模板验证。
- 公开资料不提供某个链接位置或点击深度对应的固定排名增益。
引导练习
先独立完成,再按提示修正,最后展开参考解法并用 0–4 级量规评分。
为教学用合成数据中的网络安全 SaaS 设计最小架构:现有“平台、行业、博客”三类入口,新增 6 个功能、4 个行业、12 个集成和 30 篇指南。
给定材料
- 用户任务:安全负责人先理解攻击面,再比较能力、核验集成,最后申请演示。
- 现状:所有集成只可从站内搜索访问;指南仅按发布日期列出;行业页只链接首页。
需要提示时再展开
- 先画页面对象和关系,不先讨论 URL 命名。
- 每条链接写出它帮助用户完成的下一任务,并说明模板如何自动维护。
完成后核对参考解法
应建立一个围绕“攻击面管理”持续问题的主题 hub,向核心解释指南、能力总览和行业入口分流;功能页连接适用行业、相关集成、证据案例和演示动作;行业页从该行业任务出发连接必要能力与案例;集成目录按真实产品关系提供可抓取的列表,每个集成详情反向连接能力;指南按问题阶段进入主题集合,而非只按日期。先从稳定入口爬取,确保每个保留页至少有一个相关 href,并用安全负责人任务测试从理解、比较到核验集成是否连续。点击深度和入链用于发现异常,不被宣称为固定排名因果。
自评分量规
真实项目实战
把理解变成一个可以检查、复核和复用的工作产物。
重构 B2B 平台信息架构
网站有 12 个功能、9 个行业、40 个集成和 200 篇文章,主导航与博客分类互不相连。
- 建立页面类型和业务对象清单
- 用用户任务定义一级/二级 hub
- 抓取内链并计算孤页和深度
- 设计导航、面包屑和上下文模块
- 用原型测试任务路径
验收条件
- 每个可索引页至少一个相关可抓取入口
- 商业页从稳定 hub 可达
- 未把筛选参数当主架构
- 用户可完成比较、理解和转化任务
诊断练习
目标不是猜中答案,而是提出竞争假设并选择能区分它们的证据。
一批高质量行业页被提交但很少抓取。
竞争假设
- 只有 Sitemap 入口
- 导航链接由 JS 事件生成
- hub 页 canonical/noindex 错误
- 锚文本未表达行业关系
应该检查的证据
- 爬虫的 inlinks、深度与孤页报告
- 源 HTML 的 href
- 日志中抓取间隔
- 从首页和功能页的用户路径
常见陷阱:只缩短 URL 字符串或目录,却不改变实际链接关系。
完成后用本页决策规则复核
- 若观察到:页面只在 sitemap 中出现且无站内入链
应优先:若页面有独立价值,从最相关 hub 建立真实入口;否则重新评估保留。
不要为了消灭孤页给所有页面随意加链接。 - 若观察到:主导航需要容纳数百个具体页面
应优先:按稳定任务建立聚合层,并让具体页从相关集合进入。
浅并不等于好;过宽导航会增加认知负担。 - 若观察到:文章有流量但没有通往产品或下一学习步骤
应优先:加入与当下问题直接相关的指南、功能、案例或评估动作。
CTA 相关性优先于商业强度,不能每段都硬推演示。
自测与误区
先口头回答,再展开检查。无法给出例外与证据,说明还没真正掌握。
你应该能回答
1. 页面属于哪个业务对象与用户任务?
参考答案:先写页面代表的业务对象、目标 ICP 和要完成的任务,再决定它属于功能、行业、集成、案例或教育资源等类型。
为什么:对象与任务比 URL 目录更稳定,也决定页面是否应独立存在。
2. 最自然的上游 hub 和下一步是什么?
参考答案:选择能解释目标对象来源的相关 hub,并提供用户完成当前任务后的自然下一步;二者都应通过真实 href 相连。
为什么:相关上下文同时服务发现和用户连续性;抓取图与任务走查可验证链接是否真正发挥作用。
3. 新增 500 页后规则还能维护吗?
参考答案:把关系做成模板级规则,使用对象字段驱动链接,并在加入样本后自动爬取检查孤页、错误关联和导航宽度。
为什么:依靠编辑手工维护的链接图在规模扩大后容易腐化。
需要避开的误区
- 所有页面必须三次点击内到达
- URL 层级就是站点架构
- 页脚全站链接能替代上下文链接
术语与复盘
用自己的话复述术语和结论;如果只能认出、不能解释,就还没有形成可调用的知识。
- 页面类型
- 共享对象语义、任务和模板规则的一组页面。
- Hub
- 围绕稳定问题或对象组织并解释子页面关系的聚合入口。
- Spoke
- 解决更具体子任务并与 hub 双向连接的独立页面。
- 孤页
- 没有可抓取站内入链、只能从外部或 sitemap 发现的页面。
- 点击深度
- 从指定稳定入口沿链接到目标所需的最少步数。
离开本页前记住
- 架构是对象、任务与链接关系,不是目录外观。
- 真实 href 决定可复现的发现路径。
- 图指标用于诊断,不是排名公式。
- 每个页面都要有来路与合理下一步。
- 模板规则让架构在规模扩大后仍可维护。
资料与证据
优先采用官方和一手资料。实践材料用于补充工作方法,不替代机制证据。