同样的信息,写在图片里和写在带结构化标注的 HTML 里,对机器来说差别是「不存在」和「可引用」。这篇文章给出企业官网可以直接落地的检查清单。
我们在做企业信息诊断时,遇到最多的情况不是「企业没有内容」,而是「内容机器读不到」。企业花了不少钱做官网,视觉效果不错,但整页都是设计稿导出的大图,关键信息一个字都提取不出来。
第一步:让关键事实以文本形式存在
这一条听起来基础,但它是所有后续工作的前提。以下位置的信息必须是可选中的文字,而不是图片或视频里的画面。
- 企业主体名称、成立时间、经营地址与服务区域
- 主营业务与服务范围的具体描述
- 产品型号、规格参数、适用场景
- 服务流程、交付内容与周期
- 资质、认证与可公开的项目经验
- 联系方式与营业时间
一个快速自检方法:在官网页面上用鼠标尝试选中这些信息。选不中,机器也读不到。
第二步:用语义标签表达页面结构
页面结构告诉机器「什么是主要内容、什么是导航、哪一段属于哪一节」。规范做法是使用 header、nav、main、section、article、aside、footer 这些语义标签,而不是所有层级都用 div。
标题层级的三条规则
- 每个页面只有一个 h1,且它就是这个页面的主题,不要用来放 Logo 或标语。
- 标题层级不跳级,h2 下面才是 h3,不要因为字号好看就直接用 h4。
- 标题写清楚内容,不要用「关于我们」这种在所有网站上都一样的空标题。
第三步:补上结构化数据标注
Schema.org 结构化数据是用机器语言把页面事实再说一遍,消除歧义。企业官网优先落地这几类。
- Organization:企业主体、Logo、官方链接与联系方式,让机器确认「这家企业是谁」。
- WebSite:站点级信息与站内搜索能力声明。
- Service:每一项服务的名称、描述、提供方与服务区域,对应到具体的产品页。
- BreadcrumbList:面包屑层级,帮助机器理解站点结构。
- FAQPage:常见问题与答案,这是被 AI 引用概率较高的一类结构。
- Article:文章的标题、作者、发布与更新时间。
第四步:把内容组织成能回答问题的样子
结构化标注解决的是「机器能读」,内容组织解决的是「读了有用」。判断标准很简单:你的页面能不能直接回答客户的问题。
比较常见的问题是页面按企业内部视角组织——公司简介、企业文化、发展历程、荣誉资质。而客户关心的是——你能解决我的什么问题、怎么做、多久、多少钱、有没有做过类似的。把内容按后者重组,通常不需要新增太多素材,只是换个组织方式。
第五步:确认性能不拖后腿
页面打开太慢会直接影响抓取效率和用户留存。几个基本要求:图片按需生成 WebP 或 AVIF 并声明尺寸,避免布局跳动;第三方脚本按需加载;3D、视频等重资源延迟到首屏文字之后再加载。首屏应当先出现文字和品牌信息,而不是先转半天圈。
一份可直接使用的自检清单
- 关键事实是否都能用鼠标选中?
- 每个页面是否只有一个 h1,且标题层级不跳级?
- 是否部署了 Organization、WebSite、Service、BreadcrumbList、FAQPage 标注?
- 是否有 sitemap.xml、robots.txt 与正确的 canonical?
- 移动端首屏是否在两秒内出现文字内容?
- 同一事实在官网、地图、平台账号上的表述是否一致?
这六项全部通过之后,再去投入内容生产,效率会高很多。反过来,在结构没理清的情况下先发内容,多数会白费。