长尾关键词布局过密反被降权,这不是吓唬人。见过一个做户外装备的站,编辑为了赶收录,在一篇一千二百字的文章里把一个长尾词塞了十七次,读起来像绕口令。文章发出去两周,页面既没进排名,位置还往后掉了。词不是不能多,是这个度没把握好。
一、过密的三种典型表现
第一种是正文反复出现同一个词,一段里出现两三次。第二种是词硬塞进不相关的位置,比如图片说明、页脚、无关段落。第三种是标题、首段、结尾、正文全部同词反复,页面读起来只有一种腔调。三种里占了两条,页面就容易被判成刻意优化。
二、为什么会反被降权
搜索引擎判断页面质量,看的是这段内容解决了什么问题,词只是识别的线索。线索给够就行,给太多反而说明内容本身没有增量,只能靠重复凑存在感。用户行为也会投票:读两段就关掉,平均停留时间掉下去,页面质量分跟着降。两件事叠在一起,排名自然上不去。
三、合适的度怎么把握
关键词密度不是越高越好,给三个可以直接用的标准。一是位置优先:页面标题出现一次、首段一次、小标题里按需出现,正文自然带过一两次,总计控制在四次上下。二是距离拉开:两次出现之间至少隔两三段,不要挤在一处。三是改写代替重复:同一个意思换说法表达,换成同义描述或者换个角度,页面读起来才有变化。如果这个词本身就是整篇文章的核心术语,避不开,那就把它拆进小标题里,让它在结构位置上发挥作用,正文里就不用反复念。判断的尺子很简单:把这篇文章给朋友看,朋友会不会说这个词怎么老出现。
还有一个容易忽略的地方是锚文本。站内其他页面指向这篇文章时,链接文字不要全用同一个词,换成相关表达同样能传递主题信号,还能避免同一个词在整站范围内被重复堆叠。
四、批量量化页面的关键词密度
这段脚本用来把『感觉太密』变成可看的数字:它计算每个页面正文字数和某个目标词出现的次数,输出出现次数与密度。要改的是 PAGES 目录和 WORD 目标词。跑完先看出现次数高于八次的内页,再人工通读一遍,判断哪些属于硬塞,哪些是正常提及。
# 统计每个页面的目标词出现次数与密度
import os, re
PAGES = r"./www" # 改成你的页面目录
WORD = "长尾关键词" # 改成你要统计的目标词
def visible_text(html):
html = re.sub(r"(?is)<(script|style).*?", " ", html)
return re.sub(r"\s+", " ", re.sub(r"(?s)<[^>]+>", " ", html))
for dirpath, _, files in os.walk(PAGES):
for name in files:
if not name.endswith(".html"):
continue
path = os.path.join(dirpath, name)
html = open(path, encoding="utf-8", errors="ignore").read()
body = visible_text(html)
hits = body.count(WORD)
if not body or hits == 0:
continue
print("%4.2f%% 出现%2d次 %s" % (100.0 * hits * len(WORD) / len(body), hits, path))
调完之后自己出声读一遍,凡是读到词就觉得拗口的地方都改掉。做完再过两周看数据,如果页面的展现量开始往上走、平均停留时间不再往下掉,说明这个度调对了。度这件事没有固定数字,但有一条底线:页面上每一句话,单看都要像人写的。改动别一次动太多,建议每篇只改最密的那几处,改完观察一周,数据稳住了再继续下一批。
相关阅读:
A5创业网 版权所有