哪个标题更好,人人都有一套看法。这些看法通常是错的,而且从来不值钱。A/B 测试把争论换成一个数字——在链接这一层,你两分钟就能跑起来一个,不用动网站、不用麻烦开发、也不用铺一套数据分析系统。
用链接到底能测什么
链接层面的测试,就是一条短链接把流量分给两个或更多目标。访客点一次,由链接决定他落在哪里。这能回答一类很具体的问题:
- 哪个落地页转化更好——是长篇讲解版,还是把表单顶到首屏的精简版。
- 哪个优惠更有吸引力——包邮,还是打 9 折。
- 同一个邮件位该主推哪款产品。
- 哪种价格页排布能带来更多注册——三档,还是两档。
它测不了的,是同一个页面内部的东西:按钮颜色、首屏文案、表单长度。那得靠页面级的测试工具。链接分流是拿整个目标页互相比——而这本来就是更大、也更可能赢的那类胜利。
动手配置
在 urlik.xyz 上,一条分流链接一分钟就能配好:创建短链接,加上你想对比的几个目标,再设定分流比例。到处只发这一条链接,流量自己会分。
配置时有两件事要做对:
- 权重。50/50 是默认值,也是真正做测试时该选的。不均等的分流(90/10)适合小心翼翼地放出一个有风险的版本,不适合用来测量——一边倒的测试要达到同样的置信度,需要多得多的流量。
- 给每个版本打标。给每个目标配上各自的 UTM 标签,这样点击之后你的分析工具才分得清谁是谁。不这么做,你就只能在链接这一端看到分流,到了别处全是一团糊。命名规则可以看我们的 UTM 指南。
只盯真正带来收益的那个指标
大多数链接测试就栽在这里:它们只看点击。点击不是结果。如果 A 版本多拿了 20% 的点击,转化率却只有一半,那 A 是输的。
链接告诉你流量是怎么分的;点击之后发生了什么,得问你的分析工具或你的数据库。开跑之前就把指标定死——注册数、成交数、每访客收入——并且确保你能把它归到某个版本头上。之后让追踪面板按版本给你看点击、来源和设备,再跟你这边的转化对上号。点击这一侧怎么读,如何统计链接点击量里讲得更细。
跑够时间,结果才算数
A/B 测试翻车,翻的从来不是工具,而是耐心。几条让测试保持诚实的规矩:
- 一次只改一个变量。要么改优惠,要么改排版,别一起改。两处一起动,就算赢了你也说不清赢在哪。
- 按整周跑。周二和周六的表现天差地别。周一开跑、周四收工的测试,量的是工作日,不是你的受众。
- 别一边偷看一边喊停。早期的领先都是噪音。每小时刷一遍、一看到某个版本领先就收手,就是把随机性变成一个你日后会后悔的决定。
- 对小数字保持敬畏。12 比 9 不是结果,那是抛硬币。几百个转化的样本上,差距不到 20% 左右的,就当打平,去测点更大的东西。
- 赢家上线,然后继续测。昨天的赢家就是今天的对照组。受众是会变的。
一个实战例子
你要给 2 万人发一封邮件,想知道打折和包邮哪个更能卖货。你做一条分流链接,50/50,指向两个除了优惠之外完全相同的落地页,分别打上 utm_content=discount 和 utm_content=shipping。邮件里只放这一条链接。
一周后,链接报告 1840 次点击,两边基本对半。你的商城显示打折页带来 61 单,包邮页带来 88 单——像样的样本上,出现了像样的差距。包邮胜出,你把它定为默认,下个月再拿它去跟套装组合比。这就是那个闭环。每一轮都很便宜,每一轮都在滚雪球。
不止于测试:用规则分流
同一套机制还能干一些完全不是测试的活。把手机访客送去应用商店,电脑访客送去网页版。把某个活动的流量送到对应地区的页面。这时候的分流不是实验——只是把每位访客送到该去的地方,而且只用一条你能拿去印刷的链接。
一句话总结
做一条分流链接,均匀分配,给每个版本打标,指标提前定死,按整周跑,无视早期领先,用转化而不是点击来判胜负。工具是最容易的部分——真正能给出你敢照着砸钱的答案的,是纪律。