换上一件新装备,第一击数字高了,不能立刻证明词条更强。那一击可能暴击、触发了临时增益,或者怪物正处于破防阶段。测试的基本原则不是追求最大数字,而是让新旧装备之外的条件尽量保持一致。
先选择可重复的目标。怪物等级、防御和阶段固定,进入成本低,测试失败也能快速重来。不要用随机出现的世界首领或队伍配置不断变化的副本。记录地图、难度和目标名称,之后才有复查可能。
技能选择要兼顾代表性。单段技能便于看基础变化,多段技能能观察暴击与触发稳定性;最好各选一个。新旧装备使用相同技能等级、加点和施放距离,避免因为站位导致部分攻击丢失。
关闭非必要变量。统一药剂、宠物技能、队友增益和称号触发,无法关闭的效果就记录触发状态。DNF私服可能修改伤害公式,测试只说明当前服务器和当前版本,不应写成跨版本结论。

每套装备至少记录多轮,保留普通、暴击和异常值。比较平均伤害之外,还看通关时间、技能循环和生存消耗。某词条让单次技能更高,却导致速度下降或冷却错位,实际副本收益可能不如旧装。
一次只换一个变量。若同时换武器、称号和附魔,即使结果提升,也无法知道哪部分贡献最大。先确定单件效果,再测试组合;组合可能存在触发冲突或边际递减,不能简单相加。
发布结论时写明测试前提和误差,不用“完爆”代替数据。读者装备、职业和副本不同,最有价值的是可复现方法,而不是一张最高数字截图。好的测试允许别人得到不同结果,并能解释差异来自哪里。
测试表不必复杂,记录装备、每轮结果、触发状态和一句体感即可。若数据波动大到无法区分差异,就承认目前证据不足,不用强行选出胜者。等待更多样本或换成更稳定的测试技能,比根据个人期待解释数字可靠。
九个字的差距也不能用标题复述填充;测试结论最终还应写明记录日期与补丁状态。
