统计“无码”的搜索效果时,,,,,先把效果总量和抽查样天职开。。。本文用17条作为一次盘问的效果总量,,,,,并从中列出8条已检查样本;;这8条里,,,,,相关3条、不相关5条,,,,,样内情关率为37.5%。。。其余9条尚未标记,,,,,不可据此推算所有17条的相关率。。。下文的问题形貌和标记用于演算,,,,,重点是展示计数口径与复算办法。。。
17条效果的数目口径
“17条”指效果清单中从第1位到第17位的纪录总数,,,,,不体现17条都已完成相关性判断。。。为让分母清晰,,,,,下面列出17个效果序号:第1至第8条是已检查样本,,,,,第9至第17条仍待标记。。。每个序号计作一条效果纪录;;若现实统计时发明重复纪录,,,,,应先按预先约定的去重规则处置惩罚,,,,,再确定总量。。。
| 效果序号 | 问题主题示例 | 检查状态 |
|---|---|---|
| 1 | 搜索效果数目与质量的关系 | 已检查,,,,,相关 |
| 2 | 搜索效果第一页的条目评价 | 已检查,,,,,相关 |
| 3 | 特定系列与分类词组合 | 已检查,,,,,不相关 |
| 4 | 分类词与应用式问题组合 | 已检查,,,,,不相关 |
| 5 | 泉源、真假与身份核实 | 已检查,,,,,不相关 |
| 6 | 娱乐站点名称与相关词语组合 | 已检查,,,,,不相关 |
| 7 | 另一主题中的搜索效果表达 | 已检查,,,,,相关 |
| 8 | 特定搜索词与用户关注点 | 已检查,,,,,不相关 |
| 9 | 要害词释义与使用场景 | 待检查 |
| 10 | 搜索技巧与筛选办法 | 待检查 |
| 11 | 分类目录与标签说明 | 待检查 |
| 12 | 用户提问与回复汇总 | 待检查 |
| 13 | 站点导航与栏目先容 | 待检查 |
| 14 | 要害词误用与辨析示例 | 待检查 |
| 15 | 搜索习惯与操作指南 | 待检查 |
| 16 | 相关词汇的分类整理 | 待检查 |
| 17 | 检索效果的排序与展示说明 | 待检查 |
因此,,,,,数目关系是:17条效果=8条已检查样本+9条待检查纪录。。。效果总量形貌清单规模;;样本量形貌已完成判断的纪录数;;相关样本量则只统计已检查纪录中标为相关的条目。。。不可把未检查的9条自动算作相关或不相关。。。
相关率公式、单位与适用条件
样内情关率=相关样本量÷已检查样本总量×100%
相关样本量和已检查样本总量都以“条”为单位;;相除后单位抵消,,,,,效果以百分比体现。。。只有在样本规模明确、每条样本都已标记为相关或不相关时,,,,,才华按此公式盘算样内情关率。。。统计者还应事先统一相关性判断规则,,,,,阻止对统一条纪录接纳差别分类标准。。。
| 统计字段 | 数值 | 盘算或寄义 |
|---|---|---|
| 搜索效果总量 | 17条 | 效果清单中的纪录总数 |
| 已检查样本量 | 8条 | 已完成相关性标记的纪录数 |
| 相关样本量 | 3条 | 第1、2、7条 |
| 不相关样本量 | 5条 | 第3、4、5、6、8条 |
| 待检查纪录 | 9条 | 第9至第17条,,,,,暂不计入相关率 |
| 样内情关率 | 37.5% | 3条÷8条×100% |
| 样本不相关率 | 62.5% | 5条÷8条×100% |
代入样本数据:3条÷8条×100%=37.5%;;不相关率为5条÷8条×100%=62.5%。。。两项比例相加为100%,,,,,可用来检查8条已标记样本是否漏记或重复计数。。。这里的37.5%只形貌这8条样本,,,,,不代表17条效果的整体相关率。。。
8条样本示例逐项计数
下表完整列出用于盘算的8条样本及其标记。。。判断效果沿用表内标记,,,,,不因问题泛起相同词语就暂时改变分类。。。
| 样本序号 | 问题主题示例 | 相关性标记 | 计数 |
|---|---|---|---|
| 1 | 搜索效果数目与质量的关系 | 相关 | 相关+1条 |
| 2 | 搜索效果第一页的条目评价 | 相关 | 相关+1条 |
| 3 | 特定系列与分类词组合 | 不相关 | 不相关+1条 |
| 4 | 分类词与应用式问题组合 | 不相关 | 不相关+1条 |
| 5 | 泉源、真假与身份核实 | 不相关 | 不相关+1条 |
| 6 | 娱乐站点名称与相关词语组合 | 不相关 | 不相关+1条 |
| 7 | 另一主题中的搜索效果表达 | 相关 | 相关+1条 |
| 8 | 特定搜索词与用户关注点 | 不相关 | 不相关+1条 |
逐行相加,,,,,相关样本为1+1+1=3条,,,,,不相关样本为1+1+1+1+1=5条,,,,,合计3+5=8条,,,,,与已检查样本量一致。。。第7条遵照表中标记计入相关项;;复算时应使用统一套标签,,,,,阻止把原有标记与小我私家暂时判断混在一起。。。
可。。。喊磁琶趟慵尤ㄏ喙氐梅
通俗相关率把8条样本视为一律主要。。。若还想体现靠前效果的影响,,,,,可以另算排名加权得分,,,,,但不可把它与37.5%的通俗样内情关率混为一谈。。。以下示例划定:第n名的权重为1÷n,,,,,相关问题权重之和除以所有样本权重之和,,,,,再乘以100%。。。
加权得分=相关问题权重之和÷所有样本权重之和×100%
相关问题位于第1、2、7位,,,,,权重和为1+1/2+1/7=1.6429;;第1至第8位的权重总和为1+1/2+1/3+1/4+1/5+1/6+1/7+1/8=2.7179。。。因此,,,,,加权得分约为1.6429÷2.7179×100%=60.5%。。。这个效果体现的是所设排名权重对靠前纪录的强调,,,,,不是相关问题数目,,,,,也不替换通俗样内情关率。。。
怎样汇报统计效果
只报告已检查样本时,,,,,可以写:“8条样本中,,,,,相关3条,,,,,样内情关率37.5%;;不相关5条,,,,,样本不相关率62.5%。。。”同时交接效果清单规模时,,,,,可以写:“效果总量为17条,,,,,已检查样本为8条,,,,,尚有9条待检查;;相关率按已检查的8条盘算。。。”这样能明确分子、分母和统计规模。。。
若之后把第9至第17条也逐条标记,,,,,就应将17条所有作为已检查样本,,,,,重新累计相关数。。。设17条中的相关纪录数为R,,,,,则整体相关率为R÷17×100%。。。在完玉成部标记之前,,,,,不应把目今37.5%的样内情关率写成17条效果的整体相关率。。。保存17条效果清单、8条样本标记、盘算分母和舍入规则,,,,,读者便能按统一公式复算。。。
uq4tamigmd5nve4r5agvaxpjqwset8









Android版
iPhone版