产学研创新服务平台(全国)
专利申请类型:发明专利;专利名称:一种基于用户特征信息的防刷票方法
专利类型:发明专利
专利申请号:CN202210161653.2
专利申请(专利权)人:重庆华龙数智科技有限公司
权利人地址:重庆市渝北区金开大道西段106号10幢14层
专利发明(设计)人:付勇, 伍南凌, 唐涛, 刘宗洋, 孟颢凝
专利摘要:本发明涉及防刷票管理技术领域,具体涉及一种基于用户特征信息的防刷票方法,包括:获取用户的投票请求数据;从用户的投票请求数据中提取对应的投票共性特征数据;基于投票共性特征数据计算对应的共性特征可疑值;若共性特征可疑值达到了设置的刷票阈值,则将具有对应投票共性特征数据的所有用户的投票请求数据作为刷票数据。本发明的防刷票方法能够有效实现防刷票管理且能够保护用户隐私,从而能够提高互联网投票的真实性和公正性。
主权利要求:一种基于用户特征信息的防刷票方法
技术领域
[0001] 本发明涉及防刷票管理技术领域,具体涉及一种基于用户特征信息的防刷票方法。
背景技术
[0002] 随着互联网技术的不断发展,各种投票活动均可以通过相关的电脑终端或者手机登终端完成。但由于监督的不合理性,存在恶意刷票行为(即通过刷票程序或者变化IP等方式为同一被投对象多次投票),有失公平公正的投票原则。现有防范恶意刷票的方法有基于IP的投票限制、基于手机号验证码的投票限制等。前者容易被统一破解,并且在同一公网IP下面的用户会存在投票冲突的bug问题,后者由于手机验证码存在收到延迟的问题,影响了用户体验,降低了投票参与率。
[0003] 针对如何有效防范恶意刷票的问题,公开号为CN110335401A的中国专利公开了《基于投票行为监控的防刷票方法及装置》,其方法包括:采用预设数据统计方式获取用户在投票页面上的投票行为数据,根据投票行为数据的数据特性判断执行投票行为的行为对象是否为真实用户,当判断行为对象为非真实用户时,输出恶意刷票提示信息。
[0004] 上述现有方案的防刷票方法通过监控用户在投票页面的投票行为数据,识别用户是真实用户还是投票软件,进而防止投票软件对同一被投对象恶意刷票。但是,即使参与投票的为真实用户,其也可通过注册多个ID或使用多台设备进行多次、重复的投票,即同样存在刷票的可能性,使得投票的公正性难以得到保证,导致防刷票管理的效果不好。实际上,通过获取用户真实的身份信息和设备运行时的相关数据能够解决上述问题,但是,用户真实的身份信息和设备运行时的相关数据属于用户隐私数据,不允许被随意获取。也就是说,基于用户隐私数据实现防刷票管理是不可行的。因此,如何设计一种能够有效实现防刷票管理且能够保护用户隐私的防刷票方法是亟需解决的技术问题。
发明内容
[0005] 针对上述现有技术的不足,本发明所要解决的技术问题是:如何提供一种基于用户特征信息的防刷票方法,以能够有效实现防刷票管理且能够保护用户隐私,从而能够提高互联网投票的真实性和公正性。
[0006] 为了解决上述技术问题,本发明采用了如下的技术方案:
[0007] 一种基于用户特征信息的防刷票方法,包括以下步骤:
[0008] S1:获取用户的投票请求数据;
[0009] S2:从用户的投票请求数据中提取对应的投票共性特征数据;
[0010] S3:基于投票共性特征数据计算对应的共性特征可疑值;若共性特征可疑值达到了设置的刷票阈值,则将具有对应投票共性特征数据的所有用户的投票请求数据作为刷票数据。
[0011] 优选的,步骤S2中,通过大数据流式算法从用户的投票请求数据中提取对应的投票共性特征数据。
[0012] 优选的,步骤S3中,投票共性特征数据包括经纬坐标数据;
[0013] 预先根据经纬坐标划分出了若干个投票区域,根据用户的经纬坐标数据计算用户所属的投票区域;然后计算用户所属的投票区域内的用户总数;最后将用户所属的投票区域内的用户总数与设置的区域可疑判断条件进行匹配,根据匹配结果生成对应的投票区域可疑值。
[0014] 优选的,步骤S3中,通过如下公式计算投票区域可疑值:
[0015]
[0016] 式中:k(e)表示用户所属的投票区域XYn的投票区域可疑值;e表示投票区域XYn的用户总数;当k(e)=100时,投票区域XYn内所有用户的投票请求数据作为刷票数据。
[0017] 优选的,步骤S3中,投票共性特征数据包括局域网mac数据;
[0018] 根据用户的局域网mac数据计算用户所属的局域网mac值;然后计算用户所属的局域网mac值下的用户总数;最后将用户所属的局域网mac值下的用户总数与设置的局域网可疑判断条件进行匹配,根据匹配结果生成对应的局域网mac可疑值。
[0019] 优选的,步骤S3中,通过如下公式计算局域网mac可疑值:
[0020]
[0021] 式中:k(u)表示用户所属的局域网mac值Mu的局域网mac可疑值;u表示局域网mac值Mu下的用户总数;当k(u)=100时,局域网mac值Mu下所有用户的投票请求数据作为刷票数据。
[0022] 优选的,步骤S3中,投票共性特征数据包括广域网mac数据;
[0023] 根据用户的广域网mac数据计算用户所属的广域网mac值;然后计算用户所属的广域网mac值下的用户总数;最后将用户所属的广域网mac值下的用户总数与设置的广域网可疑判断条件进行匹配,根据匹配结果生成对应的广域网mac可疑值。
[0024] 优选的,步骤S3中,通过如下公式计算广域网mac可疑值:
[0025]
[0026] 式中:k(z)表示用户所属的广域网mac值Lz的广域网mac可疑值;z表示广域网mac值Lz下的用户总数;当k(z)=100时,广域网mac值Lz下所有用户的投票请求数据作为刷票数据。
[0027] 优选的,步骤S3中,投票共性特征数据包括经纬坐标数据、局域网mac数据和广域网mac数据中的至少两种;然后将经纬坐标数据、局域网mac数据和广域网mac数据中至少两种对应的共性特征可疑值进行累加求和计算,得到对应用户的综合可疑度;
[0028] 若综合可疑度达到了设置的刷票阈值,则将对应用户的所有投票请求数据作为刷票数据。
[0029] 优选的,步骤S3中,通过如下公式计算对应用户的综合可疑度:
[0030] K=k(e)+k(u)+k(z);
[0031] 式中:K表示对应用户的综合可疑度;k(e)表示投票区域XYn的投票区域可疑值;k(u)表示局域网mac值Mu的局域网mac可疑值;k(z)表示广域网mac值Lz的广域网mac可疑值;
[0032] 其中,k(e)、k(u)、k(z)的取值均包括000、001、010和100;
[0033] 当综合可疑度K≥100时,对应用户的所有投票请求数据作为刷票数据;
[0034] 当k(e)=100时,投票区域XYn内所有用户的投票请求数据作为刷票数据;
[0035] 当k(u)=100时,局域网mac值Mu下所有用户的投票请求数据作为刷票数据;
[0036] 当k(z)=100时,广域网mac值Lz下所有用户的投票请求数据作为刷票数据。
[0037] 本发明的防刷票方法与现有技术相比,具有如下有益效果:
[0038] 本发明通过从用户的投票请求数据中提取对应的投票共性特征数据来计算共性特征可疑值,进而通过共性特征可疑值来判断用户的投票请求是否为刷票行为,一方面,投票共性特征数据可以看做是多个用户投票行为的相似度,多个用户投票行为的相似度越高,刷票的可能性即共性特征可疑值就越大,当共性特征可疑值达到设置的刷票阈值时认为用户确实存在刷票行为(即多个用户投票行为是同一用户操作),这样能够准确的检测用户是否存在刷票行为,进而能够提高防刷票管理的准确性和效果,从而能够提高互联网投票的真实性和公正性。
[0039] 本发明提取的投票共性特征数据属于用户可以公开的共用数据,不涉及用户的隐私,使得计算用户投票行为的相似度即共性特征可疑值时,不会侵犯用户的隐私,从而能够在实现防刷票管理时保护用户隐私。
附图说明
[0040] 为了使发明的目的、技术方案和优点更加清楚,下面将结合附图对本发明作进一步的详细描述,其中:
[0041] 图1为基于用户特征信息的防刷票方法的逻辑框图。
具体实施方式
[0042] 下面通过具体实施方式进一步详细的说明:
[0043] 实施例一:
[0044] 本实施例中公开了一种基于用户特征信息的防刷票方法。
[0045] 如图1所示,基于用户特征信息的防刷票方法,包括以下步骤:
[0046] S1:获取用户的投票请求数据;
[0047] S2:从用户的投票请求数据中提取对应的投票共性特征数据;本实施例中,通过大数据流式算法从用户的投票请求数据中提取对应的投票共性特征数据。
[0048] S3:基于投票共性特征数据计算对应的共性特征可疑值;若共性特征可疑值达到了设置的刷票阈值,则将具有对应投票共性特征数据的所有用户的投票请求数据作为刷票数据。本实施例中,刷票阈值设置为100。
[0049] 需要说明的是,本实施例中所述的投票可以是比赛、选举或问卷调查等需要投票人根据自己的意愿做出选择的任何事项,一般包括至少两个被投票的对象,由用户进行选择性的投票。可以采用预设数据统计方式获取用户的投票请求数据,投票请求数据包括但不限于用户投票时的经纬坐标数据和网络连接数据(局域网mac数据和广域网mac数据),这些数据均不属于用户隐私数据。
[0050] 本发明通过从用户的投票请求数据中提取对应的投票共性特征数据来计算共性特征可疑值,进而通过共性特征可疑值来判断用户的投票请求是否为刷票行为,一方面,投票共性特征数据可以看做是多个用户投票行为的相似度,多个用户投票行为的相似度越高,刷票的可能性即共性特征可疑值就越大,当共性特征可疑值达到设置的刷票阈值时认为用户确实存在刷票行为(即多个用户投票行为是同一用户操作),这样能够准确的检测用户是否存在刷票行为,进而能够提高防刷票管理的准确性和效果,从而能够提高互联网投票的真实性和公正性。同时,本发明提取的投票共性特征数据属于用户可以公开的共用数据,不涉及用户的隐私,使得计算用户投票行为的相似度即共性特征可疑值时,不会侵犯用户的隐私,从而能够在实现防刷票管理时保护用户隐私。
[0051] 具体实施过程中,投票共性特征数据包括经纬坐标数据;
[0052] 预先根据经纬坐标划分出了若干个投票区域,根据用户的经纬坐标数据计算用户所属的投票区域;然后计算用户所属的投票区域内的用户总数;最后将用户所属的投票区域内的用户总数与设置的区域可疑判断条件进行匹配,根据匹配结果生成对应的投票区域可疑值。
[0053] 本实施中,经纬坐标数据及投票区域的定义如下:
[0054] Xmin:设置的起始经度,Xmax:设置的经度最大值,73°33′E至135°05′E;
[0055] Ymin:设置的起始纬度,Ymax:设置的纬度最大值,3°51′N至53°33′N;
[0056] 投票区域(瓦片)范围,例:500m(可配置);
[0057] D投票区域的单位度数:计算单个投票区域范围代表的度数;
[0058] 经度投票区域数:M=(Xmax‑Xmin)/D;纬度投票区域数:N=(Ymax‑Ymin)/D;
[0059] 投票区域编号坐标区间:(0,0)—(M,N);
[0060] 用户投票请求数据的经纬坐标:(XQ,YQ);
[0061] 用户投票所在投票区域编号坐标计算:XYn=([(XQ‑Xmin)/D]+1,[(YQ‑Ymin)/D]+1);
[0062] 阈值E代表投票区域上请求数量如:{E(M1,N1),E(M2,N2),E(M3,N3)...E(M,N)}[0063] 投票区域投票限制阈值F,例:100000(可配置)。
[0064] 本实施例中,相同投票区域下用户总数的区域可疑判断条件如下:
[0065] 正常区间K0:[0,10000),可疑值为000;
[0066] 一级可疑区间K1:[10000,50000),可疑值为001;
[0067] 二级可疑区间K2:[50000,100000),可疑值为010;
[0068] 三级可疑区间K3:[100000,+∞),可疑值为100。
[0069] 具体的,通过如下公式计算投票区域可疑值:
[0070]
[0071] 式中:k(e)表示用户所属的投票区域XYn的投票区域可疑值;e表示投票区域XYn的用户总数;当k(e)=100时,投票区域XYn内所有用户的投票请求数据作为刷票数据。
[0072] 实际应用时,很多手机软件都能够获取用户的定位信息即经纬坐标数据,这些数据属于用户可以公开的共用数据,不涉及用户的隐私。因此,本发明通过经纬坐标数据计算用户投票行为的相似度即投票区域可疑值时,不会侵犯用户的隐私,从而能够在实现防刷票管理时保护用户隐私。
[0073] 同时,用户通过软件或者其他方式刷票时,一般会在同一位置(投票区域)内产生大量的投票请求数据。因此,本发明通过经纬坐标数据能够准确的计算用户投票行为的相似度即投票区域可疑值,投票区域可疑值越大,用户刷票的可能性就越大,当投票区域可疑值达到设置的刷票阈值时认为用户确实存在刷票行为(即多个用户投票行为是同一用户操作),这样能够更为准确的检测用户是否存在刷票行为,从而能够进一步提高防刷票管理的准确性和效果。
[0074] 具体实施过程中,投票共性特征数据包括局域网mac数据;
[0075] 根据用户的局域网mac数据计算用户所属的局域网mac值;然后计算用户所属的局域网mac值下的用户总数;最后将用户所属的局域网mac值下的用户总数与设置的局域网可疑判断条件进行匹配,根据匹配结果生成对应的局域网mac可疑值。
[0076] 本实施中,局域网mac数据的定义如下:
[0077] H:WIFImac
[0078] F:投票限制阈值,例:200票/天或总量200票(可配置);
[0079] U:投票用户的mac地址;
[0080] E:WIFI或基站mac下的用户mac总数:如{EH1,EH2,EH3,...,EH};
[0081] 若阈值E超过限制阈值F后,记可疑度戳记K(u),用做最终汇总判定。
[0082] 相同局域网mac值下用户总数的局域网可疑判断条件如下:
[0083] 正常区间M0:[0,10),可疑值为000;
[0084] 一级可疑区间M1:[10,20),可疑值为001;
[0085] 二级可疑区间M2:[20,30),可疑值为010;
[0086] 三级可疑区间M3:[30,+∞),可疑值为100。
[0087] 具体的,通过如下公式计算局域网mac可疑值:
[0088]
[0089] 式中:k(u)表示用户所属的局域网mac值Mu的局域网mac可疑值;u表示局域网mac值Mu下的用户总数;当k(u)=100时,局域网mac值Mu下所有用户的投票请求数据作为刷票数据。
[0090] 实际应用时,用户通过WiFi等方式接入局域网时,能够获取局域网mac数据和对应的用户mac数据,这些数据属于用户可以公开的共用数据,不涉及用户的隐私。因此,本发明通过局域网mac数据计算用户投票行为的相似度即局域网mac可疑值时,不会侵犯用户的隐私,从而能够在实现防刷票管理时保护用户隐私。
[0091] 同时,用户通过软件或者其他方式刷票时,一般会在同一局域网或广域网下产生大量的投票请求数据。因此,本发明通过局域网mac数据能够准确的计算用户投票行为的相似度即局域网mac可疑值,局域网mac可疑值越大,用户刷票的可能性就越大,当局域网mac可疑值达到设置的刷票阈值时认为用户确实存在刷票行为(即多个用户投票行为是同一用户操作),这样能够更为准确的检测用户是否存在刷票行为,从而能够进一步提高防刷票管理的准确性和效果。
[0092] 具体实施过程中,投票共性特征数据包括广域网mac数据;
[0093] 根据用户的广域网mac数据计算用户所属的广域网mac值;然后计算用户所属的广域网mac值下的用户总数;最后将用户所属的广域网mac值下的用户总数与设置的广域网可疑判断条件进行匹配,根据匹配结果生成对应的广域网mac可疑值。
[0094] 本实施中,广域网mac数据的定义如下:
[0095] H:基站mac;
[0096] F:投票限制阈值,例:200票/天或总量200票(可配置);
[0097] U:投票用户mac地址;
[0098] E:WIFI或基站mac下的用户mac总数:如{EH1,EH2,EH3,...,EH}
[0099] 若阈值E超过限制阈值F后,记可疑度戳记K(z),用做最终汇总判定。
[0100] 相同广域网mac值下用户总数的广域网可疑判断条件如下:
[0101] 正常区间L0:[0,10),可疑值为000;
[0102] 一级可疑区间L1:[10,20),可疑值为001;
[0103] 二级可疑区间L2:[20,30),可疑值为010;
[0104] 三级可疑区间L3:[30,+∞),可疑值为100。
[0105] 具体的,通过如下公式计算广域网mac可疑值:
[0106]
[0107] 式中:k(z)表示用户所属的广域网mac值Lz的广域网mac可疑值;z表示广域网mac值Lz下的用户总数;当k(z)=100时,广域网mac值Lz下所有用户的投票请求数据作为刷票数据。
[0108] 实际应用时,用户通过4G基站、5G基站等方式接入广域网时,能够获取广域网mac数据和对应的用户mac数据,这些数据属于用户可以公开的共用数据,不涉及用户的隐私。因此,本发明通过广域网mac数据计算用户投票行为的相似度即广域网mac可疑值时,不会侵犯用户的隐私,从而能够在实现防刷票管理时保护用户隐私。
[0109] 同时,用户通过软件或者其他方式刷票时,一般会在同一局域网或广域网下产生大量的投票请求数据。因此,本发明通过广域网mac数据能够准确的计算用户投票行为的相似度即广域网mac可疑值,广域网mac可疑值越大,用户刷票的可能性就越大,当广域网mac可疑值达到设置的刷票阈值时认为用户确实存在刷票行为(即多个用户投票行为是同一用户操作),这样能够更为准确的检测用户是否存在刷票行为,从而能够进一步提高防刷票管理的准确性和效果。
[0110] 具体实施过程中,投票共性特征数据包括经纬坐标数据、局域网mac数据和广域网mac数据中的至少两种;然后将经纬坐标数据、局域网mac数据和广域网mac数据中至少两种对应的共性特征可疑值进行累加求和计算,得到对应用户的综合可疑度;
[0111] 若综合可疑度达到了设置的刷票阈值,则将对应用户的所有投票请求数据作为刷票数据。
[0112] 具体实施过程中,步骤S3中,通过如下公式计算对应用户的综合可疑度:
[0113] K=k(e)+k(u)+k(z);
[0114] 式中:K表示对应用户的综合可疑度;k(e)表示投票区域XYn的投票区域可疑值;k(u)表示局域网mac值Mu的局域网mac可疑值;k(z)表示广域网mac值Lz的广域网mac可疑值;
[0115] 其中,k(e)、k(u)、k(z)的取值均包括000、001、010和100;
[0116] 当综合可疑度K≥100时,对应用户的所有投票请求数据作为刷票数据;
[0117] 当k(e)=100时,投票区域XYn内所有用户的投票请求数据作为刷票数据;
[0118] 当k(u)=100时,局域网mac值Mu下所有用户的投票请求数据作为刷票数据;
[0119] 当k(z)=100时,广域网mac值Lz下所有用户的投票请求数据作为刷票数据。
[0120] 实际应用时,若用户刷票的数量不够多,通过单一的共性特征可疑值可能很难有效检测出用户的刷票行为。因此,本发明通过至少两种投票共性特征数据对应的共性特征可疑值的累加求和计算得到对应用户的综合可疑度,即对用户每一次投票请求数据的综合可疑度进行计算和判断,使得用户的投票请求越多其综合可疑度就会越高,刷票的可能性就越大,当综合可疑度达到设置的刷票阈值时认为用户确实存在刷票行为(即多个用户投票行为是同一用户操作),进而将对应用户所有投票请求数据作为刷票数据,这样能够更为准确的检测用户是否存在刷票行为,从而能够进一步提高防刷票管理的准确性和效果。
[0121] 需要说明的是,以上实施例仅用以说明本发明的技术方案而非限制,尽管通过参照本发明的优选实施例已经对本发明进行了描述,但本领域的普通技术人员应当理解,可以在形式上和细节上对其作出各种各样的改变,而不偏离所附权利要求书所限定的本发明的精神和范围。同时,实施例中公知的具体结构及特性等常识在此未作过多描述。最后,本发明要求的保护范围应当以其权利要求的内容为准,说明书中的具体实施方式等记载可以用于解释权利要求的内容。
专利地区:重庆
专利申请日期:2022-02-22
专利公开日期:2023-09-01
专利公告号:CN114530011B