用户画像计算用户偏好标签及数据指标与表结构设计
作者: 超人赵,人工智能爱好者社区专栏作者
知乎:
传送门: http://www.6aiq.com/article/1537330058545
一、用户画像—计算用户偏好标签
下面介绍如何计算用户的偏好标签。
在上一篇写用户画像的文章 “用户画像—打用户行为标签”中,主要讲了如何对用户的每一次操作行为、业务行为进行记录打上相应的标签。在这篇博客中,主要讲如何对这些明细标签进行计算以及偏好的产品、内容的类目。
关于用户标签权重的计算,在这篇文章里面讲过了:
这里再详细介绍一下:
用户标签权重 = 行为类型权重 × 时间衰减 × 用户行为次数 × TF-IDF计算标签权重
公式中各参数的释义如下:
-
行为类型权重:用户浏览、搜索、收藏、下单、购买等不同行为对用户而言有着不同的重要性,一般而言操作复杂度越高的行为权重越大。该权重值一般由运营人员或数据分析人员主观给出;
-
时间衰减:用户某些行为受时间影响不断减弱,行为时间距现在越远,该行为对用户当前来说的意义越小;
-
行为次数:用户标签权重按天统计,用户某天与该标签产生的行为次数越多,该标签对用户的影响越大;
-
TF-IDF计算标签权重:每个标签的对用户的重要性及该标签在全体标签中重要性的乘积得出每个标签的客观权重值;
为计算用户偏好标签,需要在用户行为标签的基础上计算用户行为标签对应的权重值,而后对同类标签做权重汇总,算出用户偏好的标签。关于用户行为标签如何打,在这篇博客里面有介绍过了
下面介绍如何在用户行为标签表的基础上加工用户偏好标签:
1、用户标签权重表结构设计
字段定义:
-
用户id(user_id):用户唯一id;
-
标签id(tag_id):图书id;
-
标签名称(tag_name):图书名称;
-
用户行为次数(cnt):用户当日产生该标签的次数,如用户当日浏览一本图书4次,则记录4;
-
行为日期(date_id):产生该条标签对应日期;
-
标签类型(tag_type_id):在本案例中通过与图书类型表相关联,取出每本图书对应的类型,如《钢铁是怎么炼成的》对应“名著”;
-
用户行为类型(act_type_id):即用户的购买、浏览、评论等操作行为,在本例中通过预设数值1~7来定义用户对应的行为类型。1:购买行为,2:浏览行为,3:评论行为,4:收藏行为,5:取消收藏行为,6:加入购物车行为,7:搜索行为;
2、在用户行为标签基础上加工权重表
加工标签权重表时,需要根据用户不同行为对应的权重建立一个权重维表:
向维表中插入数据�
- 原文作者:知识铺
- 原文链接:https://geek.zshipu.com/post/%E4%BA%92%E8%81%94%E7%BD%91/%E7%94%A8%E6%88%B7%E7%94%BB%E5%83%8F%E8%AE%A1%E7%AE%97%E7%94%A8%E6%88%B7%E5%81%8F%E5%A5%BD%E6%A0%87%E7%AD%BE%E5%8F%8A%E6%95%B0%E6%8D%AE%E6%8C%87%E6%A0%87%E4%B8%8E%E8%A1%A8%E7%BB%93%E6%9E%84%E8%AE%BE%E8%AE%A1/
- 版权声明:本作品采用知识共享署名-非商业性使用-禁止演绎 4.0 国际许可协议进行许可,非商业转载请注明出处(作者,原文链接),商业转载请联系作者获得授权。
- 免责声明:本页面内容均来源于站内编辑发布,部分信息来源互联网,并不意味着本站赞同其观点或者证实其内容的真实性,如涉及版权等问题,请立即联系客服进行更改或删除,保证您的合法权益。转载请注明来源,欢迎对文章中的引用来源进行考证,欢迎指出任何有错误或不够清晰的表达。也可以邮件至 sblig@126.com