博客
关于我
推荐系统项目实战一(推荐业务架构介绍)
阅读量:215 次
发布时间:2019-02-28

本文共 550 字,大约阅读时间需要 1 分钟。

架构与业务流

基础数据层

该层主要处理业务数据和用户行为日志数据,数据来源于前端埋点和系统日志。其中,用户数据包括注册信息、个人资料等基础信息;文章数据则涵盖用户上传的内容、发布信息等基础属性。用户行为日志数据实时流向Kafka,用于实时计算和分析;而业务数据则以批量形式存储在HDFS上,为后续的离线分析提供数据支持。

数据处理层

这一层面对基础数据进行深度处理,主要包括用户画像和文章画像的构建。具体流程包括:基于离线数据和实时数据,通过多种算法进行数据分析和特征提取,构建用户兴趣模型和阅读习惯模型。

召回与排序

召回环节通过算法逻辑从海量文章中筛选出用户感兴趣的候选集合,集合规模通常在上千级别。排序环节则对候选文章进行用户画像模型结果的排序,生成最终的推荐列表。

推荐业务层

该层通过提供RESTful接口为推荐业务场景服务,主要包括以下功能:

  • Feed流推荐:支持用户在今日推荐场景中通过不断下拉刷新获取内容流。

转载地址:http://jvxp.baihongyu.com/

你可能感兴趣的文章
Skywalking原理
查看>>
PAT甲级——1006 Sign In and Sign Out (25分)
查看>>
PAT甲级——1007 Maximum Subsequence Sum (25分)
查看>>
PAT甲级——1009 Product of Polynomials (25分)(最后一个测试点段错误)
查看>>
Spring对jdbc的支持
查看>>
vagrant 的安装
查看>>
PayPal网站付款标准版(for PHP)
查看>>
Paystack Android SDK 集成与使用指南
查看>>
pbf格式详解,javascript加载导出pbf文件示例
查看>>
PBOC2.0与3.0的区别
查看>>
PbootCMS entrance.php SQL注入漏洞复现
查看>>
PbootCMS 前台RCE漏洞复现
查看>>
PBT
查看>>
PB级分析型数据库ClickHouse的应用场景和特性
查看>>
pc3-12800
查看>>
PCA---主成成分分析
查看>>
PCA和自动编码器:每个人都能理解的算法
查看>>
pca算法
查看>>
PCA降维demo
查看>>
SharePoint 2013 图文开发系列之定义站点模板
查看>>