博客
关于我
推荐系统项目实战一(推荐业务架构介绍)
阅读量:215 次
发布时间:2019-02-28

本文共 358 字,大约阅读时间需要 1 分钟。

架构与业务流

  • 基础数据层:
    • 包括业务数据和用户行为日志数据。
      • 业务数据主要包含用户数据和文章数据,用户数据即某头条注册用户的基础数据,文章数据在自媒体平台上传的文章的基本信息
      • 用户行为日志数据来源于前端埋点
    • 业务批量存储在HDFS上以用作离线分析
    • 日志数据实时流向Kafka以用作实时计算
  • 数据处理层:
    • 基础计算:基于离线和实时数据,对各类基础数据计算成用户画像、文章画像
    • 召回与排序
      • 召回环节使用各种算法逻辑从海量的文章中筛选出用户感兴趣的文章候选集合,集合大小:上千级别。排序即对候选集合中的文章进行用户相对的模型结果排序,生成一个排序列表。
      • 召回
      • 排序
        • 点击率预估模型
        • 特征处理、模型评价
  • 推荐业务层:通过对外提供rpc接口来实现推荐业务的接入
    • Feed流推荐:今日推荐场景,用户可以在这些页面中不断下拉刷新

转载地址:http://jvxp.baihongyu.com/

你可能感兴趣的文章
Nginx配置如何一键生成
查看>>
Nginx配置实例-动静分离实例:搭建静态资源服务器
查看>>
Nginx配置实例-反向代理实例:根据访问的路径跳转到不同端口的服务中
查看>>
Nginx配置实例-反向代理实现浏览器请求Nginx跳转到服务器某页面
查看>>
Nginx配置实例-负载均衡实例:平均访问多台服务器
查看>>
Nginx配置文件nginx.conf中文详解(总结)
查看>>
nginx配置文件nginx.conf超详细讲解
查看>>
Nginx配置自带的stub状态实现活动监控指标
查看>>
Nginx配置详解
查看>>
nginx配置详解
查看>>
nginx配置详解、端口重定向和504
查看>>
nginx配置负载均衡
查看>>
Nginx配置负载均衡到后台网关集群
查看>>
Nginx配置限流,技能拉满!
查看>>
Nginx配置静态代理/静态资源映射时root与alias的区别,带前缀映射用alias
查看>>
Nginx面试三连问:Nginx如何工作?负载均衡策略有哪些?如何限流?
查看>>
Nginx(2):Nginx配置server节点
查看>>
nginx:/usr/src/fastdfs-nginx-module/src/common.c:21:25:致命错误:fdfs_define.h:没有那个文件或目录 #include
查看>>
Nginx:NginxConfig可视化配置工具安装
查看>>
Nginx:现代Web服务器的瑞士军刀 | 文章末尾送典藏书籍
查看>>