热门关键字:  听力密码  听力密码  新概念美语  单词密码  巧用听写练听力

推荐算法

中国水利水电出版社
    【作 者】顾爽 著 【I S B N 】978-7-5226-4579-7 【责任编辑】周春元 【适用读者群】科技 【出版时间】2026-06-01 【开 本】16开 【装帧信息】平装(光膜) 【版 次】第1版第1次印刷 【页 数】336 【千字数】536 【印 张】21 【定 价】89 【丛 书】暂无分类 【备注信息】
图书详情

    本书依托作者多年一线互联网实战沉淀,融合了核心代码、实操技巧与真实业务案例,致力于搭建一整套系统化的推荐算法全链路知识体系,实现理论知识与工业落地的深度融合,从而帮助读者搭建完整清晰的推荐算法认知框架,切实赋能实际业务工作。

    全书划分为基础理论、核心技术、前沿拓展、项目实践四大模块,内容由浅入深,完整覆盖推荐系统全链路知识。在夯实底层理论基础上,逐层深度解析经典核心算法与前沿技术方案;依托真实实战案例,细致拆解技术落地路径与业务迭代逻辑,助力读者打通从理论到实践的完整闭环。

    本书适合多类读者群体,可供推荐、搜索、广告算法从业者与相关背景的在校学生系统研读;书中基础原理也可供产品经理、运营等非技术岗位人员学习参考,有助于企业实现跨岗位高效协同。

    1992年,施乐帕克研究中心的David Goldberg等人首次提出“协同过滤”的概念,以此为起点,推荐系统已走过三十余年的演进历程。在信息过载成为常态的今天,推荐算法扮演着“智能连接器”的关键角色——它高效地匹配人与信息,实现了用户价值与商业价值的双赢。Netflix曾公开披露,其平台上超过80%的观看内容源于算法推荐;2006年那场轰动一时的Netflix Prize竞赛,以百万美元悬赏只为将推荐准确度提升10%,而最终获胜算法团队为其带来的长期价值,据分析远超1.6亿美元。这些事实揭示了一个深层逻辑:在现代数字业务中,推荐系统已从“附加功能”演进为产品的核心引擎。即便是当前备受瞩目的大模型(LLM)技术,其商业落地的核心挑战之一,也是如何实现持续稳定的、真金白银的价值转化。而推荐算法,凭借其与业务场景天生的紧密耦合,始终展现出清晰的商业价值路径,持续吸引着工业界与学术界的共同投入。

    作为一名在工业界从事推荐算法研发七年的工程师,笔者亲历了推荐技术从机器学习到深度学习,再走向与大模型融合的多次范式迁移,深感荣幸能投身于这场波澜壮阔的技术浪潮。技术迭代日新月异,既带来了广阔机遇,也对从业者提出了前所未有的学习要求。本书源于笔者在头部互联网公司核心推荐业务中的长期实践、对数百篇前沿论文的持续研读,以及对行业技术演进的系统思考。笔者不才,愿将个人对推荐技术发展脉络的理解,以及多年在工业界实战中积累的经验与思考,汇聚成册。希望能帮助读者建立起对推荐系统的体系化认知,持续更新知识储备,从而在技术洪流中稳健前行。若能以此为推荐算法领域的发展与人才培育略尽绵力,便是本书最大的价值。

    写作缘起:一座连接理论与实践的桥梁

    推荐算法虽属人工智能的重要分支,却与计算机视觉、自然语言处理等领域存在一个显著差异:后者的研究者常可基于公开、静态的数据集展开工作,而推荐算法的效果评估则严重依赖真实的业务场景、动态的用户反馈以及复杂的系统环境。而学术界与工业界之间也存在一道需要被正视的鸿沟:学术研究出于简化,常将推荐抽象为静态的“用户—物品”匹配问题,但这与工业界中持续交互、多阶段配合、兼顾效率与效果的复杂系统相去甚远。这种脱节,使得许多优秀的研究成果难以直接落地,也无形中增加了相关领域的学生和初入职场的工程师的适应成本。

    因此,对于缺乏实战经验的应届生或行业新人而言,想要深入理解推荐算法的全貌颇具挑战。大家往往通过技术博客或零散的经验分享获得一知半解,容易陷入“只见树木,不见森林”的困境,不利于长远的职业发展。笔者初入行时,对此亦有切身体会。

    基于上述背景,笔者尝试用通俗易懂的语言,系统梳理工业界的主流算法与实践。本书将围绕经典的“漏斗式”推荐链路(召回→粗排→精排→重排),对其核心算法进行抽丝剥茧般的详解;同时,针对冷启动、偏差与纠偏、大模型结合推荐算法等行业难点,也设专章深入探讨。最重要的是,本书引入了国内外互联网大厂前沿推荐算法实践案例,以解决读者缺乏实践经验的痛点。希望本书能为新人朋友打开一扇窗,助其以较低成本窥见工业级推荐系统的堂奥,平稳度过入门期。

    本书的诞生并非一时兴起,它源自笔者长期的积累与总结,是“功夫在平时”的结晶。具体而言,在工作之余,我会持续追踪、复现并梳理那些在工业界被验证有效的最新算法模型,并将心得发表于个人知乎专栏。这一习惯的养成,深受《认知觉醒》一书的启发。书中将学习分为被动与主动两个层次,其知识留存率差异巨大:

     被动学习:如听讲、阅读、视听、演示,平均留存率分别为5%、10%、20%和30%。

     主动学习:如讨论、实践、教授给他人,可将留存率提升至50%、75%和90%。

    “教授给他人”这种主动学习方式,带来了高达90%的留存率,这令我深受震动。实践也证明,看懂一个知识点和把它写下来试图让别人也明白,其中有着巨大的鸿沟,其难度也不可同日而语。我惊喜地发现,在传播知识、帮助更多读者的同时,自身对于推荐算法的理解也加深了:原本不理解的知识难点,写作的过程中居然慢慢理解了;那些曾经孤立的知识点,会在笔下自动“联结”与“聚类”,逐渐形成脉络清晰的体系。最后将专栏文章进行系统整合、编排与打磨后,便有了各位手中的这本书。

    分享这段个人经历,是想传递一个朴素的信念:在技术飞速迭代的今天,唯有保持持续学习与系统总结,才能不被时代抛下。正所谓“逆水行舟,不进则退”,这一箴言在计算机技术领域尤为适用。以推荐算法为例,短短三十多年,我们已历经从机器学习到深度学习,再到如今与大模型融合的多次范式革新。在日常工作中,我们接触的任务并非全部具有高成长性,因此更需要主动规划,构建个人知识体系。像海绵一样广泛吸纳,关注行业整体趋势,而非局限于眼前一隅——这也是笔者从业多年来的一点心得体会。

    本书特色:体系化认知推荐算法

    本书旨在深入浅出地解析推荐算法,特别是其在工业界的实现与应用。全书力求以通俗的语言,在深度、广度和可读性之间取得平衡,带领读者叩开推荐系统的大门。其特色可概括为以下几点:

     主题聚焦,脉络清晰:全书紧紧围绕推荐算法展开,深入剖析各算法的设计背景、原理与演化逻辑,对比不同算法的特点与适用场景,助力读者构建对于推荐算法的系统化认知。

     立足实战,侧重落地:书中精选在工业界得到广泛验证的算法与技术,集合国内外知名互联网公司的实践案例,力求“原理”与“实践”相结合。对核心算法均提供代码实现或伪代码思路,并分享作者的一手实战技巧,以降低读者在实践中的试错成本。集中体现了全书“知行合一”的宗旨。

     体系完备,覆盖前沿:系统阐述推荐系统核心链路(召回→粗排→精排→重排)及其主流技术,内容翔实。针对冷启动、纠偏等业界难点,亦深入解读其核心思想。同时,专设章节探讨大模型与推荐算法的结合,确保内容的时效性与前瞻性。

     受众广泛,深入浅出:内容设计兼顾广度与深度,从基础知识到核心技术,再到难点突破,层层递进。对初学者友好,同时也可作为从业者的案头参考书。即便是非技术背景的产品经理、运营同仁,阅读基础部分亦能建立对推荐逻辑的基本理解,促进跨团队协作。

    全书导航:您的阅读路线图

    为帮助您高效地使用本书,我将内容组织为如下四个有机部分,并提出了不同的阅读路径建议:

     第一部分:基石篇(第1~4章)。如果您是初学者或希望巩固基础,请从这里开始。本部分系统介绍推荐系统的价值、架构、数据(样本与特征)处理、模型训练调优及评估方法,为您绘制完整的技术地图并打下坚实的地基。

     第二部分:核心技术篇(第5~9章)。这是全书的核心,深入推荐系统的主链路。无论您是希望掌握某一环节的工程师,还是寻求全局理解的架构师,本部分都将带您深入系统腹地,详细剖析召回、粗排、精排、重排各阶段的核心算法,并探讨多目标与多场景建模等高级主题。

     第三部分:前沿篇(第10~12章)。当您构建起对主流技术的理解后,可以在此挑战更复杂的领域。本部分聚焦冷启动、纠偏与大模型结合推荐算法三大前沿且富有挑战的专题,旨在拓宽您的技术视野,提升解决复杂、长尾问题的能力。

     第四部分:项目实践篇(第13章)。本部分致力于将理论转化为实践,通过剖析国内外头部互联网公司的前沿推荐算法实战案例,展现算法在复杂业务场景中的落地全过程。您将在具体情境中,看到经典架构与前沿模型如何被灵活运用、调优与迭代,从而加深对“技术为业务服务”的深刻理解。这部分内容集中体现了全书 “知行合一” 的宗旨,旨在帮助读者跨越从理解原理到解决实际问题的关键一步。

    目标读者

    本书主要面向以下三类读者:

     推荐/算法/广告领域的从业者:本书已勾勒出一整套推荐算法的知识体系,可作为深化理解、构建认知框架的参考书,并能用于日常工作的查证与启发。

     有一定机器学习基础的初学者:包括新入行的工程师及相关专业的学生。这类人员可以无障碍阅读并理解本书的全部内容,本书系统的讲解、配套的代码与案例,能帮助他们顺利跨越从理论到工业实践的桥梁。

     非技术背景的相关人员:如产品经理、运营人员,以及对推荐系统感兴趣的其他读者。通过阅读前四章的基础内容,可以建立起对推荐系统运行逻辑的基本认知,从而更有效地与技术团队沟通协作。

    致谢

    本书的完成,得益于许多人的指导、支持与陪伴。

    首先,衷心感谢我的研究生导师杨志华教授,是他引领我走进计算机科学与推荐算法的广阔世界,帮助我从一个跨专业的初学者,逐步成长为该领域的实践者。在他的悉心指导下,我不仅找到了自己的研究兴趣,更以此为基础,确立了为之奋斗的职业方向。能够将兴趣与事业结合,是我人生中的幸运。这份源自师门的热情与信念,也一直激励我在推荐算法道路上持续探索、不断前行,并最终促成本书的诞生。

    其次,感谢我职业生涯中遇到的每一位同事与领导。在日常的协作、讨论与攻坚中,他们给予我诸多宝贵的指导与启发,帮助我克服了无数实际难题。正是在这样开放、专业的团队环境中,我得以快速积累实践经验,完成从理论认知到工程落地的关键跨越。

    此外,也要感谢技术社区中无私分享的同行与前辈。你们笔耕不辍的优质内容,让我在工作之余仍能持续深化对推荐算法的理解,不断拓宽技术视野、突破认知局限。同时,感谢所有在社区中阅读、关注、评论与点赞的读者,你们的每一次互动,都是我坚持写作的重要动力。

    最后,谨以此书献给我的家人。感谢你们始终如一的理解、支持与陪伴,让我在忙碌工作之余,仍拥有安心创作的宁静时光。你们的付出,是我前行路上最温暖的支撑。

    推荐技术仍在飞速演进,书中内容虽力求准确与前瞻,但难免存在疏漏或值得商榷之处。我诚挚欢迎所有读者与同行通过邮件(17310033675@163.com)与我进行交流。期待本书能成为我们共同探讨、精进推荐技术的起点。

    愿我们都能在连接人与信息的道路上,持续探索,创造价值。

    作 者

    2026年3月于北京

    前言

    第1章 推荐系统概要 1
    1.1 从“啤酒与尿布”说起:推荐系统的
    价值 1
    1.1.1 信息爆炸时代的三驾马车:搜索、
    推荐与大模型 2
    1.1.2 推荐系统的广泛应用 3
    1.2 推荐系统的作用 4
    1.2.1 对生产者的作用 4
    1.2.2 对消费者的作用 5
    1.2.3 对平台的作用 5
    1.3 推荐系统架构 6
    1.3.1 推荐系统模型架构 6
    1.3.2 推荐系统技术架构 8
    1.4 本章总结 9
    第2章 样本与特征 11
    2.1 样本 11
    2.2 特征 13
    2.2.1 特征分类 13
    2.2.2 特征筛选 16
    2.2.3 特征转换 18
    2.2.4 缺失值处理 20
    2.3 本章总结 21
    第3章 模型训练与超参数选择 22
    3.1 模型训练 22
    3.2 超参数选择 23
    3.2.1 激活函数 24
    3.2.2 损失函数 29
    3.2.3 优化器 33
    3.3 本章总结 37
    第4章 模型评估 38
    4.1 离线评估 38
    4.1.1 排序评估 39
    4.1.2 召回评估 44
    4.1.3 过拟合与欠拟合 48
    4.2 线上实验 51
    4.2.1 A/B测试 51
    4.2.2 离在线不一致 53
    4.3 本章总结 55
    第5章 召回 57
    5.1 基于策略的召回 57
    5.2 I2I召回 58
    5.2.1 基于统计的I2I 58
    5.2.2 图嵌入 59
    5.2.3 图神经网络 66
    5.3 U2I召回 74
    5.3.1 矩阵分解 74
    5.3.2 双塔召回 76
    5.3.3 对比学习 89
    5.4 近似检索召回 93
    5.4.1 TDM:基于树结构的深度检索 93
    5.4.2 DR:端到端的深度路径召回 96
    5.4.3 二向箔:基于图压缩的
    “降维打击” 101
    5.5 本章总结 103
    第6章 粗排 105
    6.1 粗排的演化 105
    6.2 双塔模型 106
    6.2.1 虚拟内核双塔 107
    6.2.2 三塔模型 109
    6.3 深度模型 110
    6.4 链路一致性 112
    6.4.1 知识蒸馏 112
    6.4.2 样本空间一致性 114
    6.5 本章总结 115
    第7章 精排 116
    7.1 机器学习模型 117
    7.1.1 LR:线性概率模型基石 117
    7.1.2 FM:隐向量二阶交叉开创者 118
    7.1.3 树模型结构 121
    7.2 深度学习模型 125
    7.2.1 DNN:深度特征隐式交叉 126
    7.2.2 Wide&Deep:记忆与泛化联合 127
    7.2.3 DeepFM:FM与DNN融合 128
    7.3 特征交叉技术 129
    7.3.1 PNN:基于乘积的显式交叉 130
    7.3.2 DCN:显式高阶交叉 131
    7.3.3 xDeepFM:向量级显式高阶交叉 134
    7.3.4 CAN:细粒度特征协同网络 138
    7.4 序列建模 140
    7.4.1 DIN:注意力序列建模基石 140
    7.4.2 DIEN:兴趣演化的深度网络 142
    7.4.3 BST:Transformer序列建模 146
    7.4.4 DSIN:会话分区的兴趣建模 155
    7.5 长期序列建模 159
    7.5.1 SIM:超长行为序列两阶段
    检索 160
    7.5.2 ETA:端到端的长序列哈希
    检索 162
    7.5.3 TWIN:“双胞胎”两阶段检索 163
    7.5.4 SDIM:哈希碰撞一阶段检索 166
    7.6 本章总结 168
    第8章 重排 170
    8.1 多样性重排 171
    8.1.1 MMR: 相关性与多样性平衡 171
    8.1.2 DPP:行列式多样性建模 172
    8.2 一段式重排 174
    8.2.1 miRNN:用户兴趣循环网络 175
    8.2.2 PRM:上下文个性化重排 178
    8.2.3 SRGA:基于感知范围的
    注意力 180
    8.3 两段式重排 182
    8.4 强化学习重排 185
    8.4.1 强化学习 185
    8.4.2 GRN:序列元素级奖励重排 186
    8.4.3 CMR:全局序列级奖励重排 190
    8.5 端上重排 193
    8.6 本章总结 198
    第9章 多目标与多场景 200
    9.1 多目标优化 201
    9.1.1 Shared Bottom:多目标参数共享
    基石 201
    9.1.2 MMoE:共享专家混合的多任务
    优化 202
    9.1.3 PLE:渐进式分层专家分离
    网络 204
    9.1.4 ESMM:级联式多目标建模 209
    9.2 多目标融合 211
    9.2.1 多目标损失融合 211
    9.2.2 多目标分数融合 219
    9.3 多场景 225
    9.3.1 场景做特征 226
    9.3.2 STAR:共享与专属结合的星型
    拓扑 227
    9.3.3 APG:面向新场景的快速
    自适应 228
    9.4 本章总结 231
    第10章 冷启动 232
    10.1 策略冷启 232
    10.1.1 用户冷启动 233
    10.1.2 物品冷启动 233
    10.2 Bandit算法 233
    10.2.1 Epsilon-Greedy:概率随机探索的
    经典策略 234
    10.2.2 UCB:置信区间上界的乐观
    探索 236
    10.2.3 汤普森采样:贝叶斯后验采样的
    概率匹配 237
    10.3 稀疏Embedding优化 238
    10.3.1 群体Embedding初始化 239
    10.3.2 CDN:记忆与泛化特征聚合 239
    10.3.3 MWUF:基于模型的冷启动
    Embedding初始化 241
    10.4 元学习 244
    10.4.1 与机器学习的区别 244
    10.4.2 元学习训练过程 245
    10.4.3 与迁移学习的区别 248
    10.4.4 MeLU:元学习在推荐领域的
    应用 250
    10.5 本章总结 251
    第11章 偏差与纠偏 253
    11.1 推荐系统中的偏差 253
    11.1.1 偏差的根源 253
    11.1.2 偏差的分类 253
    11.1.3 偏差的交互与纠偏 255
    11.2 位置纠偏 255
    11.2.1 位置作特征 255
    11.2.2 浅层网络:加法偏置网络 256
    11.2.3 PAL:乘法偏置网络 257
    11.2.4 DPIN:位置感知的细粒度特征
    交互网络 258
    11.3 曝光纠偏 260
    11.3.1 全域学习 260
    11.3.2 迁移学习 263
    11.3.3 因果推断 266
    11.4 本章总结 269
    第12章 大模型结合推荐算法 270
    12.1 大模型概述 270
    12.1.1 大模型应用场景 270
    12.1.2 生成引擎优化 272
    12.1.3 LLM4Rec 274
    12.2 大模型推荐系统 275
    12.3 大模型特征工程 277
    12.3.1 HLLM:分层大模型的序列
    增强 278
    12.3.2 NoteLLM-2:面向推荐的多模态
    大模型 281
    12.4 生成式推荐 283
    12.4.1 GRs:生成式推荐在召排的
    实践 284
    12.4.2 TIGER:更纯粹的Transformer
    生成式召回 289
    12.5 本章总结 292
    第13章 推荐算法前沿实践 294
    13.1 LinUCB:雅虎在个性化冷启动的
    实践 294
    13.1.1 LinUCB提出的业务背景 295
    13.1.2 均值收益的线性模型 295
    13.1.3 收益的置信上界 296
    13.1.4 LinUCB个性化冷启实验 296
    13.1.5 LinUCB实践总结 298
    13.2 ESCM2:阿里巴巴-蚂蚁的无偏多任务
    建模实践 299
    13.2.1 ESCM2提出的业务背景 299
    13.2.2 理论基础:逆倾向得分加权 299
    13.2.3 增强稳健性:双稳健估计器 300
    13.2.4 ESCM2模型结构 301
    13.2.5 ESCM2实验效果评估 302
    13.2.6 ESCM2实践总结 303
    13.3 RankMixer:抖音在大规模特征交叉中的
    实践 304
    13.3.1 RankMixer提出的业务背景 304
    13.3.2 特征令牌化 306
    13.3.3 令牌混合 306
    13.3.4 逐令牌前馈网络 308
    13.3.5 RankMixer实验效果评估 309
    13.3.6 RankMixer实践总结 312
    13.4 OneRec:快手的端到端生成式推荐
    实践 312
    13.4.1 OneRec提出的业务背景 313
    13.4.2 特征令牌化:融合多模态与协同
    信号的语义ID 313
    13.4.3 预训练:编码器-解码器架构 315
    13.4.4 后训练:奖励模型与强化学习
    对齐 317
    13.4.5 后训练:流式优化与在线学习 320
    13.4.6 OneRec实验效果总结 321
    13.4.7 OneRec实践总结 324
    13.5 本章总结 324





最新评论共有 0 位网友发表了评论
发表评论
评论内容:不能超过250字,需审核,请自觉遵守互联网相关政策法规。
用户名: 密码:
匿名?
注册