李航怎么用?真实学习法
李航怎么用?我更建议把它当“原理说明书”,而不是从头到尾硬读的小说。真实体验是:先用目录定位模型,再看算法步骤,接着补公式,最后用代码复现。这样比逐字啃更稳,也更容易把《统计学习方法》变成面试和项目里的可用知识。
对比一:从头通读还是按模型查读
我第一次用李航,是从第一页开始读,结果卡在几章公式里,进度很慢。后来改成按模型查读,效果明显好。比如面试要复习决策树,就直接读决策树章节,再补相关概率概念。
从头通读适合有完整课程安排的人,优点是体系连贯;按模型查读适合备考和补短板,优点是目标清楚。多数自学者更适合第二种。
对比二:先看公式还是先看算法步骤
直接看公式,容易被符号劝退。我的做法是先看每章的算法流程:输入是什么,输出是什么,中间怎样迭代,停止条件是什么。流程清楚后,再回头看公式。
以EM算法为例,先明白它在有隐变量时交替做E步和M步,再看似然函数和下界推导,会顺很多。先搭骨架,再填血肉,这是用李航的关键。
对比三:只读文字还是配代码复现
只读文字容易产生“我懂了”的错觉。一到手写公式或调参数,就发现漏洞很多。配代码复现虽然慢,但会逼你理解输入格式、参数含义、边界情况。
不一定每章都从零手写。简单模型如k近邻、朴素贝叶斯、感知机可以手写;复杂模型如SVM、CRF可以先看伪代码和sklearn接口,再理解核心思想。
对比四:单独看书还是搭配资料
单看李航,优点是表达严谨,缺点是缺少口语化解释。搭配视频、博客和开源笔记,可以更快打通卡点。但资料不能太杂,否则一个模型看五种讲法,反而乱。
我的搭配方式是固定一本主书,也就是李航;遇到卡点,只查一个视频或一篇笔记;最后回到原书做总结。主线不能丢。
对比五:学完一章怎么验收
不要用“看完了”当验收标准。更实用的标准有四个:能用一句话说出模型用途,能画出算法流程,能解释核心公式,能回答两个典型问题。
比如逻辑斯蒂回归,验收不是会背名字,而是能说清它为什么输出概率、损失函数为什么用交叉熵、和线性回归有什么区别。做到这一步,李航才真正被你用起来。
常见问题
李航怎么用效率最高?
按目标章节学习,先看算法流程,再补公式推导,最后用代码或面试题验证理解。
李航需要做课后题吗?
建议做重点章节的题,尤其是推导题和算法流程题。时间紧时优先做面试高频模型。
李航能配什么代码学习?
可以配合Python手写小模型、sklearn官方示例和开源《统计学习方法》代码仓库学习。