自动化考研面试专业课重点笔记——《AI十大算法入门》篇!
- 2026-09-21 09:18:11
自动化考研面试专业课重点笔记——《AI十大算法入门》篇!


⭐️26考研已经进入复试备考阶段,为迎合人工智能学院及人工智能学科方向崛起的趋势,联盟为大家整理了人工智能(偏计算机)相关学科的重点知识,助力大家应对最新的考研复试热点~

今天给大家带来的是《AI十大算法》重点汇总!内容全部选自联盟自动化考研联盟企业店(闲🐟店)的:《复试面试班圣经-盘古篇中册》,大家可以收藏起来,方便日常学习! 同时需要PDF版本的可以扫码进群,找卢老师领取~ 
下面直接上重点: 1.模型简单,容易实现 2.许多非线性模型的基础 3.机器学习的基石 缺点: 1.对于非线性数据或者数据特征间具有相关性多项式回归难以建模 2.难以很好地表达高度复杂的数据 适用场景:线性回归作为最基础的模型,一般需要一个简单的回归模型的时候,通常使用线性回归,同时线性回归也是很多模型的基石。 优点: 1.理论成熟,思想简单; 2.可用于非线性; 3.准确度高; 4.对异常值不敏感。 缺点: 1.计算量大; 2.样本不均衡的问题; 3.需要大量的内存。 适用场景: 条件概率:设A、B为两个事件,且P(B)>0,则P(A|B)=P(AB)/P(B),它表示在事件B已经发生的前提下,事件A发生的概率。 全概率: 
贝叶斯公式: 
优点: 1.朴素贝叶斯起源于古典数学理论,有着坚实的数学基础,以及稳定的分类效率; 2.对小规模的数据表现很好,能进行多分类; 3.对缺失值不敏感,算法简单。 缺点: 1.需要计算先验概率; 2.对特征间强相关的模型分类效果不好。 适用场景: 容易解释,不同维度之间相关性小的模型,不计后果的前提下可以处理高维数据。 

核心:用线性组合计算特征得分,再通过 Sigmoid 函数将得分映射成 0-1 之间的概率值,从而实现二分类预测,同时输出的概率值也可用于解释事件发生的可能性。 优点: 1.实现简单,广泛应用于工业上; 2.分类时计算量非常小,速度很快,存储资源少; 3.可观测样本的概率分数。 缺点: 1.特征空间很大时,性能不是很好; 2.容易前拟合,一般准确度不高; 3.只能处理二分类线性可分问题。 适用场景: 很多分类算法的基础组件;用于分析单一因素对某一事件发生的影响因素;用于预测事件发生的概率。 

优点: 1.可以解决高维问题,即大型特征空间; 2.能够处理非线性特征的相互作用; 3.无需依赖整个数据。 缺点: 1.当观测样本很多的时候,效率不是很高; 2.对非线性问题没有通用的解决方案,很难找到一个合适的核函数; 3.对缺失数据敏感。 适用场景: 在很多数据集上都有优秀的表现,拿到数据就可以尝试一下SVM(高维数据注意核函数的选择)。 

优点: 1.计算简单,易于理解,可解释行强; 2.比较适合有缺失属性的样本; 3.能够处理不相关的特征; 4.在短时间内可以对大型数据做出好的结果。 缺点: 1.容易发生过拟合; 2.易被攻击; 3.忽略了数据之间的相关性; 4.各个类别样本数量不一致的数据,信息增益偏向具有更多数值的特征。 适用场景: 常作为一些算法的基石;它能够生成清晰的基于特征(feature)选择不同预测结果的树状结构,数据分析师希望更好的理解手上的数据的时候往往可以使用决策树。 

优点: 1.可以解决分类和回归问题; 2.抗过拟合能力强; 3.稳定性强。 缺点: 1.模型复杂; 2.计算成本高; 3.计算时间长。 适用场景: 数据维度相对低(几十维),同时对准确性有较高的要求;使用随机森林时,不需要调节很多的参数就可以达到很好的效果,所以不知道用什么方法时可以尝试一下。 


优点: 1.预测精度高; 2.适合低维数据; 3.能处理非线性数据; 4.可以灵活处理各种类型的数据,包括连续值和离散值; 5.在相对少的调参时间情况下,预测的准备率也可以比较高。 缺点: 1.由于弱学习器之间存在依赖关系,难以并行训练数据。不过可以通过自采样的SGBT来达到部分并行; 2.如果数据维度较高时会加大算法的计算复杂度。 适用场景:不知道用什么模型时候可以使用的回归/分类模型 


原理:通过计算伪残差,计算加和(同GBDT)。 对比GBDT的改进(优点继承): 1.传统GBDT以CART作为基分类器,xgboost还支持线性分类器,这个时候xgboost相当于带L1和L2正则化项的逻辑回归(分类问题)或者线性回归(回归问题)。 2.传统GBDT在优化时只用到一阶导数信息,xgboost则对代价函数进行了二阶泰勒展开,同时用到了一阶和二阶导数(能自定义损失函数)。 3.gboost在代价函数里加入了正则项,用于控制模型的复杂度。正则项里包含了树的叶子节点个数、每个叶子节点上输出的score的L2模的平方和。正则项降低了模型的复杂度,使学习出来的模型更加简单,防止过拟合,这也是xgboost优于传统GBDT的一个特性。 适用场景:各种比赛的大杀器,不知道用什么模型时候可以使用的回归/分类模型 


原理:物以类聚,人以群分 优点: 1. 原理简单,容易实现 2. 内存占用小 缺点: 1. K值需要预先给定,属于预先知识,很多情况下K值的估计是非常困难的,对于像计算全部微信用 户的交往圈这样的场景就完全的没办法用K-Means进行。 2. K-Means算法对初始选取的聚类中心点是敏感的,不同的随机种子点得到的聚类结果完全不同(K-Means++)。 3. K均值算法并不适合所有的数据类型。 4. 对离群点的数据进行聚类时,K均值也有问题,这种情况下,离群点检测和删除有很大的帮助。 适用场景:没有明确标签的情况下,我们经常用聚类模型来进行操作。 
最后,自动化考研联盟团队全体成员,祝大家一战成硕,考研上岸,有其他问题或需求欢迎评论区留言或者后台私信哦!








微信改规则了,不常点赞互动,不会第一时间收到推送,喜欢看学姐的文章,记得多点赞&在看呀 
点分享 
点点赞 
点在看

点击上方蓝字关注我们






一.线性回归
思路:线性回归假设目标值与特征之间线性相关,即满足一个多元一次方程。通过构建损失函数,来求解损失函数最小时的参数w和b。
优点:
二.K近邻算法
思路:对于待判断的点,找到离他最近的几个数据点,根据他们的类型决定待判断点的类型。。
特点:完全跟着数据走,没有什么数学模型。
需要一个好解释的模型的时候。
三.朴素贝叶斯(NB)


四.逻辑回归(LR)



五.支持向量机(SVM)

核心:找到不同类别之间的分类面,使得两类样本尽量落在面的两边,且离分类面尽量远。

六.机决策树(DT)

核心:信息增益;信息增益比;Gini系数。

七.随机森林(RF)

核心:两个随机(随机选取训练样本,随机选取特征),由决策树形成。

八.GBDT

原理:计算树的伪残差,通过前一棵树的残差拟合下一棵树,最终进行残差的加和。


九.XGBoost



十.K-Means





联盟独家福利大礼包
1.联盟复试高校汇总





2.各高校自动化考研资源QQ群

| 联盟各高校自动化考研QQ群(部分) | |
| 院校 | 扣扣群号 |
| 25自动化考研联盟总群 | 498637757 |
| 江苏省 | |
| 南京理工大学 | 606579586 |
| 南京航空航天大学 | 621069148 |
| 南京邮电大学 | 973730406 |
| 南京工业大学 | 537554778 |
| 南京信息工程大学 | 949285580 |
| 中国矿业大学 | 971212016 |
| 河海大学 | 187849515 |
| 江南大学 | 558970082 |
| 浙江省 | |
| 浙江大学 | 971278732 |
| 杭州电子科技大学 | 958424983 |
| 浙江工业大学 | 903161437 |
| 中国计量大学 | 626782163 |
| 上海市 | |
| 上海交通大学 | 884263936 |
| 上海大学 | 574726401 |
| 华东理工大学 | 579203384 |
| 上海电力大学 | 670109389 |
| 东华大学 | 581727619 |
| 上海理工大学 | 996808157 |
| 安徽省 | |
| 中国科学技术大学 | 593956536 |
| 安徽大学 | 650824745 |
| 合肥工业大学 | 736954211 |
| 其它地区 | |
| 重庆邮电大学 | 664200516 |
| 青岛理工大学 | 606550125 |
| 内蒙古大学 | 304938525 |

本文部分数据来源网络,如有侵权请联系我们删除!



本文来自网友投稿或网络内容,如有侵犯您的权益请联系我们删除,联系邮箱:wyl860211@qq.com 。