“80小说网”最新网址:https://www.80xs.cc,请您添加收藏以便访问
当前位置:80小说网 > 其他类型 > 离语 > $102章 怎么都不来啊

$102章 怎么都不来啊(1 / 2)

上一章 章节列表 下一页
好书推荐: 鉴昭行 抢我亲事,吃我绝户,嫡女重生爆杀侯府 欢迎来到你的十八岁[电竞] 请娘子称我为陛下! 剑出霜满城 彩礼十万,你给二十万什么意思? 我毒士圣体,女帝劝我冷静 诸天从小阴间开始 乾坤塔 家妻钟小艾,我祁同伟真不想进步

1、将特征重要程度排序的过程与模型构建过程同时进行的特征选择方法称作嵌入式特征选择方法(√)2、线性回归模型的目标函数为残差平方和最大化(残差平方和最小化)3、特征向量中心度度量节点在网络中的影响力。

网络中每个节点被赋予一个影响力分数,一个节点与更多的高分节点相连,其分数也趋向于更高。

(√)4、强化学习使用已标记的数据,根据延迟奖励学习策略。

(未标记的数据,通过与环境的交互来收集数据进行学习)5、过拟合是机器学习中一个重要概念,是指模型过于复杂,导致对测试数据预测很好,但对训练数据预测很差。

(对训练数据预测很好,对测试数据预测很差)三、分析题(本题满分3o分,共含5道小题,每小题6分)1、现有样本如下:o,2,3,4,5,6,7,8,9,1o,41,42,43,44,45,46,47,48,49,5o。

使用等距离散化来处理该样本,将样本分为5个区间段。

有几个区间内样本容量不为o?你的答案:2你的计算过程:先,计算样本的最小值和最大值:最小值:o最大值:5o然后,确定分为5个区间时的间距:(最大值-最小值)区间数=(5o-o)5=1o接下来,以间距为1o进行等距离散化:区间1:o-9(共1o个样本)区间2:1o-19(无样本)区间3:2o-29(无样本)区间4:3o-39(无样本)区间5:4o-5o(共11个样本)根据以上结果,有2个区间段(区间2和区间3)内的样本容量不为o。

请注意,这种等距离散化方式可能导致某些区间没有样本,而其他区间样本较多。

2、随机森林采用的是什么集成方法?(abaggg,bboostg,g)。

这种集成方法适用于什么情况?你的选择:baggg你的解释:baggg(自举汇聚法)适用于以下情况:训练数据较少,需要尽可能充分利用现有的有限样本。

数据集存在较强的噪声或离群点,需要通过多个模型的平均来减小噪声影响。

需要降低模型的方差,提高模型的稳定性和鲁棒性。

模型复杂度较高,容易过拟合,需要引入随机性增加泛化能力。

baggg通过对原始训练集进行有放回的抽样,构建多个子模型。

每个子模型相互独立地训练,并通过取平均值(回归问题)或投票(分类问题)的方式进行预测。

随机森林就是一种基于baggg思想的集成学习算法,它使用决策树作为基分类器,并通过对特征的随机选择进一步增加模型的多样性。

由于baggg的平行结构,随机森林可以有效处理大规模数据,具有较好的预测性能和计算效率。

3、为了考察一种新的教学方法对学生英语成绩的影响,某学校进行了调查,共得到4oo个样本数据。

数据表中grade为标签,psi、gpa、tuc为特征。

grade为分类数据,取1表示学习成绩提高,o表示学习成绩没有提高;psi为分类数据,取1表示接受了新的教学方法指导,o表示没有接受新的教学方法指导;gpa表示学生平均积分点,为数值型数据;tuc表示以往的学生成绩,为数值型数据。

假如,想了解gpa、tuc和psi对学生成绩是否有影响,以及预测学生学习成绩是否会提高,你会选择下述用哪个。

模型?为什么?(a线性回归b逻辑回归c聚类d关联规则挖掘)你的选择:逻辑回归你的解释:逻辑回归是一种广泛应用于分类问题的机器学习算法。

在这个情况下,我们的目标是预测学习成绩是否提高,这是一个二分类问题,即学习成绩提高或不提高。

逻辑回归可以用来建立一个概率模型,根据给定的特征值(gpa、tuc和psi),计算出学生成绩提高的概率。

逻辑回归模型的输出是一个概率值,

上一章 章节列表 下一页
新书推荐: 老婆别闹,先灭世还是先生娃? 天狱神医:归来未婚妻正办订婚宴 穿越异世之修仙 HP带着系统的她竟然支持伏地魔 崩坏三:崩坏世界的奇妙之旅 第一男后 救命!刚醒就被好大儿开瓢 带着土着种田吧 一胎三宝:前夫夜夜跪地求复婚 哈利波特与默默然