在构建决策树的过程中,ID3算法主要依赖于以下哪种指标来选择最优划分属性?A. 误分类率B. 基尼系数C. 信息增益D. 信息增益比E. 卡方检验
1.计算题某厂生产圆球,其圆球直径X可以认为服从正态分布N(mu,sigma^2),其中sigma^2=0.05,从某天的产品里随机抽取6个,测得直径(单位:cm)如下:14.70,15.21,14.90,14.91,15.32,15.32试求μ的置信度为95%的置信区间。
做频数表时,以组距为3,下列组段划分正确的是( )。A. -3,-6,-9,...B. 1-3,3-6,6-9,...C. 3-6,6-9,9-12,...D. 0-3,3-6,6-9,...E. 3-,6-,9-,...
设sim N(1,9),求sim N(1,9)_________,sim N(1,9)__________.
三、设总体Xsim N(0,4),X_(1),X_(2),...,X_(10)是X的样本,求Psum X_{i)^2leq12.988}.
探讨该资料中常规提取法与碱水提取法的有无差别,应选用何种方法计算统计量?( )A. 两独立样本t检验B. F检验C. 单样本t检验D. 配对t检验E. 卡方检验
51.单选题(1分) 5个样本率作比较,x^2>x^2_(0.01,4),则在检验水准下,可认为()。A. 各种本率不全相等B. 各样本率全不相等C. 至少有两个总体率相等D. 各总体率均全不相等E. 各总体率不全相等
5.(5.0分)在次品率为1/6的一批产品中,任意抽取300件产品,已知φ(1.55)=0.9394,则在抽取的300件产品中次品数超过40件的概率近似值为A. 0.9394B. 0.0606C. 0.8788D. 0.1212
一个研究团队正在分析不同年龄段人群对某种产品的接受度,他们收集了以下数据:20-30岁有200人接受,30-40岁有150人接受,40-50岁有100人接受。如果各个年龄段的总人数分别是1000人、800人和600人,那么哪个年龄段的接受度最高?()A. 20-30岁B. 所有年龄段接受度相同C. 30-40岁D. 40-50岁
在LDA中,如何计算投影方向?A. 通过主成分分析B. 通过计算类间散布矩阵和类内散布矩阵的比值C. 通过最小化类别之间的距离D. 通过最大化类别内的方差
热门问题
{15分)常规情况下,下列不属于人口学变量的是A. 民族B. 收入C. 年龄D. 睡眠时间E. 性别
请你从下表中找出1~100中所有质数.并数一数一共多少个. 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100
下列哪项属于常见的池化方式。()A. 反向传播B. 最大池化C. 方差池化D. 协方差池化
像从性不好的资料是()A. 由于死亡或者其他原因不能继续试验B. 能按照试验规定要求完成实验C. 重复参加试验D. 由于纳入标准不合格导致选择的研究对象不符合试验要求E. 能完成试验但是不能按照规定要求完成试验
假定用于分析的数据包含属性age.数据元组[1]中age的值如下(按递增序):13,15,16,16,19,20,20,21,22,22,25,25,25,30,33,33,35,35,36,40,45,46,52,70, 问题:使用按箱平均值平滑方法对上述数据进行平滑,箱的深度为3。第二个箱子值为:A. 18.3B. 22。6C. 26。8D. 27。9
下列说法正确的是()A. 方差数值上等于各个数据与样本方差之差的平方和之平均数B. 协方差和方差的计算方式完全一致C. 协方差衡量了多个变量的分布D. 方差描述了样本数据的波动程度
{1.5分)确定研究总体和样本时,不需要考虑A. 立题依据B. 样本量C. 抽样方法D. 目标总体E. 纳入及排除标准
44.2021年,我国人均预期寿命提高到了()。A. 78岁B. 79岁C. 78.2岁D. 79.2岁
对研究对象制定明确的纳入标准和排除标准,是为了保证样本的A. 可靠性B. 可行性C. 代表性D. 合理性E. 科学性
下列关于回归分析的描述不正确的是()A. 回归分析模型可分为线性回归模型和非线性回归模型B. 回归分析研究不同变量之间存在的关系()C. 刻画不同变量之间关系的模型统称为线性回归模型D. 回归分析研究单个变量的变化情况
以下几种数据挖掘功能中,〔〕被广泛的用于购物篮分析.A. 关联分析B. 分类和预测C. 聚类分析D. 演变分析
下列说法正确的是()A. 方差数值上等于各个数据与样本方差之差的平方和之平均数B. 协方差衡量了多个变量的分布C. 协方差和方差的计算方式完全一致D. 方差描述了样本数据的波动程度
48皮尔逊相关系数的取值范围为0到正无穷。()A. 错误B. 正确
2024年,我国每天大约有( )个小包裹往来于中国和世界各国之间A. 800万B. 1100万C. 1000万D. 900万
下列哪项属于常见的池化方式。()A. 协方差池化B. 方差池化C. 反向传播D. 最大池化
重测信度用重测相关系数来表示,相关系数越趋近于下列哪一数值时,则重测信度越高A. 1B. 0.7C. 2D. 3
皮尔逊相关系数的取值范围为0到正无穷。()A. 正确B. 错误
可以从最小化每个类簇的方差这一视角来解释K均值聚类的结果,下面对这一视角描述正确的A. 每个样本数据分别归属于与其距离最远的聚类质心所在聚类集合B. 每个簇类的质心累加起来最小C. 最终聚类结果中每个聚类集合中所包含数据呈现出来差异性最大D. 每个簇类的方差累加起来最小