一医疗团队为研究某地的一种地方性疾病与当地居民的卫生习惯(卫生习惯分为良好和不够良好两类)的关系,在已患该疾病的病例中随机调查了100例(称为病例组),同时在未患该疾病的人群中随机调查了100人(称为对照组),得到如下数据: 不够良好 良好 病例组 40 60 对照组 10 90 从该地的人群中任选一人,A表示事件“选到的人卫生习惯不够良好”,B表示事件“选到的人患有该疾病”.((P(B|A)))/((P(overline{B)|A))}与((P(B|overline{A))})/((P(overline{B)|overline{A))}}的比值是卫生习惯不够良好对患该疾病风险程度的一项度量指标,记该指标为R.(1)证明:R=((P(A|B)))/((P(overline{A)|B))}•((P(overline{A)|overline(B))})/((P(A|overline{B)))};(2)利用该调查数据,给出P(A|B),P(A|overline(B))及R的估计值.
3.[判断题]在统计分析中,定序数据主要应用于集合等数值计算。()A. 对B. 错
63.(判断题,1.0分)回归问题的输出结果是数值。()A. 对B. 错
下列关于标准误和抽样误差的描述错误的是A. 只要有个体变异,抽样就必将致抽样误差B. 抽样误差是由个体变异和抽样引起的C. 标准误是反映均数抽样误差大小的指标D. 标准误的大小与总体标准差成反比
10.对四组数据进行统计,获得如图所示的散点图,关于其相关-|||-系数的比较,正确的是 ()-|||-35 35-|||-30 30-|||-25-|||-20 25-|||-15 15/10-|||-10-|||-5 10 15 20 25 30 35 510 15 20 25 30 35-|||-相关系数为r1 相关系数为r2-|||-① ②-|||-35 35-|||-30-|||-器 20-|||-25-|||-15-|||-10 15/10-|||-0 510 15 20 25 30 35 510 15 20 25 3035-|||-相关系数为r3 相关系数为r4-|||-③ ④-|||-A. _(2)lt (r)_(4)lt 0lt (r)_(3)lt (r)_(1) B. _(4)lt (r)_(2)lt 0lt (r)_(1)lt (r)_(3)lt (r)_(3)-|||-C. _(4)lt (r)_(2)lt 0lt (r)_(3)lt (r)_(1) D. _(2)lt (r)_(4)lt 0lt (r)_(3)lt (r)_(3)lt (r)_(3)
某工厂的质检部门对拟购买的一批原料进行抽样检验,以判定是接收还是拒收这批原料.现有如下两种抽样检验方案:方案一:随机抽取一个容量为10的样本,并全部检验,若样本中不合格数不超过1个,则认为这批原料合格,予以接收;方案二:先随机抽取一个容量为5的样本,全部检验,若都合格,则予以接收;若样本中不合格数超过1个,则拒收;若样本中不合格数为1个,则再抽取一个容量为5的样本,并全部检验,且只有第二批样本全部合格才予以接收.假设拟购进的这批原料的合格率为p(0<p<1),并用p作为原料中每件产品是合格品的概率.若每件产品所需的检验费用为3元,且费用由工厂承担.(1)若p=(2)/(3),即方案二中所需的检验费用为随机变量X,求X的分布列与期望;(2)分别计算两种方案中这批原料通过检验的概率,若你是原料供应商,你希望质检部门采取哪种检验方案?说明理由.
17.(2022·新高考Ⅱ卷)(本小题满分10分)在某地区进行流行病学调查,随机调查了100位某种疾病-|||-患者的年龄,得到如下的样本数据的频率分布直方图:-|||-频率/组距-|||-0.023-|||-0.020-|||-0.017-|||-0.012-|||-0.006-|||-0.002-|||-0.001-|||-0 10 20 30 40 50 60 70 80 90 年龄/岁-|||-(1)估计该地区这种疾病患者的平均年龄(同一组中的数据用该组区间的中点值为代表);-|||-(2)估计该地区一位这种疾病患者的年龄位于区间[20,70 )的概率;-|||-(3)已知该地区这种疾病的患病率为0.1 %,该地区年龄位于区间[40,50)的人口占该地区总人口的-|||-16%.从该地区中任选一人,若此人的年龄位于区间[40,50 ),求此人患这种疾病的概率.(以样本数-|||-据中患者的年龄位于各区间的频率作为患者的年龄位于该区间的概率,精确到0.0001)
【单选题】配对设计四格表资料 检验,为什么Ho假设为B=CA. 因为假设两总体率相同B. 因为假设两总体率不相同C. 因为假设两样本率相同D. 因为假设两样本率不相同
热门问题
请你从下表中找出1~100中所有质数.并数一数一共多少个. 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100
皮尔逊相关系数的取值范围为0到正无穷。()A. 正确B. 错误
可以从最小化每个类簇的方差这一视角来解释K均值聚类的结果,下面对这一视角描述正确的A. 每个样本数据分别归属于与其距离最远的聚类质心所在聚类集合B. 每个簇类的质心累加起来最小C. 最终聚类结果中每个聚类集合中所包含数据呈现出来差异性最大D. 每个簇类的方差累加起来最小
重测信度用重测相关系数来表示,相关系数越趋近于下列哪一数值时,则重测信度越高A. 1B. 0.7C. 2D. 3
下列说法正确的是()A. 方差数值上等于各个数据与样本方差之差的平方和之平均数B. 协方差和方差的计算方式完全一致C. 协方差衡量了多个变量的分布D. 方差描述了样本数据的波动程度
{15分)常规情况下,下列不属于人口学变量的是A. 民族B. 收入C. 年龄D. 睡眠时间E. 性别
{1.5分)确定研究总体和样本时,不需要考虑A. 立题依据B. 样本量C. 抽样方法D. 目标总体E. 纳入及排除标准
2024年,我国每天大约有( )个小包裹往来于中国和世界各国之间A. 800万B. 1100万C. 1000万D. 900万
下列哪项属于常见的池化方式。()A. 反向传播B. 最大池化C. 方差池化D. 协方差池化
像从性不好的资料是()A. 由于死亡或者其他原因不能继续试验B. 能按照试验规定要求完成实验C. 重复参加试验D. 由于纳入标准不合格导致选择的研究对象不符合试验要求E. 能完成试验但是不能按照规定要求完成试验
对研究对象制定明确的纳入标准和排除标准,是为了保证样本的A. 可靠性B. 可行性C. 代表性D. 合理性E. 科学性
下列说法正确的是()A. 方差数值上等于各个数据与样本方差之差的平方和之平均数B. 协方差衡量了多个变量的分布C. 协方差和方差的计算方式完全一致D. 方差描述了样本数据的波动程度
下列哪项属于常见的池化方式。()A. 协方差池化B. 方差池化C. 反向传播D. 最大池化
假定用于分析的数据包含属性age.数据元组[1]中age的值如下(按递增序):13,15,16,16,19,20,20,21,22,22,25,25,25,30,33,33,35,35,36,40,45,46,52,70, 问题:使用按箱平均值平滑方法对上述数据进行平滑,箱的深度为3。第二个箱子值为:A. 18.3B. 22。6C. 26。8D. 27。9
下列关于回归分析的描述不正确的是()A. 回归分析模型可分为线性回归模型和非线性回归模型B. 回归分析研究不同变量之间存在的关系()C. 刻画不同变量之间关系的模型统称为线性回归模型D. 回归分析研究单个变量的变化情况
以下几种数据挖掘功能中,〔〕被广泛的用于购物篮分析.A. 关联分析B. 分类和预测C. 聚类分析D. 演变分析
44.2021年,我国人均预期寿命提高到了()。A. 78岁B. 79岁C. 78.2岁D. 79.2岁
48皮尔逊相关系数的取值范围为0到正无穷。()A. 错误B. 正确