总览教材知识脉络

本册从确定性分析(导数、数列)过渡到随机性分析(概率与统计),核心是用数学工具描述、分析和预测随机现象;计数原理则是连接二者的桥梁。

章节研究内容核心工具
第六章
计数原理
如何"数出"随机事件结果的数量分类/分步原理、排列组合、二项式定理
第七章
随机变量及其分布
如何描述随机现象的规律分布列、期望、方差、二项分布、正态分布
第八章
成对数据的统计分析
如何分析两个变量之间的关系散点图、相关系数、回归模型、独立性检验
一句话总结:从单个随机事件的概率,到一组随机变量的分布规律,再到研究两组变量之间的关系——构成从微观到宏观、从单一到关联的完整概率统计体系。

思想核心思想:确定性 → 随机性

计数原理

核心区分"分类"(或,相加)"分步"(且,相乘),是计算概率的基础。

随机变量

把随机结果数字化,用分布列、期望、方差从整体上刻画规律。

成对数据

数值变量用回归,分类变量用独立性检验,研究变量间关系。

桥梁作用:计数原理数清"有多少种可能",这正是后续计算各类概率(尤其是古典概型、分布列)的基石。

6.1两大计数原理

分类加法计数原理("或")

完成一件事有若干类相互独立的方案,各类方法数相加:

$$N=m_1+m_2+\cdots+m_n$$

分步乘法计数原理("且")

完成一件事需若干相互依存、缺一不可的步骤,各步方法数相乘:

$$N=m_1\times m_2\times\cdots\times m_n$$
⚠ 解题第一步:先明确"完成一件事"的具体定义,再判断分类还是分步。复杂问题通常遵循"先分类,后分步"原则。

6.2排列与组合

排列(有顺序)

从 $n$ 个不同元素取 $m$ 个按顺序排列:

$$A_n^m=n(n-1)\cdots(n-m+1)=\frac{n!}{(n-m)!}$$

全排列 $A_n^n=n!$

组合(无顺序)

从 $n$ 个不同元素取 $m$ 个作为一组:

$$C_n^m=\frac{A_n^m}{m!}=\frac{n!}{m!(n-m)!}$$

性质 $C_n^m=C_n^{n-m}$

⚠ 根本区别:排列与组合的差别在于"是否有顺序"。解题第一步先判断有序还是无序,再选公式。
常用策略:优先法(特殊元素/位置优先)、捆绑法(相邻问题)、插空法(不相邻问题)、排除法(正难则反)。

6.3二项式定理

$$(a+b)^n=\sum_{k=0}^{n}C_n^k\,a^{\,n-k}b^{\,k}$$

通项公式(核心):$T_{k+1}=C_n^k\,a^{\,n-k}b^{\,k}$,用于求指定项及其系数。

二项式系数和

$$\sum_{k=0}^n C_n^k=2^n$$

对称性

$$C_n^k=C_n^{\,n-k}$$

最大项

$n$ 偶:$C_n^{n/2}$ 最大;$n$ 奇:中间两项 $C_n^{(n-1)/2}=C_n^{(n+1)/2}$ 最大且相等。

⚠ 两个"系数"别混:二项式系数仅含组合数 $C_n^k$;② 项的系数需算 $a,b$ 幂的系数。求各项系数和令 $a=b=1$;求奇/偶次项系数和分别令 $(a,b)=(1,1)$ 与 $(1,-1)$ 再运算。

7.1条件概率与全概率公式

条件概率 & 乘法公式

在 $A$ 发生条件下 $B$ 发生的概率:

$$P(B|A)=\frac{P(AB)}{P(A)}\;(P(A)>0)$$
$$P(AB)=P(A)\cdot P(B|A)$$

全概率 & 贝叶斯

全概率(由因索果):$P(B)=\sum P(A_i)P(B|A_i)$,$A_i$ 为一组互斥完备事件。

贝叶斯(执果寻因):已知 $B$ 发生,反求某原因 $A_i$ 的概率。

记忆:全概率"由因索果"算事件发生总概率;贝叶斯"执果寻因"在结果已知时回溯原因。

7.2离散型随机变量及其分布列

分布列 & 性质

取值可一一列举;$P(X=x_i)=p_i$。

两条性质(可验证分布列):$p_i\ge0$ 且 $\sum p_i=1$。

数字特征

期望(平均水平):

$$E(X)=\sum x_i p_i,\quad E(aX+b)=aE(X)+b$$

方差(离散程度):

$$D(X)=\sum(x_i-E(X))^2p_i,\quad D(aX+b)=a^2D(X)$$

标准差 $\sigma(X)=\sqrt{D(X)}$

7.4二项分布与超几何分布

模型二项分布 $X\sim B(n,p)$超几何分布 $X\sim H(N,M,n)$
背景$n$ 次独立重复试验(每次两结果、概率不变,如有放回)从总量 $N$(含 $M$ 个某类)中不放回抽 $n$ 件
概率$P(X=k)=C_n^k p^k(1-p)^{n-k}$$P(X=k)=\dfrac{C_M^k\,C_{N-M}^{\,n-k}}{C_N^n}$
期望$E(X)=np$$E(X)=n\cdot\dfrac{M}{N}$
方差$D(X)=np(1-p)$公式较复杂,记住即可
辨析:有放回(或独立)→ 二项分布;不放回、总体有限 → 超几何分布。当 $N$ 很大时超几何近似于二项。

7.5正态分布

图象与参数

"中间高、两头低"的钟形曲线,关于 $x=\mu$ 对称。

  • $\mu$(均值):决定对称轴位置。
  • $\sigma$(标准差):决定"胖瘦"——$\sigma$ 越小越瘦高(数据集中),$\sigma$ 越大越矮胖(数据分散)。

$3\sigma$ 原则

$$P(\mu-\sigma\le X\le\mu+\sigma)\approx68.27\%$$
$$P(\mu-2\sigma\le X\le\mu+2\sigma)\approx95.45\%$$
$$P(\mu-3\sigma\le X\le\mu+3\sigma)\approx99.73\%$$

标准化

任何正态分布 $N(\mu,\sigma^2)$ 均可经变换化为标准正态分布 $N(0,1)$,便于查表求概率。

补充两点分布(0-1 分布)

最简单的离散型分布,描述只有两个结果的试验(如"成功/失败")。

定义 & 分布列

$X=\begin{cases}1,& A\text{ 发生}\\0,& \bar A\text{ 发生}\end{cases}$,其中 $P(A)=p$。

$X$$1$$0$
$P$$p$$1-p$

数字特征 & 关系

$$E(X)=p,\quad D(X)=p(1-p)$$

两点分布即 $n=1$ 的二项分布:$X\sim B(1,p)$。

典型例子:彩票是否中奖、婴儿性别、投篮是否命中、产品是否次品——凡"是/否"二结果皆可建模为两点分布。

8.1相关关系与相关系数

概念 & 工具

相关关系:变量间非确定性依赖(不同于函数关系)。

散点图:直观显示正相关/负相关、线性/非线性。

相关系数 $r$

$$r=\frac{\sum(x_i-\bar x)(y_i-\bar y)}{\sqrt{\sum(x_i-\bar x)^2\sum(y_i-\bar y)^2}}$$

$r>0$ 正相关的;$r<0$ 负相关;$|r|$ 越近 1 线性相关越强。

8.2一元线性回归模型

模型与最小二乘法

模型:$Y=bx+a+e$($e$ 为随机误差,是回归与函数模型的关键区别)。

最小二乘法:使各样本点到回归直线的竖直距离平方和最小,求参数估计 $\hat a,\hat b$;经验回归方程 $\hat y=\hat b x+\hat a$。

残差分析

残差 $\hat e_i=y_i-\hat y_i$。残差点大致均匀分布在横轴两侧且无规律 → 拟合效果好。

决定系数 $R^2$

$$R^2=1-\frac{\text{残差平方和}}{\text{总偏差平方和}}$$

$R^2$ 越接近 1,模型解释变异比例越大、拟合越好。

8.3列联表与独立性检验

$2\times2$ 列联表 & $\chi^2$ 统计量

展示两个分类变量频数分布。卡方统计量:

$$\chi^2=\frac{n(ad-bc)^2}{(a+b)(c+d)(a+c)(b+d)}$$

$n$ 为样本总量,$a,b,c,d$ 为列联表四格频数。

检验步骤

  • 提零假设 $H_0$:两分类变量无关联。
  • 计算 $\chi^2$ 值。
  • 与临界值比较(如 $3.841$,对应 $P\approx0.05$)。
  • $\chi^2\ge$ 临界值 → 拒绝 $H_0$,认为有关联;否则无足够证据。
⚠ 结论性质:独立性检验是在一定概率下犯错误的统计推断,不是绝对的因果判断。

总结全书知识脉络回顾

章节研究内容核心工具
第六章 计数原理数出随机事件结果的数量分类/分步原理、排列组合、二项式定理
第七章 随机变量及其分布描述随机现象的规律分布列、期望、方差、二项分布、正态分布
第八章 成对数据统计分析分析两个变量之间的关系散点图、相关系数、回归模型、独立性检验
一句话总结:从单个随机事件的概率,到一组随机变量的分布规律,再到两组变量之间的关系——构成从微观到宏观、从单一到关联的完整概率统计体系。

提醒全册易错点清单

祝复习顺利 · 计数重"分类分步",概率重"模型识别",统计重"相关与检验" 💪