返回

考研数学(微积分)(下)

  part Ⅱ主要内容为 不等式常微分方程 (ODE)级数理论多元函数微积分,包括工具定理、计算方法与部分证明,以例题辅助解释。


常用常数

任何正数的任意根次之值ak=x0f(x0)=x0ka=0\sqrt[k]{a}=x_0\Leftrightarrow f(x_0)=x^k_0-a=0都可以用牛顿-辛普森优化算法计算:xn+1=xnf(xn)f(xn)=1k((k1)xn+axnk1)x_{n+1}=x_n-\frac{f(x_n)}{f'(x_n)}=\frac1k\left((k-1)x_n+\frac a{x^{k-1}_n}\right),特别的对于二次根式a=x\sqrt{a}=xxn+1=12(xn+axn)x_{n+1}=\frac12\left(x_n+\frac a{x_n}\right);非多项式函数不方便笔算,也可以类似地考虑切线法、不动点法等其他优化算法计算其数值解(要是有计算机,利用已有的库现写一个BFGS算法也不是难事)。不过简便起见,本文提供一些常见的常数以供查阅,略去计算的步骤。

  • π3.141593\pi\approx3.141593
展开/收起 π 的一些极限/级数式π=limnnsin180°n \pi=\lim\limits_{\,n\to\infty}n\sin\frac{180\degree}{n} π=limn2n22+2+2++2n1 squre roots \pi=\lim\limits_{n\to\infty}2^n\underbrace{\sqrt{2-\sqrt{2+\sqrt{2+\sqrt{2+\cdots+\sqrt2}}}}}_{n-1\text{ squre roots}} Pi1 Pi2
  • e=limn(1+1n)n2.718282e=\lim\limits_{n\to\infty}\left(1+\frac1n\right)^n\approx2.718282

  • γ=limn(k=1n1klnn)=limn(011xn1xdxlnn)0.577216\gamma=\lim\limits_{n\to\infty}\left(\sum\limits^n_{k=1}\frac1k-\ln n\right)=\lim\limits_{n\to\infty}\left(\displaystyle{\int^1_0\frac{1-x^n}{1-x}\mathrm{d}x-\ln n}\right)\approx0.577216

  • π28.824978\pi^2\approx8.824978

  • e2=7.389056e^2=7.389056

  • 21.414214\sqrt2\approx1.414214

  • e=1.648721\sqrt{e}=1.648721

  • 31.732051\sqrt3\approx1.732051

  • π=Rex2dx=2Γ(12)1.772454\sqrt{\pi}=\displaystyle{\int_{\mathbb{R}}e^{-x^2}\mathrm{d}x=2\,\Gamma\big(\frac12\big)\approx1.772454}

  • 52.236068\sqrt5\approx2.236068

  • 72.645751\sqrt7\approx2.645751

  • 113.316625\sqrt{11}\approx3.316625

  • 133.605551\sqrt{13}\approx3.605551

  • ln20.693147\ln2\approx0.693147

  • ln31.098612\ln3\approx1.098612

  • ln51.609438\ln5\approx1.609438

  • ln71.945910\ln7\approx1.945910

不等式综述

不等式在分析学中是极其重要的,某种意义上,数学分析和实分析是玩弄不等式的艺术。

多元不等式

多元不等式更“普适”、更“普通”,例如柯西不等式和x>0x>0sinx<x\sin x\lt x的区别。

排序不等式

倒序和  乱序和  顺序和 \text{倒序和 }\leqslant\text{ 乱序和 }\leqslant\text{ 顺序和}

设长度为nn的有限数列{ai}\{a_i\}{bi}\{b_i\}单调递增,即a1a2ana_1\leqslant a_2\leqslant\cdots\leqslant a_nb1b2bnb_1\leqslant b_2\leqslant\cdots\leqslant b_n,则

i=1naibni+1i=1naibkii=1naibi \sum^n_{i=1}a_ib_{n-i+1}\leqslant\sum^n_{i=1}a_ib_{k_i}\leqslant\sum^n_{i=1}a_ib_i

其中{bki}\{b_{k_i}\}{bi}\{b_i\}中元素的任意乱序排列。

排序不等式的证明(配合Abel变换)

切比雪夫的和不等式

切比雪夫不等式的离散形式是排序不等式的推广。

离散形式:设a1a2ana_1\leqslant a_2\leqslant\cdots\leqslant a_nb1b2bnb_1\leqslant b_2\leqslant\cdots\leqslant b_n,则

n(i=1naibi)(i=1nai)(i=1nbi) n\left(\sum^n_{i=1}a_ib_i\right)\geqslant\left(\sum^n_{i=1}a_i\right)\left(\sum^n_{i=1}b_i\right) 当且仅当a1=a2==anb1=b2==bn时取等 \text{当且仅当}a_1=a_2=\cdots=a_n\text{且}b_1=b_2=\cdots=b_n\text{时取等}

积分形式:f,gf,g[a,b][a,b]上连续、单调且单调性相同,则

1baabf(x)g(x)dx(1baabf(x)dx)(1baabg(x)dx) \frac1{b-a}\int^b_af(x)g(x)\mathrm{d}x\geqslant\left(\frac1{b-a}\int^b_af(x)\mathrm{d}x\right)\left(\frac1{b-a}\int^b_ag(x)\mathrm{d}x\right) 当且仅当ff都为常数时取等 \text{当且仅当}f\text{和}f\text{都为常数时取等}  如果fg一个不增一个不减,则不等式反向后式子仍成立 ^{\ast}\ \text{如果}f\text{和}g\text{一个不增一个不减,则不等式反向后式子仍成立}

切比雪夫不等式还算直观,其离散形式构造(aibj)(a_ib_j)矩阵再利用排序不等式即可得到;积分形式可以通过积分定义得到——直接从离散切比雪夫不等式入手、取极限得黎曼和直接导出其积分形式,也可以利用二重积分证明,构造D[f(x)f(y)][g(x)g(y)]dσ\displaystyle{\iint\limits_D\big[f(x)-f(y)\big]\big[g(x)-g(y)\big]\mathrm{d}\sigma},将其化为累次积分后证明式子大于等于00即可。

积分形式的推广:设p(x)0p(x)\geqslant0且在[a,b][a,b]上可积,f,gf,g[a,b][a,b]上单调且单调性相同,则

abp(x)dxabp(x)f(x)g(x)dxabp(x)f(x)dxabp(x)g(x)dx \int^b_ap(x)\mathrm{d}x\cdot\int^b_ap(x)f(x)g(x)\mathrm{d}x\geqslant\int^b_ap(x)f(x)\mathrm{d}x\cdot\int^b_ap(x)g(x)\mathrm{d}x

推广形式的证明可以参考:切比雪夫不等式(积分型)

基本不等式

  • a,bR,  a2+b22ab\forall a,b\in\mathbb{R},\ \ a^2+b^2\geqslant2ab
  • a,b,c0,  a3+b3+c33abc\forall a,b,c\geqslant0,\ \ a^3+b^3+c^3\geqslant3abc.

基本不等式可以被认为是下述均值不等式的特例,因为a3+b3+c33abca^3+b^3+c^3\geqslant3abc可以被等价地转写为a+b+c3abc3\frac{a+b+c}{3}\geqslant\sqrt[3]{abc}

离散均值不等式

Hn 调和平均数Gn 几何平均数An 算术平均数Sn 平方平均数(均方根) H_n\text{ 调和平均数}\leqslant G_n\text{ 几何平均数}\leqslant A_n\text{ 算术平均数}\leqslant S_n\text{ 平方平均数(均方根)}

即对于非负数列{xi}\{x_i\}

ni=1n1xii=1nxini=1nxini=1nxi2n=RMSE(x) \frac{n}{\sum\limits^n_{i=1}\frac{1}{x_i}}\leqslant\sqrt[n]{\prod\limits^n_{i=1}x_i}\leqslant\frac{\sum\limits^n_{i=1}x_i}{n}\leqslant\sqrt{\frac{\sum\limits^n_{i=1}x^2_i}{n}}=RMSE(\boldsymbol{x})

当且仅当x1=x2==xnx_1=x_2=\cdots=x_n时等号成立。

如果当nn\to\infty时各式极限均存在,则不等式仍成立。

积分均值不等式

baab1f(x)dxexpablnf(x)dxbaabf(x)dxbaabf2(x)dxba \frac{b-a}{\displaystyle{\int^b_a\frac1{f(x)}\mathrm{d}x}}\leqslant\exp{\frac{\displaystyle{\int^b_a\ln f(x)\mathrm{d}x}}{b-a}}\leqslant\frac{\displaystyle{\int^b_af(x)\mathrm{d}x}}{b-a}\leqslant\sqrt{\frac{\displaystyle{\int^b_af^2(x)\mathrm{d}x}}{b-a}}

从左到右,不等式中的四式分别被称为积分调和平均数 (HabH^b_a)、积分几何平均数 (GabG^b_a)、积分算术平均数 (AabA^b_a) 和积分平方平均数 (SabS^b_a),因此可以简记为:

HabGabAabSab H^b_a\leqslant G^b_a\leqslant A^b_a\leqslant S^b_a

对数平均值不等式

Gn 几何平均数 对数平均值 An 算术平均数 G_n\text{ 几何平均数}\leqslant\text{ 对数平均值 }\leqslant A_n\text{ 算术平均数}

a,b>0a,b>0aba\neq b时。

abablnalnba+b2 \sqrt{ab}\leqslant\frac{a-b}{\ln a-\ln b}\leqslant\frac{a+b}{2}

Schur不等式

a,b,c>0a,b,c>0,则rR\forall r\in\mathbb{R},有

ar(ab)(ac)+br(ba)(bc)+cr(ca)(cb)0 a^r(a-b)(a-c)+b^r(b-a)(b-c)+c^r(c-a)(c-b)\geqslant0

当且仅当a=b=ca=b=c时等号成立。

伯努利不等式

如果{xi}i=1n\{x_i\}^n_{i=1}同号且均大于1-1,则有

(1+x1)(1+x2)(1+xn)1+x1+x2++xn (1+x_1)(1+x_2)\cdots(1+x_n)\geqslant1+x_1+x_2+\cdots+x_n

当且仅当n=1n=1时取等;特别地,当x1=x2==xn=xx_1=x_2=\cdots=x_n=x时,有:

(1+x)n1+nx (1+x)^n\geqslant1+nx

三角不等式

三角不等式在度量空间中有重要作用。

aba±ba+b \big||a|-|b|\big|\leqslant|a\pm b|\leqslant|a|+|b|

当且仅当aabb线性相关时取等;该不等式对任意实数、负数与向量均成立。在内积空间中,其形式为x+yx+y\Vert x+y\Vert\leqslant\Vert x\Vert+\Vert y\Vert,但是在一般的赋范线性空间上不一定成立,若赋范线性空间一致凸则成立。

琴生不等式

琴生不等式(Jensen’s inequality)描述了一个由于凸函数的凸性而导致的不等式,于1906年被丹麦数学家Johan Jensen证明。首先要说明的是,(下) 凸函数本身有多种等价定义,例如在区间II上函数ff有定义时,若:

x1,x2I and λ(0,1), f(λx1+(1λ)x2)λf(x1)+(1λ)f(x2) \forall x_1,x_2\in I\ and\ \lambda\in(0,1),\ \,f\big(\lambda x_1+(1-\lambda)x_2\big)\geqslant\lambda f(x_1)+(1-\lambda)f(x_2)

则称f(x)f(x)是一个(下)凸函数;该定义推广至多元函数f:RnRf:\mathbb{R}^n\to\mathbb{R}时,要求II是凸集,其余条件不变;上述不等式的等号对于严格凸函数只在x=yx=y时才取到。二阶导数存在的(下)凸函数,其二阶导数是大于等于00的。

对于区间II上的(下)凸函数,有琴生不等式:

f(x1+x2++xnn)f(x1)+f(x2)++f(xn)n f\left(\frac{x_1+x_2+\cdots+x_n}{n}\right)\geqslant\frac{f(x_1)+f(x_2)+\cdots+f(x_n)}{n}

如果函数在II上是凹的(或称上凸),则琴生不等式不等号反向后成立;当且仅当x1=x2==xnx_1=x_2=\cdots=x_n时取等。

柯西不等式

柯西不等式(Cauchy-Buniakowsky-Schwarz inequality)有多种形式,从离散实数和、积分到测度论、泛函分析,都有他的身影,实在是贯彻了数学的许多分支、方向。

实数空间里,柯西不等式的离散形式与积分形式分别为:

i=1nai2i=1nbi2(i=1naibi)2(i=1naibi)2 \boxed{\sum^n_{i=1}a^2_i\sum^n_{i=1}b^2_i\geqslant\left(\sum^n_{i=1}\big|a_ib_i\big|\right)^2}\geqslant\left(\sum^n_{i=1}a_ib_i\right)^2 l2空间中:a2b2abT \text{在}l^2\text{空间中:}\Vert\boldsymbol{a}\Vert_2\cdot\Vert\boldsymbol{b}\Vert_2\geqslant\vert\boldsymbol{ab}^T\vert a1b1=a2b2==anbn{ai}{bi}中有一列全为0时取等 \text{当}\frac{a_1}{b_1}=\frac{a_2}{b_2}=\cdots=\frac{a_n}{b_n}\text{或}\{a_i\}\text{、}\{b_i\}\text{中有一列全为}0\text{时取等}

Rf2(x)dxRg2(x)dx(Rf(x)g(x)dx)2(Rf(x)g(x)dx)2 \boxed{\int_{\mathbb{R}}f^2(x)\mathrm{d}x\int_{\mathbb{R}}g^2(x)\mathrm{d}x\geqslant\left(\int_{\mathbb{R}}\big|f(x)g(x)\big|\mathrm{d}x\right)^2}\geqslant\left(\int_{\mathbb{R}}f(x)g(x)\mathrm{d}x\right)^2 L2空间中:f2g2fg1 \text{在}L^2\text{空间中:}\Vert f\Vert_2\cdot\Vert g\Vert_2\geqslant\Vert fg\Vert_1 f(x)=kg(x)   a.e.fg中有一个几乎处处为0时取等 \text{当}f(x)=k\cdot g(x)\ \;a.e.\text{或}f\text{与}g\text{中有一个几乎处处为}0\text{时取等}

其实i=1nai2i=1nbi2(i=1naibi)2\sum\limits^n_{i=1}a^2_i\sum\limits^n_{i=1}b^2_i\geqslant\left(\sum\limits^n_{i=1}\big|a_ib_i\big|\right)^2i=1nai2i=1nbi2(i=1naibi)2\sum\limits^n_{i=1}a^2_i\sum\limits^n_{i=1}b^2_i\geqslant\left(\sum\limits^n_{i=1}a_ib_i\right)^2是等价的,因为始终可以认为ai2a^2_i是一个正数的平方——尽管aia_i可以取任何数,他完全可以是一个负数。所以,由前者可以推出后者,由后者也可以推出前者,但简洁起见,通常还是后者的形式更为人熟知。

应当注意,在离散形式中,将aia_i替换为ai2|a_i|^2bib_i替换为bi2|b_i|^2后,不等式在复数域同样成立;此外,有限数nn还可以推广到\infty的情况。顺便一提,柯西不等式还在许多领域以各种各样的形式出现:

  • 解析几何:ababcosθ=abT|\boldsymbol{a}|\cdot|\boldsymbol{b}|\geqslant|\boldsymbol{a}||\boldsymbol{b}|\cos\theta=\boldsymbol{a}\cdot\boldsymbol{b}^T,当向量α\boldsymbol{\alpha}β\boldsymbol{\beta}线性相关取等;

  • Rn\mathbb{R}^n中:α2β2αβ2|\boldsymbol{\alpha}|^2\cdot|\boldsymbol{\beta}|^2\geqslant|\boldsymbol{\alpha}\cdot\boldsymbol{\beta}|^2,当向量α\boldsymbol{\alpha}β\boldsymbol{\beta}线性相关取等;

  • 概率空间中:E(X2)E(Y2)[E(XY)]2\mathbb{E}(X^2)\cdot\mathbb{E}(Y^2)\geqslant\left[\mathbb{E}(XY)\right]^2,要求随机变量XXYY的二阶矩存在、E(XY)\mathbb{E}(XY)存在,当P(X=kY)=1P(X=kY)=1P(X=0)=1P(X=0)=1P(Y=0)=1P(Y=0)=1成立其一时取等;

  • 对于正定矩阵A\boldsymbol{A}xAxTyAyT(xAyT)2\boldsymbol{xAx}^T\cdot\boldsymbol{yAy^T}\geqslant(\boldsymbol{xAy}^T)^2

离散形式的柯西不等式证明法里,除了用数学归纳法完成,最直接、最直观的办法应该是构造二次函数。记

f(x)=(i=1nai2)x2+(2i=1naibi)x+(i=1nbi2)=i=1n(aix+bi)20 f(x)=\left(\sum^n_{i=1}a^2_i\right)x^2+\left(2\sum^n_{i=1}a_ib_i\right)x+\left(\sum^n_{i=1}b^2_i\right)=\sum^n_{i=1}(a_ix+b_i)^2\geqslant0

由于有f(x)=i=1n(aix+bi)20f(x)=\sum\limits^n_{i=1}(a_ix+b_i)^2\geqslant0,所以针对二次函数f(x)f(x)Δ=(2i=1naibi)24(i=1nai2)(i=1nbi2)0\Delta=\left(2\sum\limits^n_{i=1}a_ib_i\right)^2-4\cdot\left(\sum\limits^n_{i=1}a^2_i\right)\left(\sum\limits^n_{i=1}b^2_i\right)\leqslant0,这就是柯西不等式的离散形式,当且仅当Δ=0\Delta=0,即当a1b1=a2b2==anbn\frac{a_1}{b_1}=\frac{a_2}{b_2}=\cdots=\frac{a_n}{b_n}{ai},{bi}\{a_i\},\{b_i\}中有一列全为00时取等。

连续形式的柯西不等式也可以按如上过程证明,取

F(t)=(abg2(x)dx)t2+(2abf(x)g(x)dx)t+(abf2(x)dx)=ab[f(x)+tg(x)]2dx0 \begin{align}F(t)&=\left(\int^b_ag^2(x)\mathrm{d}x\right)t^2+\left(2\int^b_af(x)g(x)\mathrm{d}x\right)t+\left(\int^b_af^2(x)\mathrm{d}x\right)\\&=\int^b_a\big[f(x)+tg(x)\big]^2\mathrm{d}x\geqslant0\end{align}

剩余的步骤同上。

柯西不等式有非常之多的证明方法,例如还可以利用二重积分、通过构造函数和依据定积分定义等进行证明,这里不再一一陈述。

Young不等式

1<p<1\lt p<\infty1<q<1\lt q<\infty1p+1q=1\frac{1}{p}+\frac{1}{q}=1,则对非负实数a,ba,b,有abapp+bqqab\leqslant\frac{a^p}{p}+\frac{b^q}{q}

Young不等式能通过exe^x的凸性简单证明:ab=elna+lnb=e1plogap+1qlogbqelogapp+elogbqq=app+bqqab=e^{\ln a+\ln b}=e^{\frac{1}{p}\log a^p+\frac{1}{q}\log b^q}\leqslant\frac{e^{\log a^p}}{p}+\frac{e^{\log b^q}}{q}=\frac{a^p}{p}+\frac{b^q}{q}

还可以利用拉格朗日乘子法证明,由于证Young不等式等价于证abab在条件app+bqq=k>0\frac{a^p}{p}+\frac{b^q}{q}=k>0下最大值为kk,故构造拉格朗日函数L(a,b,λ)=ab+λ(app+bqqk)L(a,b,\lambda)=ab+\lambda\left(\frac{a^p}{p}+\frac{b^q}{q}-k\right),然后令LL对各个自变量的偏导为00,得到方程组

{aL=b+λap1=0bL=a+λbp1=0λL=app+bqqk=0 \left\{\begin{aligned} &\nabla_aL=b+\lambda a^{p-1}=0\\ &\nabla_bL=a+\lambda b^{p-1}=0\\ &\nabla_{\lambda}L=\frac{a^p}{p}+\frac{b^q}{q}-k=0\end{aligned}\right.

由方程组解得LL有唯一驻点(k1p,k1q,1)(k^{\frac1p},k^{\frac1q},-1),于是易见该点为极大值 (最大值) 点,因此abk1pk1q=k=app+bqqab\leqslant k^{\frac1p}k^{\frac1q}=k=\frac{a^p}{p}+\frac{b^q}{q},证毕。

Young不等式在卷积中亦有体现,卷积形式的Young不等式常见的证明是利用Hölder不等式进行的。设fL1(Rn)f\in L^1(\mathbb{R}^n)gLp(Rn)g\in L^p(\mathbb{R}^n)1<p<+1\lt p<+\infty),则

fgpf1gp \Vert f\ast g\Vert_p\leqslant\Vert f\Vert_1\cdot\Vert g\Vert_p

Hölder不等式

Hölder不等式可以视为柯西不等式的推广,在泛函分析中有重要意义;通常将Young不等式作为证明Hölder不等式的引理。

1p+1\leqslant p\leqslant+\infty1q+1\leqslant q\leqslant+\infty1p+1q=1\frac{1}{p}+\frac{1}{q}=1(称为Hölder共轭),若fLp(μ)f\in L^p(\mu)gLq(μ)g\in L^q(\mu),则fgL1(μ)f\cdot g\in L^1(\mu),且:

fg1fpgq \Vert fg\Vert_1\leqslant\Vert f\Vert_p\cdot\Vert g\Vert_q

离散形式:

i=1naibi(i=1naip)1p(i=1nbiq)1q \sum^n_{i=1}\big|a_ib_i\big|\leqslant\left(\sum^n_{i=1}|a_i|^p\right)^{\frac{1}{p}}\cdot\left(\sum^n_{i=1}|b_i|^q\right)^{\frac{1}{q}}

积分形式:

baf(x)g(x)dx(Rf(x)pdx)1p(Rg(x)qdx)1q \int^a_b\big|f(x)g(x)\big|\mathrm{d}x\leqslant\left(\int_{\mathbb{R}}\big|f(x)\big|^p\mathrm{d}x\right)^{\frac{1}{p}}\left(\int_{\mathbb{R}}\big|g(x)\big|^q\mathrm{d}x\right)^{\frac{1}{q}} fg1fpgq \Vert fg\Vert_1\leqslant\Vert f\Vert_p\cdot\Vert g\Vert_q

注:当p=1p=1时则q=q=\infty,反之同理;其中f=esssupf=inf{aR:μ(f1(a,+))=0}\Vert f\Vert_{\infty}=\mathrm{ess}\sup|f|=\inf\big\{a\in\mathbb{R}:\mu\big(f^{-1}(a,+\infty)\big)=0\big\},这里的aa实质上是ff的上界,即无穷范数是本性上确界,等于上界构成集合的下确界;本性上确界可以认为是取上界集的子集、子集与上界集至多相差零测集情况下,该子集的下确界,因为受“外界影响”更小,更“稳定”。

特别地,当p=q=2p=q=2,Hölder不等式等价于柯西不等式。

如果p,q(1,+)p,q\in(1,+\infty),则Hölder不等式取等当且仅当fp|f|^pgq|g|^qL1(μ)L^1(\mu)中线性相关,即存在不全为的α,βR\alpha,\beta\in\mathbb{R},使得αfp=a.s.βgq\alpha|f|^p\xlongequal{\text{a.s.}}\beta|g|^q

Hölder

这里利用Young不等式简单证明一下积分形式的Hölder不等式,如果f(x)0f(x)\equiv0g(x)0g(x)\equiv0则不等式显然成立,所以只考虑f,gf,g均不恒为00的情况。有f,gf,g不恒为00,所以有abf(x)pdx>0\displaystyle{\int^b_a\big|f(x)\big|^p\mathrm{d}x>0}abg(x)qdx>0\displaystyle{\int^b_a\big|g(x)\big|^q\mathrm{d}x>0}。根据Young不等式,有

f(x)g(x)(abf(x)pdx)1p(abg(x)qdx)1qf(x)ppabf(x)pdx+g(x)qqabg(x)qdx \frac{|f(x)|\cdot|g(x)|}{\left(\int^b_a\big|f(x)\big|^p\mathrm{d}x\right)^{\frac1p}\cdot\left(\int^b_a\big|g(x)\big|^q\mathrm{d}x\right)^{\frac1q}}\leqslant\frac{\big|f(x)\big|^p}{p\cdot\int^b_a\big|f(x)\big|^p\mathrm{d}x}+\frac{\big|g(x)\big|^q}{q\cdot\int^b_a\big|g(x)\big|^q\mathrm{d}x}

对不等式两端同时取[a,b][a,b]上的定积分,有

abf(x)g(x)dx(abf(x)pdx)1p(abg(x)qdx)1q1p+1q=1 \frac{\int^b_a|f(x)g(x)|\mathrm{d}x}{\left(\int^b_a\big|f(x)\big|^p\mathrm{d}x\right)^{\frac1p}\cdot\left(\int^b_a\big|g(x)\big|^q\mathrm{d}x\right)^{\frac1q}}\leqslant\frac1p+\frac1q=1

整理后即得baf(x)g(x)dx(baf(x)pdx)1p(bag(x)qdx)1q\displaystyle{\int^a_b\big|f(x)g(x)\big|\mathrm{d}x\leqslant\left(\int^a_b\big|f(x)\big|^p\mathrm{d}x\right)^{\frac{1}{p}}\left(\int^a_b\big|g(x)\big|^q\mathrm{d}x\right)^{\frac{1}{q}}},证毕。

Minkowski不等式

1p1\leqslant p\leqslant\inftyf,gLp(E)f,g\in L^p(E)时,有

f+gpfp+gp \Vert f+g\Vert_p\leqslant\Vert f\Vert_p+\Vert g\Vert_p

Minkowski不等式可以被视为范数的三角不等式在Lp(μ)L^p(\mu)空间之推广,利用Hölder不等式可以简洁地证明该不等式:

f+gpp=(f+g)p1(f+g)1(f+g)p1f1+(f+g)p1g1        三角不等式(f+g)p1p(fp+gp)                Ho¨lder不等式=f+gpp1(fp+gp) \begin{align} \Vert f+g\Vert^p_p&=\Vert (f+g)^{p-1}(f+g)\Vert_1\\ &\leqslant\Vert (f+g)^{p-1}f\Vert_1+\Vert (f+g)^{p-1}g\Vert_1\ \ \ \ \ \ \ \ ^{\ast}\,\text{三角不等式}\\ &\leqslant\Vert (f+g)^{p-1}\Vert_p\big(\Vert f\Vert_p+\Vert g\Vert_p\big)\ \ \ \ \ \ \ \ \ \ \ \ \ \ \ \ ^{\ast}\,\text{Hölder不等式}\\ &=\Vert f+g\Vert^{p-1}_p\big(\Vert f\Vert_p+\Vert g\Vert_p\big)\end{align}

整理结果,不等式两边消去f+gpp1\Vert f+g\Vert^{p-1}_p即得f+gpfp+gp\Vert f+g\Vert_p\leqslant\Vert f\Vert_p+\Vert g\Vert_p,证毕。

除此之外,还有广义Minkowski不等式,这里只给出不等式形式,不加证明:设f(x,y)f(x,y)Rn×Rn\mathbb{R}^n\times\mathbb{R}^n上的可测函数,若对几乎处处的yRny\in\mathbb{R}^nf(x,y)Lp(Rn)f(x,y)\in L^p(\mathbb{R}^n)1p<+1\leqslant p<+\infty),且有

Rn(Rnf(x,y)pdx)1pdy=M<+ \int_{\mathbb{R}^n}\left(\int_{\mathbb{R}^n}\big|f(x,y)\big|^p\mathrm{d}x\right)^{\frac1p}\mathrm{d}y=M<+\infty

(RnRnf(x,y)dypdx)1pRn(Rnf(x,y)pdx)1pdy \left(\int_{\mathbb{R}^n}\left|\int_{\mathbb{R}^n}f(x,y)\mathrm{d}y\right|^p\mathrm{d}x\right)^{\frac1p}\leqslant\int_{\mathbb{R}^n}\left(\int_{\mathbb{R}^n}\big|f(x,y)\big|^p\mathrm{d}x\right)^{\frac1p}\mathrm{d}y

当在R×[0,2]\mathbb{R}\times[0,2]上作二元函数f(x,y)={f(x),0y<1g(x),1y2f(x,y)=\left\{\begin{aligned}&f(x),&&0\leqslant y<1\\&g(x),&&1\leqslant y\leqslant2\end{aligned}\right.,其中f,gLp(R)f,g\in L^p(\mathbb{R})时,广义Minkowski不等式便化为通常的Minkowski不等式。

Carlson不等式

Carlson不等式也是柯西不等式的推广,和Hölder不等式是等价的,二者结合起来可以导出更一般的不等式。

Carlson不等式可以与矩阵关联,是关于几何平均数的不等式:对于m×nm\times n的非负实数阵A\boldsymbol{A}nn个列上,列和的几何平均数不小于mm个行中,行的几何平均数之和,即:

(a11+a21+am1)(a12+a22+am2)(a1n+a2n+amn)n                        a11a12a1nn+a21a22a2nn++am1am2amnn \begin{align}&\sqrt[n]{(a_{11}+a_{21}+\cdots a_{m1})(a_{12}+a_{22}+\cdots a_{m2})\cdots(a_{1n}+a_{2n}+\cdots a_{mn})}\\&\ \ \ \ \ \ \ \ \ \ \ \ \ \ \ \ \ \ \ \ \ \ \ \ \geqslant\sqrt[n]{a_{11}a_{12}\cdots a_{1n}}+\sqrt[n]{a_{21}a_{22}\cdots a_{2n}}+\cdots+\sqrt[n]{a_{m1}a_{m2}\cdots a_{mn}}\end{align}

其中,矩阵A\boldsymbol{A}的形状为:

A=[a11a12a1na21a22a2nam1am2amn] \boldsymbol{A}=\left[\begin{matrix}a_{11}&a_{12}&\cdots&a_{1n}\\a_{21}&a_{22}&\cdots&a_{2n}\\\vdots&\vdots&&\vdots\\a_{m1}&a_{m2}&\cdots&a_{mn}\\\end{matrix}\right]

当至少一列完全为00或所有的行之间均成比例时取等。n=2n=2时正是柯西不等式的情况。

Gronwall不等式

Gronwall不等式有多种变形,比较常见的有:

  1. 对区间[a,b][a,b]上的连续非负实值函数u(t)u(t)v(t)v(t),如果有u(t)K+atu(s)v(s)ds\displaystyle{u(t)\leqslant K+\int^t_au(s)v(s)\mathrm{d}s},其中KK是任意常数,则在[a,b][a,b]上成立不等式 u(t)Aeatv(s)ds u(t)\leqslant A\cdot e^{\int^t_av(s)\mathrm{d}s}

这种Gronwall不等式的证明可以参考:Gronwall 不等式的几种证明,作者给出了四种证法,在此不再赘述。

  1. f(t),g(t)f(t),g(t)y(t)y(t)均为[a,b][a,b]上的连续实值函数,f(t)>0f(t)>0y(t)g(t)+atf(τ)y(τ)dτ\displaystyle{y(t)\leqslant g(t)+\int^t_af(\tau)y(\tau)\mathrm{d}\tau},则在[a,b][a,b]上成立不等式 y(t)g(t)+atf(τ)g(τ)eτtf(s)dsdτ \displaystyle{y(t)\leqslant g(t)+\int^t_af(\tau)g(\tau)e^{\int^t_{\tau}f(s)\mathrm{d}s}\mathrm{d}\tau}
  2. 此外Gronwall不等式还有一些推广,这就不在本文的讨论范围之内了。

Gronwall不等式在常微分方程、偏微分方程中都有极其重要的意义,同样地他也有相应的离散形式,在此不做赘述,而只证明第二种变形的积分形式。以下证明过程非常具有代表性,是证明微分不等式的一种较为泛用的方法。

R(t)=atf(τ)y(τ)dτ\displaystyle{R(t)=\int^t_af(\tau)y(\tau)\mathrm{d}\tau},则根据条件有y(t)g(t)R(t)y(t)-g(t)\leqslant R(t)。注意到R(t)=f(t)y(t)R'(t)=f(t)y(t)与被积式中包含的式子eτtf(s)dse^{\int^t_{\tau}f(s)\mathrm{d}s},这启发了我们可以考虑利用微分方程来证明不等式。

f(t)>0,R(t)=f(t)y(t)y(t)=R(t)f(t)f(t)>0,R'(t)=f(t)y(t)\Rightarrow y(t)=\frac{R'(t)}{f(t)},设有y(t)=g(t)+R(t)\displaystyle{y(t)=g(t)+R(t)}成立,也就是把已知的、条件中的不等式改为等式并令其成立,则结合二式有

R(t)f(t)=g(t)+R(t) \frac{R'(t)}{f(t)}=g(t)+R(t)

这是一阶变系数非齐次的线性微分方程,解得

R(t)=eatf(s)ds(C+atf(τ)g(τ)eaτf(s)dsdτ) R(t)=e^{\int^t_{a}f(s)\mathrm{d}s}\left(C+\int^t_af(\tau)g(\tau)e^{-\int^{\tau}_af(s)\mathrm{d}s}\mathrm{d}\tau\right)

CC与其他式子分离,得

C=R(t)eatf(s)dsatf(τ)g(τ)eτaf(s)dsdτ C=R(t)e^{-\int^t_{a}f(s)\mathrm{d}s}-\int^t_af(\tau)g(\tau)e^{\int^a_{\tau}f(s)\mathrm{d}s}\mathrm{d}\tau

所以做辅助函数F(t)=R(t)eatf(s)dsatf(τ)g(τ)eτaf(s)dsdτ\displaystyle{F(t)=R(t)e^{-\int^t_{a}f(s)\mathrm{d}s}-\int^t_af(\tau)g(\tau)e^{\int^a_{\tau}f(s)\mathrm{d}s}\mathrm{d}\tau},对FF求导得

F(t)=etaf(s)ds[R(t)f(t)R(t)]f(t)g(t)etaf(s)dsetaf(s)ds{R(t)f(t)[y(t)g(t)]f(t)g(t)}      注意f(t)>0=etaf(s)ds[R(t)R(t)]=0 \begin{align} F'(t)&=e^{\int^a_tf(s)\mathrm{d}s}\big[R'(t)-f(t)R(t)\big]-f(t)g(t)e^{\int^a_tf(s)\mathrm{d}s}\\ &\leqslant e^{\int^a_tf(s)\mathrm{d}s}\big\{R'(t)-f(t)[y(t)-g(t)]-f(t)g(t)\big\}\ \ \ \ \ \ ^{\ast}\,\text{注意}f(t)>0\\ &=e^{\int^a_tf(s)\mathrm{d}s}\big[R'(t)-R'(t)\big]\\ &=0\end{align}

因此F(t)F(t)是单调递减的,t[a,b]\forall t\in[a,b]F(t)F(a)=0F(t)\leqslant F(a)=0,所以t[a,b]\forall t\in[a,b],有R(t)eatf(s)dsatf(τ)g(τ)eτaf(s)dsdτ\displaystyle{R(t)e^{-\int^t_{a}f(s)\mathrm{d}s}\leqslant\int^t_af(\tau)g(\tau)e^{\int^a_{\tau}f(s)\mathrm{d}s}\mathrm{d}\tau},即

t[a,b], atf(τ)y(τ)dτeatf(s)dsatf(τ)g(τ)eτaf(s)dsdτ=atf(τ)g(τ)eτtf(s)dsdτ \begin{align}\forall t\in[a,b],\ \,\int^t_af(\tau)y(\tau)\mathrm{d}\tau&\leqslant e^{\int^t_{a}f(s)\mathrm{d}s}\int^t_af(\tau)g(\tau)e^{\int^a_{\tau}f(s)\mathrm{d}s}\mathrm{d}\tau\\&=\int^t_af(\tau)g(\tau)e^{\int^t_{\tau}f(s)\mathrm{d}s}\mathrm{d}\tau\end{align}

综上,在t[a,b]t\in[a,b]内成立y(t)g(t)+atf(τ)y(τ)dτg(t)+atf(τ)g(τ)eτtf(s)dsdτ\displaystyle{y(t)\leqslant g(t)+\int^t_af(\tau)y(\tau)\mathrm{d}\tau\leqslant g(t)+\int^t_af(\tau)g(\tau)e^{\int^t_{\tau}f(s)\mathrm{d}s}\mathrm{d}\tau},证毕。

说一个题外话,证明微分方程解的唯一性的另一个引理是“设f(x)f(x)[0,+][0,+\infty]上可导,f(0)=0f(0)=0,且存在常数k>0k>0使得f(x)kf(x)\big|f'(x)\big|\leqslant k\big|f(x)\big|[0,+][0,+\infty]上成立,则在(0,+)(0,+\infty)f0f\equiv0”。对此黄哥给了两种证明方法:

微分方程解唯一性引理

杂例

  • Muirhead不等式

  • 反Hölder不等式;

  • 反Minkowski不等式;

  • Hanner不等式;

  • Clarkson不等式;

  • Bessel不等式;

  • Hardy不等式;

上述本文未介绍的不等式,一般情况下没有本文所提到的不等式常用,因此不再此处赘述,但不能说明他们并不重要,只不过本文主要方向是高等数学(分析);轻击便会跳转到相应的详解文章,可供参阅。

多元不等式证明法 (“全导数”)

通常来说,证明不等式可以认为是在证明极值(最值),也可以认为是“放缩的艺术”;不等式和分析学的关系是密不可分的,这说明了不等式的重要性。对于无条件不等式,直接求导和利用现成不等式构造并放缩是最常见的做法,在此介绍另外一种可以逐渐将变量个数较多的一个多元不等式转化为容易处理的多个变量个数较少的不等式的方法。

有人将这种方法称为“全导数”,个人觉得这个称呼不是十分适合,因为和全微分的定义没有太大联系。这个方法的思想在一般的动力系统(主要是ODE)教材中肯定是有所提及的,并不是新鲜事物。

首先对任意可微函数h(x1,x2,,xn)h(x_1,x_2,\cdots,x_n),记D(h)=i=1nhxiD(h)=\sum\limits^n_{i=1}\frac{\partial h}{\partial x_i}(即所谓“全导数”);接着,如果某多元不等式是f(x1,x2,,xn)g(x1,x2,,xn)f(x_1,x_2,\cdots,x_n)\geqslant g(x_1,x_2,\cdots,x_n)的形式,其中i,xi0\forall i,x_i\geqslant0,则当满足如下条件时:

  • 恒有D(f)D(g)D(f)\geqslant D(g)
  • x1x2xn=0x_1x_2\cdots x_n=0时,恒有fgf\geqslant g

此时必然有f(x1,x2,,xn)g(x1,x2,,xn)f(x_1,x_2,\cdots,x_n)\geqslant g(x_1,x_2,\cdots,x_n)成立。

考虑到不少不等式具有轮换对称性,即各个变量的“地位”是相等的,这种情况下对于第二个条件只需要任取一个xi=0x_i=0,若式子仍成立即可,而不需要考虑所有情况。

该方法的证明极其简单:已知D(f)D(g)D(f)\geqslant D(g)与当x1x2xn=0x_1x_2\cdots x_n=0时恒有fgf\geqslant g,要证对任意非负实元均有fgf\geqslant g等价于证明对任意非负实元均有h(x1,x2,,xn)=fg0h(x_1,x_2,\cdots,x_n)=f-g\geqslant0,不妨令xnx_nx1,x2,,xnx_1,x_2,\cdots,x_n中最小的非负实数,设t[0,xn]t\in[0,x_n],令yi=xixn0y_i=x_i-x_n\geqslant0p(t)=h(y1+t,y2+t,,yn+t)p(t)=h(y_1+t,y_2+t,\cdots,y_n+t),则有p(t)=D(h)0p'(t)=D(h)\geqslant0,从而有p(xn)p(0)0p(x_n)\geqslant p(0)\geqslant0,等价于h(x1,x2,,xn)h(x1xn,x2xn,,0)0h(x_1,x_2,\cdots,x_n)\geqslant h(x_1-x_n,x_2-x_n,\cdots,0)\geqslant0,证毕。

一元不等式

一元不等式更“特殊”,例如琴生不等式和x>1x>1x1+x<ln(1+x)<x\frac{x}{1+x}<\ln(1+x)\lt x的区别。

不等式原理:泰勒公式

利用在 part Ⅰ 中的泰勒公式,以拉格朗日余项作为不等式的误差,基本上可以证明任何一元可微函数的不等式。方法略过,这是比较直观的。

涉及三角函数的不等式

  • sinx<x<tanx,  x(0,π2)\sin x\lt x<\tan x,\ \ x\in\big(0,\frac{\pi}2\big);在x=0x=0处取等,x(π2,0)x\in\big(-\frac{\pi}2,0\big)时不等号反向。
  • 0<sin(cosx)<cosx<cos(sinx),  x(0,π2)0<\sin(\cos x)<\cos x<\cos(\sin x),\ \ x\in\big(0,\frac{\pi}2\big)

涉及对数的不等式

  • x1+xln(1+x)x,  x0\frac{x}{1+x}\leqslant\ln(1+x)\leqslant x,\ \ x\geqslant0;仅在x=0x=0处取等,在x(0,1)x\in(0,1)时放缩程度小于下式。
  • x1+xln(1+x)x,  x0\frac{x}{1+x}\leqslant\ln(1+x)\leqslant\sqrt{x},\ \ x\geqslant0,并且在xx较大时放缩程度相对较小,xln(1x)\sqrt{x}-\ln(1-x)除点x=1x=1外是严格凹函数。
  • bab<lnba<b1a\frac{b-a}b<\ln\frac ba<\frac{b-1}a,其中0<a<b0\lt a\lt b

涉及指数的不等式

  • 1+xex1+x\leqslant e^x;仅在x=0x=0处取等,事实上根据泰勒公式可以把这个不等式的左端部分写到任意次多项式。

常微分方程

本文不做任何关于微分方程理论上的推导,只给出常见微分方程的解法。

这里给出通解的定义,注意通解不一定等价于所有解:把含有nn个独立的任意常数{C1,C2,,Cn}\{C_1,C_2,\cdots,C_n\}的解y=φ(x,C1,,cn)y=\varphi(x,C_1,\cdots,c_n)称为nn阶微分方程F=(x,y,dydx,,dnydxn)=0F=(x,y,\frac{\mathrm{d}y}{\mathrm{d}x},\cdots,\frac{\mathrm{d}^ny}{\mathrm{d}x^n})=0的通解,其中解对常数的独立性是指,对φ\varphi及其n1n-1阶偏导数关于nn个常数{C1,C2,,Cn}\{C_1,C_2,\cdots,C_n\}的雅可比行列式不为00。有时又把微分方程的解称为积分曲线。

还有所谓的积分方程,一般解法是等号两端求导化为微分方程再求解。

一个微分方程,将等式两端微分倾向于增加解,原来的解也是微分后新方程的解;如果对两端同时积分,倾向于减少解,原来的解中的一部分是新方程的解。

一阶微分方程的通解

一阶微分方程的一般形式是dydx=f(x,y)\frac{\mathrm{d}y}{\mathrm{d}x}=f(x,y),可以形象地视为用函数f(x,y)f(x,y)规定了积分曲线的变化率。

可分离变量的方程

若微分方程能被分解为y=f(x)g(y)y'=f(x)g(y)的形式,则称为可分离变量的方程;“可分离变量方程”名称中的“可分解”体现在xxyy可以分别被移至等式的两侧:dyg(y)=f(x)dx\frac{\mathrm{d}y}{g(y)}=f(x)\mathrm{d}x,他的通解为:

f(x)=f(x)dx=1g(y)dy f(x)=\int f(x)\mathrm{d}x=\int\frac{1}{g(y)}\mathrm{d}y

齐次方程

y=f(yx)y'=f\big(\frac yx\big)形式的微分方程为齐次方程,“齐次”一词源自于yx\frac yx,这是一个零次齐次函数。欲求出这类微分方程的通解,可令u=yxu=\frac yxy=uxy=ux使原式转化为可分离变量的方程(ux)=u+xu=f(u)(ux)'=u+xu'=f(u)x0x\neq0),再按上文所述分离变量求解、代回变量即可。例如解方程dydx=yx+x2y\frac{\mathrm{d}y}{\mathrm{d}x}=\frac yx+\frac x{2y},首先令u=yxu=\frac yxy=uxy=ux,有dydx=dydududx=u+xdudx\boldsymbol{\frac{\mathrm{d}y}{\mathrm{d}x}=\frac{\mathrm{d}y}{\mathrm{d}u}\frac{\mathrm{d}u}{\mathrm{d}x}=u+x\frac{\mathrm{d}u}{\mathrm{d}x}},于是u+xdudx=u+12uu+x\frac{\mathrm{d}u}{\mathrm{d}x}=u+\frac1{2u},分离变量得到2udu=dxx2u\mathrm{d}u=\frac{\mathrm{d}x}x,两边同时取积分,得u2=lnx+Cu^2=\ln|x|+C,最后代回u=yxu=\frac yx,最终得到y2=x2(lnx+C)y^2=x^2(\ln|x|+C)

一阶非齐次变系数线性方程

y+P(x)y=Q(x)y'+P(x)y=Q(x)形式的微分方程为一阶线性方程,其中PPQQ可以是任何连续函数。

通解公式:f(x)=eP(x)dx[Q(x)eP(x)dxdx+C] \text{通解公式:}f(x)=e^{-\int P(x)\mathrm{d}x}\left[\int Q(x)e^{\int P(x)\mathrm{d}x}\mathrm{d}x+C\right]

要强调的是,通解公式中只有一个未定系数。尽管该式包含了三个不定积分,但均为任取一个原函数即可。

该公式若一时想不起,也可以很容易地进行推导。联系到 part Ⅰ 在微分中值定理证明题中针对f(ξ)+g(ξ)f(ξ)=0f'(\xi)+g(\xi)f(\xi)=0问题的处理——构造辅助函数F(x)=eg(x)dxf(x)F(x)=e^{\int g(x)\mathrm{d}x}f(x)的思想,故而在此有y+P(x)y=Q(x)(yeP(x)dx)=Q(x)eP(x)dxy'+P(x)y=Q(x)\Leftrightarrow\big(ye^{\int P(x)\mathrm{d}x}\big)'=Q(x)e^{\int P(x)\mathrm{d}x},即原式两端同乘eP(x)dxe^{\int P(x)\mathrm{d}x}后左边凑微分。接着,式子两边(对xx)积分,便得yeP(x)dx+C1=Q(x)eP(x)dxdxye^{\int P(x)\mathrm{d}x}+C_1=\displaystyle{\int}Q(x)e^{\int P(x)\mathrm{d}x}\mathrm{d}x

一般来说通解\neq所有解。但是对于线性微分方程而言,通解等价于所有解,且只有nn簇。


示例 1:解微分方程(xy21)dydx+y3=0\displaystyle{(xy^2-1)\frac{\mathrm{d}y}{\mathrm{d}x}+y^3=0},注意到

dydx=y3xy21=1xy+1y3 \frac{\mathrm{d}y}{\mathrm{d}x}=-\frac{y^3}{xy^2-1}=\frac1{-\frac{x}{y}+\frac1{y^3}}

所以有

dxdy+1yx=1y3 \frac{\mathrm{d}x}{\mathrm{d}y}+\frac1y\cdot x=\frac1{y^3}

所以yy的通解为

y=edyy[1y3edyydy+C]=Cy1y2 y=e^{-\int\frac{\mathrm{d}y}y}\left[\int\frac1{y^3}e^{\int\frac{\mathrm{d}y}y}\mathrm{d}y+C\right]=\frac{Cy-1}{y^2}

解这个微分方程时用到了将自变量与因变量关系倒换的小技巧,如果不这么做,这个方程是很难直接解出来的。


示例 2:解微分方程y+1=eysinxy'+1=e^{-y}\sin x,先对等式两边同乘eye^yeyy+ey=sinxe^yy'+e^y=\sin x,注意到(ey)=eyy(e^y)'=e^yy',因此原方程等价于

(ey)+ey=sinx (e^y)'+e^y=\sin x

eye^y视为一个整体应用一阶非齐次变系数线性方程的通解公式(可令t=eyt=e^y,先对tt求通解再代回t=eyt=e^y,这样会更直观一点),可以得到通解

ey=edx[sinxedx+C]=sinxcosx2+Cex e^y=e^{-\int\mathrm{d}x}\left[\int\sin xe^{\int\mathrm{d}x}+C\right]=\frac{\sin x-\cos x}2+Ce^{-x}

解这个微分方程所用的方法实质上是换元思想的体现,或者说是“将某个函数视为一个抽象整体从而把未知的问题 (非线性方程) 转化为已知问题 (一阶线性方程)”,这也是常用解法之一。

*** 伯努利方程

y+P(x)y=Q(x)yαy'+P(x)y=Q(x)y^{\alpha}为伯努利方程,其中α1\alpha\neq1。伯努利方程通解的一般解法是做代换u=y1αu=y^{1-\alpha}后将原式化为线性方程,再利用通解公式求解。如此代换的原因是原式两端同除yαy^{\alpha}后右边消去了yy项,而左边yy的幂正是1α1-\alpha

*** 全微分方程

dF(x,y)=P(x,y)dx+Q(x,y)dy=0\mathrm{d}F(x,y)=P(x,y)\mathrm{d}x+Q(x,y)\mathrm{d}y=0为全微分方程,通解为F(x,y)=CF(x,y)=C

  • 判定微分方程为全微分方程:当P(x,y)P(x,y)Q(x,y)Q(x,y)在单连通区域内连续可微时,方程P(x,y)dx+Q(x,y)dy=0P(x,y)\mathrm{d}x+Q(x,y)\mathrm{d}y=0是全微分方程的充要条件是Py=Qx\frac{\partial P}{\partial y}=\frac{\partial Q}{\partial x}
  • 断定方程为全微分方程后,寻找FF的解法:
    1. 偏积分;
    2. 凑微分;
    3. 线积分。

其他方法

若给出的一阶微分方程不属于上述任何形式,首先考虑将xxyy的映射关系对调,判断新方程的类型;或者换元将方程化为上述标准形式求解。为方便求解,在此给出结论:

  • dxdy=1dydx=1y\displaystyle{\frac{\mathrm{d}x}{\mathrm{d}y}=\frac1{\frac{\mathrm{d}y}{\mathrm{d}x}}=\frac1{y'}}(反函数求导)
  • d2xdy2=ddy(1y)dxdy=yy3\displaystyle{\frac{\mathrm{d}^2x}{\mathrm{d}y^2}=\frac{\mathrm{d}}{\mathrm{d}y}\left(\frac1{y'}\right)\cdot\frac{\mathrm{d}x}{\mathrm{d}y}=-\frac{y''}{y'^3}}

*** 降阶的高阶方程

一般的高阶微分方程没有容易求得的通解(二阶就没有了),但对特殊的高阶方程可以降阶求解。

  • y(n)=f(x)y^{(n)}=f(x)型,这是最简单的一类高阶微分方程,直接两边不断积分即可降阶求解。

接下来以二阶微分方程为例,二阶微分方程的一般形式是y=f(x,y,y)y''=f(x,y,y')。核心观点是想办法让方程只含有两种未知项以方便降阶,因为含有三种未知项的微分方程是难以直接计算的。

  • y=f(x,y)y''=f(x,y')型,这类方程不直接包含yy项,令u=yu=y'dudx=y\frac{\mathrm{d}u}{\mathrm{d}x}=y''将原式化为dudx=f(x,u)\frac{\mathrm{d}u}{\mathrm{d}x}=f(x,u),这是一个关于uuxx的一阶方程,求解即可得到yy',再积分得到yy
  • y=f(y,y)y''=f(y,y'')型,这类方程不直接包含xx项,令u=yu=y'ududy=yu\frac{\mathrm{d}u}{\mathrm{d}y}=y''(注意与前文处理方法的异同),原式化为ududy=f(y,u)u\frac{\mathrm{d}u}{\mathrm{d}y}=f(y,u)

对于更高阶的微分方程,也可以如此降阶。

*** 线性微分方程组

常微分方程:(第五章)线性微分方程组

高阶线性微分方程与欧拉方程

无论是nn阶常系数的齐次或非齐次线性常微分方程还是nn阶变系数的齐次或非齐次线性常微分方程,他们的通解中都包含nn个自由常数{Ci}\{C_i\},这是线性方程通解的结构。

线性微分方程的叠加原理

If u1 and u2 are solutions of linear PDE in some function space R, then u = c1u1 + c2u2 with any constants c1 and c2 are also a solution of that PDE in the same function space.

变系数线性微分方程

研究高阶线性微分方程,需要研究线性微分方程的解的结构,这一点和高等代数中基础解系内容是相通的。

   标准nn阶变系数齐次线性方程:nyxn+k=0n1Pk(x)kyxk=0\frac{\partial^ny}{\partial x^n}+\sum\limits^{n-1}_{k=0}P_k(x)\frac{\partial^ky}{\partial x^k}=0

   标准nn阶变系数非齐次线性方程:nyxn+k=0n1Pk(x)kyxk=f(x)\frac{\partial^ny}{\partial x^n}+\sum\limits^{n-1}_{k=0}P_k(x)\frac{\partial^ky}{\partial x^k}=f(x)

重要定理 1:如果y1(x)y_1(x)y2(x)y_2(x)是同一齐次微分方程的两个 线性无关 特解,则y=C1y1(x)+C2y2(x)y=C_1y_1(x)+C_2y_2(x)是该齐次微分方程的通解。

重要定理 2:如果y(x)y^{\ast}(x)是非齐次方程的一个特解、y1(x)y_1(x)y2(x)y_2(x)是相应的齐次方程的两个线性无关特解,则y=C1y1(x)+C2y2(x)+y(x)y=C_1y_1(x)+C_2y_2(x)+y^{\ast}(x)是该非齐次微分方程的通解。

重要定理 3:如果y1(x)y^{\ast}_1(x)y2(x)y^{\ast}_2(x)是非齐次方程的两个特解,则y1(x)y2(x)y^{\ast}_1(x)-y^{\ast}_2(x)是相应的齐次方程的一个解。

重要定理 4:以二阶齐次线性微分方程为例,如果y1(x)y^{\ast}_1(x)y2(x)y^{\ast}_2(x)分别是方程y+P(x)y+Q(x)y=f1(x)y''+P(x)y'+Q(x)y=f_1(x)y+P(x)y+Q(x)y=f2(x)y''+P(x)y'+Q(x)y=f_2(x)的特解,则y1(x)+y2(x)y^{\ast}_1(x)+y^{\ast}_2(x)是方程y+P(x)y+Q(x)y=f1(x)+f2(x)y''+P(x)y'+Q(x)y=f_1(x)+f_2(x)的一个特解。

截至到今日,对一般的高阶变系数线性方程的求解仍然没有比较通用的理论,但是部分变系数线性方程可以通过巧妙的换元化为常系数线性方程,通过将未知的问题转化为已知的问题求解。例如,欲求方程ycosx2ysinx+3ycosx=exy''\cos x-2y'\sin x+3y\cos x=e^x的通解,应作换元u=ycosxu=y\cos x,则原方程化为u+4u=exu''+4u=e^x,不难解得u=C1cos2x+C2sin2x+15exu=C_1\cos2x+C_2\sin2x+\frac15e^x,从而原方程的通解为ycosx=C1cos2x+C2sin2x+15exy\cos x=C_1\cos2x+C_2\sin2x+\frac15e^x

常系数线性微分方程

普通方法(公式法)

简便起见,首先讨论常系数齐次线性微分方程y+py+qy=0y''+py'+qy=0

特征方程:以二阶方程为例,称r2+pr+q=0r^2+pr+q=0为二阶次线性微分方程y+py+qy=0y''+py'+qy=0的特征方程。

r1r_1r2r_2是特征方程的两个根:

  1. r1r_1r2r_2为两不等实根时r1r2r_1\neq r_2,通解为y=C1er1x+C2er2xy=C_1e^{r_1x}+C_2e^{r_2x}er1xe^{r_1x}er2xe^{r_2x}是该齐次微分方程的两个线性无关特解;

  2. r1r_1r2r_2为相等实根时r1=r2=rr_1=r_2=r,通解为y=erx(C1+xC2)y=e^{rx}(C_1+xC_2)erxe^{rx}xerxxe^{rx}是方程的两个线性无关特解;

  3. r1r_1r2r_2互为共轭复根,记作r1,2=α±iβr_{1,2}=\alpha\pm i\beta,通解为y=eαx(C1cosβx+C2sinβx)y=e^{\alpha x}(C_1\cos\beta x+C_2\sin\beta x)

    事实上他们均为y=eαx[(C1,1+C1,2x++C1,nxn1)cosβx+(C2,1+C2,2x++C2,nxn1)sinβx]\scriptsize{y=e^{\alpha x}\big[(C_{1,1}+C_{1,2}x+\cdots+C_{1,n}x^{n-1})\cos\beta x+(C_{2,1}+C_{2,2}x+\cdots+C_{2,n}x^{n-1})\sin\beta x\big]}的特例,下文会有一般方程通解的完整形式。

对于二阶常系数非齐次线性微分方程,其一般形式为y+py+qy=f(x)y''+py'+qy=f(x)

  • f(x)=Pm(x)eλxf(x)=P_m(x)e^{\lambda x},其中PmP_mmm次多项式,考虑待定系数法。令y=xkQm(x)eλxy^{\ast}=x^kQ_m(x)e^{\lambda x},其中kkλ\lambda作为齐次方程的特征方程r2+pr+q=0r^2+pr+q=0根的重数(λ\lambda不是根时取k=0k=0)、QmQ_m是一个一般的mm次多项式,然后将含待定系数的yy^{\ast}代入原式,找到Qm(x)Q_m(x),于是得到确切的特解yy^{\ast},进而得到通解。

  • f(x)=eαx[Pl(x)cosβx+Pn(x)sinβx]f(x)=e^{\alpha x}[P_l(x)\cos\beta x+P_n(x)\sin\beta x],也是考虑待定系数法。取m=max{l,n}m=\max\{l,n\},令y=xkeαx[Rm(1)(x)cosβx+Rm(2)(x)sinβx]y^{\ast}=x^k e^{\alpha x}[R^{(1)}_m(x)\cos\beta x+R^{(2)}_m(x)\sin\beta x],这里kk不再是λ\lambda作为齐次方程的特征方程的根重数,而是α+iβ\alpha+i\beta作为特征方程的根重数,然后代入含待定系数的yy^{\ast}便能找到确切的特解yy^{\ast},进而得到通解。

高阶的线性常微分方程,类似处理。

线性方程

上图中给出了针对特征方程解为一对kk重共轭复根情况下原微分方程的通解;如果特征方程计算出有nn对不重复的共轭复根,其中第jj对的重数为kjk_j,则分别计算出第jj对共轭复根对应的第jj个“子通解”,最后将全部的“子通解”相加便得到原微分方程的通解。

算子法求特解

在这里只列出算子法计算特解常用的公式,完整内容稍后再介绍。

DD为微分算子ddx\frac{\mathrm{d}}{\mathrm{d}x}Dk=dkdxkD^k=\frac{\mathrm{d}^k}{\mathrm{d}x^k},同时规定1D\frac1{D}为积分,则微分方程可以写为F(D)y=f(x)F(D)y=f(x),其中F(D)F(D)DD的一个多项式,从而特解可以写为y=1F(D)f(x)y^{\ast}=\frac1{F(D)}f(x),接下来分类讨论一些常见的f(x)f(x)对应的特解。

  • f(x)=eaxf(x)=e^{ax},即y=1F(D)eax\displaystyle{y^{\ast}=\frac1{F(D)}e^{ax}},包括f(x)=kf(x)=k,因为取a=0a=0即可:

    • F(D)D=a0F(D)\Big|_{D=a}\neq0,则y=1F(D)eax=1F(D)D=aeax\displaystyle{y^{\ast}=\frac1{F(D)}e^{ax}=\frac{1}{F(D)\Big|_{D=a}}e^{ax}}
    • F(D)D=a=0F(D)\Big|_{D=a}=0,但F(D)D=a0F'(D)\Big|_{D=a}\neq0,则y=1F(D)eax=xF(D)D=aeax\displaystyle{y^{\ast}=\frac1{F(D)}e^{ax}=\frac{\color{#836FFF}{\boldsymbol{x}}}{F'(D)\Big|_{D=a}}e^{ax}}
    • F(D)D=a=0F(D)\Big|_{D=a}=0F(D)D=a=0F'(D)\Big|_{D=a}=0,但F(D)D=a0F''(D)\Big|_{D=a}\neq0,则y=1F(D)eax=x2F(D)D=aeax\displaystyle{y^{\ast}=\frac1{F(D)}e^{ax}=\frac{\color{#836FFF}{\boldsymbol{x^2}}}{F''(D)\Big|_{D=a}}e^{ax}}
    • \dots

    例如求y2y+y=exy''-2y'+y=e^x的特解,令F(D)=D22D+1F(D)=D^2-2D+1,计算得F(D)D=1=0F(D)\Big|_{D=1}=0F(D)D=1=0F'(D)\Big|_{D=1}=0F(D)D=1=20F''(D)\Big|_{D=1}=2\neq0,因此

    y=x2F(D)D=1ex=x22ex y^{\ast}=\frac{x^2}{F''(D)\Big|_{D=1}}e^{x}=\frac{x^2}2e^x
  • 对于y=1F(D2)cosβx\displaystyle{y^{\ast}=\frac1{F(D^2)}\cos\beta x}y=1F(D2)sinβx\displaystyle{y^{\ast}=\frac1{F(D^2)}\sin\beta x},其中特别约定F(D2)=D2+qF(D^2)=D^2+qqq是一个常数(即F(D)F(D)中不包含一阶微分算子DD):

    • F(D2)D=iβ0F(D^2)\Big|_{D=i\beta}\neq0,则

      y=1F(D2)cosβx=1F(D2)D=iβcosβx y^{\ast}=\frac1{F(D^2)}\cos\beta x=\frac{1}{F(D^2)\Big|_{D=i\beta}}\cos\beta x y=1F(D2)sinβx=1F(D2)D=iβsinβx y^{\ast}=\frac1{F(D^2)}\sin\beta x=\frac{1}{F(D^2)\Big|_{D=i\beta}}\sin\beta x
    • F(D2)D=iβ=0F(D^2)\Big|_{D=i\beta}=0,则

      y=1F(D2)cosβx=x[F(D2)]cosβx y^{\ast}=\frac1{F(D^2)}\cos\beta x=\frac{\color{#836FFF}{\boldsymbol{x}}}{[F(D^2)]'}\cos\beta x y=1F(D2)sinβx=x[F(D2)]sinβx y^{\ast}=\frac1{F(D^2)}\sin\beta x=\frac{\color{#836FFF}{\boldsymbol{x}}}{[F(D^2)]'}\sin\beta x

    例如求y+4y=sin2xy''+4y=\sin2x的特解,令F(D2)=D2+4F(D^2)=D^2+4,计算得F(D2)D=2i=0F(D^2)\Big|_{D=2i}=0,因此

    y=x(D2+4)sin2x=x21Dsin2x=x2sin2xdx=xcos2x4 y^{\ast}=\frac{x}{(D^2+4)'}\sin2x=\frac{x}2\frac{1}{D}\sin2x=\frac{x}2\int\sin2x\mathrm{d}x=-\frac{x\cos2x}4
  • 对于一般的y=1F(D)cosβx\displaystyle{y^{\ast}=\frac1{F(D)}\cos\beta x}y=1F(D)sinβx\displaystyle{y^{\ast}=\frac1{F(D)}\sin\beta x}(即F(D)F(D)中包含一阶微分算子DD),处理方法是基于上一种情况的,但解起来相对麻烦一点。

    直接以求y3y+2y=12cos2xy''-3y'+2y=-\frac12\cos2x特解为例,令F(D)=D23D+2F(D)=D^2-3D+2,则y=1D23D+2(12cos2x)y^{\ast}=\frac1{D^2-3D+2}\left(-\frac12\cos2x\right)先直接代入D2=(2i)2=4\boldsymbol{D^2=(2i)^2=-4},后续再做讨论

    y=1(D23D+2)D2=4(12cos2x)=1213D+2cos2x=123D29D24cos2x=1223D40cos2x=380Dcos2x+140cos2x=340sin2x+140cos2x \begin{align} y^{\ast}&=\frac1{(D^2-3D+2)\big|_{D^2=-4}}\left(-\frac12\cos2x\right)\\ &=\frac12\frac1{3D+2}\cos2x\\ &=\frac12\frac{3D-2}{9D^2-4}\cos2x\\ &=\frac12\frac{2-3D}{40}\cos2x\\ &=-\frac{3}{80}D\cos2x+\frac1{40}\cos2x\\ &=\frac3{40}\sin2x+\frac1{40}\cos2x \end{align}
  • f(x)=xk+a1xk1++ak1x+akf(x)=x^k+a_1x^{k-1}+\cdots+a_{k-1}x+a_k,即y=1F(D)(xk+a1xk1++ak1x+ak)y^{\ast}=\frac1{F(D)}(x^k+a_1x^{k-1}+\cdots+a_{k-1}x+a_k),利用泰勒级数11x=1+x+x2+\frac1{1-x}=1+x+x^2+\cdotsF(D)F(D)展开即可。

    例如求y+y=x2+1y''+y'=x^2+1的特解,令F(D)=D2+DF(D)=D^2+D,则

    y=1F(D)(x2+1)=1D11+D(x2+1)=1D(1D+D2D3+)(x2+1)=(1D1+DD2+)(x2+1)=(x2+1)dx(x2+1)+(2x)+0=x33x2+3x1 \begin{align}y^{\ast}&=\frac1{F(D)}(x^2+1)\\&=\frac1D\frac1{1+D}(x^2+1)\\&=\frac1D(1-D+D^2-D^3+\cdots)(x^2+1)\\&=\left(\frac1D-1+D-D^2+\cdots\right)(x^2+1)\\&=\int(x^2+1)\mathrm{d}x-(x^2+1)+(2x)+0\\&=\frac{x^3}3-x^2+3x-1\end{align}
  • 推广:当f(x)=eaxg(x)f(x)=e^{ax}g(x),即y=1F(D)eaxg(x)\displaystyle{y^{\ast}=\frac1{F(D)}e^{ax}g(x)},其中g(x)g(x)是任意一个实函数,有

    重要公式:y=1F(D)(eaxg(x))=eax(1F(D+a)g(x)) \color{#990066}{\textbf{重要公式:}\boldsymbol{y^{\ast}=\frac1{F(D)}\Big(e^{ax}g(x)\Big)=e^{ax}}\cdot\boldsymbol{\left(\frac1{F(D+a)}g(x)\right)}}

    利用该公式消掉分母的D2D^2DD或常数项后,将1F(D+a)g(x)\frac1{F(D+a)}g(x)视为整体,于是按上文情况处理即可。

    例如求y+4y+5y=e2xsinxy''+4y'+5y=e^{-2x}\sin x的特解,

    y=1D2+4D+5e2xsinx=e2x1(D2)2+4(D2)+5sinx=e2x1D2+1sinx    注意到代入D2=(1i)2i2+1=0=e2xx[D2+1]sinx=e2xx2sinxdx=xe2xcosx2+C \begin{align} y^{\ast}&=\frac1{D^2+4D+5}e^{-2x}\sin x\\ &=e^{-2x}\cdot\boxed{\frac1{(D-2)^2+4(D-2)+5}\sin x}\\ &=e^{-2x}\cdot\boxed{\frac1{D^2+1}\sin x}\ \ \ \ \ast\text{注意到代入}D^2=(1i)^2\text{有}i^2+1=0\\ &=e^{-2x}\cdot\frac{x}{[D^2+1]'}\sin x\\ &=e^{-2x}\cdot\frac{x}2\int\sin x\mathrm{d}x\\ &=-\frac{xe^{-2x}\cos x}2+C \end{align}

    又例如求y3y+2y=2xexy''-3y'+2y=2xe^x的特解,

    y=1D23D+22xex=2ex1(D+1)23(D+1)+2x=2ex1D(D1)x=2ex1D(1DD2)x=2ex1D(x1)=2ex(x22x) \begin{align} y^{\ast}&=\frac1{D^2-3D+2}2xe^x\\ &=2e^x\cdot\boxed{\frac1{(D+1)^2-3(D+1)+2}x}\\ &=2e^x\cdot\boxed{\frac1{D(D-1)}x}\\ &=2e^x\cdot\frac1D\left(-1-D-D^2-\cdots\right)x\\ &=2e^x\cdot\frac1D\left(-x-1\right)\\ &=2e^x\left(-\frac{x^2}2-x\right) \end{align}

    要特别注意微分算子DD的作用对象,虽然P(D)P(D)Q(D)Q(D)之间有交换律、分配律等运算法则成立,但是当DD作用于函数时切不可随意颠倒次序,一定要以作用函数为起点,从右往左逐个计算导数算子或积分算子,例如最后一个例子中,1D(D1)x\frac1{D(D-1)}x的运算只能是

    1D[(1DD2)x]=1D(x1)=x22x \frac1D\left[(-1-D-D^2-\cdots)x\right]=\frac1D(-x-1)=-\frac{x^2}2-x

    而不可以是

    [1D(1DD2)]x=(1D1D)x=x22x1 \left[\frac1D(-1-D-D^2-\cdots)\right]x=(-\frac1D-1-D-\cdots)x=-\frac{x^2}2-x-1

    这样只会得到错误的结果。虽然很多情况下为书写的简便起见没有写明表运算顺序的括号,但在计算时一定要从右往左逐个计算。

完整的算子法收纳了起来,如有需要可以展开下面这篇论文。

展开/收起算子法论文算子法1 算子法2 算子法3 算子法4 算子法5 算子法6 算子法7 算子法8 算子法9

反推微分方程

给定通解,如何反推微分方程?我将方法总结如下,称之为“观察”与“求导”。

以式子xy=c1ex+c2e2xxy=c_1e^x+c_2e^{2x}为例,设该式是某二阶齐次线性微分方程的通解,试求这个微分方程。

  • 方法“观察”,顾名思义,就是观察通解的形式。可以发现,式子xy=c1ex+c2e2xxy=c_1e^x+c_2e^{2x}本身并不是任何一个二阶常系数微分方程的通解,因为将x,yx,y分离后得y=c1xex+c2xe2xy=\frac{c_1}xe^x+\frac{c_2}xe^{2x}——这不满足一般二阶常系数微分方程通解的形式(如果满足的话,我们可以干净利落地给出特征方程,然后直接得到原方程)。

    显然,对于二阶与高阶常系数微分方程我们很好处理,但二阶与高阶变系数微分方程就没有很好的方法应对了,可这里的式子又显然不是常系数微分方程的解,怎么办呢?我们可以想办法尝试着把这里的变系数问题转化成一个常系数问题。细心观察可以发现,式子xy=c1ex+c2e2xxy=c_1e^x+c_2e^{2x}等号右边的那部分正是一个标准的二阶常系数微分方程通解,所以可以作换元z=xyz=xy,把原式化为z=c1ex+c2e2xz=c_1e^x+c_2e^{2x}并将式子视为xxz(x)z(x)的微分方程,易见这时的特征方程为(λ2)(λ1)=λ23λ+2(\lambda-2)(\lambda-1)=\lambda^2-3\lambda+2,因此原方程为

    d2zdx23dzdx+2z=0 \frac{\mathrm{d}^2z}{\mathrm{d}x^2}-3\frac{\mathrm{d}z}{\mathrm{d}x}+2z=0

    代回z=xyz=xy,得

    dydx+dydx+xd2ydx23y3xdydx+2xy=0 \frac{\mathrm{d}y}{\mathrm{d}x}+\frac{\mathrm{d}y}{\mathrm{d}x}+x\frac{\mathrm{d}^2y}{\mathrm{d}x^2}-3y-3x\frac{\mathrm{d}y}{\mathrm{d}x}+2xy=0

    整理得

    xy+(23x)y+(2x3)y=0 xy''+(2-3x)y'+(2x-3)y=0

    这是一个变系数微分方程,但我们通过巧妙的换元,将一个未知的问题(还原变系数微分方程)转变为了已知的问题(还原常系数微分方程),类似的思想充斥着数学的各个领域。

  • 方法“求导”,其实也就是直接对给出的式子求导,联立方程求解。直接对等式xy=c1ex+c2e2xxy=c_1e^x+c_2e^{2x}两端求导,有

    (xy=c1ex+c2e2x)y+xy=c1ex+2c2e2x \big(xy=c_1e^x+c_2e^{2x}\big)'\Leftrightarrow y+xy'=c_1e^x+2c_2e^{2x} (xy=c1ex+c2e2x)2y+xy=c1ex+4c2e2x \big(xy=c_1e^x+c_2e^{2x}\big)''\Leftrightarrow2y'+xy''=c_1e^x+4c_2e^{2x}

    由以上二式解得

    c1ex=2xy+2yxy2y c_1e^x=2xy'+2y-xy''-2y' c2e2x=12xy12xy12y+y c_2e^{2x}=\frac12xy''-\frac12xy'-\frac12y+y'

    c1ex,c2e2xc_1e^x,c_2e^{2x}的表达式代回xy=c1ex+c2e2xxy=c_1e^x+c_2e^{2x},整理得

    xy+(23x)y+(2x3)y=0 xy''+(2-3x)y'+(2x-3)y=0

    这一方法可能没有上一方法“优雅”,但至少也是可行的。

*** 欧拉方程

欧拉方程xny(n)+a1xn1y(n1)++an1xy+any=f(x)x^ny^{(n)}+a_1 x^{n-1}y^{(n-1)}+\cdots+a_{n-1}xy'+a_ny=f(x)是特殊的线性变系数微分方程,求解的思路是将欧拉方程化为线性常系数方程,令x=etx=e^t,原式化为xky(k)=ddt(ddt1)(ddtk+1)yx^ky^{(k)}=\frac{\mathrm{d}}{\mathrm{d}t}(\frac{\mathrm{d}}{\mathrm{d}t}-1)\cdots(\frac{\mathrm{d}}{\mathrm{d}t}-k+1)y,即一个线性常系数方程。

*** 幂级数解法

可以解决勒让德方差与贝塞尔方程,略。

*** 首次积分

常微分方程学习笔记(11)

一阶差分方程

差分这一概念在统计学中较为常用,例如时间序列中的AR模型。某种意义上,可以把差分看作“数列的导数”,这也是为何差分方程的解和微分方程有相似之处。

对于序列y0,y1,,yx,y_0,y_1,\cdots,y_x,\cdots,称Δyx=yx+1yx\Delta y_x=y_{x+1}-y_x为一阶差分,称Δ2yx=Δ(Δyx)=Δyx+1Δyx=yx+22yx+1+yx\Delta^2y_x=\Delta(\Delta y_x)=\Delta y_{x+1}-\Delta y_x=y_{x+2}-2y_{x+1}+y_x为二阶差分,以此类推。

  • 一阶常系数线性齐次差分方程:yx+1+ayx=0y_{x+1}+ay_x=0,通解为yc(x)=y0(a)x=C(a)xy_c(x)=y_0(-a)^x=C(-a)^x,其中y0y_0是初值,在初值未知的情况下考虑用待定系数CC代替;

  • 一阶常系数线性非齐次差分方程:yx+1+ayx=f(x)y_{x+1}+ay_x=f(x),通解为yx=yc(x)+yxy_x=y_c(x)+y^{\ast}_x,其中yc(x)y_c(x)yx+1+ayx=0y_{x+1}+ay_x=0的解、yxy^{\ast}_x是特解,因此只需要找出特解,就可以给出一阶线性非齐次差分方程的通解。下面列出常见情况下的特解,其中k,k0,k1,,knk,k_0,k_1,\cdots,k_n均为待定系数:

    • f(x)=Rn(x)f(x)=R_n(x),其中RnR_nnn阶多项式:

      • a1a\neq1,则特解为yx=k0+k1x++xnxn=j=0nkjxjy^{\ast}_x=k_0+k_1x+\cdots+x_nx^n=\sum\limits^n_{j=0}k_jx^j
      • a=1a=1,则特解为yx=x(k0+k1x++xnxn)=xj=0nkjxjy^{\ast}_x=x\big(k_0+k_1x+\cdots+x_nx^n\big)=x\sum\limits^n_{j=0}k_jx^j
    • f(x)=λxRn(x)f(x)=\lambda^x R_n(x),其中RnR_nnn阶多项式:

      • aλa\neq\lambda,则特解为yx=(k0+k1x++xnxn)λx=λxj=0nkjxjy^{\ast}_x=(k_0+k_1x+\cdots+x_nx^n)\lambda^x=\lambda^x\sum\limits^n_{j=0}k_jx^j
      • a=λa=\lambda,则特解为yx=x(k0+k1x++xnxn)λx=xλxj=0nkjxjy^{\ast}_x=x\big(k_0+k_1x+\cdots+x_nx^n\big)\lambda^x=x\lambda^x\sum\limits^n_{j=0}k_jx^j
    • f(x)=b1cosωx+b2sinωxf(x)=b_1\cos\omega x+b_2\sin\omega x,其中ω0\omega\neq0b1,b2b_1,b_2不同时为00,记D=a+cosωsinωsinωa+cosωD=\left|\begin{matrix}a+\cos\omega&\sin\omega\\-\sin\omega&a+\cos\omega\end{matrix}\right|

      • D0D\neq0,则特解为yx=k1cosωx+k2sinωxy^{\ast}_x=k_1\cos\omega x+k_2\sin\omega x
      • D=0D=0,则特解为yx=x(k1cosωx+k2sinωx)y^{\ast}_x=x(k_1\cos\omega x+k_2\sin\omega x)

    部分特例:

    • f(x)=λf(x)=\lambda

      • a1a\neq1,则特解为yx=ky^{\ast}_x=k
      • a=1a=1,则特解为yx=kxy^{\ast}_x=kx
    • f(x)=λbxf(x)=\lambda b^x

      • aba\neq b,则特解为yx=kbxy^{\ast}_x=kb^x
      • a=ba=b,则特解为yx=kxbxy^{\ast}_x=kxb^x
    • f(x)=λxbxf(x)=\lambda xb^x

      • aba\neq b,则特解为yx=(k1t+k0)bxy^{\ast}_x=(k_1t+k_0)b^x
      • a=ba=b,则特解为yx=t(k1t+k0)bxy^{\ast}_x=t(k_1t+k_0)b^x

对于一些二阶差分方程的解,可以参考:差分方程基本理论

级数理论

阿贝尔定理略。

阿贝尔变换

称阿贝尔变换为“离散的分部积分”是不为过的,他的确十分强大。阿贝尔变换之于差分,正如分部积分之于微分。

i=1naibi=i=1n1bi(aiai+1)+i=1nbian \sum^n_{i=1}a_ib_i=\sum^{n-1}_{i=1}b_i(a_i-a_{i+1})+\sum^n_{i=1}b_ia_n

阿贝尔变换可以求出k=1nk2=2n3+3n2+n6\sum\limits^n_{k=1}k^2=\frac{2n^3+3n^2+n}6,当然这只是一种方法,还是一种相对繁琐的方法。

数项级数

数项级数值的计算往往要借助幂级数的和函数,这部分内容见后文幂级数部分。

数项级数敛散性

级数n=1an\sum\limits^{\infty}_{n=1}a_n收敛的必要条件是limnan=0\lim\limits_{n\to\infty}a_n=0,因此:

  • limnan0\lim\limits_{n\to\infty}a_n\neq0,则级数必发散;

尽管逐项求导/求积不改变收敛半径,但可以证明:

  • 为数项级数加上括号会增强收敛性;
  • 将数项级数括号去掉会削弱收敛性;
  • 绝对收敛的数项级数,加上或去掉括号,即任意改变运算先后次序,结果均绝对收敛。

给级数加上小括号改变运算顺序,会增强收敛性:原本收敛的级数加上括号后一定收敛,加上括号后发散的级数一定发散。

级数an\sum a_n与平方和an2\sum a^2_n的关系:

  • an\sum a_n收敛,不一定有an2\sum a^2_n收敛,例如(1)nn\sum\frac{(-1)^n}n

    但如果an\sum a_n是绝对收敛的,或an\sum a_n是正项级数,则由limnan=0\lim\limits_{n\to\infty}a_n=0可知an2\sum a^2_n绝对收敛,因为存在NN使得当n>Nn>N时有an>an2|a_n|>a^2_n

  • an2\sum a^2_n收敛,不一定有an\sum a_n收敛,例子是容易想到的,例如1n2\sum\frac1{n^2}

  • an2\sum a^2_n收敛,则ann\sum\frac{a_n}n绝对收敛,因为ann12(an2+1n2)\left|\frac{a_n}n\right|\leqslant\frac12\left(a^2_n+\frac1{n^2}\right)

凡是收敛的级数,无论怎样增添删减括号,结果仍是一个收敛的级数,且新级数的收敛值等于原级数的收敛值,即使原级数仅仅是条件收敛的。

但如果要调整级数项的次序,则在级数绝对收敛的条件下才能100%100\%保证调整顺序后的级数仍是收敛的,且不改变收敛的数值。

  • n=1(anan+1) 收敛=limnan 存在\sum\limits^{\infty}_{n=1}(a_n-a_{n+1})\text{ 收敛}=\lim\limits_{n\to\infty}a_n\text{ 存在}
展开/收起1道级数收敛性例题
  • a1=2a_1=2an+1=12(an+1an)a_{n+1}=\frac12\left(a_n+\frac1{a_n}\right)nN+n\in\mathbb{N}^+),证明级数n=1(anan+11)\sum\limits^{\infty}_{n=1}\left(\frac{a_n}{a_{n+1}}-1\right)收敛;

    证:观察anan+11=anan+1an+1\frac{a_n}{a_{n+1}}-1=\frac{a_n-a_{n+1}}{a_{n+1}},等号右边式子的分子部分anan+1a_n-a_{n+1}可以联系到limnan\lim\limits_{n\to\infty}a_n,因为如果limnan\lim\limits_{n\to\infty}a_n存在,则n=1(anan+1)\sum\limits^{\infty}_{n=1}(a_n-a_{n+1})收敛。由基本不等式,有an+1=12(an+1an)1a_{n+1}=\frac12\left(a_n+\frac1{a_n}\right)\geqslant1,所以anan+1an+1anan+1\frac{a_n-a_{n+1}}{a_{n+1}}\leqslant a_n-a_{n+1}。如果an>an+1a_n>a_{n+1},则n=1anan+1an+1\sum\limits^{\infty}_{n=1}\frac{a_n-a_{n+1}}{a_{n+1}}n=1(anan+1)\sum\limits^{\infty}_{n=1}(a_n-a_{n+1})均为正项级数,根据正项级数的比较判别法,当后者收敛时前者也收敛。

    理清了思路后就可以着手证明了。先证极限limnan\lim\limits_{n\to\infty}a_n存在,an+1an=12(1anan)0a_{n+1}-a_n=\frac12\left(\frac1{a_n}-a_n\right)\leqslant0(因为上文已经由基本不等式导出了n, an+11\forall n,\ \,a_{n+1}\geqslant1),所以{an}\{a_n\}是单调递减数列,又{an}\{a_n\}有下界11,根据单调有界定理,limnan\lim\limits_{n\to\infty}a_n存在,进一步地对题干条件的方程两边同时取极限,还可以知道limnan=1\lim\limits_{n\to\infty}a_n=1,不过这里只需要推出极限存在就足够了。

    接下来证级数n=1(anan+1)\sum\limits^{\infty}_{n=1}(a_n-a_{n+1})收敛,记部分和S(k)=n=1k(anan+1)=a1ak+1S(k)=\sum\limits^k_{n=1}(a_n-a_{n+1})=a_1-a_{k+1},由于limnan\lim\limits_{n\to\infty}a_n存在,所以

    n=1(anan+1)=limkS(k)=a1limkak+1=1 \sum^{\infty}_{n=1}(a_n-a_{n+1})=\lim_{k\to\infty}S(k)=a_1-\lim_{k\to\infty}a_{k+1}=1

    从而级数n=1(anan+1)\sum\limits^{\infty}_{n=1}(a_n-a_{n+1})收敛,所以

    n=1(anan+11)n=1(anan+1)=1 \sum^{\infty}_{n=1}\left(\frac{a_n}{a_{n+1}}-1\right)\leqslant\sum^{\infty}_{n=1}(a_n-a_{n+1})=1

    因此,作为正项级数,n=1(anan+11)\sum\limits^{\infty}_{n=1}\left(\frac{a_n}{a_{n+1}}-1\right)收敛。

    这道题并不是什么难题,但其中蕴含的limnan\lim\limits_{n\to\infty}a_nn=1(anan+1)\sum\limits^{\infty}_{n=1}(a_n-a_{n+1})相联系的技巧是十分重要的。

基本重要数项级数类

下文的判断数项级数的敛散性方法,常常需要通过与一些基本的数项级数进行对比方能得以讨论。

pp级数

n=11np\sum\limits^{\infty}_{n=1}\frac{1}{n^p}p>1p>1 时收敛,在 p1p\leqslant1 时发散;当 p=1p=1 时为调和级数。

几何级数(等比级数):当a,q>0a,q>0

n=1aqn\sum\limits^{\infty}_{n=1}aq^nq<1q<1 时收敛,在 q1q\geqslant1 时发散。

级数敛散性判别法

正项级数

  • 由单调有界定理知,正项级数的部分和SnS_n有界的充要条件是级数收敛。

  • 比较原则(控制收敛),常配合放缩技巧使用:设anbna_n\leqslant b_n,则

    1. n=1bn\sum\limits^{\infty}_{n=1}b_n收敛 n=1an\ \Rightarrow\sum\limits^{\infty}_{n=1}a_n收敛;
    2. n=1an\sum\limits^{\infty}_{n=1}a_n发散 n=1bn\ \Rightarrow\sum\limits^{\infty}_{n=1}b_n发散;
  • 比较原则极限形式:设limnanbn=c\lim\limits_{n\to\infty}\frac{a_n}{b_n}=c

    • 0<c<+0\lt c<+\infty,则n=1an\sum\limits^{\infty}_{n=1}a_nn=1bn\sum\limits^{\infty}_{n=1}b_n同敛散;
    • c=0c=0,则当n=1bn\sum\limits^{\infty}_{n=1}b_n收敛时n=1an\sum\limits^{\infty}_{n=1}a_n收敛,当n=1an\sum\limits^{\infty}_{n=1}a_n发散时n=1bn\sum\limits^{\infty}_{n=1}b_n发散;
    • c=+c=+\infty,则当n=1an\sum\limits^{\infty}_{n=1}a_n收敛时n=1bn\sum\limits^{\infty}_{n=1}b_n收敛,当n=1bn\sum\limits^{\infty}_{n=1}b_n发散时n=1an\sum\limits^{\infty}_{n=1}a_n发散;
  • 比值判别法,达朗贝尔判别法:对于正项级数an\sum a_n,假设存在某正数N0N_0与正常数ρ\rho

    1. 若对一切n>N0n>N_0,成立不等式an+1anρ<1\frac{a_{n+1}}{a_n}\leqslant\rho<1,则级数an\sum a_n收敛;
    2. 若对一切n>N0n>N_0,成立不等式an+1an1\frac{a_{n+1}}{a_n}\geqslant1,则级数an\sum a_n发散。
  • 比式判别法极限形式,涉及n!n!nnn^n时极为有效:设limnan+1an=ρ\lim\limits_{n\to\infty}\frac{a_{n+1}}{a_n}=\rho,则

    n=1an {收敛,ρ<1发散,ρ>1敛散性未知,ρ=1\sum\limits^{\infty}_{n=1}a_n\ \left\{\begin{aligned}&\text{收敛},&&\rho<1\\&\text{发散},&&\rho>1\\&\text{敛散性未知},&&\rho=1\end{aligned}\right.

    • 推广:

      limnan+1an=ρ<1\varlimsup\limits_{n\to\infty}\frac{a_{n+1}}{a_n}=\rho<1,则级数收敛;

      limnan+1an=ρ>1\varliminf\limits_{n\to\infty}\frac{a_{n+1}}{a_n}=\rho>1,则级数发散。

  • 根式判别法,柯西判别法:对于正项级数an\sum a_n,假设存在某正数N0N_0与正常数ρ\rho

    1. 若对一切n>N0n>N_0,成立不等式annρ<1\sqrt[n]{a_n}\leqslant\rho<1,则级数an\sum a_n收敛;
    2. 若对一切n>N0n>N_0,成立不等式ann1\sqrt[n]{a_n}\geqslant1,则级数an\sum a_n发散。
  • 根式判别法极限形式,涉及[f(n)]n[f(n)]^n时极为有效:设limnann=ρ\lim\limits_{n\to\infty}\sqrt[n]{a_n}=\rho,则

    n=1an {收敛,ρ<1发散,ρ>1敛散性未知,ρ=1\sum\limits^{\infty}_{n=1}a_n\ \left\{\begin{aligned}&\text{收敛},&&\rho<1\\&\text{发散},&&\rho>1\\&\text{敛散性未知},&&\rho=1\end{aligned}\right.

    • 推广:

      limnann=ρ\varlimsup\limits_{n\to\infty}\sqrt[n]{a_n}=\rho,结论同上。

  • 积分判据,尤其针对pp级数的推广1nαlnβn\displaystyle{\sum\frac{1}{n^{\alpha}\ln^{\beta}n}}形级数敛散性判定极为有效:

    f(x)f(x)[1,+][1,+\infty]上单调递减的非负连续函数,则n=n0f(n)\displaystyle{\sum\limits^{\infty}_{n=n_0}f(n)}n0+f(x)dx\displaystyle{\int^{+\infty}_{n_0}f(x)\mathrm{d}x}同敛散,这是充要的。

    • 0b1xαlnβxdx  {α<1α=1β>1,收敛Otherwise,发散\displaystyle{\int^b_0\frac{1}{x^{\alpha}\ln^{\beta}x}\mathrm{d}x\ \ }\left\{\begin{aligned}&\alpha<1\text{或}\alpha=1\text{、}\beta>1,&&\text{收敛}\\&\text{Otherwise},&&\text{发散}\end{aligned}\right.
    • a+1xαlnβxdx  {α>1α=1β>1,收敛Otherwise,发散\displaystyle{\int^{+\infty}_a\frac{1}{x^{\alpha}\ln^{\beta}x}\mathrm{d}x\ \ }\left\{\begin{aligned}&\alpha>1\text{或}\alpha=1\text{、}\beta>1,&&\text{收敛}\\&\text{Otherwise},&&\text{发散}\end{aligned}\right.
    • 如果分母包含有多个项,则只要有一个项满足收敛条件,积分就收敛,事实上根据比较判别法的极限形式这点是显然的。例如,对于无穷积分1+1x2+x12dx\displaystyle{\int^{+\infty}_1\frac1{x^2+x^{\frac12}}\mathrm{d}x},虽然12<1\frac12<1,但2>12>1,所以积分收敛;同理,瑕积分011x2+x12dx\displaystyle{\int^1_0\frac1{x^2+x^{\frac12}}\mathrm{d}x}也是收敛的,进而导出0+1x2+x12dx\displaystyle{\int^{+\infty}_0\frac1{x^2+x^{\frac12}}\mathrm{d}x}也是收敛的。

    所以直接把无穷积分a+1xαlnβxdx\displaystyle{\int^{+\infty}_a\frac{1}{x^{\alpha}\ln^{\beta}x}\mathrm{d}x}的判据照搬来级数1nαlnβn\displaystyle{\sum\frac{1}{n^{\alpha}\ln^{\beta}n}}即可。

  • pp级数推广再推广:n=k1n(ln[m]n)pi=1m1lnin\displaystyle{\sum^{\infty}_{n=k}\frac1{n(\ln^{[m]}n)^p\prod\limits^{m-1}_{i=1}\ln^in}}p1p\leqslant1时发散,在p>1p>1时收敛。其中,ln[m]n:=ln(ln(ln(lnn)))\ln^{[m]}n:=\ln\big(\ln(\ln\cdots(\ln n))\big),嵌套mm次。

  • 柯西凝聚判别法:设{an}\{a_n\}是单调递减的正项数列,则正项级数n=1an\sum\limits^{\infty}_{n=1}a_n收敛的充要条件是凝聚项级数n=02na2n\sum\limits^{\infty}_{n=0}2^na_{2^n}收敛。这一方法可以解决pp-级数的收敛性问题,也可以解决1nαlnβn\sum\frac{1}{n^{\alpha}\ln^{\beta}n}收敛性问题(尽管积分判据似乎更便捷)。

  • 拉贝判别法:对于正项级数an\sum a_n,假设存在某正数N0N_0与正常数ρ\rho

    1. 若对一切n>N0n>N_0,成立不等式n(1an+1an)ρ>1n\left(1-\frac{a_{n+1}}{a_n}\right)\geqslant\rho>1,则级数an\sum a_n收敛;
    2. 若对一切n>N0n>N_0,成立不等式n(1an+1an)1n\left(1-\frac{a_{n+1}}{a_n}\right)\leqslant1,则级数an\sum a_n发散。
  • 拉贝判别法极限形式:设limnn(1an+1an)=ρ\lim\limits_{n\to\infty}n\left(1-\frac{a_{n+1}}{a_n}\right)=\rho,则

    n=1an {收敛,ρ>1发散,ρ<1敛散性未知,ρ=1\sum\limits^{\infty}_{n=1}a_n\ \left\{\begin{aligned}&\text{收敛},&&\rho>1\\&\text{发散},&&\rho<1\\&\text{敛散性未知},&&\rho=1\end{aligned}\right.

交错级数

  • 莱布尼茨判别法:对于交错级数 n=1(1)n+1an\sum\limits^{\infty}_{n=1}(-1)^{n+1}a_n(不妨令an>0a_n>0),若满足:

    1. ana_n单调递减;
    2. limnan=0\lim\limits_{n\to\infty}a_n=0

    则交错级数n=1(1)n+1an\sum\limits^{\infty}_{n=1}(-1)^{n+1}a_n收敛。

莱布尼茨判别法的条件乍一看似乎有些许过分的强了,但这些条件其实都是十分必要的。例如,根据莱布尼茨判别法不难知道级数n=1(1)nn\sum\limits^{\infty}_{n=1}\frac{(-1)^n}{\sqrt{n}}是收敛的,事实上

n=1(1)nn=(21)ζ(12)0.6048986434216 \sum^{\infty}_{n=1}\frac{(-1)^n}{\sqrt{n}}=(\sqrt{2}-1)\zeta\left(\frac12\right)\approx-0.6048986434216

与此同时,级数n=2(1)nn+(1)n\sum\limits^{\infty}_{n=2}\frac{(-1)^n}{\sqrt{n}+(-1)^n}却是一个实打实的发散级数——尽管我们真真切切只改变了分母极其微小的一部分。以下是用RR语言计算的该级数和函数的前 10,000,00010,000,000 项图像:

diverge

即使这个级数发散得很慢,和函数在第一千万项时也不过才区区16-16左右,但起码他的确是发散的。进一步地,我们可以从理论上证明该级数发散且发散的速度应当同调和级数n=11n\sum\limits^{\infty}_{n=1}\frac1n一致,因为

(1)nn+(1)n=(1)nn(1+(1)nn)1=(1)nn(1(1)nn+o(1n))=1n+(1)nn+o(1n) \begin{align} \frac{(-1)^n}{\sqrt{n}+(-1)^n}&=\frac{(-1)^n}{\sqrt{n}}\left(1+\frac{(-1)^n}{\sqrt{n}}\right)^{-1}\\ &=\frac{(-1)^n}{\sqrt{n}}\left(1-\frac{(-1)^n}{\sqrt{n}}+\mathcal{o}\Big(\frac1{\sqrt{n}}\Big)\right)\\ &=-\frac1n+\frac{(-1)^n}{\sqrt{n}}+\mathcal{o}\Big(\frac1{\sqrt{n}}\Big)\end{align}

其中,(1)nn\frac{(-1)^n}{\sqrt{n}}是收敛的成分(上文已经给出了其级数数值约为0.6-0.6),而1n-\frac1n却是典型的发散的成分,所以级数n=2(1)nn+(1)n\sum\limits^{\infty}_{n=2}\frac{(-1)^n}{\sqrt{n}+(-1)^n}发散,而且与调和级数有相同的发散速度。换句话说,级数n=2(1)nn+(1)n\sum\limits^{\infty}_{n=2}\frac{(-1)^n}{\sqrt{n}+(-1)^n}的发散是由1n-\frac1n控制与决定的。

由于调和级数的和函数近似对数函数(n=1k1n=lnk+γ+εk\sum\limits^k_{n=1}\frac{1}{n}=\ln k+\gamma+\varepsilon_k),我们也可以用对数函数来侧面印证上述的理论分析:

ln(10,000,000)16.118095650958 -\ln(10,000,000)\approx-16.118095650958

这个值的确符合我们绘制出的图像,即第一千万项的和函数值在16-16左右。

由此可见,即使只改变了很渺小的一部分,也可能导致级数发散。所以在试图运用莱布尼茨判别法判定级数收敛时,一定要确保级数满足莱布尼茨判别法所要求的所有条件。

任意项级数

  • 个人认为,最好使的办法是等价极限替代,将复杂式子替代成pp级数、几何级数等基本级数,结果就容易判别了。这其实就是比较原则的极限形式之一运用,而这种泛用方法的可行性是可以证明的,对任意项级数有效。要注意的是同数列极限、函数极限的等价极限替换一样,只能对式子整体的乘除因子替换,不可随意对加减各项替换,这一原理通过泰勒公式是容易理解的。

  • 级数收敛的柯西准则:级数an\sum a_n收敛的充要条件是ε>0\forall\varepsilon>0NN+\exists N\in\mathbb{N}^+s.t.s.t. m>N\forall m>NpN+p\in\mathbb{N}^+,都有i=1m+pam+i<ε\left|\sum\limits^{m+p}_{i=1}a_{m+i}\right|<\varepsilon

  • Weierstrass优级数判别法(控制收敛):设bn\sum b_n是收敛的正项级数,若存在NN,使得任意n>Nn>N都有an<bn|a_n|\lt b_n,则an\sum a_n绝对收敛。

  • 阿贝尔判别法:若{an}\{a_n\}为单调有界数列,且级数bn\sum b_n收敛,则级数anbn\sum a_nb_n收敛。

  • 迪利克雷判别法:若数列{an}\{a_n\}单调递减且limnan=0\lim\limits_{n\to\infty}a_n=0,又级数bn\sum b_n的部分和数列有界,则级数anbn\sum a_nb_n收敛。

绝对收敛与条件收敛

^{\ast} 如果要求判断级数绝对收敛、条件收敛还是发散,应当首先判断绝对值级数列的收敛性。尤其是运用上文中的比式极限判别法与根式极限判别法判别绝对收敛性时,结论可改写为:设limnan+1an=ρ\lim\limits_{n\to\infty}\left|\frac{a_{n+1}}{a_n}\right|=\rholimnann=ρ\lim\limits_{n\to\infty}\sqrt[n]{|a_n|}=\rho,则:

    n=1an {绝对收敛,ρ<1发散,ρ>1敛散性未知,ρ=1\ \ \ \ \sum\limits^{\infty}_{n=1}a_n\ \left\{\begin{aligned}&\text{绝对收敛},&&\rho<1\\&\text{发散},&&\rho>1\\&\text{敛散性未知},&&\rho=1\end{aligned}\right.

意即当且仅当ρ=1\rho=1时有可能条件收敛。

绝对收敛是比较强的条件,绝对收敛的级数本身必然收敛。收敛的正项级数都是绝对收敛的。

  • 绝对收敛的级数具有可交换性;
  • 柯西定理:两绝对收敛级数,所有项按两级数间两两的乘积,按任意顺序排列得到的级数也绝对收敛,且和为原本两级数收敛值的积。

第一条性质也可以被理解为:绝对收敛的级数重排仍然是收敛到原来的值的,但条件收敛级数随意重排后不能保证仍收敛(即使收敛,也不一定收敛到原来的值)。所以我认为绝对收敛是种“本质收敛”,而条件收敛仅是“恰好在当前排列下收敛”。

对于条件收敛级数,

  • 条件收敛的级数经过适当的重排,可以收敛到任何指定的数;

  • 条件收敛的级数的所有正项或负项构成的级数一定发散;

  • 条件收敛级数逐项与另一条件收敛级数相加仍然收敛,但新级数可能条件收敛,可能绝对收敛。

函数列、函数项级数(暂略)

暂略

幂级数

幂级数与泰勒公式紧密相联。

可证明,若ff在收敛域内任意阶可导,则ffx=x0x=x_0处的幂级数展开式f(x)=n=0an(xx0)nf(x)=\sum\limits^{\infty}_{n=0}a_n(x-x_0)^n唯一,且an=f(n)(x0)n!a_n=\frac{f^{(n)}(x_0)}{n!},称该级数为泰勒级数;在x0=0x_0=0处做展式的称麦克劳林级数。幂级数在收敛域内均连续。

** 处理幂级数敛散性两大法宝,一是讨论通项极限性质的极限判别法,二是柯西-阿达马定理 **

幂级数的收敛性

这里暂时先考虑最基本的幂级数n=0anxn\sum\limits^{\infty}_{n=0}a_nx^n

阿贝尔定理

  1. 若幂级数n=0anxn\sum\limits^{\infty}_{n=0}a_nx^nx=x00x=x_0\neq0处收敛,则对x  s.t. x<x0\forall x\ \ s.t.\ |x|<|x_0|幂级数绝对收敛;
  2. 若幂级数n=0anxn\sum\limits^{\infty}_{n=0}a_nx^nx=x00x=x_0\neq0处发散,则对x  s.t. x>x0\forall x\ \ s.t.\ |x|>|x_0|幂级数发散;

记幂级数n=0anxn\sum\limits^{\infty}_{n=0}a_nx^n的收敛域区间长度为2R2R,则称RR为幂级数收敛半径、(R,R)(-R,R)为收敛区间,即R=sup{x0:幂级数对x s.t. x<x0收敛}R=\sup\{x_0:\text{幂级数对}\forall x\ s.t.\ |x|<|x_0|\text{收敛}\},易见收敛区间只衡量范围不考虑端点的敛散性,而考虑端点敛散性后得到的那个“级数收敛的区间”则称为收敛域(不要搞混淆了!!!)注意,RR可以为00也至少为00;也可以为++\infty,此时幂级数在R\mathbb{R}上均绝对收敛。

阿贝尔定理可以推广到复变函数中。

幂级数在收敛区间上的任何闭区间内一致收敛,即内闭一致收敛,进而可以逐项求积、逐项求导,但端点处仍需单独处理。

在幂级数内闭一致收敛的收敛区间内,和函数必然连续;如果幂级数在收敛区间的左或右端点处收敛,则和函数也相应地在该点右或左连续。进一步地,在收敛区间内和函数的任意阶导数均存在,而且在展开处kk阶导数的值可以通过泰勒级数的形式求出。

计算收敛半径的方法

  • limnann=ρ:=1R\lim\limits_{n\to\infty}\sqrt[n]{|a_n|}=\rho:=\frac1R,当ρ=0\rho=0收敛半径R=+R=+\infty,当ρ=+\rho=+\infty收敛半径R=0R=0,其余情况(0<ρ<+0<\rho<+\infty)收敛半径R=1ρR=\frac{1}{\rho},下同,不再赘述;
  • limnan+1an=ρ:=1R\lim\limits_{n\to\infty}\frac{|a_{n+1}|}{|a_n|}=\rho:=\frac1R
  • 柯西-阿达马定理:limnann=ρ:=1R\varlimsup\limits_{n\to\infty}\sqrt[n]{|a_n|}=\rho:=\frac1R(在C\mathbb{C}上仍有效,对幂级数an(xx0)n\sum a_n(x-x_0)^n仍有效),如果缺项则对xx做换元即可得到正确的收敛半径,例如对于只有偶次幂项的幂级数,收敛半径等于1ρ\frac1{\sqrt{\rho}}
  • 放缩,其合理性由阿贝尔定理所保证;
  • 一些同处理数项级数敛散性的方法,例如比较审敛法的极限形式等,同样适用于幂级数。这些方法实际上并不能方便地计算收敛半径具体数值,但适合用来推导两个幂级数之间的敛散性关系。

注意,由于上极限总是存在的,所以柯西-阿达马定理可以被视为幂级数收敛半径RR“充要条件”,在证明一些问题时该定理大有帮助;这也说明,任何幂级数都有收敛半径RR,尽管可能为00

  1. 针对缺项幂级数,例如n=1x2nn32n\sum\limits^{\infty}_{n=1}\frac{x^{2n}}{n-3^{2n}},收敛半径仍可计算,不过这种情况下不可直接套用上述计算方法,而是用的“原始”的、针对数项级数收敛性问题的方法(将整个通项都带入计算公式,而不只是系数),即:由于limnx2nn32nn=x29\lim\limits_{n\to\infty}\sqrt[n]{\frac{x^{2n}}{|n-3^{2n}|}}=\frac{x^2}{9},由数项级数敛散性判别法知当x29<1\frac{x^2}{9}<1时级数收敛,因此x<3|x|<3,再单独判断x=±3x=\pm3的敛散性即可。

    当然这种问题也可以直接使用威力无穷的柯西-阿达马定理,如果幂级数的每一项可以写作cnxan+bc_nx^{an+b},先照常用柯西-阿达马定理计算收敛半径1R=ρ=limncnn\frac1{R'}=\rho'=\varlimsup\limits_{n\to\infty}\sqrt[n]{|c_n|},接着取R=Ra\displaystyle{R=\sqrt[a]{R'}}RR即为幂级数cnxan+b\sum c_nx^{an+b}的收敛半径。其中,bb不影响收敛半径,因为完全可以把它“提”出来,使级数变为xbcnxanx^b\sum c_nx^{an},从而只需要考虑aa

  2. 当幂级数的形式为an(xx0)n\sum a_n(x-x_0)^n,可以先计算anxn\sum a_nx^n的收敛域,再通过简单的换元得到结果。不过我喜欢“直接”一点,和上文中对缺项幂级数的处理一样,直接对幂级数包含xx的通项利用判别法求解,不用“绕弯弯”。

请注意,端点处敛散性需要单独讨论。

值得一提的是,尽管对于有明确通项的幂级数或许各类极限判别法计算收敛半径更为方便,但比较原则仍然是大有用处的,尤其是对较为抽象的递推通项幂级数(证明收敛半径不小于某数)。典型如当ana_n为斐波那契数列时(以a1a_1作为首项),证明n=1anxn1\sum\limits^{\infty}_{n=1}a_nx^{n-1}x<12|x|<\frac12内必收敛并求其和函数。事实上,只需要注意到an+1=an+an1<2an<22an1<<2n1a_{n+1}=a_n+a_{n-1}<2a_n<2^2a_{n-1}<\cdots<2^{n-1},于是n=1anxn1n=12xn1\sum\limits^{\infty}_{n=1}|a_nx^{n-1}|\leqslant\sum\limits^{\infty}_{n=1}|2x|^{n-1},由于不等号右边的级数必定于12<x<12-\frac12\lt x<\frac12内收敛,因此n=1anxn1\sum\limits^{\infty}_{n=1}a_nx^{n-1}x(12,12)x\in(-\frac12,\frac12)内绝对收敛。至于其和函数S(x)S(x),可以通过寻找S(x)S(x)自身的联系,最后解方程得到。在本例中,有

S(x)=n=1anxn1=1+x+n=3(an1+an2)xn1=1+x+x[S(x)1]+x2S(x) S(x)=\sum\limits^{\infty}_{n=1}a_nx^{n-1}=1+x+\sum\limits^{\infty}_{n=3}(a_{n-1}+a_{n-2})x^{n-1}=1+x+x[S(x)-1]+x^2S(x)

最后解得S(x)=1x2x+1S(x)=\frac{1}{-x^2-x+1}。有时这一步也可以与逐项求导与微分方程联系起来,例如当a0=1a_0=1a1=0a_1=0以及an+1=nan+an1n+1a_{n+1}=\frac{na_n+a_{n-1}}{n+1}时,欲证明幂级数n=0anxn\sum\limits^{\infty}_{n=0}a_nx^n的收敛半径不小于11并解出和函数S(x)S(x)的表达式;首先前者仿照上例放缩后通过比较原则是容易证明的,而后者需要注意到(1x)S(x)xS(x)=0(1-x)S'(x)-xS(x)=0并解出这个微分方程。

幂级数的四则运算

n=0anxn\sum\limits^{\infty}_{n=0}a_nx^n的收敛半径为RaR_an=0bnxn\sum\limits^{\infty}_{n=0}b_nx^n的收敛半径为RbR_b,记R=min{Ra,Rb}R=\min\{R_a,R_b\},则有:

  • λR,  λn=0anxn=n=0λanxn\forall\lambda\in\mathbb{R},\ \ \lambda\sum\limits^{\infty}_{n=0}a_nx^n=\sum\limits^{\infty}_{n=0}\lambda a_nx^nx<Ra|x|\lt R_a

  • n=0anxn±n=0nbnxn=n=0(an±bn)xn\sum\limits^{\infty}_{n=0}a_nx^n\pm\sum\limits^n_{n=0}b_nx^n=\sum\limits^{\infty}_{n=0}(a_n\pm b_n)x^nx<R|x|\lt R

  • (n=0anxn)(n=0bnxn)=n=0cnxn=a0b0+(a0b1+a1b0)x+(a0b2+a1b1+a2b0)x2+\left(\sum\limits^{\infty}_{n=0}a_nx^n\right)\cdot\left(\sum\limits^{\infty}_{n=0}b_nx^n\right)=\sum\limits^{\infty}_{n=0}c_nx^n=a_0b_0+(a_0b_1+a_1b_0)x+(a_0b_2+a_1b_1+a_2b_0)x^2+\cdots,即cn=k=0nakbnkc_n=\sum\limits^n_{k=0}a_kb_{n-k}x<R|x|\lt R

  • n=0anxnn=0bnxn=n=0qnxn\displaystyle{\frac{\sum\limits^{\infty}_{n=0}a_nx^n}{\sum\limits^{\infty}_{n=0}b_nx^n}}=\textstyle\sum\limits^{\infty}_{n=0}q_nx^n,系数qnq_n(n=0bnxn)(n=0qnxn)=n=0anxn\left(\sum\limits^{\infty}_{n=0}b_nx^n\right)\cdot\left(\sum\limits^{\infty}_{n=0}q_nx^n\right)=\sum\limits^{\infty}_{n=0}a_nx^n确定

注意,n=0(an±bn)xn\sum\limits^{\infty}_{n=0}(a_n\pm b_n)x^n的收敛半径是可以大于RR的,但n=0anxn±n=0nbnxn=n=0(an±bn)xn\sum\limits^{\infty}_{n=0}a_nx^n\pm\sum\limits^n_{n=0}b_nx^n=\sum\limits^{\infty}_{n=0}(a_n\pm b_n)x^n只在x<R|x|\lt R时必然成立。事实上,若RaRbR_a\neq R_b,则n=0(an±bn)xn\sum\limits^{\infty}_{n=0}(a_n\pm b_n)x^n的收敛半径为RR;若Ra=RbR_a=R_b,则只能断言n=0(an±bn)xn\sum\limits^{\infty}_{n=0}(a_n\pm b_n)x^n的收敛半径大于或等于RR

一致收敛性与逐项求导 / 求积

重要定理:若幂级数收敛半径R=0R=0,则在(R,R)(-R,R)上内闭一致收敛;若幂级数在x=Rx=R(或x=Rx=-R)上也收敛,则在[0,R][0,R](或[R,0][-R,0])上一致收敛。

在一致收敛区间上(至少在收敛域上),幂级数可进行逐项求导、逐项求积,这些操作不会改变收敛半径。

尽管逐项求导/求积不改变收敛半径,但可以证明:

  • 逐项求积会增强端点处的收敛性;
  • 逐项求导会增强端点处的发散性。

这意味着,尽管逐项求积/求导不改变收敛半径,但可能改变端点处敛散性,典型如11+x2\frac{1}{1+x^2}的幂级数在x=±1x=\pm1处发散,而他的一个不定积分arctanx\arctan x却在x=±1x=\pm1处均收敛。该现象可以被进一步具体解释为:

  1. 若幂级数在一端点处收敛,则逐项求积仍收敛;若幂级数在一端点处发散,则逐项求积后可能收敛
  2. 同理,若幂级数在一端点处发散,则逐项求导仍发散;若幂级数在一端点处收敛,则逐项求导后可能发散

这是否与对级数加括号会增强其收敛性的结论,有点相同呢?

泰勒级数与幂级数和函数

由于在 高等数学工具 PartⅠ 中为了提供更完整的处理函数极限的工具,已经给出了所有常见函数的泰勒公式,事实上也一并给出了他们的泰勒级数及收敛域(麦克劳林级数),这里就不再重复了,只作引用。

常用泰勒公式

泰勒公式的一般形式是:若f(x)f(x)在点aa处存在直到nn阶的导数,则f(x)=k=0nf(k)(a)k!(xa)k+o((xa)n)\displaystyle{f(x)=\sum^n_{k=0}\frac{f^{(k)}(a)}{k!}(x-a)^k}+\mathcal{o}\left((x-a)^n\right),这里取皮亚诺余项,如果取拉格朗日余项则条件需要加强至f(x)f(x)在含点aa的某个开区间内存在直到n+1n+1阶的导数。

1. sinx=n=0(1)n(2n+1)!x2n+1=xx33!+x55!x77!+    for  xR\text{1. }\displaystyle{\sin x=\sum\limits^{\infty}_{n=0}\frac{(-1)^n}{(2n+1)!}x^{2n+1}=x-\frac{x^3}{3!}+\frac{x^5}{5!}-\frac{x^7}{7!}+\cdots\ \ \ \ for\ \ x\in\mathbb{R}}

2. cosx=n=0(1)n(2n)!x2n=1x22!+x44!x66!+    for  xR\text{2. }\displaystyle{\cos x=\sum\limits^{\infty}_{n=0}\frac{(-1)^n}{(2n)!}x^{2n}=1-\frac{x^2}{2!}+\frac{x^4}{4!}-\frac{x^6}{6!}+\cdots\ \ \ \ for\ \ x\in\mathbb{R}}

3. tanx=x+x33+2x515+17x7315+62x92835+    for  xπ2+kπ\text{3. }\displaystyle{\tan x=x+\frac{x^3}{3}+\frac{2x^5}{15}+\frac{17x^7}{315}+\frac{62x^9}{2835}+\cdots\ \ \ \ for\ \ x\neq\frac{\pi}{2}+k\pi}

4. arcsinx=n=0k=1n(112k)x2n+12n+1=x+n=1(2n1)!!(2n)!!(2n+1)x2n+1=x+x36+3x540+5x7112+35x91152+    for  x<1 \begin{align*} \text{4. }\arcsin x&=\sum\limits^{\infty}_{n=0}\prod\limits^{n}_{k=1}\Big(1-\frac{1}{2k}\Big)\frac{x^{2n+1}}{2n+1}\\&=x+\sum^{\infty}_{n=1}\frac{(2n-1)!!}{(2n)!!(2n+1)}x^{2n+1}\\&=x+\frac{x^3}{6}+\frac{3x^5}{40}+\frac{5x^7}{112}+\frac{35x^9}{1152}+\cdots\ \ \ \ for\ \ \vert x\vert<1 \end{align*}

  计算arcsinx\arcsin x的泰勒公式可以考虑对其导数(1x2)12(1-x^2)^{-\frac12}展开;

  由此可以得到 {(arcsinx)(2n)x=0=0,nN(arcsinx)x=0=1(arcsinx)(2n+1)x=0=[(2n1)!!]2,nN+\ \left\{\begin{aligned}&(\arcsin x)^{(2n)}\big|_{x=0}=0,&&n\in\mathbb{N}\\&(\arcsin x)'\big|_{x=0}=1\\&(\arcsin x)^{(2n+1)}\big|_{x=0}=[(2n-1)!!]^2,&&n\in\mathbb{N}^+\end{aligned}\right.

5. \text{5. }注意到arcsinx+arccosx=π2\displaystyle{\arcsin x+\arccos x=\frac{\pi}{2}},故arccosx=π2xx363x5405x7112    x1\displaystyle{\arccos x=\frac{\pi}{2}-x-\frac{x^3}{6}-\frac{3x^5}{40}-\frac{5x^7}{112}-\cdots\ \ \ \ \vert x\vert\leqslant1}

6. arctanx=n=0(1)nx2n+12n+1=xx33+x55x77+    for  x1\text{6. }\displaystyle{\arctan x=\sum\limits^{\infty}_{n=0}\frac{(-1)^nx^{2n+1}}{2n+1}=x-\frac{x^3}{3}+\frac{x^5}{5}-\frac{x^7}{7}+\cdots\ \ \ \ for\ \ \vert x\vert\leqslant1}

7. ex=n=0xnn!=1+x+x22!+x33!+x44!+    for  xR\text{7. }\displaystyle{e^x=\sum\limits^{\infty}_{n=0}\frac{x^n}{n!}=1+x+\frac{x^2}{2!}+\frac{x^3}{3!}+\frac{x^4}{4!}+\cdots\ \ \ \ for\ \ x\in\mathbb{R}}

8. \text{8. }推论:ax=exlna=n=0(xlna)nn!=1+xlna+x2ln2a2!+x3ln3a3!+    for  xR\displaystyle{a^x=e^{x\ln a}=\sum\limits^{\infty}_{n=0}\frac{(x\ln a)^n}{n!}=1+x\ln a+\frac{x^2\ln^2a}{2!}+\frac{x^3\ln^3a}{3!}+\cdots\ \ \ \ for\ \ x\in\mathbb{R}}

9. ln(1+x)=n=1(1)n+1xnn=xx22+x33x44+    for  x(1,1]\text{9. }\displaystyle{\ln(1+x)=\sum\limits^{\infty}_{n=1}(-1)^{n+1}\frac{x^n}{n}=x-\frac{x^2}{2}+\frac{x^3}{3}-\frac{x^4}{4}+\cdots\ \ \ \ for\ \ x\in(-1,1]}

  特别地,ln(1x)=n=1xnn    for  x[1,1)\displaystyle{-\ln(1-x)=\sum\limits^{\infty}_{n=1}\frac{x^n}{n}\ \ \ \ for\ \ x\in[-1,1)},注意对数前的负号;

  注意利用好 ln=ln\ln\prod=\sum\ln 的性质,例如ln1x1+x=ln[1+(1x1+x1)]\ln\frac{1-x}{1+x}=\ln\left[1+\left(\frac{1-x}{1+x}-1\right)\right]不便直接展开,

  但ln1x1+x=ln(1x)ln(1+x)\ln\frac{1-x}{1+x}=\ln(1-x)-\ln(1+x)的泰勒公式2k=1nx2k12k1+O(x2k+1)-2\sum\limits^n_{k=1}\frac{x^{2k-1}}{2k-1}+\mathcal{O}(x^{2k+1})却十分简洁

10. \text{10. }推论:在(1,1](-1,1]内利用换底公式loga(1+x)=ln(1+x)lna=1lnan=1(1)n+1xnn\log_a(1+x)=\frac{\ln(1+x)}{\ln a}=\frac{1}{\ln a}\sum\limits^{\infty}_{n=1}(-1)^{n+1}\frac{x^n}{n},即

loga(1+x)=xlnax22ln2a+x33ln3ax44ln4a+    for  x(1,1] \log_a(1+x)=\frac{x}{\ln a}-\frac{x^2}{2\ln^2a}+\frac{x^3}{3\ln^3a}-\frac{x^4}{4\ln^4a}+\cdots\ \ \ \ for\ \ x\in(-1,1]

  再利用上式,有ax=exlna=n=0(xlna)nn!=1+xlna+(xlna)22!+    for  xR\displaystyle{a^x=e^{x\ln a}=\sum\limits^{\infty}_{n=0}\frac{(x\ln a)^n}{n!}=1+x\ln a+\frac{(x\ln a)^2}{2!}+\cdots\ \ \ \ for\ \ x\in\mathbb{R}}

11. (1+x)α=n=0α(α1)(αn+1)n!xn=1+αx+α(α1)2!x2+α(α1)(α2)3!x3+    when{α1, x<11<α<0, x(1,1]α>0, x1    tip: 二项式定理的推广 \begin{align*}\text{11. }(1+x)^{\alpha}&=\sum\limits^{\infty}_{n=0}\frac{\alpha(\alpha-1)\cdots(\alpha-n+1)}{n!}x^n\\&=1+\alpha x+\frac{\alpha(\alpha-1)}{2!}x^2+\frac{\alpha(\alpha-1)(\alpha-2)}{3!}x^3+\cdots\ \ \ \ \\&when\left\{\begin{aligned}&\alpha\leqslant-1,\ \vert x\vert<1\\&-1<\alpha<0,\ x\in(-1,1]\\&\alpha>0,\ \vert x\vert\leqslant1\end{aligned}\right.\ \ \ \ \text{tip: 二项式定理的推广}\end{align*}

  注意(1+x)1x(1+x)^{\frac1x}直接用(1+x)α(1+x)^{\alpha}的泰勒公式是解不出来的,虽然形式相近;

  正确做法应该是先处理幂指函数,再利用exe^x的泰勒公式:

(1+x)1x=e1xln(1+x)=e1x(xx22+x33x44+o(x4))=e1x2+x23x34+o(x3)=eex2+x23x34+o(x3)=e[1+(x2+x23x34)+12!(x2+x23x34)2+13!(x2+x23x34)3+o(x3)]=ee2x+11e24x2716x3+o(x3) \begin{align} (1+x)^{\frac1x}&=e^{\frac1x\ln(1+x)}=e^{\frac1x\big(x-\frac{x^2}2+\frac{x^3}{3}-\frac{x^4}{4}+\mathcal{o}(x^4)\big)}\\ &=e^{1-\frac x2+\frac{x^2}3-\frac{x^3}4+\mathcal{o}(x^3)}=e\cdot e^{-\frac x2+\frac{x^2}3-\frac{x^3}4+\mathcal{o}(x^3)}\\ &=e\scriptstyle{\left[1+\left(-\frac x2+\frac{x^2}3-\frac{x^3}4\right)+\frac1{2!}\left(-\frac x2+\frac{x^2}3-\frac{x^3}4\right)^2+\frac{1}{3!}\left(-\frac x2+\frac{x^2}3-\frac{x^3}4\right)^3+\mathcal{o}(x^3)\right]}\\ &=e-\frac e2x+\frac{11e}{24}x^2-\frac{7}{16}x^3+\mathcal{o}(x^3) \end{align}

12. \text{12. }推论 1:11x=n=0xn=1+x+x2+x3+    for  x<1\displaystyle{\frac{1}{1-x}=\sum\limits^{\infty}_{n=0}x^n=1+x+x^2+x^3+\cdots\ \ \ \ for\ \ \vert x\vert<1}

13. \text{13. }推论 2:11+x=n=0(x)n=1x+x2x3+    for  x<1\displaystyle{\frac{1}{1+x}=\sum\limits^{\infty}_{n=0}(-x)^n=1-x+x^2-x^3+\cdots\ \ \ \ for\ \ \vert x\vert<1}

14. cscx=1x+16x+7360x3+3115120x5+127604800x7+    for  x(0,π)\text{14. }\displaystyle{\csc x=\frac{1}{x}+\frac{1}{6}x+\frac{7}{360}x^3+\frac{31}{15120}x^5+\frac{127}{604800}x^7+\cdots\ \ \ \ for\ \ x\in(0,\pi)}

15. secx=1+12x2+524x4+61720x6+    for  x<π2\text{15. }\displaystyle{\sec x=1+\frac{1}{2}x^2+\frac{5}{24}x^4+\frac{61}{720}x^6+\cdots\ \ \ \ for\ \ \vert x\vert<\frac{\pi}{2}}

  secx\sec x的泰勒公式求法至少有以下两种方法,其他函数如tanx\tan x依此类推:

  • 直接计算在00处各阶导数的值,注意到secx=1cosx\sec x=\frac1{\cos x}偶函数,因此奇数阶泰勒多项式系数值为 00,故只需计算偶数阶导数值。有sec0=0\sec0=0secx=tanxsecx\sec'x=\tan x\sec xsec0=tan20sec0+sec30=1\sec''0=\tan^20\sec0+\sec^30=1secx=tanxsecx(tan2x+5sec5x)\sec'''x=\tan x\sec x(\tan^2x+5\sec^5x)sec(4)0=(secx)x=0=sec0(tan40+5sec40+18tan20sec20)=5\sec^{(4)}0=(\sec'''x)'|_{x=0}=\sec0(\tan^40+5\sec^40+18\tan^20\sec^20)=5,所以:

    secx=sec0+sec02!x2+sec(4)4!x4+o(x4)=1+12x2+524x4+o(x4) \begin{align} \sec x&=\sec0+\frac{\sec''0}{2!}x^2+\frac{\sec^{(4)}}{4!}x^4+\mathcal{o}(x^4)\\ &=1+\frac12x^2+\frac5{24}x^4+\mathcal{o}(x^4) \end{align}
  • 利用cosx\cos x的泰勒公式,有

    secx=1cosx=1112!x2+14!x4+O(x5)=sec0+ax+bx2+cx3+dx4+O(x5) \sec x=\frac1{\cos x}=\frac1{1-\frac1{2!}x^2+\frac1{4!}x^4+\mathcal{O}(x^5)}=\sec0+ax+bx^2+cx^3+dx^4+\mathcal{O}(x^5)

    也就是说

    (sec0+ax+bx2+cx3+dx4)(112!x2+14!x4)=1+o(x4) (\sec0+ax+bx^2+cx^3+dx^4)\left(1-\frac1{2!}x^2+\frac1{4!}x^4\right)=1+\mathcal{o}(x^4)

    对比系数,考察xx项系数有a=0a=0,考察x2x^2项系数有b12=0b-\frac12=0,考察x3x^3项系数有c12a=0c-\frac12a=0,考察x4x^4项系数有d12b+14!=0d-\frac12b+\frac1{4!}=0,综上所述有a=c=0a=c=0b=12b=\frac12d=524d=\frac5{24},所以

    secx=1+12x2+524x4+o(x4) \sec x=1+\frac12x^2+\frac5{24}x^4+\mathcal{o}(x^4)

16. cotx=1xx3145x32945x5    for  x(0,π)\text{16. }\displaystyle{\cot x=\frac{1}{x}-\frac{x}{3}-\frac{1}{45}x^3-\frac{2}{945}x^5-\cdots\ \ \ \ for\ \ x\in(0,\pi)}

利用好奇函数的泰勒级数只有奇数幂、偶函数的泰勒级数只有偶数幂的结论,做选择题确认无穷小阶时往往能事半功倍!

44个函数的泰勒级数展开式

我们来更自然地推导泰勒公式!

arctanx\arctan x的泰勒级数有一个很有趣的推导,由于较容易想到和人尽皆知,为不影响观感为此列在最后:

for  x<1, arctanx=0xdt1+t2=0xn=0(t2)ndt=n=0(1)n0xt2ndt=n=0(1)nx2n+12n+1 \begin{align} for\ \ \vert x\vert<1,\ \arctan x&=\int^x_0\frac{\mathrm{d}t}{1+t^2}\\ &=\int^x_0\sum^{\infty}_{n=0}(-t^2)^n\mathrm{d}t\\ &=\sum^{\infty}_{n=0}(-1)^n\int^x_0t^{2n}\mathrm{d}t\\ &=\sum\limits^{\infty}_{n=0}\frac{(-1)^nx^{2n+1}}{2n+1} \end{align}

积分号与累和号次序交换的可行性由逐项可积定理保证:{(1)nx2n+12n+1}n=0\big\{\frac{(-1)^nx^{2n+1}}{2n+1}\big\}^{\infty}_{n=0}处处可微,因此在复数域内均解析,所以在收敛半径内均一致收敛,故而可以逐项积分;此外,可测集上的非负可测函数列也是逐项可积的,但在这里并不适用。

一些常用的幂级数补充:

  • 1. 1(1x)2=n=0(n+1)xn    for  x<1\text{1. }\displaystyle{\frac1{(1-x)^2}=\sum^{\infty}_{n=0}(n+1)x^n\ \ \ \ for\ \ |x|<1}
  • 2. 2(1x)3=n=0(n+2)(n+1)xn    for  x<1\text{2. }\displaystyle{\frac2{(1-x)^3}=\sum^{\infty}_{n=0}(n+2)(n+1)x^n\ \ \ \ for\ \ |x|<1}
  • 3. exex2=n=0x2n+1(2n+1)!    for  xR\text{3. }\displaystyle{\frac{e^x-e^{-x}}2=\sum^{\infty}_{n=0}\frac{x^{2n+1}}{(2n+1)!}\ \ \ \ for\ \ x\in\mathbb{R}}
  • 4. ex+ex2=n=0x2n(2n)!    for  xR\text{4. }\displaystyle{\frac{e^x+e^{-x}}2=\sum^{\infty}_{n=0}\frac{x^{2n}}{(2n)!}\ \ \ \ for\ \ x\in\mathbb{R}}
  • 5. 12ln1+x1x=n=0x2n+12n+1    for  x<1\text{5. }\displaystyle{\frac12\ln\frac{1+x}{1-x}=\sum^{\infty}_{n=0}\frac{x^{2n+1}}{2n+1}\ \ \ \ for\ \ |x|<1}

通常而言,求幂级数的和函数有两种常用的方法:

  • 利用逐项求积 / 求导与泰勒公式 / 麦克劳林级数,通过分析,或者说“凑”,还原出和函数;
  • 利用逐项求积 / 求导,通过寻找一个关于和函数的微分方程,解出微分方程以求得和函数。

对于一些形式稍稍复杂的幂级数,求其和函数往往需要在一定条件下灵活运用逐项求导定理和逐项积分定理,这个过程可能还涉及微分方程问题等。

例如求级数n=1n1n!xn\sum\limits^{\infty}_{n=1}\frac{n-1}{n!}x^n的和函数S(x)S(x),我们可以分别用以上两种方法来处理。

  1. 注意到我们逐项求导后可以消掉每一项分子中的n1n-1,即S(x)=n=21(n2)!xn1S'(x)=\sum\limits^{\infty}_{n=2}\frac1{(n-2)!}x^{n-1},所以

    S(x)=xn=01n!xn=xex S'(x)=x\sum^{\infty}_{n=0}\frac1{n!}x^{n}=xe^x

    从而

    S(x)=S(x)dx=ex(x1)+C1 S(x)=\int S'(x)\mathrm{d}x=e^x(x-1)+C_1

    S(0)=0S(0)=0确认不定系数C1=1C_1=1,所以S(x)=xexex+1S(x)=xe^x-e^x+1,收敛域为R\mathbb{R}。如果在还原的过程中经历了多次逐项求积 / 求导,得到的式子中含有多个不定系数,这时仅由S(0)S(0)便无法确定所有的不定系数,还需要S(0)S'(0)S(0)S''(0)等值来共同确认多个不定系数。

  2. 注意到,

    S(x)S(x)=n=21(n2)!xn1n=2n1(n2)!xn2=n=1xnn!=ex S'(x)-S''(x)=\sum^{\infty}_{n=2}\frac1{(n-2)!}x^{n-1}-\sum^{\infty}_{n=2}\frac{n-1}{(n-2)!}x^{n-2}=-\sum^{\infty}_{n=1}\frac{x^n}{n!}=-e^x

    这是一个非齐次二阶线性微分方程,可以解得S(x)=xexex+1S(x)=xe^x-e^x+1

不少数项级数值的计算需要借助幂级数的和函数,例如交错级数n=1(1)nn\displaystyle{\sum^{\infty}_{n=1}\frac{(-1)^n}{n}},虽然由莱布尼茨判别法容易知道该级数条件收敛,但莱布尼茨判别法并没有说这个数项级数的值到底是多少,这时就需要通过观察“变”出xx项来,将数项级数转写为幂级数。在这个例子中,注意符号是交错的且系数绝对值为1n\frac1n,立刻联想到ln(1+x)=n=1(1)n+1xnn, x(1,1]\displaystyle{\ln(1+x)=\sum\limits^{\infty}_{n=1}(-1)^{n+1}\frac{x^n}{n}},\ x\in(-1,1],经分析,n=1(1)nn\displaystyle{\sum^{\infty}_{n=1}\frac{(-1)^n}{n}}可以视为ln(1+x)-\ln(1+x)的麦克劳林级数取值x=1x=1时的情况(nN+, 1n=1\forall n\in\mathbb{N}^+,\ 1^n=1),从而n=1(1)nn=ln(1+x)x=1=ln2\displaystyle{\sum^{\infty}_{n=1}\frac{(-1)^n}{n}=-\ln(1+x)\big|_{x=1}=-\ln2}

利用幂级数求高阶微分

f(x)f(x)的幂级数展式的收敛区域内,f(x)f(x)的任意阶导数均存在,换句话说f(x)f(x)在这一区域内是解析的。注意讨论的是收敛区域而非收敛域,即收敛域的所有内点。

因此,在收敛域内函数均无穷可导。借助此,可以方便地通过幂级数求函数的高阶微分。

例如对于函数f(x)=sinxxf(x)=\frac{\sin x}{x}补充定义f(0)=1f(0)=1,求f(n)(0)f^{(n)}(0);首先容易知道f(x)f(x)在补充定义后在R\mathbb{R}上连续,于是有:

sinxx=n=0(1)n(2n+1)!x2n=1x23!+x45!x67!+ \begin{align} \frac{\sin x}x=\sum\limits^{\infty}_{n=0}\frac{(-1)^n}{(2n+1)!}x^{2n}=1-\frac{x^2}{3!}+\frac{x^4}{5!}-\frac{x^6}{7!}+\cdots\end{align}

该级数在x=0x=0处收敛到f(0)=1f(0)=1,因此该级数在R\mathbb{R}上收敛至f(x)f(x),所以f(x)f(x)R\mathbb{R}上任意阶导数存在。将级数等价转写为n=0an\sum\limits^{\infty}_{n=0}a_n,其中在nn为奇数时an=0a_n=0nn为偶数时an=(1)n2(n+1)!xna_n=\frac{(-1)^\frac n2(n+1)!}{x^n},所以

f(n)(0)=xnn!an={0,n为正奇数(1)n2n,n为非负偶数 f^{(n)}(0)=\frac{x^n}{n!}a_n=\left\{\begin{aligned}&0,&&\text{当}n\text{为正奇数}\\&(-1)^{\frac n2}n,&&\text{当}n\text{为非负偶数}\end{aligned}\right.

这和复变函数中的解析函数的性质非常相似,读者不妨思考思考他们的内在联系。

和函数问题与展开式问题

由于可行的处理方法较多、技巧的运用较灵活,导致这类问题中的一些常用技巧和方法难以用文字的形式总结,所以这里选取了一些比较有代表性的题目作为范例,读者可以从作者给出的解析中了解到作者处理这类问题的主要思想和方法。


展开/收起3道幂级数的和函数问题在前文已经给出了和函数问题的通法:

通常而言,求幂级数的和函数有两种常用的方法:

  • 利用逐项求积 / 求导与泰勒公式 / 麦克劳林级数,通过分析,或者说“凑”,还原出和函数;
  • 利用逐项求积 / 求导,通过寻找一个关于和函数的微分方程,解出微分方程以求得和函数。

前文中也给出了用这两种方法分别解决问题的简单例子,这里就主要聚焦于针对特殊级数的细节处理。

  • 求幂级数n=1n[2+(1)n]nnxn\sum\limits^n_{n=1}\frac{[2+(-1)^n]^n}nx^n的和函数S(x)S(x)

    首先计算收敛域,这个级数的形式似乎不那么好计算收敛半径——如果不用柯西-阿达马定理的话。虽然由柯西-阿达马定理能直接计算得收敛半径为1limn[2+(1)n]nnn=13\frac1{\varlimsup\limits_{n\to\infty}\sqrt[n]{\left|\frac{[2+(-1)^n]^n}n\right|}}=\frac13,但这里可以不使用柯西-阿达马定理。

    容易观察到,n=1n[2+(1)n]nnxn\sum\limits^n_{n=1}\frac{[2+(-1)^n]^n}nx^n的奇数项和偶数项分别的形式其实是比较简单的,只不过合在一起后才变得不那么直观,所以做分解:

    n=1n[2+(1)n]nnxn=n=0x2n+12n+1+n=132n2nx2n \sum^n_{n=1}\frac{[2+(-1)^n]^n}nx^n=\sum^{\infty}_{n=0}\frac{x^{2n+1}}{2n+1}+\sum^{\infty}_{n=1}\frac{3^{2n}}{2n}x^{2n}

    不难计算,奇数项n=0x2n+12n+1\sum\limits^{\infty}_{n=0}\frac{x^{2n+1}}{2n+1}的收敛域为(1,1)(-1,1),偶数项n=132n2nx2n\sum\limits^{\infty}_{n=1}\frac{3^{2n}}{2n}x^{2n}的收敛半径为(13,13)\left(-\frac13,\frac13\right),所以整个级数n=1n[2+(1)n]nnxn\sum\limits^n_{n=1}\frac{[2+(-1)^n]^n}nx^n的收敛域应该为(13,13)\left(-\frac13,\frac13\right);确认了收敛域剩下的工作就很简单了,逐项求导得S(x)=n=0x2n+n=132nx2n1=11x2+9x19x2S'(x)=\sum\limits^{\infty}_{n=0}x^{2n}+\sum\limits^{\infty}_{n=1}3^{2n}x^{2n-1}=\frac1{1-x^2}+\frac{9x}{1-9x^2},所以S(x)=ln1+x(1x)(19x2)S(x)=\ln\sqrt{\left|\frac{1+x}{(1-x)(1-9x^2)}\right|}x(13,13)x\in\left(-\frac13,\frac13\right)

  • 求幂级数n=0(1)n+1(4n2+2)(2n1)(2n+1)x2n+1\sum\limits^{\infty}_{n=0}\frac{(-1)^{n+1}(4n^2+2)}{(2n-1)(2n+1)}x^{2n+1}的和函数S(x)S(x)

    解:先求收敛域,

    limn(1)n(4(n+1)2+2)(2n+1)(2n+3)(1)n+1(4n2+2)(2n1)(2n+1)=1 \lim_{n\to\infty}\frac{\frac{(-1)^{n}\big(4(n+1)^2+2\big)}{(2n+1)(2n+3)}}{\frac{(-1)^{n+1}(4n^2+2)}{(2n-1)(2n+1)}}=1

    所以收敛半径为11=1\sqrt{\frac11}=1,又x=±1x=\pm1limn±(1)n(4n2+2)(2n1)(2n+1)\lim\limits_{n\to\infty}\pm\frac{(-1)^n(4n^2+2)}{(2n-1)(2n+1)}不存在(或limn(4n2+2)(2n1)(2n+1)=10\lim\limits_{n\to\infty}\left|\frac{(4n^2+2)}{(2n-1)(2n+1)}\right|=1\neq0),所以级数在x=±1x=\pm1处不收敛,从而收敛域为(1,1)(-1,1)

    接下来对S(x)=n=0(1)n+1(4n2+2)(2n1)(2n+1)x2n+1S(x)=\sum\limits^{\infty}_{n=0}\frac{(-1)^{n+1}(4n^2+2)}{(2n-1)(2n+1)}x^{2n+1}做分解,这一点是不难想到的,因为他每一项系数的形式都是nn的有理分式:

    n=0(1)n+1(4n2+2)(2n1)(2n+1)x2n+1=xn=0(1)n+1x2n+3n=0(1)n+1(2n1)(2n+1)x2n+1=x1+x2+3n=0(1)n+1(2n1)(2n+1)x2n+1 \begin{align} \sum\limits^{\infty}_{n=0}\frac{(-1)^{n+1}(4n^2+2)}{(2n-1)(2n+1)}x^{2n+1}&=x\sum^{\infty}_{n=0}(-1)^{n+1}x^{2n}+3\sum\limits^{\infty}_{n=0}\frac{(-1)^{n+1}}{(2n-1)(2n+1)}x^{2n+1}\\ &=-\frac{x}{1+x^2}+3\sum\limits^{\infty}_{n=0}\frac{(-1)^{n+1}}{(2n-1)(2n+1)}x^{2n+1} \end{align}

    针对3n=0(1)n+1(2n1)(2n+1)x2n+13\sum\limits^{\infty}_{n=0}\frac{(-1)^{n+1}}{(2n-1)(2n+1)}x^{2n+1}可以通过逐项求导来处理掉系数(注:思考一下,这里是否有比逐项求导计算量更小的解法呢?):

    (3n=0(1)n+1(2n1)(2n+1)x2n+1)=3n=0(1)n+1(2n1)x2n=3+3xn=1(1)n+1(2n1)x2n1 \left(3\sum\limits^{\infty}_{n=0}\frac{(-1)^{n+1}}{(2n-1)(2n+1)}x^{2n+1}\right)'=3\sum\limits^{\infty}_{n=0}\frac{(-1)^{n+1}}{(2n-1)}x^{2n}=3+3x\sum\limits^{\infty}_{n=1}\frac{(-1)^{n+1}}{(2n-1)}x^{2n-1} (n=1(1)n+1(2n1)x2n1)=n=1(1)n+1x2n2=11+x2 \left(\sum\limits^{\infty}_{n=1}\frac{(-1)^{n+1}}{(2n-1)}x^{2n-1}\right)'=\sum^{\infty}_{n=1}(-1)^{n+1}x^{2n-2}=\frac1{1+x^2}

    所以

    3n=0(1)n+1(2n1)(2n+1)x2n+1=(3+3xn=1(1)n+1(2n1)x2n1)dx=(3+3x(11+x2)dx)dx=(3+3xarctanx)dx     分部积分即可=3x2+(3x232)arctanx \begin{align}3\sum\limits^{\infty}_{n=0}\frac{(-1)^{n+1}}{(2n-1)(2n+1)}x^{2n+1}&=\int\left(3+3x\sum\limits^{\infty}_{n=1}\frac{(-1)^{n+1}}{(2n-1)}x^{2n-1}\right)\mathrm{d}x\\&=\int\left(3+3x\int\left(\frac1{1+x^2}\right)\mathrm{d}x\right)\mathrm{d}x\\&=\int\big(3+3x\arctan x\big)\mathrm{d}x\ \ \ \ \ ^{\ast}\text{分部积分即可}\\&=\frac{3x}2+\left(\frac{3x^2-3}2\right)\arctan x\end{align}

    综上,

    n=0(1)n+1(4n2+2)(2n1)(2n+1)x2n+1=x1+x2+3n=0(1)n+1(2n1)(2n+1)x2n+1=x+3x32(1+x2)+3(1+x2)2arctanx,    x<1 \begin{align}\sum\limits^{\infty}_{n=0}\frac{(-1)^{n+1}(4n^2+2)}{(2n-1)(2n+1)}x^{2n+1}&=-\frac{x}{1+x^2}+3\sum\limits^{\infty}_{n=0}\frac{(-1)^{n+1}}{(2n-1)(2n+1)}x^{2n+1}\\&=\frac{x+3x^3}{2(1+x^2)}+\frac{3(1+x^2)}2\arctan x,\ \ \ \ \,|x|<1\end{align}
  • 求幂级数n=0x4n(4n)!\sum\limits^{\infty}_{n=0}\frac{x^{4n}}{(4n)!}的和函数S(x)S(x)

    解:首先容易确定收敛域为R\mathbb{R},因为limnx4n+4(4n+4)!x4n(4n)!=limn(4n)!(4n+4)!x4=0\lim\limits_{n\to\infty}\frac{\left|\frac{x^{4n+4}}{(4n+4)!}\right|}{\left|\frac{x^{4n}}{(4n)!}\right|}=\lim\limits_{n\to\infty}\frac{(4n)!}{(4n+4)!}x^4=0

    接着对S(x)S(x)进行多次逐项求导,有

    1. S(x)=n=1x4n1(4n1)!\displaystyle S'(x)=\sum^{\infty}_{n=1}\frac{x^{4n-1}}{(4n-1)!}
    2. S(x)=n=1x4n2(4n2)!\displaystyle S''(x)=\sum^{\infty}_{n=1}\frac{x^{4n-2}}{(4n-2)!}
    3. S(3)(x)=n=1x4n3(4n3)!\displaystyle S^{(3)}(x)=\sum^{\infty}_{n=1}\frac{x^{4n-3}}{(4n-3)!}
    4. S(4)(x)=n=1x4n4(4n4)!=S(x)\displaystyle S^{(4)}(x)=\sum^{\infty}_{n=1}\frac{x^{4n-4}}{(4n-4)!}=S(x)

    解四阶齐次线性微分方程S(4)(x)S(x)=0S^{(4)}(x)-S(x)=0,得通解

    S(x)=C1ex+C2ex+C3cosx+C4sinx S(x)=C_1e^x+C_2e^{-x}+C_3\cos x+C_4\sin x

    依次代入初值S(0)=1, S(0)=S(0)=S(3)(0)=0S(0)=1,\ S'(0)=S''(0)=S^{(3)}(0)=0,解得C1=C2=14C_1=C_2=\frac14C3=12C_3=\frac12C4=0C_4=0,所以和函数为

    S(x)=14(ex+ex)+12cosx,  xR S(x)=\frac14(e^x+e^{-x})+\frac12\cos x,\ \ x\in\mathbb{R}

展开/收起4道幂级数的展开式问题(多种方法示例)
  • f(x)=arctan1+x1xf(x)=\arctan\frac{1+x}{1-x}xx幂级数展式及收敛域;

    解:由于多数读者对反三角函数没那么熟悉,因此若对这个问题如果没有经验,欲解出正确结果就需要很强的观察力了。注意到,

    f(x)=11+x2 f'(x)=\frac1{1+x^2}

    这说明,f(x)f(x)arctanx\arctan x(1,1)(-1,1)上仅相差一个常数,这个常数为f(0)arctan0=π4f(0)-\arctan0=\frac{\pi}4,故f(x)f(x)的幂级数展式为n=0(1)nx2n+12n+1\sum\limits^{\infty}_{n=0}\frac{(-1)^nx^{2n+1}}{2n+1};当注意该级数收敛区间不可能与arctanx\arctan x一样为[1,1][-1,1],因为x=1x=1f(x)f(x)没有定义,而x=1x=-1处的敛散性根据莱布尼茨判别法是容易知道为收敛的。

    有些时候如果函数本身难以处理,可以尝试对其求导或求积,可能他的导函数或原函数是容易处理的。

  • f(x)=1(x+2)2f(x)=\frac1{(x+2)^2}x=1x=-1处的幂级数展式及其收敛域;

    • 法一:直接考虑二项式幂的幂级数展开式;

      注意到1[(x+1)+1]2=(1+(x+1))2\frac1{[(x+1)+1]^2}=\left(1+(x+1)\right)^{-2}是一个二项式的幂的形式,因此利用麦克劳林级数(1+x)α=n=0α(α1)(αn+1)n!xn(1+x)^{\alpha}=\sum\limits^{\infty}_{n=0}\frac{\alpha(\alpha-1)\cdots(\alpha-n+1)}{n!}x^n,有

      (1+(x+1))2=n=02(21)(2n+1)n!(x+1)n=12(x+1)+2(21)2!(x+1)2+2(21)(22)3!(x+1)3+=n=0(1)n(n+1)(x+1)n \begin{align}\left(1+(x+1)\right)^{-2}&=\sum\limits^{\infty}_{n=0}\frac{-2(-2-1)\cdots(-2-n+1)}{n!}(x+1)^n\\&=1-2(x+1)+\frac{-2(-2-1)}{2!}(x+1)^2+\frac{-2(-2-1)(-2-2)}{3!}(x+1)^3+\cdots\\&=\sum^{\infty}_{n=0}(-1)^n(n+1)(x+1)^n\end{align}

      由于幂21-2\leqslant-1,因此收敛域为x+1<1|x+1|<1,即x(2,0)x\in(-2,0)

    • 法二:利用逐项求导 / 积分定理;

      注意到f(x)=(1x+2)=(11+(x+1))f(x)=\left(\frac{1}{x+2}\right)'=\left(\frac{1}{1+(x+1)}\right)',因此

      (11+(x+1))=(n=1(1)n+1(x+1)n)=n=1(1)n+1n(x+1)n1 \begin{align}\left(\frac{1}{1+(x+1)}\right)'&=\left(\sum^{\infty}_{n=1}(-1)^{n+1}(x+1)^n\right)'\\&=\sum^{\infty}_{n=1}(-1)^{n+1}n(x+1)^{n-1}\end{align}

      由于1x+2\frac1{x+2}的收敛域为x+1<1|x+1|<1,而求导只会加强端点处的发散性,因此f(x)f(x)幂级数展开式收敛域与之相同,亦为2<x<0-2\lt x<0;代入x=2x=-2x=0x=0也是容易验证的。综上,f(x)=n=1(1)n+1n(x+1)n1f(x)=\sum\limits^{\infty}_{n=1}(-1)^{n+1}n(x+1)^{n-1}x(2,0)x\in(-2,0)

  • f(x)=ln(1x)1+xf(x)=-\frac{\ln(1-x)}{1+x}x=0x=0处的幂级数展开式及其收敛域;

    • 法一:利用泰勒级数的定义与莱布尼茨公式计算高阶导数;

      按泰勒级数的定义,有f(x)=n=0f(n)(x0)n!(xa)nf(x)=\sum\limits^{\infty}_{n=0}\frac{f^{(n)}(x_0)}{n!}(x-a)^n,所以我们只要能计算出f(k)(0)f^{(k)}(0)就好了。易见有

      1. [ln(1x)]=11x[-\ln(1-x)]'=\frac1{1-x}
      2. (11x)(m)=m!\left(\frac1{1-x}\right)^{(m)}=m!
      3. (11+x)(m)=(1)mm!\left(\frac1{1+x}\right)^{(m)}=(-1)^mm!

      于是,按莱布尼茨公式有

      f(n)(0)=k=0n[ln(1x)](k)(11+x)(nk)x=0=k=1n(nk)×(k1)!×(1)nk(nk)!=k=1n(1)nkn!k \begin{align}f^{(n)}(0)&=\left.\sum^n_{k=0}\big[-\ln(1-x)\big]^{(k)}\left(\frac1{1+x}\right)^{(n-k)}\right|_{x=0}\\&=\sum^n_{k=1}\binom{n}{k}\times(k-1)!\times(-1)^{n-k}(n-k)!\\&=\sum^n_{k=1}(-1)^{n-k}\frac{n!}k\end{align}

      所以

      f(x)=n=0k=1n(1)nkn!kn!(xa)n=n=0k=1n(1)nkkxn f(x)=\sum\limits^{\infty}_{n=0}\frac{\sum\limits^n_{k=1}(-1)^{n-k}\frac{n!}k}{n!}(x-a)^n=\sum^{\infty}_{n=0}\sum^n_{k=1}\frac{(-1)^{n-k}}kx^n

      k=1n(1)nkkk=1n(1)kkln2   (n)\sum\limits^n_{k=1}\frac{(-1)^{n-k}}k\leqslant\left|\sum\limits^n_{k=1}\frac{(-1)^{k}}k\right|\to\ln2\ \ \ (n\to\infty),从而limnk=1n(1)nkkn=1\lim\limits_{n\to\infty}\sqrt[n]{\left|\sum\limits^n_{k=1}\frac{(-1)^{n-k}}k\right|}=1,故n=0k=1n(1)nkkxn\sum\limits^{\infty}_{n=0}\sum\limits^n_{k=1}\frac{(-1)^{n-k}}kx^n的收敛半径为11;当x=±1x=\pm1时易见不收敛,因为limnk=1n(1)nkk=ln20\lim\limits_{n\to\infty}\left|\sum\limits^n_{k=1}\frac{(-1)^{n-k}}k\right|=\ln2\neq0。综上所述,f(x)=ln(1x)1+xf(x)=-\frac{\ln(1-x)}{1+x}x=0x=0处的幂级数展开式为n=0k=1n(1)nkkxn\sum\limits^{\infty}_{n=0}\sum\limits^n_{k=1}\frac{(-1)^{n-k}}kx^n,收敛域为x<1|x|<1

    • 法二:直接展为两个级数的乘积;

      由于f(x)=ln(1x)1+x=ln(1+x)×11+xf(x)=-\frac{\ln(1-x)}{1+x}=-\ln(1+x)\times\frac1{1+x},而我们知道:

      1. ln(1x)=n=1xnn    for  x[1,1)-\ln(1-x)=\sum\limits^{\infty}_{n=1}\frac{x^n}n\ \ \ \ for\ \ x\in[-1,1)
      2. 11+x=n=0(x)n    for  x<1\frac{1}{1+x}=\sum\limits^{\infty}_{n=0}(-x)^n\ \ \ \ for\ \ \vert x\vert<1

      所以f(x)=(n=1xnn)(n=0(x)n)f(x)=\left(\sum\limits^{\infty}_{n=1}\frac{x^n}n\right)\cdot\left(\sum\limits^{\infty}_{n=0}(-x)^n\right),收敛域为x<1|x|<1。若记f(x)=n=0anxnf(x)=\sum\limits^{\infty}_{n=0}a_nx^n,可以观察到ana_n是有规律的(多项式的积),其中

      an=1n1n1+1n21n3++(1)n212+(1)n1 a_n=\frac1n-\frac1{n-1}+\frac1{n-2}-\frac1{n-3}+\cdots+(-1)^{n-2}\frac12+(-1)^{n-1}
  • 将幂级数n=0(1)n(2n+1)(2x1)n\sum\limits^{\infty}_{n=0}(-1)^n(2n+1)(2x-1)^n的和函数展为x1x-1的幂级数;

    解:这个题的常规做法是先解出和函数,再将和函数展开,但在实际处理的过程中可以适当“偷懒”,即不写出和函数的最终形式,直接用微分与积分将和函数表示为(x1)(x-1)的函数,最后再将其展为x1x-1的幂级数。

    容易计算出收敛域为(0,1)(0,1),于是

    n=0(1)n(2n+1)(2x1)n=n=0(1)n2(n+1)(2x1)nn=0(1)n(2x1)n=(n=0(1)n(2x1)n+1)11+(2x1)=(2x11+(2x1))11+(2x1)=(11211+(x1))1211+(x1)=12n=0(1)nddx(x1)n12n=0(1)n(x1)n=12(n=0(1)n+1(n+1)(x1)n+n=0(1)n(x1)n)=12n=0(1)nn(x1)n,       x(0,1) \begin{align} \sum^{\infty}_{n=0}(-1)^n(2n+1)(2x-1)^n&=\sum^{\infty}_{n=0}(-1)^n2(n+1)(2x-1)^n-\sum^{\infty}_{n=0}(-1)^n(2x-1)^n\\ &=\left(\sum^{\infty}_{n=0}(-1)^n(2x-1)^{n+1}\right)'-\frac1{1+(2x-1)}\\ &=\left(\frac{2x-1}{1+(2x-1)}\right)'-\frac1{1+(2x-1)}\\ &=\left(1-\frac12\frac1{1+(x-1)}\right)'-\frac12\frac1{1+(x-1)}\\ &=-\frac12\sum^{\infty}_{n=0}(-1)^n\frac{\mathrm{d}}{\mathrm{d}x}(x-1)^n-\frac12\sum^{\infty}_{n=0}(-1)^n(x-1)^n\\ &=-\frac12\left(\sum^{\infty}_{n=0}(-1)^{n+1}(n+1)(x-1)^n+\sum^{\infty}_{n=0}(-1)^n(x-1)^n\right)\\ &=\frac12\sum^{\infty}_{n=0}(-1)^nn(x-1)^n,\ \ \ \ \ \ \ x\in(0,1) \end{align}

最后,个人建议,在计算和函数时如非必要则尽量不要逐项积分与逐项求导(即使逐项积分与逐项求导的确是一个强大且有效的方法),除非万不得已(也应注意某些情况下逐项积分与逐项求导或微分方程反而是最简便甚至唯一可行的方法)。这是因为,来回积分与求导的计算量是很大的,而一般对幂级数进行了逐项积分后需要对和函数求导才能得到原幂级数的和函数,对幂级数进行了逐项求导后也需要对和函数积分才能得到原幂级数的和函数,这期间伴随着凑补xx的幂,会让计算变得复杂;微分方程则毋需多言,也是有一定计算量的方法。

如果是笔算的话,毕竟我们是自然人而不是计算机,因此算的步骤越多,难免错的概率越大,所以如果能直接凑成已知的泰勒级数,就没必要来回求导和求积。

注:即便如此,在前文折叠起来的幂级数例题中,我所给出的解法步骤仍然大量使用了逐项求导与逐项求积的方法,这主要是于我个人而言对这种方法较为熟悉。

以一个简单的幂级数作为例子说明这一建议的缘由,譬如求n=2xnn+1\sum\limits^{\infty}_{n=2}\frac{x^n}{n+1}的和函数,如果一定要用逐项求导的方法,可以先将分子凑成n+1n+1次再求导,即n=2xnn+1=1nn=2xn+1n+1\sum\limits^{\infty}_{n=2}\frac{x^n}{n+1}=\frac1n\sum\limits^{\infty}_{n=2}\frac{x^{n+1}}{n+1},而ddx(n=2xn+1n+1)=n=2ddxxn+1n+1=n=2xn=11x1x\frac{\mathrm{d}}{\mathrm{d}x}\left(\sum\limits^{\infty}_{n=2}\frac{x^{n+1}}{n+1}\right)=\sum\limits^{\infty}_{n=2}\frac{\frac{\mathrm{d}}{\mathrm{d}x}x^{n+1}}{n+1}=\sum\limits^{\infty}_{n=2}x^n=\frac1{1-x}-1-x,因此n=2xnn+1=1x(11x1x)dx=1xln(1x)1x2+C1x\sum\limits^{\infty}_{n=2}\frac{x^n}{n+1}=\frac1x\displaystyle\int\textstyle\big(\frac1{1-x}-1-x\big)\mathrm{d}x=-\frac1x\ln(1-x)-1-\frac{x}2+C\frac1x,最后通过(n=2xnn+1)x=0=0\left.\left(\sum\limits^{\infty}_{n=2}\frac{x^n}{n+1}\right)'\right|_{x=0}=0确认C=0C=0,综上n=2xnn+1=ln(1x)x1x2\sum\limits^{\infty}_{n=2}\frac{x^n}{n+1}=-\frac{\ln(1-x)}x-1-\frac{x}2

但仔细想想,这会不会过于繁琐了呢?注意到,n=2xnn+1=1xn=3xnn=1x(ln(1x)xx22)\sum\limits^{\infty}_{n=2}\frac{x^n}{n+1}=\frac1x\sum\limits^{\infty}_{n=3}\frac{x^n}{n}=\frac1x\big(-\ln(1-x)-x-\frac{x^2}2\big)——这里只用了一步就直接解出了和函数为ln(1x)x1x2-\frac{\ln(1-x)}x-1-\frac{x}2。虽然这个例子十分浅显,但蕴含的道理是很有意义的:减少不必要的计算。只有这样,当面对复杂的幂级数时才能够尽可能减少计算时间与计算错误的可能。


上文已经给出了”尽量少使用逐项求导与逐项求积的解法“的思想,这里负责说明对具体的幂级数,如何分析才能达到少使用逐项求导与逐项求积、减少计算量以减小错误率的目的。

  • 针对R(n)xn\sum R(n)x^n型的幂级数(R(n)R(n)nn的多项式),首先给出以下三个常用幂级数,证明是平凡的:

    {11x=n=0xnfor  x<11(1x)2=n=0(n+1)xnfor  x<12(1x)3=n=0(n+2)(n+1)xnfor  x<1 \left\{\begin{aligned} &\frac{1}{1-x}=\sum\limits^{\infty}_{n=0}x^n&&for\ \ \vert x\vert<1\\ &\frac1{(1-x)^2}=\sum^{\infty}_{n=0}(n+1)x^n&&for\ \ |x|<1\\ &\frac2{(1-x)^3}=\sum^{\infty}_{n=0}(n+2)(n+1)x^n&&for\ \ |x|<1 \end{aligned}\right.

    以幂级数n=0(n+1)(n+3)xn\sum\limits^{\infty}_{n=0}(n+1)(n+3)x^n为例,由于

    (n+1)(n+3)=(n+2)(n+1)n2 + (n+1)n +0凑常数项 (n+1)(n+3)=\underbrace{(n+2)(n+1)}_{\text{凑}n^2\text{项}}\ +\ \underbrace{(n+1)}_{\text{凑}n\text{项}}\ +\underbrace{0}_{\text{凑常数项}}

    因此n=0(n+1)(n+3)xn=2(1x)3+1(1x)2\sum\limits^{\infty}_{n=0}(n+1)(n+3)x^n=\frac2{(1-x)^3}+\frac1{(1-x)^2},收敛域为x<1|x|<1

  • 针对R(n)(n+k)!xn\sum\frac{R(n)}{(n+k)!}x^n型的幂级数(即系数中含有阶乘部分的幂级数),类似处理R(n)xn\sum R(n)x^n型幂级数的思想,将系数R(n)(n+k)!\frac{R(n)}{(n+k)!}k1(n+k)!\frac{k_1}{(n+k)!}k2(n+k)(n+k)!\frac{k_2(n+k)}{(n+k)!}k3(n+k)(n+k1)(n+k)!\frac{k_3(n+k)(n+k-1)}{(n+k)!}等表示出来,也可以达到减少计算量的目的。

    以幂级数n=0(1)nn2(n+1)!xn\sum\limits^{\infty}_{n=0}\frac{(-1)^nn^2}{(n+1)!}x^n为例,由于

    n2(n+1)!=(n+1)n(n+1)!n+1(n+1)!+1(n+1)! \frac{n^2}{(n+1)!}=\frac{(n+1)n}{(n+1)!}-\frac{n+1}{(n+1)!}+\frac1{(n+1)!}

    n=0(n+1)n(n+1)!(x)n=n=11(n1)!(x)n=xn=01n!(x)n=xex \sum^{\infty}_{n=0}\frac{(n+1)n}{(n+1)!}(-x)^n=\sum^{\infty}_{n=1}\frac1{(n-1)!}(-x)^n=-x\sum^{\infty}_{n=0}\frac1{n!}(-x)^n=-xe^{-x} n=0n+1(n+1)!(x)n=n=01x!(x)n=ex \sum^{\infty}_{n=0}\frac{n+1}{(n+1)!}(-x)^n=\sum^{\infty}_{n=0}\frac1{x!}(-x)^n=e^{-x} n=01(n+1)!(x)n=1xn=11n!(x)n=1xex+1x \sum^{\infty}_{n=0}\frac1{(n+1)!}(-x)^n=-\frac1x\sum^{\infty}_{n=1}\frac1{n!}(-x)^n=-\frac1xe^{-x}+\frac1x

    因此n=0(1)nn2(n+1)!xn=ex(x11x)+1x\sum\limits^{\infty}_{n=0}\frac{(-1)^nn^2}{(n+1)!}x^n=e^{-x}(-x-1-\frac1x)+\frac1x,在x=0x=0处补充定义和函数取00,收敛域为xRx\in\mathbb{R}

  • 针对R1(n)R2(n)xn\sum\frac{R_1(n)}{R_2(n)}x^n型的幂级数,同样做分解、凑成已知的麦克劳林级数即可。除了上文已经给出的一些基本函数的麦克劳林级数,这里还需要补充一个常见幂级数12ln1+x1x=n=0x2n+12n+1\frac12\ln\frac{1+x}{1-x}=\sum\limits^{\infty}_{n=0}\frac{x^{2n+1}}{2n+1},收敛域为x<1|x|<1

部分特殊级数

等差数列 an=an1+da_n=a_{n-1}+d,有 Sn=n(a1+an)2=na1+n(n1)dS_n=\frac{n(a_1+a_n)}{2}=n\cdot a_1+n(n-1)d

↑ 有趣的是,当a1=1a_1=1d=2d=2时,在数值上恰有Sn=n2S_n=n^2

等比数列 bn=qbn1b_n=q\cdot b_{n-1},有 Sn=b1(1qn)1q=b11qb11qqnS_n=\frac{b_1(1-q^n)}{1-q}=\frac{b_1}{1-q}-\frac{b_1}{1-q}\cdot q^n

π4=n=0(1)n12n+1=113+1517+\frac{\pi}{4}=\sum\limits^{\infty}_{n=0}(-1)^{n}\frac{1}{2n+1}=1-\frac{1}{3}+\frac{1}{5}-\frac{1}{7}+\cdots

↑ 该级数又称莱布尼茨级数,可通过arctanx\arctan x的幂级数取x=1x=1直接得到

π26=ζ(2)=n=11n2=1+14+19+\frac{\pi^2}{6}=\zeta(2)=\sum\limits^{\infty}_{n=1}\frac{1}{n^2}=1+\frac{1}{4}+\frac{1}{9}+\cdots

π28=n=01(2n+1)2=1+19+125+\frac{\pi^2}{8}=\sum\limits^{\infty}_{n=0}\frac{1}{(2n+1)^2}=1+\frac{1}{9}+\frac{1}{25}+\cdots

↑ 欧拉通过对比cosx\cos x的泰勒级数系数于1735年不严谨地“证明”了上式

↑ 稍后将利用傅里叶级数严谨地证明以上级数

π490=ζ(4)=n=11n4=1+116+181+\frac{\pi^4}{90}=\zeta(4)=\sum\limits^{\infty}_{n=1}\frac{1}{n^4}=1+\frac{1}{16}+\frac{1}{81}+\cdots

调和级数n=11n=ζ(1)\sum\limits^{\infty}_{n=1}\frac{1}{n}=\zeta(1)发散,欧拉常数γ0.5772\gamma\approx0.5772\text{,}

n=1k1n=011xk1xdx=ψ(k+1)+γ=lnk+γ+εk \sum\limits^k_{n=1}\frac{1}{n}=\int^1_0\frac{1-x^k}{1-x}\mathrm{d}x=\psi(k+1)+\gamma=\ln k+\gamma+\varepsilon_k

k=1nkj\sum\limits^n_{k=1}k^j一定是一个nn次的j+1j+1次多项式,这类数列和的求法可参考:1²+2²+…+n²求和公式的推导有哪些方法?,这里有很齐全很多样的各种推导,或严谨,或有趣,或巧妙,或标准。

傅里叶级数

傅里叶级数与正交三角函数系,构成一个函数的希尔伯特空间。

傅里叶级数的收敛定理

f(x)f(x)在周期区间[l,l][-l,l]上按段光滑(在[l,l][-l,l]ff至多有限个第一类间断点、ff'至多有限点外连续),则ff的傅里叶级数在x[l,l]\forall x\in[-l,l]上均收敛于ffxx处左右极限的算术平均值。

傅里叶级数系数计算:

f(x)a02+n=1(ancosnπxl+bnsinnπxl) f(x)\sim\frac{a_0}{2}+\sum^{\infty}_{n=1}\big(a_n\cos\frac{n\pi x}{l}+b_n\sin\frac{n\pi x}{l}\big)

其中:

  • an=1lllf(x)cosnπxldx\displaystyle{a_n=\frac1{l}\int^{l}_{-l}f(x)\cos\frac{n\pi x}{l}\mathrm{d}x}
    • 特别地在[π,π][-\pi,\pi]上:an=1πππf(x)cosnxdx\displaystyle{a_n=\frac1{\pi}\int^{\pi}_{-\pi}f(x)\cos{nx}\mathrm{d}x}
  • bn=1lllf(x)sinnπxldx\displaystyle{b_n=\frac1{l}\int^{l}_{-l}f(x)\sin\frac{n\pi x}{l}\mathrm{d}x}
    • 特别地在[π,π][-\pi,\pi]上:bn=1πππf(x)sinnxdx\displaystyle{b_n=\frac1{\pi}\int^{\pi}_{-\pi}f(x)\sin{nx}\mathrm{d}x}
  • 其中,a0=1lllf(x)dx\displaystyle{a_0=\frac1{l}\int^{l}_{-l}f(x)\mathrm{d}x}
    • 特别地在[π,π][-\pi,\pi]上:a0=1πππf(x)dx\displaystyle{a_0=\frac1{\pi}\int^{\pi}_{-\pi}f(x)\mathrm{d}x}

可以将ll\displaystyle{\int^l_{-l}}替换为x0lx0+l\displaystyle{\int^{x_0+l}_{x_0-l}},没有本质区别;

容易知道,奇函数的傅里叶级数只有sin\sin项(正弦级数),偶函数的傅里叶级数只有cos\cos项(余弦级数)。

当函数被要求展开的区间不对称时,应当进行解析延拓;这其中最特殊的是在[0,l][0,l]上将f(x)f(x)展为傅里叶级数,奇延拓即令f(x)=f(x)f(x)=-f(-x)、偶延拓即令f(x)=f(x)f(x)=f(-x),两种延拓都能将ff[0,l][0,l]拓展到[l,l][-l,l],从而区间对称、可以展为傅里叶级数。奇延拓后的傅里叶级数为正弦级数,偶延拓后的傅里叶级数为余弦级数,这是容易理解的,因为sin\sin是奇函数、cos\cos是偶函数。

[0,l][0,l]上的f(x)f(x)通过延拓展为傅里叶级数:

  • 奇延拓,正弦级数:an=0a_n=0bn=2l0lf(x)sinnπxldx\displaystyle{b_n=\frac2{l}\int^{l}_0f(x)\sin\frac{n\pi x}{l}\mathrm{d}x}
  • 偶延拓,余弦级数:an=2l0lf(x)cosnπxldx\displaystyle{a_n=\frac2{l}\int^{l}_0f(x)\cos\frac{n\pi x}{l}\mathrm{d}x}bn=0b_n=0

其余情况以此类推;也可以做周期延拓。请注意,当函数本身便是奇函数或偶函数,可以视为相应的延拓,直接按给出的延拓公式计算即可:因为按标准公式算出来结果是一致的。


在这里,将通过傅里叶级数证明前文所提到的n=11n2=π26\sum\limits^{\infty}_{n=1}\frac1{n^2}=\frac{\pi^2}6n=01(2n+1)2=π28\sum\limits^{\infty}_{n=0}\frac1{(2n+1)^2}=\frac{\pi^2}8

首先将f(x)=2+xf(x)=2+|x|[1,1][-1,1]上、以22为周期展为傅里叶级数,计算傅里叶系数:

{an=201(2+x)cos(nπx)dx=2(cosnπ1)n2π2bn=0         Tip: 偶函数 \left\{ \begin{aligned} &a_n=2\int^1_0(2+x)\cos(n\pi x)\mathrm{d}x=\frac{2(\cos n\pi-1)}{n^2\pi^2}\\ &b_n=0\ \ \ \ \ \ \ \ \ \text{Tip: 偶函数}\end{aligned} \right.

其中a0=201(2+x)dx=5a_0=2\displaystyle{\int^1_0(2+x)\mathrm{d}x=5},因此在[1,1][-1,1]上,有

f(x)=52+n=12(cosnπ1)n2π2cos(nπx)=524π2n=0cos[(2n+1)πx](2n+1)2 \begin{align}f(x)&=\frac52+\sum^{\infty}_{n=1}\frac{2(\cos n\pi-1)}{n^2\pi^2}\cos(n\pi x)\\&=\frac52-\frac4{\pi^2}\sum^{\infty}_{n=0}\frac{\cos[(2n+1)\pi x]}{(2n+1)^2}\end{align}
  1. x=0x=0,有2=524π2n=01(2n+1)22=\frac52-\frac4{\pi^2}\sum\limits^{\infty}_{n=0}\frac1{(2n+1)^2},即n=01(2n+1)2=π28\sum\limits^{\infty}_{n=0}\frac1{(2n+1)^2}=\frac{\pi^2}8

  2. 注意到n=11n2=n=01(2n+1)2+n=11(2n)2=n=01(2n+1)2+14n=11n2\sum\limits^{\infty}_{n=1}\frac1{n^2}=\sum\limits^{\infty}_{n=0}\frac1{(2n+1)^2}+\sum\limits^{\infty}_{n=1}\frac1{(2n)^2}=\sum\limits^{\infty}_{n=0}\frac1{(2n+1)^2}+\frac14\sum\limits^{\infty}_{n=1}\frac1{n^2},故得到n=11n2=34n=01(2n+1)2=π26\sum\limits^{\infty}_{n=1}\frac1{n^2}=\frac34\sum\limits^{\infty}_{n=0}\frac1{(2n+1)^2}=\frac{\pi^2}6

这只是计算这两个级数的一种利用傅里叶级数的解法,除此之外还可以通过Wallis公式、留数定理等方法解决。


Bessel不等式是证明收敛定理的关键之一:若函数ff[π,π][-\pi,\pi]上可积,则a022+n=1(an2+bn2)1πππf2(x)dx\displaystyle{\frac{a^2_0}{2}+\sum\limits^{\infty}_{n=1}(a^2_n+b^2_n)\leqslant\frac1{\pi}\int^{\pi}_{-\pi}f^2(x)\mathrm{d}x}

黎曼引理对傅里叶级数连续性证明是至关重要的,但是由于已经在 高等数学工具 PartⅠ 提及,所以在此折叠。

展开/收起黎曼引理

任何两个互不相同的三角函数系函数乘积在[π,π][-\pi,\pi]上积分为零,即三角函数系是正交函数系;

ππcosnxdx=ππsinnxdx=0 \int^{\pi}_{-\pi}\cos nx\mathrm{d}x=\int^{\pi}_{-\pi}\sin nx\mathrm{d}x=0 { ππsin(nx)cos(mx)dx=0ππsin(nx)sin(mx)dx=0ππcos(nx)cos(mx)dx=0 } nm \left\{ \ \begin{aligned} &\int^{\pi}_{-\pi}\sin(nx)\cos(mx)\mathrm{d}x=0\\ &\left.\begin{aligned}&\int^{\pi}_{-\pi}\sin(nx)\sin(mx)\mathrm{d}x=0\\ &\int^{\pi}_{-\pi}\cos(nx)\cos(mx)\mathrm{d}x=0\end{aligned}\ \right\}\ n\neq m \end{aligned} \right.

三角函数系中任何函数的平方在[π,π][-\pi,\pi]上积分都不为零,

ππcos2nxdx=ππsin2nxdx=π \int^{\pi}_{-\pi}\cos^2 nx\mathrm{d}x=\int^{\pi}_{-\pi}\sin^2 nx\mathrm{d}x=\pi

三角函数形式的黎曼-勒贝格定理(Riemann–Lebesgue lemma):若ff黎曼可积,则

{limnππf(x)cos(nx)dx=0limnππf(x)sin(nx)dx=0 \left\{ \begin{aligned} &\lim\limits_{n\to\infty}\int^{\pi}_{-\pi}f(x)\cos(nx)\mathrm{d}x=0\\ &\lim\limits_{n\to\infty}\int^{\pi}_{-\pi}f(x)\sin(nx)\mathrm{d}x=0 \end{aligned} \right.

推广:黎曼引理:若ff在区间[a,b][a,b]上黎曼可积,则以下三式均成立且等价

{[1] limn±abf(x)sin(nx)dx=0[2] limn±abf(x)cos(nx)dx=0[3] limn±abf(x)einxdx=0 \left\{ \begin{aligned} &[1]\ \lim_{n\to\pm\infty}\int^b_af(x)\sin(nx)\mathrm{d}x=0\\ &[2]\ \lim_{n\to\pm\infty}\int^b_af(x)\cos(nx)\mathrm{d}x=0\\ &[3]\ \lim_{n\to\pm\infty}\int^b_af(x)e^{inx}\mathrm{d}x=0 \end{aligned} \right.

再推广:黎曼引理:若ff在区间[a,b][a,b]上黎曼可积、gg有最小正周期TT且在[0,T][0,T]上黎曼可积,则

limn±abf(x)g(nx)dx=1Tabf(x)dx0Tg(x)dx \lim_{n\to\pm\infty}\int^b_af(x)g(nx)\mathrm{d}x=\frac1T\int^b_af(x)\mathrm{d}x\int^T_0g(x)\mathrm{d}x

黎曼引理证明的部分请参考这篇文章:大学数学竞赛#2-Riemann引理及其应用(积分极限、无穷级数)

黎曼引理相关推论请参考这篇文章:如何通俗易懂地理解黎曼引理?

利用下文的区间在现方法可导出:

{ 0πxf(sinx)dx=π20πf(sinx)dx 0πxf(cosx)dx=π20πf(cosx)dx \left\{ \begin{aligned} &\ \int^\pi_0xf(\sin x)\mathrm{d}x=\frac{\pi}{2}\int^\pi_0f(\sin x)\mathrm{d}x\\ &\ \int^\pi_0xf(\cos x)\mathrm{d}x=\frac{\pi}{2}\int^\pi_0f(-\cos x)\mathrm{d}x \end{aligned} \right.

三角函数积分总结(一)~ sinx与cosx混合积分

三角函数积分总结(二)~ secx与tanx混合积分

傅里叶变换可以认为是“连续的傅里叶级数”,这里暂时不涉及傅里叶变换的内容。

多元函数的极限与连续

重极限与累次极限

ff是定义在DR2D\subset\mathbb{R}^2上的二元函数,P0P_0DD的一个聚点、AA是某个常实数。若ε>0\forall\varepsilon>0,总δ>0\exists \delta>0s.t.s.t.PU˚(P0;δ)DP\in\mathring{U}(P_0;\delta)\cap D时,都有f(P)A<ε|f(P)-A|<\varepsilon,则称ffDD上当PP0P\to P_0时以AA为 (重) 极限,记作limpP0PDf(P)=A\lim\limits_{p\to P_0\atop P\in D}f(P)=AlimPP0f(P)=A\lim\limits_{P\to P_0}f(P)=Alim(x,y)(x0,y0)f(P)=A\lim\limits_{(x,y)\to(x_0,y_0)}f(P)=A

  1. 若任一累次极限和重极限均存在,则二者一定相等;
  2. 对于二元函数,若两个累次极限存在但不相等,则重极限一定不存在;
  3. 重极限和累次极限没有必然关系,累次极限不是重极限的一种“趋近方式”。因此若重极限存在,累次极限不一定存在;反之若累次极限均存在,重极限也不一定存在。

证明重极限不存在,可以任找一组{(xn,yn)}\{(x_n,y_n)\},证明当(xn,yn)(x0,y0)(x_n,y_n)\to(x_0,y_0)时,极限lim(xn,yn)(x0,y0)f(x,y)\lim\limits_{(x_n,y_n)\to(x_0,y_0)}f(x,y)不唯一即可。这里蕴含的原理是:若重极限存在,则以任意方式逼近,得到的极限应该都相等。

例如当(xn,yn)(0,0)(x_n,y_n)\to(0,0)时欲判断重极限不存在,最简单的做法是令y=kty=ktx=tx=t(按需求取合适的变量即可,这里取的是过点(0,0)(0,0)的直线),然后令t0t\to0,若极限的值与tt取值有关,则重极限不存在。也可以取两个不同的kk,说明结果不唯一。

多元函数连续性

ff是定义在DR2D\subset\mathbb{R}^2上的二元函数,P0DP_0\in D。若ε>0\forall\varepsilon>0,总δ>0\exists \delta>0,只要PU(P0;δ)DP\in U(P_0;\delta)\cap D时,就有f(P)f(P0)<ε|f(P)-f(P_0)|<\varepsilon,则称ff关于集合DD在点P0P_0连续。

一元函数极限的唯一性、局部有界性、保号性、四则运算、迫敛性和所谓等价无穷小,在多元函数极限均成立。

若函数ff在有界闭域DR2D\subset\mathbb{R}^2上连续,则:

  1. ffDD上有界,且能取到最大值和最小值;
  2. ffDD上一致连续;
  3. 介值性定理成立。

增量与偏增量

Δx=xx0\Delta x=x-x_0Δy=yy0\Delta y=y-y_0,称Δz=Δf(x0,y0)=f(x,y)f(x0,y0)=f(x0+Δx,y0+Δy)f(x0,y0)\Delta z=\Delta f(x_0,y_0)=f(x,y)-f(x_0,y_0)=f(x_0+\Delta x,y_0+\Delta y)-f(x_0,y_0)为函数ff在点P0P_0的全增量,可以用增量描述连续性:当且仅当lim(Δx,Δy)(0,0)(x,y)DΔz=0\lim\limits_{(\Delta x,\Delta y)\to(0,0)\atop(x,y)\in D}\Delta z=0时,函数ff在点P0P_0连续。

当分别在全增量中取Δy=0\Delta y=0Δx=0\Delta x=0,称相应的函数增量为偏增量,分别记为Δxz\Delta_xzΔyz\Delta_yz。一般来说,全增量不等于两偏增量的和。

多元函数微分学

可微性

在点P0(x0,y0)P_0(x_0,y_0)的某个邻域中,若z=f(x,y)z=f(x,y)有定义且在点P0P_0处的全增量Δz\Delta z能被表示为Δz=f(x0+Δx,y0+Δy)f(x0,y0)=AΔx+BΔy+o(ρ)\Delta z=f(x_0+\Delta x,y_0+\Delta y)-f(x_0,y_0)=A\Delta x+B\Delta y+\mathcal{o}(\rho),则称ff在点P0P_0可微,并称关于Δx\Delta xΔy\Delta y的线性函数AΔx+BΔyA\Delta x+B\Delta y为函数ff在点P0P_0的全微分,记作dzP0=df(x0,y0)=AΔx+BΔy\mathrm{d}z\big|_{P_0}=\mathrm{d}f(x_0,y_0)=A\Delta x+B\Delta y——即全微分dz\mathrm{d}z是全增量Δz\Delta z的线性主部,其中AABB是仅与点P0P_0有关的常数,事实上他们分别是偏导数fx(x0,y0)f_x(x_0,y_0)fy(x0,y0)f_y(x_0,y_0)ρ=Δx2+Δy2\rho=\sqrt{\Delta x^2+\Delta y^2},而o(ρ)\mathcal{o}(\rho)是较ρ\rho的高阶无穷小量。

Δx|\Delta x|Δy|\Delta y|充分小时,全微分为全增量的近似值,即f(x,y)f(x0,y0)+A(xx0)+B(yy0)f(x,y)\approx f(x_0,y_0)+A(x-x_0)+B(y-y_0)

总结 1:因此,证明函数ff在点(x0,y0)(x_0,y_0)处可微,考察其全增量f(x0+Δx,y0+Δy)f(x0,y0)f(x_0+\Delta x,y_0+\Delta y)-f(x_0,y_0),观察观察原式是否能写为AΔx+BΔy+g(Δx,Δy)A\Delta x+B\Delta y+g(\Delta x,\Delta y)的形式即可,其中g(Δx,Δy)ρ0  (ρ0)\frac{|g(\Delta x,\Delta y)|}{\rho}\to0\ \ (\rho\to0)

等价地说,只需要验证极限式

limρ0[f(x0+Δx,y0+Δy)f(x0,y0)][fx(x0,y0)Δx+fy(x0,y0)Δy]ρ=0 \color{#CD0000}{\boldsymbol{\lim\limits_{\rho\to0}\frac{[f(x_0+\Delta x,y_0+\Delta y)-f(x_0,y_0)]-[f_x(x_0,y_0)\Delta x+f_y(x_0,y_0)\Delta y]}{\rho}=0}}

是否成立即可。

总结 2:证明不可微,实际上是在证明一个重极限不存在,因此说明(Δx,Δy)(\Delta x,\Delta y)沿着不同的方向趋于(0,0)(0,0)时极限结果不唯一即可。

上文中AABB分别为ff关于xxyy在点(x0,y0)(x_0,y_0)处的偏导数,根据定义,有:

{A=fx(x0,y0)=limΔx0Δxf(x0,y0)Δx=limΔx0f(x0+Δx,y0)f(x0,y0)ΔxB=fy(x0,y0)=limΔy0Δyf(x0,y0)Δy=limΔy0f(x0,y0+Δy)f(x0,y0)Δy \left\{\begin{aligned} &A=\left.\frac{\partial f}{\partial x}\right|_{(x_0,y_0)}=\lim\limits_{\Delta x\to0}\frac{\Delta_xf(x_0,y_0)}{\Delta x}=\lim\limits_{\Delta x\to0}\frac{f(x_0+\Delta x,y_0)-f(x_0,y_0)}{\Delta x}\\ &B=\left.\frac{\partial f}{\partial y}\right|_{(x_0,y_0)}=\lim\limits_{\Delta y\to0}\frac{\Delta_yf(x_0,y_0)}{\Delta y}=\lim\limits_{\Delta y\to0}\frac{f(x_0,y_0+\Delta y)-f(x_0,y_0)}{\Delta y}\end{aligned}\right.

总结 3:所以,欲计算分段函数ff在点(x0,y0)(x_0,y_0)处的偏导数(或验证偏导数是否存在),计算上述极限即可。

总结 4:明确ff在点(x0,y0)(x_0,y_0)处有一阶连续偏导数的情况下,若需计算偏导数在该点的具体值,则可以将该点分量的值代入无关变量后再求导,避免了直接使用繁复的定义,大大简化了计算。这种方法显然可行,因为偏导的极限定义式中不涉及非偏导变量以外的增量。例如求f(x,y)=2x+3y1+xyx2+y2f(x,y)=\frac{2x+3y}{1+xy\sqrt{x^2+y^2}}(0,0)(0,0)处对xx偏导数的值fx(0,0)f_x(0,0),有f(x,y)x(x,y)=(0,0)=df(x,0)dxx=0=ddx2xx=0=2\frac{\partial f(x,y)}{\partial x}\Big|_{(x,y)=(0,0)}=\frac{\mathrm{d}f(x,0)}{\mathrm{d}x}\Big|_{x=0}=\frac{\mathrm{d}}{\mathrm{d}x}2x\Big|_{x=0}=2,将偏导问题转为一元函数导数问题,极大减小了计算量。即使需要求高阶混合偏导的值,也可以如此操作。

  • 可微必要条件:函数在某点可微的必要条件是函数在该点对每个自变量的偏导数均存在。
  • 可微充分条件 (连续可微):若函数的对每个分量的偏导数在(x0,y0)(x_0,y_0)的某个邻域内均存在、点(x0,y0)(x_0,y_0)处均连续,则函数在该点可微。使用该充分条件时需要注意,ffx1,x2,x_1,x_2,\cdots的函数,偏导数也是x1,x2,x_1,x_2,\cdots的函数;如果偏导数都只对其中一个分量连续,是推不出函数可微的。
  • 连续可微的条件可进一步减弱,对于二元实函数,若在某点对其中一自变量的偏导存在,而对令一自变量的偏导连续,则函数在该点可微。证明思路是利用拉格朗日中值定理,不妨设fx(x0.y0)f_x(x_0.y_0)存在而fy(x,y)f_y(x,y)(x0,y0)(x_0,y_0)处连续,则:
连续可微
  • 即使在某点处偏导数存在,多元函数也不一定在这一点连续。

  • 补充:对于在点x=ax=a的某邻域内有定义的函数ff,函数f(x)xaf(x)|x-a|x=ax=a处可导的充要条件是f(a)=0f(a)=0

    该定理可以推广到多元的情形,以二元为例,对于在点(a,b)(a,b)的某邻域内有定义的二元函数f(,)f(\cdot,\cdot),函数f(x,y)(xa)(yb)f(x,y)\big|(x-a)-(y-b)\big|在点(a,b)(a,b)处偏导数存在的充要条件是极限limxaf(x,b)\lim\limits_{x\to a}f(x,b)limybf(a,y)\lim\limits_{y\to b}f(a,y)存在且limxaf(x,b)=limybf(a,y)=0\lim\limits_{x\to a}f(x,b)=\lim\limits_{y\to b}f(a,y)=0

此外,P(x,y)dx+Q(x,y)dyP(x,y)\mathrm{d}x+Q(x,y)\mathrm{d}y是某函数的全微分,且PPQQ关于xxyy都有一阶连续偏导数,则一定满足:

Py=Qx \boldsymbol{\frac{\partial P}{\partial y}=\frac{\partial Q}{\partial x}}

这实际上是混合偏导可交换的充分条件“若fxy(x,y)f_{xy}(x,y)fyx(x,y)f_{yx}(x,y)均在点(x0,y0)(x_0,y_0)处连续,则fxy(x0,y0)=fyx(x0,y0)f_{xy}(x_0,y_0)=f_{yx}(x_0,y_0)”的一个推论,但实在大有用处。

展开/收起1道混合偏导问题

计算不光滑点处的导数或偏导数,无论对象是一元函数、二元函数还是多元函数,通常都依赖于利用定义求导。

  • f(x,y)={x2yx2+y2,x2+y200,x2+y2=0f(x,y)=\left\{\begin{aligned}&\frac{x^2y}{x^2+y^2},&&x^2+y^2\neq0\\&0,&&x^2+y^2=0\end{aligned}\right.,试判断fxy(0,0)f_{xy}(0,0)fyx(0,0)f_{yx}(0,0)的存在性;

    解:要判断混合偏导的存在性,首先要计算一阶偏导。一方面,如果一阶偏导都不存在,二阶的混合偏导当然也不存在;另一方面,在通过定义计算二阶偏导时,也需要用到一阶偏导的值。

    根据定义,有

    {fx(0,0)=limx0f(x,0)f(0,0)x=limx00=0fy(0,0)=limy0f(0,y)f(0,0)y=limy00=0 \left\{\begin{aligned}&f_x(0,0)=\lim_{x\to0}\frac{f(x,0)-f(0,0)}x=\lim_{x\to0}0=0\\&f_y(0,0)=\lim_{y\to0}\frac{f(0,y)-f(0,0)}y=\lim_{y\to0}0=0\end{aligned}\right.

    故在(0,0)(0,0)点处一阶偏导存在且均为00,接着计算当x,y0x,y\neq0时的偏导数:

    {fx=xx2yx2+y2=2xy3(x2+y2)2,x2+y20fy=yx2yx2+y2=x4x2y2(x2+y2)2,x2+y20 \left\{\begin{aligned}&f_x=\frac{\partial}{\partial x}\frac{x^2y}{x^2+y^2}=\frac{2xy^3}{(x^2+y^2)^2},&&x^2+y^2\neq0\\&f_y=\frac{\partial}{\partial y}\frac{x^2y}{x^2+y^2}=\frac{x^4-x^2y^2}{(x^2+y^2)^2},&&x^2+y^2\neq0\end{aligned}\right.

    接下来就可以按定义计算点(0,0)(0,0)处的混合偏导以判断其存在性了:

    fxy(0,0)=limy0fx(0,y)fx(0,0)y=limy001y=0 f_{xy}(0,0)=\lim_{y\to0}\frac{f_x(0,y)-f_x(0,0)}y=\lim_{y\to0}0\cdot\frac1y=0 fyx(0,0)=limx0fy(x,0)fy(0,0)x=limx0x3x4= f_{yx}(0,0)=\lim_{x\to0}\frac{f_y(x,0)-f_y(0,0)}x=\lim_{x\to0}\frac{x^3}{x^4}=\infty

    综上所述,fxy(0,0)f_{xy}(0,0)存在且值为00fyx(0,0)f_{yx}(0,0)不存在。

    这类问题按定义逐步分析即可。

一阶全微分的形式不变性:对于可微多元函数z=f(u,v)z=f(u,v),其中{u=φ(x,y)v=ψ(x,y)\left\{\begin{aligned}&u=\varphi(x,y)\\&v=\psi(x,y)\end{aligned}\right.,有

dz=zxdx+zydy=(zuux+zvvx)dx+(zuuy+zvvy)dy=zu(uxdx+uydy)+zv(vxdx+vydy)=zudu+zvdv \begin{align} \mathrm{d}z&=\frac{\partial z}{\partial x}\mathrm{d}x+\frac{\partial z}{\partial y}\mathrm{d}y\\ &=\left(\frac{\partial z}{\partial u}\frac{\partial u}{\partial x}+\frac{\partial z}{\partial v}\frac{\partial v}{\partial x}\right)\mathrm{d}x+\left(\frac{\partial z}{\partial u}\frac{\partial u}{\partial y}+\frac{\partial z}{\partial v}\frac{\partial v}{\partial y}\right)\mathrm{d}y\\ &=\frac{\partial z}{\partial u}\left(\frac{\partial u}{\partial x}\mathrm{d}x+\frac{\partial u}{\partial y}\mathrm{d}y\right)+\frac{\partial z}{\partial v}\left(\frac{\partial v}{\partial x}\mathrm{d}x+\frac{\partial v}{\partial y}\mathrm{d}y\right)\\ &=\frac{\partial z}{\partial u}\mathrm{d}u+\frac{\partial z}{\partial v}\mathrm{d}v\end{align}

多元函数一阶全微分的形式不变性可视为一元函数的一阶微分形式不变性的推广。

复合函数微分法

多元复合函数的求导较为麻烦,需要考虑所有中间变量。一般地,复合函数f(g1(x1,,xn),,gm(x1,,xn))f\big(g_1(x_1,\cdots,x_n),\cdots,g_m(x_1,\cdots,x_n)\big)关于自变xix_i的导数为fxi=k=1mfgkgkxi\frac{\partial f}{\partial x_i}=\sum\limits^m_{k=1}\frac{\partial f}{\partial g_k}\frac{\partial g_k}{\partial x_i},按此准则,按照链式法则即可完成复合函数求导。

多元函数微分

从“图 17-5”可以看出,如此绘出分支图后,只需要找出从zz出发的、所有最终指向偏导变量的路径。

以一个简单的题目为例,如果方程F(xz,zy)F(\frac xz,\frac zy)可唯一确定函数z=z(x,y)z=z(x,y),试求偏导数zx\frac{\partial z}{\partial x}。首先做图:

     F       /\    xz   zy    /\   /\  z  x z  y /\   /\x  y x  y \begin{aligned} &\ \ \ \ \ \,\,\,\,\,F\\ &\ \ \ \,\ \ \ \ /\backslash\\ &\ \ \ \ \frac xz\ \ \ \frac zy\\ &\ \ \ \ /\backslash\ \ \ \,/\backslash\\ &\ \ \,z\ \ \,x\ \,z\ \ \,y\\ &\ \,/\backslash\ \ \ \,\,/\backslash\\ &x\ \ \,y\ \,\,x\ \ \,y\end{aligned}

可知,从FFxx一共有三条“路径”,分别是FxzzxF\to\frac xz\to z\to xFxzxF\to\frac xz\to xFzyzxF\to\frac zy\to z\to x,又分别有443344“层”。对每条路径,分别逐个用本层变量对下一层变量求偏导并按链式法则相乘,最后将三条路径的结果相加,可以得到:

0=Fx=F1(xz2zx+1z)+F21yzx 0=\frac{\partial F}{\partial x}=F_1\left(-\frac{x}{z^2}\frac{\partial z}{\partial x}+\frac1z\right)+F_2\frac1y\frac{\partial z}{\partial x}

最后将该式化简,可得zx=yzF1xyF1z2F2\frac{\partial z}{\partial x}=\frac{yzF_1}{xyF_1-z^2F_2}。如果要进一步求二阶甚至高阶偏导,计算会变得异常复杂,因为F1F_1F2F_2作为FF的偏导数,也是xz\frac xzzy\frac zy的函数;而zx\frac{\partial z}{\partial x}作为zzxx的偏导数,也是xxyy的函数,必须将他们也考虑进二阶偏导过程之中。

用另一个例子演示说明如何计算二阶偏导,高阶偏导以此类推即可。设u=f(ξ,η)u=f(\xi,\eta)具有二阶偏导数,其中ξ=ξ(x,y)\xi=\xi(x,y)η=η(x,y)\eta=\eta(x,y),下计算2ux2\frac{\partial^2u}{\partial x^2}

     2ux2=x(uξξx+uηηx)=(uξ)xξx+uξ(ξx)x+(uη)xηx+uη(ηx)x=(2uξ2ξx+2uξηηx)ξx+uξ2ξx2+(2uη2ηx+2uηξξx)ηx+uη2ηx2 \begin{align} &\ \ \ \ \ \frac{\partial^2u}{\partial x^2}\\ &=\frac{\partial}{\partial x}\left(\frac{\partial u}{\partial \xi}\frac{\partial \xi}{\partial x}+\frac{\partial u}{\partial \eta}\frac{\partial \eta}{\partial x}\right)\\ &=\frac{\partial\left(\frac{\partial u}{\partial \xi}\right)}{\partial x}\frac{\partial \xi}{\partial x}+\frac{\partial u}{\partial \xi}\frac{\partial\left(\frac{\partial \xi}{\partial x}\right)}{\partial x}+\frac{\partial\left(\frac{\partial u}{\partial \eta}\right)}{\partial x}\frac{\partial \eta}{\partial x}+\frac{\partial u}{\partial \eta}\frac{\partial\left(\frac{\partial \eta}{\partial x}\right)}{\partial x}\\ &=\left(\frac{\partial^2u}{\partial \xi^2}\frac{\partial \xi}{\partial x}+\frac{\partial^2u}{\partial \xi\partial\eta}\frac{\partial \eta}{\partial x}\right)\frac{\partial \xi}{\partial x}+\frac{\partial u}{\partial \xi}\frac{\partial^2\xi}{\partial x^2}+\left(\frac{\partial^2u}{\partial \eta^2}\frac{\partial \eta}{\partial x}+\frac{\partial^2u}{\partial \eta\partial\xi}\frac{\partial \xi}{\partial x}\right)\frac{\partial \eta}{\partial x}+\frac{\partial u}{\partial \eta}\frac{\partial^2\eta}{\partial x^2}\end{align}

显而易见,二阶偏导已经有非常大的计算量了。作为符号计算,计算时是容易出错的。

如果只需要计算部分点的二阶或高阶偏导,并不需要将各阶偏导数的表达式完全求出来,例如已求出一阶偏导fxf_xfyf_y并且已知二阶偏导均连续的情况下,需要计算ff(x0,y0)(x_0,y_0)处二阶偏导的具体值,则有

{2fx2(x0,y0)=xfx(x,y0)2fy2(x0,y0)=yfy(x0,y)2fxy(x0,y0)=yfx(x0,y) \left\{\begin{aligned} &\left.\frac{\partial^2f}{\partial x^2}\right|_{(x_0,y_0)}=\frac{\partial}{\partial x}f_x(x,y_0)\\ &\left.\frac{\partial^2f}{\partial y^2}\right|_{(x_0,y_0)}=\frac{\partial}{\partial y}f_y(x_0,y)\\ &\left.\frac{\partial^2f}{\partial x\partial y}\right|_{(x_0,y_0)}=\frac{\partial}{\partial y}f_x(x_0,y)\end{aligned}\right.

这一“提前代入”的方法在前文可微性部分中是有提到过的,该方法理论支持源于偏导数的定义。


一阶全微分具有形式不变性,指对于函数z=f(x,y)z=f(x,y)和复合函数{x=φ(u,v)y=ψ(u,v)z=f(x,y)\left\{\begin{aligned}&x=\varphi(u,v)\\&y=\psi(u,v)\\&z=f(x,y)\end{aligned}\right.,若z=f(x,y)z=f(x,y)可微且φ\varphiψ\psi是可微函数,则复合函数z=f(φ(u,v),ψ(u,v))z=f\big(\varphi(u,v),\psi(u,v)\big)可微,而且他们全微分在形式上都等于dz=zxdx+zydy\mathrm{d}z=\frac{\partial z}{\partial x}\mathrm{d}x+\frac{\partial z}{\partial y}\mathrm{d}y,这大大简化了求解复杂复合函数一阶全微分的计算量。值得注意的是,二阶全微分不再具有形式不变性。例如欲求解z=exysin(x+y)z=e^{xy}\sin(x+y)的全微分,记s=xys=xyt=x+yt=x+y,有

ds=ydx+xdy \mathrm{d}s=y\mathrm{d}x+x\mathrm{d}y dt=dx+dy \mathrm{d}t=\mathrm{d}x+\mathrm{d}y

z=essintz=e^s\sin t,利用一阶全微分形式不变性得

dz=zsds+ztdt=essintds+escostdt \mathrm{d}z=z_s\mathrm{d}s+z_t\mathrm{d}t=e^s\sin t\mathrm{d}s+e^s\cos t\mathrm{d}t

联立以上三式,化简得

dz=essint(ydx+xdy)+escost(dx+dy)=exy[ysin(x+y)+cos(x+y)]dx+exy[xsin(x+y)+cos(x+y)]dy \begin{align}\mathrm{d}z&=e^s\sin t(y\mathrm{d}x+x\mathrm{d}y)+e^s\cos t(\mathrm{d}x+\mathrm{d}y)\\&=e^{xy}[y\sin(x+y)+\cos(x+y)]\mathrm{d}x+e^{xy}[x\sin(x+y)+\cos(x+y)]\mathrm{d}y\end{align}

极值问题与泰勒公式

首先规定记号,切勿混淆:

y(2zx2):=3zx2y:=fx2y(x,y) \frac{\partial}{\partial y}\left(\frac{\partial^2z}{\partial x^2}\right):=\frac{\partial^3z}{\partial x^2\partial y}:=f_{x^2y}(x,y)

混合偏导数不一定相等,但是有fxy(x0,y0)f_{xy}(x_0,y_0)fyx(x0,y0)f_{yx}(x_0,y_0)相等的充分条件:fxy(x,y)f_{xy}(x,y)fyx(x,y)f_{yx}(x,y)均在点(x0,y0)(x_0,y_0)处连续。

多元函数的泰勒公式使用梯度和黑塞矩阵最多写到二阶,再往上需要用到张量。不过对于二元函数,是可以用混合偏导写出泰勒公式的。

泰勒定理 (二元函数):若函数ff在点P0(x0,y0)P_0(x_0,y_0)的某邻域U(P0)U(P_0)上有直到n+1n+1阶的连续偏导数,则对U(P0)U(P_0)上任一点(x0+h,y0+k)(x_0+h,y_0+k),存在相应的θ(0,1)\theta\in(0,1),使得

f(x0+h,y0+k)=f(x0+y0)+(hx+ky)f(x0,y0)+12!(hx+ky)2f(x0+y0)+    +1n!(hx+ky)nf(x0,y0)+1(n+1)!(hx+ky)n+1f(x0+θh,y0+θk) \begin{aligned}f(x_0+h,y_0+k)&=\textstyle f(x_0+y_0)+\left(h\frac{\partial}{\partial x}+k\frac{\partial}{\partial y}\right)f(x_0,y_0)+\frac1{2!}\left(h\frac{\partial}{\partial x}+k\frac{\partial}{\partial y}\right)^2f(x_0+y_0)+\cdots\\&\ \ \ \ +\textstyle\frac1{n!}\left(h\frac{\partial}{\partial x}+k\frac{\partial}{\partial y}\right)^nf(x_0,y_0)+\frac1{(n+1)!}\left(h\frac{\partial}{\partial x}+k\frac{\partial}{\partial y}\right)^{n+1}f(x_0+\theta h,y_0+\theta k)\end{aligned}

上式被称为二元函数ff在点P0P_0nn阶泰勒公式,其中

(hx+ky)mf(x0,y0)=i=1m(mi)mxiymif(x0,y0)hikmi \left(h\frac{\partial}{\partial x}+k\frac{\partial}{\partial y}\right)^mf(x_0,y_0)=\sum^m_{i=1}\binom{m}{i}\frac{\partial^m}{\partial x^i\partial y^{m-i}}f(x_0,y_0)h^ik^{m-i}

极值的必要条件:若ff在某点存在关于每个自变量的偏导数,则在该点取得极值的必要条件是在该点关于每个自变量的偏导数值为00。称满足该必要条件的点为稳定点。

记二元函数的黑塞矩阵为Hf(P0)\boldsymbol{H}_f(P_0),可以认为是梯度grad\textbf{grad}的“导数”、多元函数的“二阶导数”,即:

Hf(P0)=[fxxfxyfyxfyy]P0 \boldsymbol{H}_f(P_0)=\left[\begin{matrix}f_{xx}&f_{xy}\\f_{yx}&f_{yy}\\\end{matrix}\right]_{P_0}

则可以给出二元函数极值的充分条件:设二元函数ff在点P0(x0,y0)P_0(x_0,y_0)的某邻域U(P0)U(P_0)上具有二阶连续偏导数,且P0P_0ff的稳定点,则:

  1. Hf(P0)\boldsymbol{H}_f(P_0)正定,ff在点P0P_0取得极小值;
  2. Hf(P0)\boldsymbol{H}_f(P_0)负定,ff在点P0P_0取得极大值;
  3. Hf(P0)\boldsymbol{H}_f(P_0)不定,ff不在点P0P_0取极值;
  4. Hf(P0)\boldsymbol{H}_f(P_0)半正定或半负定时,无法断言。

对于第四点,可以确定的是当Hf(P0)\boldsymbol{H}_f(P_0)半正定,至少ff不可能在点P0P_0取得极大值;当Hf(P0)\boldsymbol{H}_f(P_0)半负定,至少ff不可能在点P0P_0取得极小值。无法断言的只是在该点是否取到极值。

注意:对于二阶方阵(aij)(a_{ij})而言,

  • 矩阵正定或负定的充要条件是行列式大于00,其中a11>0a_{11}>0则正定,a11<0a_{11}<0则负定(一阶顺序主子式);

    或等价地在行列式大于00a22>0a_{22}>0则正定,a22<0a_{22}<0则负定;

  • 矩阵半正定或半负定的充要条件是行列式等于00

  • 矩阵不定的充要条件是行列式小于00

有时无法解出二阶偏导,甚至连二阶偏导存在性都不能确定,这种情况需要从极值定义入手。

展开/收起1道极值问题
  • f(x,y)f(x,y)在点(0,0)(0,0)处连续且有 limx0y0f(x,y)xy(x2+y2)2=1\displaystyle{\lim\limits_{x\to0\atop y\to0}\frac{f(x,y)-xy}{(x^2+y^2)^2}=1},问点(0,0)(0,0)是否是ff的极值点,若是解出极值点类型。

    这道题显然不能使用极值的充分条件判断,因为不能确认ff的二阶偏导。首先注意到应有f(0,0)f(0,0),否则根据ff的连续性,设limx0y0f(x,y)=A0\lim\limits_{x\to0\atop y\to0}f(x,y)=A\neq0,极限limx0y0f(x,y)xy(x2+y2)2=limx0y0Ao(ρ)o(ρ)=\displaystyle{\lim\limits_{x\to0\atop y\to0}\frac{f(x,y)-xy}{(x^2+y^2)^2}=\lim\limits_{x\to0\atop y\to0}\frac{A-\mathcal{o}(\rho)}{\mathcal{o}(\rho)}=\infty},矛盾(其中ρ=x2+y2\rho=\sqrt{x^2+y^2})。

    接下来设f(x,y)xy(x2+y2)2=1+εx,y\frac{f(x,y)-xy}{(x^2+y^2)^2}=1+\varepsilon_{x,y},有limx0y0εx,y=0\lim\limits_{x\to0\atop y\to0}\varepsilon_{x,y}=0,于是ff可以被等价地表为:

    f(x,y)=xy+(1+εx,y)(x2+y2)2 f(x,y)=xy+(1+\varepsilon_{x,y})(x^2+y^2)^2

    x=y=tx=y=t,则有f(t,t)=t2+4(1+εt,t)t4=t2+o(t2)f(t,t)=t^2+4(1+\varepsilon_{t,t})t^4=t^2+\mathcal{o}(t^2)

    再令x=tx=ty=ty=-t,则有f(t,t)=t2+4(1+εt,t)t4=t2+o(t2)f(t,t)=-t^2+4(1+\varepsilon_{t,-t})t^4=-t^2+\mathcal{o}(t^2)

    故而总是有一个点(0,0)(0,0)的邻域UR2U\subset\mathbb{R}^2,必然(x1,y1),(x2,y2)U\exists (x_1,y_1),(x_2,y_2)\in Us.t. f(x1,y1)<f(0,0)=0<f(x2,y2)s.t.\ f(x_1,y_1)\lt f(0,0)=0\lt f(x_2,y_2),因此ff一定不可能在(0,0)(0,0)处取到极值。

条件极值 / 约束优化

以下方法求到的解可能只是最优解的必要条件,实际上所得到的只是可行解(局部最优,只有凸优化问题中才等价于全局最优)。

等式约束

可微等式约束hi(x1,x2,,xn)=c, i=1,2,,lh_i(x_1,x_2,\cdots,x_n)=c,\ i=1,2,\cdots,l下的连续可微函数优化问题argminf(x1,x2,,xn)\arg\min f(x_1,x_2,\cdots,x_n)可以转化为无约束优化的拉格朗日函数LL

L(x1,x2,,xn;λ1,,λl)=f(x1,x2,,xn)+i=1lλi(hi(x1,x2,,xn)c) L(x_1,x_2,\cdots,x_n;\lambda_1,\cdots,\lambda_l)=f(x_1,x_2,\cdots,x_n)+\sum^l_{i=1}\lambda_i\big(h_i(x_1,x_2,\cdots,x_n)-c\big)

最后求LL的稳定点即可,即要求

{Lxk=fxk+j=1lλj(hj)xk=0,  k=1,2,,nLλi=hi(x1,x2,,xn)c=0,  i=1,2,,l \left\{\begin{aligned} &\frac{\partial L}{\partial x_k}=f_{x_k}+\sum^l_{j=1}\lambda_j{(h_j)}_{x_k}=0,\ \ k=1,2,\cdots,n\\ &\frac{\partial L}{\partial \lambda_i}=h_i(x_1,x_2,\cdots,x_n)-c=0,\ \ i=1,2,\cdots,l\end{aligned}\right.

该方法称为拉格朗日乘子法。记梯度grad(L)\textbf{grad}(L)L(x,λ)\nabla L(\boldsymbol{x},\boldsymbol{\lambda}),则以上二式可以合并为一个向量式:

L(x,λ)=0 \nabla L(\boldsymbol{x},\boldsymbol{\lambda})=\boldsymbol0

最优解包含在满足上述等式的解中。

如果可微函数ff的优化问题中约束包含了部分不等式,且满足这些不等式的点构成一个闭域,那么可以将不等式约束优化问题转变为等式约束优化问题。步骤是:

  1. 首先求出区域内部的驻点并计算这些驻点的值,方法直接对ff求偏导,寻找偏导数均为00的点(可以进一步判断驻点是极大值点、极小值点还是非极值点,非极值点就不用在后续考虑了);
  2. 接着在区域界点集上解出极值,方法是将不等式约束改为相应地等式约束,直接运用等式约束的拉格朗日乘子法即可求解,最后对比ff在边界与内部的极值大小即可。
  3. 如果函数不是处处可微的,还要额外考虑偏导数不存在点的值。

当然,直接考虑KKT条件或许是更简洁的,不过这给KKT条件的互相松弛条件提供了一种直观解释。

不等式约束

可微不等式约束{hi(x)=0,i=1,2,,pgj(x)0,j=1,2,,q\left\{\begin{aligned}&h_i(\boldsymbol{x})=0,&&i=1,2,\cdots,p\\&g_j(\boldsymbol{x})\leqslant0,&&j=1,2,\cdots,q\end{aligned}\right. 下的连续可微函数优化问题argminf(x)\arg\min f(\boldsymbol{x})同样可以转化为无约束优化的拉格朗日函数LL

L(x,λ,μ)=f(x)+j=1qλjgj(x)+i=1pμihi(x) L(\boldsymbol{x},\boldsymbol{\lambda},\boldsymbol{\mu})=f(\boldsymbol{x})+\sum^q_{j=1}\lambda_jg_j(\boldsymbol{x})+\sum^p_{i=1}\mu_ih_i(\boldsymbol{x})

LL的梯度等于0\boldsymbol{0},可得到KKT条件,可认为是拉格朗日乘子法的推广:

  1. 稳定性条件:xL(x,λ,μ)=0\nabla_{\boldsymbol{x}}L(\boldsymbol{x},\boldsymbol{\lambda},\boldsymbol{\mu})=\boldsymbol0
  2. 原问题可行性条件1:μL(x,λ,μ)=hi(x)=0,    i=1,2,,p\nabla_{\boldsymbol{\mu}}L(\boldsymbol{x},\boldsymbol{\lambda},\boldsymbol{\mu})=h_i(\boldsymbol{x})=0,\ \ \ \ i=1,2,\cdots,p
  3. 原问题可行性条件2:λL(x,λ,μ)=gj(x)0,    j=1,2,,q\nabla_{\boldsymbol{\lambda}}L(\boldsymbol{x},\boldsymbol{\lambda},\boldsymbol{\mu})=g_j(\boldsymbol{x})\leqslant0,\ \ \ \ j=1,2,\cdots,q
  4. 对偶问题可行性条件:λi0,    i=1,2,,p\lambda_i\geqslant0,\ \ \ \ i=1,2,\cdots,p
  5. 互相松弛条件:λigi(x)=0,    i=1,2,,p\lambda_ig_i(\boldsymbol{x})=0,\ \ \ \ i=1,2,\cdots,p

支持向量机(SVM)的数学推导中,“松弛变量”一名就来自这里。

记可行域为D\mathbb{D},则拉格朗日对偶问题的对偶优化函数定义为Γ(λ,μ)=infxD(x,λ,μ)\Gamma(\boldsymbol{\lambda},\boldsymbol{\mu})=\inf\limits_{x\in\mathbb{D}}(\boldsymbol{x},\boldsymbol{\lambda},\boldsymbol{\mu}),如果问题的KKT条件给出的方程难以解出,可以先考虑对偶问题。如果对这部分内容感兴趣,可以深入研究最优化理论。SVM的数学推导,就完全依赖于这些优化方法。

多元函数导数的几何应用

尽管这部分内容很有趣,但在此从略。

如果以后考虑写空间解析几何方面的文章,在做更新吧。

隐函数定理及其应用

隐函数

隐函数

在此补充一些隐函数求导法,通过一个例子加以说明。设F(x,y,z)F(x,y,z)是一阶偏导数连续的隐函数,z=z(x,y)z=z(x,y)由方程F(x,y,z)=0F(x,y,z)=0唯一确定,此时求zz关于自变量的偏导有两种方法。

  • 第一种方法是对等式两边直接求偏导,在此不妨对xx求偏导,可以知道隐函数FF既被xx直接影响,也被xx通过中间变量zz间接影响(直观上说F(x,y,z)=F(x,y,f(x,y))F(x,y,z)=F\big(x,y,f(x,y)\big)),故根据链式法则有Fx=Fx+Fzzx=0\frac{\partial F}{\partial x}=\frac{\partial F}{\partial x}+\frac{\partial F}{\partial z}\frac{\partial z}{\partial x}=0,即Fx+Fzzx=0F_x+F_z\frac{\partial z}{\partial x}=0zzyy的偏导数求法同理,可以总结为下述公式:

    {zx=FxFzzy=FyFz \color{#990066}{\left\{\begin{aligned}&\frac{\partial z}{\partial x}=-\frac{F_x}{F_z}\\&\frac{\partial z}{\partial y}=-\frac{F_y}{F_z}\end{aligned}\right.}

    上式对复合函数仍有效,例如隐函数z=z(x,y)z=z(x,y)由方程F(xz,zy)F(\frac xz,\frac zy)确定,按公式,仍有zx=1zF1xz2F1+1yF2\frac{\partial z}{\partial x}=-\frac{\frac1zF_1}{-\frac x{z^2}F_1+\frac1yF_2}

    这个公式比较重要,需要掌握。

  • 第二种方法是利用一阶全微分的形式不变性,有

    Fxdx+Fydy+Fzdz=0 F_x\mathrm{d}x+F_y\mathrm{d}y+F_z\mathrm{d}z=0

有时需要解可微复合函数u=f(x,y,z)u=f(x,y,z)的全微分du\mathrm{d}u,其中zz是关于xxyy的函数,而z=z(x,y)z=z(x,y)是通过某个隐函数确定的(注:这种写法一般是默认了u=u(x,y)u=u(x,y),否则u()f()u(\cdot)\equiv f(\cdot),会使后文对u=f(x,y,z)u=f(x,y,z)的偏导结果改变)。相对“笨拙”的办法是直接按定义求解,即先对隐函数等式两端求xxyy的偏导得到由zx\frac{\partial z}{\partial x}zy\frac{\partial z}{\partial y}表出的ux\frac{\partial u}{\partial x}uy\frac{\partial u}{\partial y}(对xx偏导得到ux=fx+fzzx\frac{\partial u}{\partial x}=\frac{\partial f}{\partial x}+\frac{\partial f}{\partial z}\frac{\partial z}{\partial x},对yy偏导同理),再分别求出zz关于xxyy的偏导,最后代入。

相对简洁的方法是利用一阶全微分的形式不变性,立刻有

du=fxdx+fydy+fzdz \mathrm{d}u=\frac{\partial f}{\partial x}\mathrm{d}x+\frac{\partial f}{\partial y}\mathrm{d}y+\frac{\partial f}{\partial z}\mathrm{d}z

只需要通过z=z(x,y)z=z(x,y)解出dz\mathrm{d}z(等式两边同时取微分),最后就能得到用偏微分dx\mathrm{d}xdy\mathrm{d}y表出的全微分du\mathrm{d}u

隐函数组

隐函数组

针对通过隐函数组定义的多个隐函数的情况,如果需要计算其中一个隐函数的导数(注意,这里并不是计算偏导),则需要结合隐函数与隐函数组的方法。

例如,设有满足隐函数组定理的隐函数组{F(x,y,z)=0G(x,y,z)=0\left\{\begin{aligned}&F(x,y,z)=0\\&G(x,y,z)=0\end{aligned}\right.,当(F,G)(y,z)=FyFzGyGz0\frac{\partial(F,G)}{\partial(y,z)}=\left|\begin{matrix}\frac{\partial F}{\partial y}&\frac{\partial F}{\partial z}\\\frac{\partial G}{\partial y}&\frac{\partial G}{\partial z}\end{matrix}\right|\neq0时,可以唯一地确定两个以xx为自变量的隐函数{y=y(x)z=z(x)\left\{\begin{aligned}&y=y(x)\\&z=z(x)\end{aligned}\right.,而且有

dydx=(F,G)(x,z)(F,G)(y,z)=FxFzGxGzFyFzGyGz \frac{\mathrm{d}y}{\mathrm{d}x}=-\frac{\frac{\partial(F,G)}{\partial(x,z)}}{\frac{\partial(F,G)}{\partial(y,z)}}=-\frac{\left|\begin{matrix}\frac{\partial F}{\partial x}&\frac{\partial F}{\partial z}\\\frac{\partial G}{\partial x}&\frac{\partial G}{\partial z}\end{matrix}\right|}{\left|\begin{matrix}\frac{\partial F}{\partial y}&\frac{\partial F}{\partial z}\\\frac{\partial G}{\partial y}&\frac{\partial G}{\partial z}\end{matrix}\right|} dzdx=(F,G)(x,y)(F,G)(z,y)=FxFyGxGyFzFyGzGy \frac{\mathrm{d}z}{\mathrm{d}x}=-\frac{\frac{\partial(F,G)}{\partial(x,y)}}{\frac{\partial(F,G)}{\partial(z,y)}}=-\frac{\left|\begin{matrix}\frac{\partial F}{\partial x}&\frac{\partial F}{\partial y}\\\frac{\partial G}{\partial x}&\frac{\partial G}{\partial y}\end{matrix}\right|}{\left|\begin{matrix}\frac{\partial F}{\partial z}&\frac{\partial F}{\partial y}\\\frac{\partial G}{\partial z}&\frac{\partial G}{\partial y}\end{matrix}\right|}

注:FyFzGyGz=FzFyGzGy\left|\begin{matrix}\frac{\partial F}{\partial y}&\frac{\partial F}{\partial z}\\\frac{\partial G}{\partial y}&\frac{\partial G}{\partial z}\end{matrix}\right|=-\left|\begin{matrix}\frac{\partial F}{\partial z}&\frac{\partial F}{\partial y}\\\frac{\partial G}{\partial z}&\frac{\partial G}{\partial y}\end{matrix}\right|,也就是说对雅可比行列式有(F,G)(y,z)=(F,G)(z,y)\frac{\partial(F,G)}{\partial(y,z)}=-\frac{\partial(F,G)}{\partial(z,y)}。从初等变换与行列式的角度看,(FzFyGzGy)\left(\begin{matrix}\frac{\partial F}{\partial z}&\frac{\partial F}{\partial y}\\\frac{\partial G}{\partial z}&\frac{\partial G}{\partial y}\end{matrix}\right)相当于是(FyFzGyGz)\left(\begin{matrix}\frac{\partial F}{\partial y}&\frac{\partial F}{\partial z}\\\frac{\partial G}{\partial y}&\frac{\partial G}{\partial z}\end{matrix}\right)调换第一列与第二列的结果,这一初等变换对应的行列式为1-1

隐函数导数的几何应用

尽管这部分内容很有趣,但在此从略。

如果以后考虑写空间解析几何方面的文章,在做更新和深入剖析吧。

重积分

Fubini定理与重积分换元法

Fubini定理 (可积函数情形)     fL(Rn)f\in L(\mathbb{R}^n)(x,y)Rn=Rp×Rq(x,y)\in\mathbb{R}^n=\mathbb{R}^p\times\mathbb{R}^q,则:

  1. 对于几乎处处的xRpx\in\mathbb{R}^pf(x,y)f(x,y)Rq\mathbb{R}^q上的可积函数;
  2. 积分Rqf(x,y)dy\displaystyle{\int_{\mathbb{R}^q}f(x,y)\mathrm{d}y}Rp\mathbb{R}^p上的可积函数;
  3. Rnf(x,y)dxdy=RpdxRqf(x,y)dy=RqdyRpf(x,y)dx\displaystyle{\int_{\mathbb{R}^n}f(x,y)\mathrm{d}x\mathrm{d}y}=\displaystyle{\int_{\mathbb{R}^p}\mathrm{d}x\int_{\mathbb{R}^q}f(x,y)\mathrm{d}y}=\displaystyle{\int_{\mathbb{R}^q}\mathrm{d}y\int_{\mathbb{R}^p}f(x,y)\mathrm{d}x}

Fubini定理的证明通常用Tonelli定理作引理,Tonelli定理可以被认为是针对非负可测函数的Fubini定理。值得注意的是,Fubini定理为重积分的计算与累次积分积分号的交换提供了理论保证,但即使f(x,y)f(x,y)的两个累次积分存在且相等,f(x,y)f(x,y)Rn\mathbb{R}^n上也可能不可积。

重积分变量变换     重积分的换元法可以认为是一元积分中第二类还原法的推广。设变换T:xi=xi(y1,y2,,yn), i=1,2,,nT:x_i=x_i(y_1,y_2,\cdots,y_n),\ i=1,2,\cdots,nnn维的y1y2yny_1y_2\cdots y_n空间区域VV'一对一地映射成nn维的x1x2xnx_1x_2\cdots x_n空间中的区域VV,且在VV'上的Jocobian

J=(x1,x2,,xn)(y1,y2,,yn)=x1y1x1y2x1ynx2y1x2y2x2ynxny1xny2xnyn J=\frac{\partial(x_1,x_2,\cdots,x_n)}{\partial(y_1,y_2,\cdots,y_n)}=\left|\begin{matrix}\frac{\partial x_1}{\partial y_1}&\frac{\partial x_1}{\partial y_2}&\cdots&\frac{\partial x_1}{\partial y_n}\\\frac{\partial x_2}{\partial y_1}&\frac{\partial x_2}{\partial y_2}&\cdots&\frac{\partial x_2}{\partial y_n}\\\vdots&\vdots&&\vdots\\\frac{\partial x_n}{\partial y_1}&\frac{\partial x_n}{\partial y_2}&\cdots&\frac{\partial x_n}{\partial y_n}\end{matrix}\right|

恒不为零,则有:

      Vnfoldf(x1,x2,,xn)dx1dx2dxn=Vnfoldf(x1(y1,,yn),,xn(y1,,yn))Jdy1dyn \begin{align} &\ \ \ \ \ \ \overbrace{\mathop{\int\cdots\int}_V}^{n-\text{fold}}f(x_1,x_2,\cdots,x_n)\mathrm{d}x_1\mathrm{d}x_2\cdots\mathrm{d}x_n\\ &=\overbrace{\mathop{\int\cdots\int}_{V'}}^{n-\text{fold}}f\big(x_1(y_1,\cdots,y_n),\cdots,x_n(y_1,\cdots,y_n)\big)|J|\mathrm{d}y_1\cdots\mathrm{d}y_n\end{align}

为Jocobian加上绝对值是很常见的操作,之所以如此,是为了避免繁琐地讨论符号的问题。但不给Jocobian加上绝对值是完全可行的,只不过要留意变换后符号究竟为正还是负。以一元积分情形举例,如果换元x=g(t)x=g(t)时不给Jocobian加绝对值,则dx=dg(t)=g(t)dt\mathrm{d}x=\mathrm{d}g(t)=g'(t)\mathrm{d}t,积分上限与积分下限分别按ttxx的关系“更新”即可,但这可能导致变换后的新的关于tt的积分上限小于积分下限,这种情况下若希望积分上限大于积分下限则需要通过取负使积分上下限互换;但若一开始就给Jocobian加上绝对值,即令dx=g(t)dt\mathrm{d}x=|g'(t)|\mathrm{d}t,则不需要加以关心符号问题:直接将变换后的两个积分限取较大的一个作为积分上限、取较小的一个作为积分下限即可,这样便不再需要考虑符号。

特别地,对于极坐标变换{x=rcosθy=rsinθ\left\{\begin{aligned}&x=r\cos\theta\\&y=r\sin\theta\end{aligned}\right.,其雅可比矩阵(过渡矩阵)为:

[cosθrsinθsinθrcosθ] \left[\begin{matrix}\cos\theta&-r\sin\theta\\\sin\theta&r\cos\theta\end{matrix}\right]

该矩阵的行列式正是rr,所以做二重积分的极坐标换元时,只需要将xxyy代换后式子整体乘上rr,相应地求出新的积分区域即可。特别地,令r=1r=1则得到旋转变换的矩阵表示,即

(xy)=(cosθsinθsinθcosθ)(xy) \left(\begin{matrix}x'\\y'\end{matrix}\right)=\left(\begin{matrix}\cos\theta&-\sin\theta\\\sin\theta&\cos\theta\end{matrix}\right)\left(\begin{matrix}x\\y\end{matrix}\right)

许多时候,如果重积分不好直接计算,且化为累次积分再试着换序后还是难以处理,不妨试试重积分的换元法。但在换元时应当注意不要仅仅局限在极坐标变换、球面坐标变换等,这是一个比较常见的问题——由于平时用到了太多极坐标换元和球面坐标换元,导致面对需要作其他换元才能求解的积分时被“禁锢”住了想法,联想不到其他换元。换元时应当观察被积式和积分区域,选择一个合适的变换,而不是不管三七二十一,先代个极坐标变换再说。

二重积分

二重积分Df(x,y)dσ\displaystyle{\iint\limits_Df(x,y)\mathrm{d}\sigma}的定义可以类比一重黎曼积分的定义,视为可数(可列)个在小区域{σi}\{\triangle\sigma_i\}上、以f(xi,yi)f(x_i,y_i)为高的柱体的体积之和,因此二重积分在f(x,y)0f(x,y)\geqslant0时,可以认为其值代表了以积分域DD为底、以曲面z=f(x,y)z=f(x,y)为曲顶的曲顶柱体体积。除了序的性质与一重积分相同,当ffDD上连续时,还有积分中值定理:Df(x,y)dσ=f(ξ,η)S\displaystyle{\iint\limits_Df(x,y)\mathrm{d}\sigma=f(\xi,\eta)S},其中(ξ,η)D(\xi,\eta)\in DS=m(D)S=m(D),为DD的面积。

Df(x,y)dxdy=limT0i=1nf(ξi,ηi)Δσi \iint\limits_Df(x,y)\mathrm{d}x\mathrm{d}y=\lim_{\Vert T\Vert\to0}\sum^n_{i=1}f(\xi_i,\eta_i)\Delta\sigma_i

可证明,如果f(x,y)f(x,y)在有界闭域DD上有界且不连续点集EE为为零面积集(零测集),则f(x,y)f(x,y)DD上是可积的。

利用Fubini定理,二重积分可转为累次积分轻松解决(按转写前后定义域应相同为原则即可);需要特别指出的是二重积分转为极坐标累次积分,作极坐标变换

T:{x=rcosθy=rsinθ  ,    0r<+, 0θ2π T:\left\{\begin{aligned} &x=r\cos\theta\\ &y=r\sin\theta\end{aligned}\right.\ \ ,\ \ \ \ 0\leqslant r<+\infty,\ 0\leqslant\theta\leqslant2\pi

可以得到结果:

Df(x,y)dσ=βαdθφ1(θ)φ2(θ)rf(rcosθ,rsinθ)dr \iint\limits_Df(x,y)\mathrm{d}\sigma=\int^{\alpha}_{\beta}\mathrm{d}\theta\int^{\varphi_2(\theta)}_{\varphi_1(\theta)}r\,f(r\cos\theta,r\sin\theta)\mathrm{d}r

↑ 这一公式在下文“定积分的几何应用”章节下的“二重积分计算面积”部分有可视化。一般来说,当被积函数可以被写为f(x2+y2)f(\sqrt{x^2+y^2})f(xy)f(\frac{x}{y}),或是积分域为圆x2+y2Rx^2+y^2\leqslant R、同心圆、椭圆x2+y22ax   or   2byx^2+y^2\leqslant 2ax\ \;or\ \;2by时,将重积分转写为极坐标下的累次积分计算较为方便。

通常,利用好对称性对重积分的计算有极大帮助:

  • 注意奇偶性;
  • 注意对称性;
  • 注意轮换对称性。

二重积分在转化为二次积分发现难以计算时,换序后可能就会变得容易处理得多。

三重积分

类比二重积分。

类似二重积分的极坐标变换,三重积分也有一些常用的坐标变换。不妨设一个三重积分为Vf(x,y,z)dxdydz\displaystyle{\iiint\limits_Vf(x,y,z)\mathrm{d}x\mathrm{d}y\mathrm{d}z}

  • 柱面坐标变换

    T:{x=rcosθ,0r<+y=rsinθ,0θ2πz=z,<z<+ T:\left\{\begin{aligned} &x=r\cos\theta,&&0\leqslant r<+\infty\\ &y=r\sin\theta,&&0\leqslant\theta\leqslant2\pi\\ &z=z,&&-\infty\lt z<+\infty \end{aligned}\right. Vf(x,y,z)dxdydz=Vrf(rcosθ,rsinθ,z)drdθdz=Ddxdyz1(x,y)z2(x,y)f(x,y,z)dz \begin{align}\iiint\limits_Vf(x,y,z)\mathrm{d}x\mathrm{d}y\mathrm{d}z&=\iiint\limits_{V'}rf(r\cos\theta,r\sin\theta,z)\mathrm{d}r\mathrm{d}\theta\mathrm{d}z\\&=\iint\limits_D\mathrm{d}x\mathrm{d}y\int^{z_2(x,y)}_{z_1(x,y)}f(x,y,z)\mathrm{d}z\end{align}

    其中VV'VV在柱面坐标变换下的原象,DDVVxyxy平面上的投影区域,即V={(x,y,z)z1(x,y)zz2(x,y),(x,y)D}V=\{(x,y,z)|z_1(x,y)\leqslant z\leqslant z_2(x,y),(x,y)\in D\}

  • 球坐标变换

    T:{x=rsinφcosθ,0r<+y=rsinφsinθ,0φπz=rcosφ,0θ2π T:\left\{\begin{aligned} &x=r\sin\varphi\cos\theta,&&0\leqslant r<+\infty\\ &y=r\sin\varphi\sin\theta,&&0\leqslant\varphi\leqslant\pi\\ &z=r\cos\varphi,&&0\leqslant\theta\leqslant2\pi \end{aligned}\right. Vf(x,y,z)dxdydz=Vr2sinφf(rsinφcosθ,rsinφsinθ,rcosφ)drdφdθ=θ1θ2dθφ1(θ)φ2(θ)dφr1(φ,θ)r2(φ,θ)r2sinφf(rsinφcosθ,rsinφsinθ,rcosφ)dr \begin{align}\iiint\limits_Vf(x,y,z)\mathrm{d}x\mathrm{d}y\mathrm{d}z&=\iiint\limits_{V'}r^2\sin\varphi f(r\sin\varphi\cos\theta,r\sin\varphi\sin\theta,r\cos\varphi)\mathrm{d}r\mathrm{d}\varphi\mathrm{d}\theta\\&=\int^{\theta_2}_{\theta_1}\mathrm{d}\theta\int^{\varphi_2(\theta)}_{\varphi_1(\theta)}\mathrm{d}\varphi\int^{r_2(\varphi,\theta)}_{r_1(\varphi,\theta)}r^2\sin\varphi f(r\sin\varphi\cos\theta,r\sin\varphi\sin\theta,r\cos\varphi)\mathrm{d}r\end{align}

    其中VV'VV在球坐标变换下的原象,V={(r,φ,θ)r1(φ,θ)rr2(φ,θ),φ1(θ)φφ2(θ),θ1θθ2}V=\{(r,\varphi,\theta)|r_1(\varphi,\theta)\leqslant r\leqslant r_2(\varphi,\theta),\varphi_1(\theta)\leqslant\varphi\leqslant\varphi_2(\theta),\theta_1\leqslant\theta\leqslant\theta_2\}

重积分的中值定理

DD是平面有界闭区域,f(x,y)f(x,y)g(x,y)g(x,y)都在DD上连续且g(x,y)g(x,y)DD上不变号,则存在(ξ,η)D(\xi,\eta)\in D,使得

Df(x,y)g(x,y)dσ=f(ξ,η)Dg(x,y)dσ \iint\limits_Df(x,y)g(x,y)\mathrm{d}\sigma=f(\xi,\eta)\iint\limits_Dg(x,y)\mathrm{d}\sigma

推论:设DD是平面有界闭区域,f(x,y)f(x,y)DD上连续,则存在(ξ,η)D(\xi,\eta)\in D,使得Df(x,y)dσ=f(ξ,η)S\displaystyle{\iint\limits_Df(x,y)\mathrm{d}\sigma=f(\xi,\eta)S},其中SSDD的面积,即S=D1dσS=\displaystyle{\iint\limits_D1\mathrm{d}\sigma}

重积分的应用 (几何应用)

下述积分的不定积分是可以求出来的,但是从圆、椭圆的面积公式来看,也有:

  • 0aa2x2dx=π4a2\displaystyle{\int^a_0\sqrt{a^2-x^2}}\mathrm{d}x=\frac{\pi}4a^2
  • 0a2axx2dx=π4a2\displaystyle{\int^a_0\sqrt{2ax-x^2}}\mathrm{d}x=\frac{\pi}4a^2
  • 02a2axx2dx=π2a2\displaystyle{\int^{2a}_0\sqrt{2ax-x^2}}\mathrm{d}x=\frac{\pi}2a^2

积分计算函数平均数

可积函数ff在区间[a,b][a,b]上的平均数被定义为

average=1baabf(x)dx average=\frac1{b-a}\int^b_af(x)\mathrm{d}x

由此可以把离散形式的均值不等式推广到连续的积分形式,这在文首已给出。

同样地,利用重积分,对多元函数也可以类似定义平均数。

计算一元积分

一些难以直接计算的一元定积分、反常积分,通过“升维”到二重积分或利用含参量积分,计算可能会容易许多。一些含参量积分也可以联系到二重积分,二者没有本质上的区别。

最经典的例子莫过于无穷积分之欧拉-泊松积分Rex2dx\displaystyle{\int_{\mathbb{R}}e^{-x^2}\mathrm{d}x}了,要解出正态分布概率密度函数的确切形式,就不得不讨论这个积分的值。直接求解固然困难,但巧妙地利用二重积分,便可以化繁为简:

Rex2dx=R2e(x2+y2)dσ=02πdθ01rer2dr=π \int_{\mathbb{R}}e^{-x^2}\mathrm{d}x=\sqrt{\iint_{\mathbb{R}^2}e^{-(x^2+y^2)}\mathrm{d}\sigma}=\sqrt{\int^{2\pi}_0\mathrm{d}\theta\int^1_0re^{-r^2}\mathrm{d}r}=\sqrt{\pi}

再者如含参量积分01xbxalnxdx\displaystyle\int^1_0\frac{x^b-x^a}{\ln x}\mathrm{d}x,其中a,b>0a,b>0,有

01xbxalnxdx=01dxabxtdt=abdt01xtdx=ab1t+1dt=ln(b+1a+1) \begin{align} \int^1_0\frac{x^b-x^a}{\ln x}\mathrm{d}x&=\int^1_0\mathrm{d}x\int^b_ax^t\mathrm{d}t\\ &=\int^b_a\mathrm{d}t\int^1_0x^t\mathrm{d}x\\ &=\int^b_a\frac1{t+1}\mathrm{d}t\\ &=\ln\left(\frac{b+1}{a+1}\right)\end{align}

二重积分计算平面面积

f(x,y)f(x,y)视为密度 / 高度,于是二重积分等价于求区域上一个几何体的质量 (平面几何体) / 体积 (立体几何体);特别地,当被积函数为f(x,y)=1f(x,y)=1时,在其定义域上二重积分可以视为求平面上定义域图形的面积。

求面积的二重积分可以转化为二次积分,如某平面域DD是由上曲线f(x)f(x)与下曲线g(x)g(x)x=ax=ax=bx=b包围而成的,则其面积为:

S=D1dσ=abdxg(x)f(x)1dy=ab[f(x)g(x)]dx S=\iint\limits_D1\mathrm{d}\sigma=\int^b_a\mathrm{d}x\int^{f(x)}_{g(x)}1\mathrm{d}y=\int^b_a\big[f(x)-g(x)\big]\mathrm{d}x

若平面域DD是由曲线r=r(θ)r=r(\theta)θ=α\theta=\alphaθ=β\theta=\beta所包围而成的(如下图),则其面积为:

S=D1dσ=αβdθ0r(θ)rdr=12αβr2(θ)dθ S=\iint\limits_D1\mathrm{d}\sigma=\int^{\beta}_{\alpha}\mathrm{d}\theta\int^{r(\theta)}_0r\mathrm{d}r=\frac12\int^{\beta}_{\alpha}r^2(\theta)\mathrm{d}\theta

二重积分计算面积

实际上,更一般的标准欧式正交基下的二重积分与极坐标二重积分之间可以相互转换:

Df(x,y)dσ=βαdθφ1(θ)φ2(θ)rf(rcosθ,rsinθ)dr \iint\limits_Df(x,y)\mathrm{d}\sigma=\int^{\alpha}_{\beta}\mathrm{d}\theta\int^{\varphi_2(\theta)}_{\varphi_1(\theta)}r\,f(r\cos\theta,r\sin\theta)\mathrm{d}r

可以推广为三重积分计算体积,元密度为11(即假设空间体体积均匀分布)。正如下文所述,二重积分也能计算体积,因此积分式能代表什么,关键在于如何看待被积式。

展开/收起1道利用积分计算面积例题

其实用二重积分计算平面面积与用定积分计算平面面积相比别无二致,因为如果用二重积分计算平面面积则被积式为11,这里重积分可以等价为二次积分,接着对第一次积分应用牛顿-莱布尼茨定理即得到定积分。

  • 求曲线y=exsinxy=e^{-x}\sin x[0,+)[0,+\infty)上与xx轴所围的面积SS

    解:唯一要注意的是不能将式子写为S=0+exsinxdx\displaystyle S=\int^{+\infty}_0e^{-x}\sin x\mathrm{d}x,因为yy[0,+)[0,+\infty)上是不断变号的,这个问题的正确计算应该是

    S=0+exsinxdx=n=0(1)nnπ(n+1)πexsinxdx=x=nπ+tn=0enπ0πetsintdt \begin{align} S&=\int^{+\infty}_0|e^{-x}\sin x|\mathrm{d}x\\ &=\sum^{\infty}_{n=0}(-1)^n\int^{(n+1)\pi}_{n\pi}e^{-x}\sin x\mathrm{d}x\\ &\xlongequal{x=n\pi+t}\sum^{\infty}_{n=0}e^{-n\pi}\int^{\pi}_0e^{-t}\sin t\mathrm{d}t \end{align}

    对于定积分I=0πetsintdt\displaystyle I=\int^{\pi}_0e^{-t}\sin t\mathrm{d}t,可以分别对ete^{-t}sint\sin t运用分部积分求解

    I=0πetsintdt=0πsintdet=0+0πetcostdt I=\int^{\pi}_0e^{-t}\sin t\mathrm{d}t=-\int^{\pi}_0\sin t\mathrm{d}e^{-t}=0+\int^{\pi}_0e^{-t}\cos t\mathrm{d}t I=0πetsintdt=0πetdcost=eπ+10πetcostdt I=\int^{\pi}_0e^{-t}\sin t\mathrm{d}t=-\int^{\pi}_0e^{-t}\mathrm{d}\cos t=e^{-\pi}+1-\int^{\pi}_0e^{-t}\cos t\mathrm{d}t     I=I+I2=eπ+12 \Rightarrow\ \ \ \ I=\frac{I+I}2=\frac{e^{-\pi}+1}2

    所以

    S=eπ+12n=0enπ=eπ+12limn1enπ1eπ=eπ+12(1eπ) S=\frac{e^{-\pi}+1}2\sum^{\infty}_{n=0}e^{-n\pi}=\frac{e^{-\pi}+1}2\lim_{n\to\infty}\frac{1-e^{-n\pi}}{1-e^{-\pi}}=\frac{e^{-\pi}+1}{2(1-e^{-\pi})}

二重积分计算曲面面积

二重积分计算曲面面积

二重积分计算旋转体体积

欲求平面域DD饶直线L:ax+by+c=0L:\,ax+by+c=0旋转产生的旋转体体积VV,可以在DD中选取一面积为dσ\mathrm{d}\sigma的子区域,设(x,y)(x,y)为子区域上的任意一点,记r(x,y)r(x,y)为点(x,y)(x,y)到直线LL的距离,即

r(x,y)=ax+by+ca2+b2 r(x,y)=\frac{|ax+by+c|}{\sqrt{a^2+b^2}}

则该子区域绕直线LL旋转所得环状体的近似值为

dV=2πr(x,y)dσ \mathrm{d}V=2\pi\,r(x,y)\mathrm{d}\sigma

因此,一般地有

V=2πDr(x,y)dσ \boldsymbol{V=2\pi\iint\limits_Dr(x,y)\mathrm{d}\sigma}

特别地,设区域DD是由曲线y=f(x)0y=f(x)\geqslant0x=ax=ax=bx=byy轴所围成的,则:

  • DDxx轴旋转一周(r(x,y)=yr(x,y)=y)产生的旋转体体积:

    Vx=2πDydσ=2πabdx0f(x)ydy=πabf2(x)dx V_x=2\pi\iint\limits_Dy\mathrm{d}\sigma=2\pi\int^b_a\mathrm{d}x\int^{f(x)}_0y\mathrm{d}y=\pi\int^b_af^2(x)\mathrm{d}x
  • DDyy轴旋转一周(r(x,y)=xr(x,y)=x)产生的旋转体体积:

    Vy=2πDxdσ=2πabdx0f(x)xdy=2πabxf(x)dx V_y=2\pi\iint\limits_Dx\mathrm{d}\sigma=2\pi\int^b_a\mathrm{d}x\int^{f(x)}_0x\mathrm{d}y=2\pi\int^b_axf(x)\mathrm{d}x
  • DDx=x0x=x_0旋转一周产生的旋转体体积:

    Vx=x0=2πD(x0x)dσ=2πabdx0f(x)(x0x)dy V_{x=x_0}=2\pi\iint\limits_D(x_0-x)\mathrm{d}\sigma=2\pi\int^b_a\mathrm{d}x\int^{f(x)}_0(x_0-x)\mathrm{d}y
  • DDy=y0y=y_0旋转一周产生的旋转体体积:

    Vy=y0=2πD(y0y)dσ=2πabdx0f(x)(y0y)dy V_{y=y_0}=2\pi\iint\limits_D(y_0-y)\mathrm{d}\sigma=2\pi\int^b_a\mathrm{d}x\int^{f(x)}_0(y_0-y)\mathrm{d}y

如果曲线的上下界线分别是f1f_1f2f_2,不妨记f1>f2f_1>f_2,则第一个公式修改为2πabdxf2(x)f1(x)ydy\displaystyle{2\pi\int^b_a\mathrm{d}x\int^{f_1(x)}_{f_2(x)}y\mathrm{d}y},其余公式以此类推。

但个人认为以上公式没必要硬记,他们都只是V=2πDr(x,y)dσ\displaystyle{V=2\pi\iint\limits_Dr(x,y)\mathrm{d}\sigma}的特殊变体。

举个具体的例子,求由曲线y=x2y=x^2与直线y=xy=x所围成的区域DD绕直线y=xy=x旋转一周所得旋转体的体积,直接代入公式有:

Vy=x=2πDyx2dσ=2π201dxx2x(xy)dy=2π60 \begin{align} V_{y=x}&=2\pi\iint\limits_D\frac{|y-x|}{\sqrt2}\mathrm{d}\sigma\\ &=\frac{2\pi}{\sqrt2}\int^1_0\mathrm{d}x\int^x_{x^2}(x-y)\mathrm{d}y\\ &=\frac{\sqrt2\pi}{60}\end{align}

若已知横截面面积系数S(x)S(x)(体积“密度”),则直接积分V=abS(x)dx\displaystyle{V=\int^b_aS(x)\mathrm{d}x}即可。

展开/收起1道有趣的计算例子

在利用二重积分计算旋转体体积的时候,有时可以利用一些有趣的计算技巧。

  • 例如,设函数y(x)y(x)x[0,+)x\in[0,+\infty)上由隐函数y3+xy8=0y^3+xy-8=0所确定,求由曲线y=y(x)y=y(x)、直线x=7x=7和两个坐标轴所围成的曲边梯形绕xx轴旋转一周所得旋转体的体积VV

    1. 可以直接代入公式计算,即直接对区域作分割。

      由于题目给出的是一个隐函数,而y(x)y(x)的具体形式又难以求解,故xx型区域是难以表示的;但很容易注意到x=8y3yx=\frac{8-y^3}y,所以可以尝试将区域表示为yy型区域。

      根据隐函数可微性定理,可以知道y(x)y'(x)存在且y(x)=y3y2+x<0y'(x)=-\frac{y}{3y^2+x}<0(其中yy恒正),即y(x)y(x)[0,+][0,+\infty]上恒正且单调递减,又x=0x=0y=3y=3x=7x=7y=1y=1,所以用yy型区域表示积分区域的话,就是一个矩形加上一个小直角曲边梯形(画出来会更直观),记题干描述的区域 (大曲边梯形) 为DD,即

      V=2πDr(x,y)dσ=2π12dy08y3yydx+2π01dy07ydx=312π \begin{align}V&=2\pi\iint\limits_Dr(x,y)\mathrm{d}\sigma\\&=2\pi\int^2_1\mathrm{d}y\int^{\frac{8-y^3}y}_0y\mathrm{d}x+2\pi\int^1_0\mathrm{d}y\int^7_0y\mathrm{d}x\\&=\frac{31}2\pi\end{align}
    2. 但我们有更精妙的方法。

      因为要计算的是曲边梯形绕xx轴旋转一周所得旋转体的体积,

      V=2π07dx0y(x)ydx=π07[y(x)]2dx V=2\pi\int^7_0\mathrm{d}x\int^{y(x)}_0y\mathrm{d}x=\pi\int^7_0\big[y(x)\big]^2\mathrm{d}x

      所以我们只要能求出y2dxy^2\mathrm{d}x的表达式就可以了,而不需要求y(x)y(x)

      y3+xy8=0y^3+xy-8=0,两边取微分得3y2dy+ydy+xdx=03y^2\mathrm{d}y+y\mathrm{d}y+x\mathrm{d}x=0,即ydx=(3y2+x)dyy\mathrm{d}x=-(3y^2+x)\mathrm{d}y,进而y2dx=(3y3+xy)dyy^2\mathrm{d}x=-(3y^3+xy)\mathrm{d}y;又回到y3+xy8=0y^3+xy-8=0,有xy=8y3xy=8-y^3,将其代入y2dxy^2\mathrm{d}x,得y2dx=2(y3+4)dyy^2\mathrm{d}x=-2(y^3+4)\mathrm{d}y,所以

      V=π07[y(x)]2dx=π212(y3+4)dy=312π V=\pi\int^7_0\big[y(x)\big]^2\mathrm{d}x=\pi\int^1_2-2(y^3+4)\mathrm{d}y=\frac{31}2\pi

曲线弧长与旋转体侧面积

曲线弧长

  1. 设曲线段CC由直角坐标方程y=y(x)y=y(x)axba\leqslant x\leqslant b)给出,其中y(x)y(x)[a,b][a,b]上有一阶连续导数,则这一段曲线段的弧长为

    s=ab1+y2dx s=\int^b_a\sqrt{1+{y'}^2}\,\mathrm{d}x
  2. 设曲线段CC由参数方程{x=φ(t)y=ψ(t) ,   t[α,β]\left\{\begin{aligned}&x=\varphi(t)\\&y=\psi(t)\end{aligned}\right.\ ,\ \ \ t\in[\alpha,\beta]给出,其中φ(t),ψ(t)\varphi(t),\psi(t)[α,β][\alpha,\beta]上有一阶连续导数,则这一段曲线段的弧长为

    s=αβ[φ(t)]2+[ψ(t)]2dt s=\int^{\beta}_{\alpha}\sqrt{[\varphi'(t)]^2+[\psi'(t)]^2}\,\mathrm{d}t
  3. 特别地,设曲线段CC由极坐标方程r=r(θ)r=r(\theta)αθβ\alpha\leqslant\theta\leqslant\beta)给出,其中r(θ)r(\theta)[α,β][\alpha,\beta]上有一阶连续导数,则这一段曲线段的弧长为

    s=αβr2(θ)+r2(θ)dθ s=\int^{\beta}_{\alpha}\sqrt{r^2(\theta)+{r'}^2(\theta)}\,\mathrm{d}\theta

注意,根据解析几何知识,拥有直角坐标方程的曲线一定也有参数方程,但反之不一定。一般而言,直角坐标方程都是通过可求解的参数方程解出来的。

旋转体侧面积

由曲线y=f(x)y=f(x)f(x)0f(x)\geqslant0)和直线x=a,x=bx=a,\,x=b0a<b0\leqslant a\lt b)及xx轴所围成的区域绕xx轴旋转所得旋转体的侧体积为

S=2πabf(x)1+f2(x)dx S=2\pi\int^b_af(x)\sqrt{1+{f'}^2(x)}\mathrm{d}x

赋值问题

类似于已知axf(x,t)dt=g(x)\displaystyle{\int^x_{a}f(x,t)\mathrm{d}t=g(x)}而求abf(x)dx\displaystyle{\int^b_af(x)\mathrm{d}x}这类的问题,老黄将其称为“赋值问题”,这里沿用他的称呼。

  • 首先,可以考虑取个别值代入,观察能否导出结论;
  • 如不能,则可以考虑综合个别值,取平均值,试试能不能求解;
  • 如若仍没有进展,则考虑在等式两边对xx积分,即取连续平均值,得到一个二重积分,试着通过二重积分求解。要注意观察换序是否可以化繁为简,如果可以那么应当换序;
  • 最后,如果连续平均(直接积分)还是不能解决,可以考虑加权平均,即dcdxaxp(x)f(x,t)dt\displaystyle{\int^c_d\mathrm{d}x\int^x_{a}p(x)f(x,t)\mathrm{d}t},其中p(x)p(x)是权重函数,其积分应为11

以一道具体的题目为例,设f(x)f(x)是非负连续函数,有xπ2f(tx)f(t)dt=cos4x\displaystyle{\int^{\frac{\pi}2}_xf(t-x)f(t)\mathrm{d}t=\cos^4x},求积分0π2f(x)dx\displaystyle{\int^{\frac{\pi}2}_0f(x)\mathrm{d}x}

可以发现,直接代入x=0x=0是得不到0π2f(x)dx\displaystyle{\int^{\frac{\pi}2}_0f(x)\mathrm{d}x}相关的结果的,所以考虑连续平均,即二次积分。对等式两端进行对xx的积分,得:

0π2dxxπ2f(tx)f(t)dt=0π2cos4xdx=34×12×π2=3π16 \int^{\frac{\pi}2}_0\mathrm{d}x\int^{\frac{\pi}2}_xf(t-x)f(t)\mathrm{d}t=\int^{\frac{\pi}2}_0\cos^4x\mathrm{d}x=\frac34\times\frac12\times\frac{\pi}2=\frac{3\pi}{16}

由于积分xπ2f(tx)f(t)dt\displaystyle{\int^{\frac{\pi}2}_xf(t-x)f(t)\mathrm{d}t}不好处理,所以考虑积分换序,

换序

F(x)=0xf(t)dt\displaystyle{F(x)=\int^x_0f(t)\mathrm{d}t},有

0π2dxxπ2f(tx)f(t)dt=换序0π2dt0tf(tx)f(t)dx=u=tx换元0π2f(t)dtt0f(u)du=0π2f(t)F(t)dt=12F2(π2)12F2(0) \begin{align}\int^{\frac{\pi}2}_0\mathrm{d}x\int^{\frac{\pi}2}_xf(t-x)f(t)\mathrm{d}t&\xlongequal{\text{换序}}\int^{\frac{\pi}2}_0\mathrm{d}t\int^t_0f(t-x)f(t)\mathrm{d}x\\&\xlongequal[u=t-x]{\text{换元}}\int^{\frac{\pi}2}_0f(t)\mathrm{d}t\int^0_{t}-f(u)\mathrm{d}u\\&=\int^{\frac{\pi}2}_0f(t)F(t)\mathrm{d}t\\&=\frac12F^2\Big(\frac{\pi}2\Big)-\frac12F^2(0)\end{align}

综上,有12F2(π2)=12[0π2f(x)dx]2=3π16\displaystyle{\frac12F^2\Big(\frac{\pi}2\Big)=\frac12\left[\displaystyle{\int^{\frac{\pi}2}_0f(x)\mathrm{d}x}\right]^2=\frac{3\pi}{16}},又f(x)f(x)是非负函数,所以0π2f(x)dx=6π4\displaystyle{\int^{\frac{\pi}2}_0f(x)\mathrm{d}x}=\frac{\sqrt{6\pi}}4

三大积分&极限换序定理

这里只给出命题,而不加证明。比如DCT证明起来就非常麻烦,证明方法可以参考任何一本《实变函数论》教材。

  1. Fatou’s Lemma,Fatou引理

    {fn(x)}\big\{f_n(x)\big\}是可测集EE上的可测函数列,则

    Elimnfn(x)dxlimnEfn(x)dx \int_E\varliminf_{n\to\infty}f_n(x)\mathrm{d}x\leqslant\varliminf_{n\to\infty}\int_Ef_n(x)\mathrm{d}x

    注意:

    • 当存在EE上的非负可积函数g(x)g(x),使得对nN+\forall n\in\mathbb{N}^+fn(x)g(x) a.e.f_n(x)\geqslant g(x)\ \,a.e.成立,则可以将Fatou引理适用范围拓展至值域为扩展实数轴的{fn(x)}\big\{f_n(x)\big\}
    • 假设函数列几乎处处收敛到ff或依测度收敛到ff,命题仍然成立,这时limnfn=f\varliminf\limits_{n\to\infty}f_n=f,即Ef(x)dxlimnEfn(x)dx\displaystyle\int_Ef(x)\mathrm{d}x\leqslant\varliminf_{n\to\infty}\int_Ef_n(x)\mathrm{d}x

    类似地,我们有反向的Fatou引理。设{fn(x)}\big\{f_n(x)\big\}是可测集EE上的值域为扩展实数域的可测函数列,若存在EE上的非负可积函数g(x)g(x),使得对nN+\forall n\in\mathbb{N}^+fn(x)g(x) a.e.f_n(x)\geqslant g(x)\ \,a.e.成立,则

    Elimnfn(x)dxlimnEfn(x)dx \int_E\varlimsup_{n\to\infty}f_n(x)\mathrm{d}x\geqslant\varlimsup_{n\to\infty}\int_Ef_n(x)\mathrm{d}x
  2. MCT,Monotone Convergence Theorem

    \ast 在部分中文文献中也被称为Beppo Levi非负渐升列积分定理

    设定义在可测集EE上非负可测渐升函数列{fn(x)}\big\{f_n(x)\big\}满足f1(x)f2(x)fk(x)f_1(x)\leqslant f_2(x)\leqslant\cdots\leqslant f_k(x)\leqslant\cdots,且对xE  a.e.x\in E\ \ a.e.limnfn(x)=f(x)\lim\limits_{n\to\infty}f_n(x)=f(x),则

    limnEfn(x)dx=Ef(x)dx \lim_{n\to\infty}\int_Ef_n(x)\mathrm{d}x=\int_Ef(x)\mathrm{d}x

    类似地,我们有非负可积渐降列积分定理,但注意:针对非负渐升列仅仅要求函数可测即可,而对非负渐降列则进一步要求可积(非负可积函数是几乎处处有限的)。对于可测集EE上非负可测渐降函数列{fn(x)}\big\{f_n(x)\big\},如果在EE上还是可积的,且对xE  a.e.x\in E\ \ a.e.limnfn(x)=f(x)\lim\limits_{n\to\infty}f_n(x)=f(x),则

    limnEfn(x)dx=Ef(x)dx \lim_{n\to\infty}\int_Ef_n(x)\mathrm{d}x=\int_Ef(x)\mathrm{d}x
  3. DCT,Dominated Convergence Theorem

    \ast 在部分中文文献中也被称为Lebesgue控制收敛定理

    fnL1(E), nN+f_n\in L^1(E),\ n\in\mathbb{N}^+,且对于xE  a.e.x\in E\ \ a.e.limnfn(x)=f(x)\lim\limits_{n\to\infty}f_n(x)=f(x),若存在EE上的可积函数F(x)F(x)使得fn(x)F(x),  a.e. xE\big|f_n(x)\big|\leqslant F(x),\ \ a.e.\ x\in EnN+n\in\mathbb{N}^+,则fn(x)f_n(x)EE上依L1L^1意义收敛于ff,这意味着

    limnEfn(x)dx=Ef(x)dx \lim_{n\to\infty}\int_Ef_n(x)\mathrm{d}x=\int_Ef(x)\mathrm{d}x

    以上是在几乎处处收敛意义下的控制收敛定理。此外我们还有依测度收敛的控制收敛定理,设fnL1(Rk)f_n\in L^1(\mathbb{R}^k)nN+n\in\mathbb{N}^+,且fnf_nRk\mathbb{R}^k上依测度收敛到ff,若存在Rk\mathbb{R}^k上的可积函数F(x)F(x)使得fn(x)F(x),  a.e. xRk\big|f_n(x)\big|\leqslant F(x),\ \ a.e.\ x\in\mathbb{R}^knN+n\in\mathbb{N}^+,则fn(x)f_n(x)Rk\mathbb{R}^k上依L1L^1意义收敛于ff,同样可以导出

    limnRkfn(x)dx=Rkf(x)dx \lim_{n\to\infty}\int_{\mathbb{R}^k}f_n(x)\mathrm{d}x=\int_{\mathbb{R}^k}f(x)\mathrm{d}x

    在证明实数域上点态收敛的DCT时时,可以考虑先证明依测度收敛的DCT,再简洁地得到实数域上的点态收敛的DCT之推论。

    重要推论:对于一致有界且几乎处处收敛的函数列在有限测度集上的积分,其极限号与积分号可以交换次序,这被称为BCT,即Bounded Convergence Theorem

  4. DCT的推论——BCT的标准描述

    对于有限测度集EE(即μ(E)<\mu(E)<\infty),设fnL1(E), nN+f_n\in L^1(E),\ n\in\mathbb{N}^+,且对于xE  a.e.x\in E\ \ a.e.limnfn(x)=f(x)\lim\limits_{n\to\infty}f_n(x)=f(x),若存在MRM\in\mathbb{R}使得fn(x)M,  a.e. xE\big|f_n(x)\big|\leqslant M,\ \ a.e.\ x\in E,则

    limnEfn(x)dx=Ef(x)dx \lim_{n\to\infty}\int_Ef_n(x)\mathrm{d}x=\int_Ef(x)\mathrm{d}x

    BCT要求EE具有有限测度,是因为若EE的测度为无穷大,则常数MM在其上的积分也为无穷大,我们便不可再令常数MM作为“控制函数”。

换元注意事项

有一些细节问题我也不知道到底该归在哪一部分,那么就以一道例题的形式写下来吧。

f(x,y)f(x,y)在单位圆域上有连续的偏导数,而且f(x,y)f(x,y)在单位圆上值恒为00,若设区域Dε:ε2x2+y21D_{\varepsilon}:\varepsilon^2\leqslant x^2+y^2\leqslant1,其中0<ε<10<\varepsilon<1,求证

limε0+Dϵxfx+yfyx2+y2dσ=2πf(0,0) \lim_{\varepsilon\to0^+}\iint\limits_{D_{\epsilon}}\frac{xf'_x+yf'_y}{x^2+y^2}\mathrm{d}\sigma=-2\pi f(0,0)

一个直观的想法是,这个问题可以用格林公式处理。

L+(Pdx+Qdy)=D(QxPy) \oint_{L^+}(P\mathrm{d}x+Q\mathrm{d}y)=\iint\limits_D\left(\frac{\partial Q}{\partial x}-\frac{\partial P}{\partial y}\right)

那如果不用格林公式呢?这就涉及了一些知识点。

首先,对于圆域很自然就会想到极坐标变换:

{x=rcosθy=rsinθ    {r=x2+y2θ=arctanyx \left\{\begin{aligned}&x=r\cos\theta\\&y=r\sin\theta\end{aligned}\ \ \right.\Leftrightarrow\ \ \left\{\begin{aligned}&r=\sqrt{x^2+y^2}\\&\theta=\arctan\frac yx\end{aligned}\right.

接下来需要计算fxf_x'fyf_y'在极坐标变换下等于什么,根据链式法则,有

xfx=xf(x,y)x=换元rcosθ(f(rcosθ,rsinθ)rrx+f(rcosθ,rsinθ)θθx) xf'_x=x\frac{\partial f(x,y)}{\partial x}\xlongequal{\text{换元}}r\cos\theta\left(\frac{\partial f(r\cos\theta,r\sin\theta)}{\partial r}\frac{\partial r}{\partial x}+\frac{\partial f(r\cos\theta,r\sin\theta)}{\partial\theta}\frac{\partial\theta}{\partial x}\right)

注意在计算rx\frac{\partial r}{\partial x}时不能像一元积分那样把他处理为反函数的导数rx=1xr\frac{\partial r}{\partial x}=\frac1{\frac{\partial x}{\partial r}},因为二元函数的偏导数只是一个方便的记号,并不是微商,所以rx\frac{\partial r}{\partial x}正确的计算方法是先对xx求偏导,再代入x=rcosθx=r\cos\thetay=rsinθy=r\sin\theta,即rx=xx2+y2=xx2+y2=换元cosθ\frac{\partial r}{\partial x}=\frac{\partial}{\partial x}\sqrt{x^2+y^2}=\frac{x}{\sqrt{x^2+y^2}}\xlongequal{\text{换元}}\cos\theta。处理θx\frac{\partial \theta}{\partial x}同理,有θx=xarctanyx=yx21+y2x2=yx2+y2=换元sinθr\frac{\partial\theta}{\partial x}=\frac{\partial}{\partial x}\arctan\frac yx=\frac{-\frac{y}{x^2}}{1+\frac{y^2}{x^2}}=-\frac{y}{x^2+y^2}\xlongequal{\text{换元}}-\frac{\sin\theta}{r}

综上所述,可以得到xfx=rcosθ(frcosθfθsinθr)\displaystyle{xf'_x=r\cos\theta\Big(f_r'\cos\theta-\frac{f_{\theta}'\sin\theta}{r}\Big)},对yfyyf'_y做同样的操作,于是有:

xfx+yfy=rcosθ(frcosθfθsinθr)+rsinθ(frsinθ+fθcosθr)=rfr xf'_x+yf'_y=r\cos\theta\left(f_r'\cos\theta-\frac{f_{\theta}'\sin\theta}{r}\right)+r\sin\theta\left(f_r'\sin\theta+\frac{f_{\theta}'\cos\theta}r\right)=rf'_r

xfx+yfy=rfr\boldsymbol{xf'_x+yf'_y=rf'_r}

所以原式经极坐标变换后,是:

limε0+Dϵxfx+yfyx2+y2dσ=极坐标变换limε0+02πdθε1rrfr(rcosθ,rsinθ)r2dr=limε0+02πdθε1fr(rcosθ,rsinθ)dr=limε0+02πf(rcosθ,rsinθ)r=εr=1dθ=02πf(cosθ,sinθ)dθlimε0+02πf(εcosθ,εsinθ)dθ \begin{align} \lim_{\varepsilon\to0^+}\iint\limits_{D_{\epsilon}}\frac{xf'_x+yf'_y}{x^2+y^2}\mathrm{d}\sigma&\xlongequal{\text{极坐标变换}}\lim_{\varepsilon\to0^+}\int^{2\pi}_0\mathrm{d}\theta\int^1_{\varepsilon}r\,\frac{rf_r'(r\cos\theta,r\sin\theta)}{r^2}\mathrm{d}r\\ &=\lim_{\varepsilon\to0^+}\int^{2\pi}_0\mathrm{d}\theta\int^1_{\varepsilon}f_r'(r\cos\theta,r\sin\theta)\mathrm{d}r\\ &=\lim_{\varepsilon\to0^+}\int^{2\pi}_0f(r\cos\theta,r\sin\theta)\Big|^{r=1}_{r=\varepsilon}\mathrm{d}\theta\\ &=\int^{2\pi}_0f(\cos\theta,\sin\theta)\mathrm{d}\theta-\lim_{\varepsilon\to0^+}\int^{2\pi}_0f(\varepsilon\cos\theta,\varepsilon\sin\theta)\mathrm{d}\theta\end{align}

由于f(x,y)f(x,y)在单位圆上值恒为00,所以f(cosθ,sinθ)=0f(\cos\theta,\sin\theta)=0,进而02πf(cosθ,sinθ)dθ=0\displaystyle{\int^{2\pi}_0f(\cos\theta,\sin\theta)\mathrm{d}\theta=0}

对于limε0+02πf(εcosθ,εsinθ)dθ\displaystyle{\lim_{\varepsilon\to0^+}\int^{2\pi}_0f(\varepsilon\cos\theta,\varepsilon\sin\theta)\mathrm{d}\theta},注意到0εcosθε,0εsinθε0\leqslant|\varepsilon\cos\theta|\leqslant\varepsilon,\,0\leqslant|\varepsilon\sin\theta|\leqslant\varepsilon,因此可以考虑重积分的中值定理 (对于重积分一定要想到中值定理),即

limε0+02πf(εcosθ,εsinθ)dθ=limε0+f(ξ,η)02πdθ,  其中0ξ2+η2ε=2πf(0,0) \begin{align}\lim_{\varepsilon\to0^+}\int^{2\pi}_0f(\varepsilon\cos\theta,\varepsilon\sin\theta)\mathrm{d}\theta&=\lim_{\varepsilon\to0^+}f(\xi,\eta)\int^{2\pi}_0\mathrm{d}\theta,\ \ \text{其中}0\leqslant\xi^2+\eta^2\leqslant\varepsilon\\&=2\pi f(0,0)\end{align}

不过也可以考虑勒贝格控制收敛定理,由于f(εcosθ,εsinθ)f(\varepsilon\cos\theta,\varepsilon\sin\theta)可微,故而在积分区域内有界。根据勒贝格控制收敛定理,有界函数列在有限测度集上的积分一定可以与极限交换次序,所以:

limε0+02πf(εcosθ,εsinθ)dθ=02πlimε0+f(εcosθ,εsinθ)dθ=02πf(0,0)dθ=2πf(0,0) \begin{align}\lim_{\varepsilon\to0^+}\int^{2\pi}_0f(\varepsilon\cos\theta,\varepsilon\sin\theta)\mathrm{d}\theta&=\int^{2\pi}_0\lim_{\varepsilon\to0^+}f(\varepsilon\cos\theta,\varepsilon\sin\theta)\mathrm{d}\theta\\&=\int^{2\pi}_0f(0,0)\mathrm{d}\theta\\&=2\pi f(0,0)\end{align}

最常用的三大积分号与极限号换序定理,Levi非负渐升列积分定理、Fatou引理与Lebesgue控制收敛定理,实在是一把利器。初阶的数学分析教材一般会提到如果函数列一致收敛到函数,那么就可以换序,但一致收敛的条件还是太强了,所以Lebesgue控制收敛定理通常更常用。

含参量积分(暂略)

暂略

曲线积分

第一型曲线积分

第一型曲线积分,即依弧长的积分。第一型曲线积分与曲线的方向无关,这是因为弧长是无向的,这一点应当与第一型曲线积分辨别。

Lf(x,y)ds=limT0i=1nf(ξi,ηi)Δsi \int_Lf(x,y)\mathrm{d}s=\lim_{\Vert T\Vert\to0}\sum^n_{i=1}f(\xi_i,\eta_i)\Delta s_i Lf(x,y,z)ds=limT0i=1nf(ξi,ηi,γi)Δsi \int_Lf(x,y,z)\mathrm{d}s=\lim_{\Vert T\Vert\to0}\sum^n_{i=1}f(\xi_i,\eta_i,\gamma_i)\Delta s_i

第一型曲线积分是定积分的推广,就像第一型曲面积分是二重积分的推广一样。类似于可以认为定积分代表着被积函数与直线xx轴围成平面图形的面积,同样可以认为平面曲线的第一型曲线积分代表着以平面曲线LL为投影、以f(x,y)f(x,y)为高度的曲线同OxyOxy平面围成柱面的面积。更严谨地说,当LL是平面OxyOxy上分段光滑曲线且f(x,y)f(x,y)是定义在LL上的非负连续函数时,Lf(x,y)ds\displaystyle\int_Lf(x,y)\mathrm{d}s就是以LL为准线,且母线平行于zz轴的柱面上截取0zf(x,y)0\leqslant z\leqslant f(x,y)部分的面积。

还可以将f(x,y)f(x,y)视为密度,那么Lf(x,y)ds\displaystyle\int_Lf(x,y)\mathrm{d}s也可以被视为平面曲线LL的质量。类似地,Lf(x,y,z)ds\displaystyle\int_Lf(x,y,z)\mathrm{d}s可以被视为空间曲线LL的质量。当f(x,y)1f(x,y)\equiv1时,第一型曲线积分Lds\displaystyle\int_L\mathrm{d}s在数值上等于曲线LL的周长。

第一型曲线积分的计算:设有通过参数方程定义的光滑曲线LL

L:{x=φ(t)y=ψ(t) ,   t[α,β] L:\left\{\begin{aligned}&x=\varphi(t)\\&y=\psi(t)\end{aligned}\right.\ ,\ \ \ t\in[\alpha,\beta]

f(x,y)f(x,y)是定义在LL上的连续函数,其中φ(t),ψ(t)\varphi(t),\psi(t)[α,β][\alpha,\beta]上均具有一阶连续导数,则有

Lf(x,y)ds=αβf(φ(t),ψ(t))[φ(t)]2+[ψ(t)]2dt \color{#C80032}{\int_Lf(x,y)\mathrm{d}s=\int^{\beta}_{\alpha}f\big(\varphi(t),\psi(t)\big)\sqrt{[\varphi'(t)]^2+[\psi'(t)]^2}\,\mathrm{d}t}

推导是容易的,只需要注意到LL上由t=ti1t=t_{i-1}t=tit=t_i的弧长为

Δsi=ti1ti[φ(t)]2+[ψ(t)]2dt \Delta s_i=\int^{t_i}_{t_{i-1}}\sqrt{[\varphi'(t)]^2+[\psi'(t)]^2}\,\mathrm{d}t

再考虑积分中值定理,接着按第一型曲线积分的定义作推导即可。

  • 特别地,当曲线LL由方程y=y(x)y=y(x)x[a,b]x\in[a,b])表示时,计算公式成为

    Lf(x,y)ds=abf(x,y(x))1+y2(x)dx \color{#C80032}{\int_Lf(x,y)\mathrm{d}s=\int^b_af\big(x,y(x)\big)\sqrt{1+{y'}^2(x)}\,\mathrm{d}x}
  • 当曲线LL由方程x=x(y)x=x(y)y[c,d]y\in[c,d])表示时,计算公式成为

    Lf(x,y)ds=abf(x(y),y)1+x2(y)dy \color{#C80032}{\int_Lf(x,y)\mathrm{d}s=\int^b_af\big(x(y),y\big)\sqrt{1+{x'}^2(y)}\,\mathrm{d}y}

第二类曲线积分

第二型曲线积分,即依坐标的积分。在物理学中,涉及变力做功这样的矢量积分问题,就可能是第二型曲线积分的应用场景。第二型曲线积分与有向曲线AB\overset{\,\frown}{AB}的方向有关,如果朝着相反的方向积分,则结果为相反数,这一点应与第一型曲线积分辨析。

ABP(x,y)dx+Q(x,y)dy =limT0i=1nP(ξi,ηi)Δxi +limT0i=1nQ(ξi,ηi)Δyi \int_{\overset{\,\frown}{AB}}P(x,y)\mathrm{d}x+Q(x,y)\mathrm{d}y\ =\lim_{\Vert T\Vert\to0}\sum^n_{i=1}P(\xi_i,\eta_i)\Delta x_i\ +\lim_{\Vert T\Vert\to0}\sum^n_{i=1}Q(\xi_i,\eta_i)\Delta y_i ABP(x,y,z)dx+Q(x,y,z)dy+R(x,y,z)dz=limT0i=1nP(ξi,ηi,γi)Δxi +limT0i=1nQ(ξi,ηi,γi)Δyi +limT0i=1nR(ξi,ηi,γi)Δzi \begin{aligned}\int_{\overset{\,\frown}{AB}}P(&x,y,z)\mathrm{d}x+Q(x,y,z)\mathrm{d}y+R(x,y,z)\mathrm{d}z\\&=\textstyle\lim\limits_{\Vert T\Vert\to0}\sum^n\limits_{i=1}P(\xi_i,\eta_i,\gamma_i)\Delta x_i\ +\lim\limits_{\Vert T\Vert\to0}\sum^n\limits_{i=1}Q(\xi_i,\eta_i,\gamma_i)\Delta y_i\ +\lim\limits_{\Vert T\Vert\to0}\sum^n\limits_{i=1}R(\xi_i,\eta_i,\gamma_i)\Delta z_i\end{aligned}

L=ABL=\overset{\,\frown}{AB}为封闭有向曲线时,任选一点作为曲线起点即可(同时这一点也作为曲线终点),积分可以写为

LP(x,y)dx+Q(x,y)dy \oint_LP(x,y)\mathrm{d}x+Q(x,y)\mathrm{d}y

可见,第二型曲线积分没有考虑圆弧,而是考虑针对坐标分量分别积分。

第二型曲线积分的计算:设有通过参数方程定义的光滑有向曲线L=ABL=\overset{\,\frown}{AB}

L:{x=φ(t)y=ψ(t) ,   t[α,β] L:\left\{\begin{aligned}&x=\varphi(t)\\&y=\psi(t)\end{aligned}\right.\ ,\ \ \ t\in[\alpha,\beta]

f(x,y)f(x,y)是定义在LL上的连续函数,其中φ(t),ψ(t)\varphi(t),\psi(t)[α,β][\alpha,\beta]上均具有一阶连续导数,则有

LP(x,y)dx+Q(x,y)dy=αβ[P[φ(t),ψ(t)]φ(t)+Q[φ(t),ψ(t)]ψ(t)]dt \color{#C80032}{\int_LP(x,y)\mathrm{d}x+Q(x,y)\mathrm{d}y=\int^{\beta}_{\alpha}\Big[P\big[\varphi(t),\psi(t)\big]\varphi'(t)+Q\big[\varphi(t),\psi(t)\big]\psi'(t)\Big]\mathrm{d}t}
  • 当曲线LL由方程y=y(x)y=y(x)x[a,b]x\in[a,b])表示时,计算公式成为

    LP(x,y)dx+Q(x,y)dy=αβ[P[x,y(x)]+Q[x,y(x)]y(x)]dx \color{#C80032}{\int_LP(x,y)\mathrm{d}x+Q(x,y)\mathrm{d}y=\int^{\beta}_{\alpha}\Big[P\big[x,y(x)\big]+Q\big[x,y(x)\big]y'(x)\Big]\mathrm{d}x}
  • 当曲线LL由方程x=x(y)x=x(y)y[c,d]y\in[c,d])表示时,计算公式成为

    LP(x,y)dx+Q(x,y)dy=αβ[P[x(y),y]x(y)+Q[x(y),y]]dy \color{#C80032}{\int_LP(x,y)\mathrm{d}x+Q(x,y)\mathrm{d}y=\int^{\beta}_{\alpha}\Big[P\big[x(y),y\big]x'(y)+Q\big[x(y),y\big]\Big]\mathrm{d}y}

两类曲线积分的联系

(t,x^), (t,y^)(\widehat{\boldsymbol{t},x}),\ (\widehat{\boldsymbol{t},y})分别表示切线方向t\boldsymbol{t}xx轴和yy轴正向的夹角,则在曲线上的 每一点的切线方向余弦是

dxds=cos(t,x^),  dyds=cos(t,y^) \frac{\mathrm{d}x}{\mathrm{d}s}=\cos(\widehat{\boldsymbol{t},x}),\ \ \frac{\mathrm{d}y}{\mathrm{d}s}=\cos(\widehat{\boldsymbol{t},y})

于是,有

     LP(x,y)dx+Q(x,y)dy=0l[P[x(s),y(s)]cos(t,x^)+Q[x(s),y(s)]cos(t,y^)]ds=L[P(x,y)cos(t,x^)+Q(x,y)cos(t,y^)]ds \begin{align} &\ \ \ \ \ \int_LP(x,y)\mathrm{d}x+Q(x,y)\mathrm{d}y\\ &=\int^l_0\Big[P\big[x(s),y(s)\big]\cos(\widehat{\boldsymbol{t},x})+Q\big[x(s),y(s)\big]\cos(\widehat{\boldsymbol{t},y})\Big]\mathrm{d}s\\ &=\int_L\big[P(x,y)\cos(\widehat{\boldsymbol{t},x})+Q(x,y)\cos(\widehat{\boldsymbol{t},y})\big]\mathrm{d}s\end{align}

同理,有

LPdx+Qdy+Rdz=L[P(x,y,z)cos(t,x^)+Q(x,y,z)cos(t,y^)+R(x,y,z)cos(t,z^)]ds \int_LP\mathrm{d}x+Q\mathrm{d}y+R\mathrm{d}z=\int_L\big[P(x,y,z)\cos(\widehat{\boldsymbol{t},x})+Q(x,y,z)\cos(\widehat{\boldsymbol{t},y})+R(x,y,z)\cos(\widehat{\boldsymbol{t},z})\big]\mathrm{d}s

运用这一性质,有的时候可以帮助我们简化积分计算。例如,试计算L+ydx+zdy+xdz\displaystyle\oint_{L^+}y\mathrm{d}x+z\mathrm{d}y+x\mathrm{d}z,其中LLx2+y2+z2=1x^2+y^2+z^2=1x+y+z=1x+y+z=1的交线,从xx轴正向看去取逆时针方向。

首先,从曲线LL的描述中可以知道LL正切向的方向余弦为12(zy,xz,yx)\frac1{\sqrt2}(z-y,x-z,y-x),于是

I=L+ydx+zdy+xdz=L+12[y(zy)+z(xz)+x(yx)]ds=12L+ds \begin{align} I&=\oint_{L^+}y\mathrm{d}x+z\mathrm{d}y+x\mathrm{d}z\\ &=\oint_{L^+}\frac1{\sqrt2}[y(z-y)+z(x-z)+x(y-x)]\mathrm{d}s\\ &=-\frac1{\sqrt2}\oint_{L^+}\mathrm{d}s\end{align}

由于交线是一个半径为23\sqrt{\frac23}的圆,故而L+ds=223π\displaystyle\oint_{L^+}\mathrm{d}s=2\sqrt{\frac23}\cdot\pi,因此

I=12L+ds=23π3 I=-\frac1{\sqrt2}\oint_{L^+}\mathrm{d}s=-\frac{2\sqrt3\pi}3

格林公式与积分路径无关性

格林公式:若函数P(x,y),Q(x,y)P(x,y),\,Q(x,y)在闭区域DD上连续且有连续的一阶偏导数,则有

D(QxPy)dσ=L+Pdx+Qdy \boxed{\iint\limits_D\left(\frac{\partial Q}{\partial x}-\frac{\partial P}{\partial y}\right)\mathrm{d}\sigma=\oint_{L^+}P\mathrm{d}x+Q\mathrm{d}y}

其中LL是区域DD的分段光滑的有向边界曲线,方向取正方向。这一公式就被称为格林公式。

格林公式告诉我们,当区域DD是单连通区域时,如果P(x,y), Q(x,y)P(x,y),\ Q(x,y)DD内连续且具有一阶连续的偏导数,则曲线积分的值与路径无关,只与起点和终点有关。在上述条件下,以下四个命题是等价的:

  1. 沿DD内任一按段光滑封闭曲线LL,有

    LPdx+Qdy=0 \oint_LP\mathrm{d}x+Q\mathrm{d}y=0
  2. DD中任一按段光滑曲线LL,曲线积分LPdx+Qdy\displaystyle\int_LP\mathrm{d}x+Q\mathrm{d}y与路线无关,只与LL的起点和重点有关。

  3. Pdx+QdyP\mathrm{d}x+Q\mathrm{d}yDD内某一函数u(x,y)u(x,y)的全微分,即在DDu\exists us.t. du=Pdx+Qdys.t.\ \mathrm{d}u=P\mathrm{d}x+Q\mathrm{d}y

  4. DD内处处成立

    Py=Qx \frac{\partial P}{\partial y}=\frac{\partial Q}{\partial x}

其中DD是单连通区域这一条件是十分必要的。所谓单连通,直观上就是指没有“洞”的区域,与之相对的是复连通区域。严格地讲,单连通区域是使得区域上任一封闭曲线均可以不经过区域以外的点而连续收缩与属于该区域中某一点的区域。


一个经典的例子是计算Lxdyydxx2+y2\displaystyle\oint_L\frac{x\mathrm{d}y-y\mathrm{d}x}{x^2+y^2},其中曲线LL的方程为x2+y2=R2x^2+y^2=R^2R>0R>0),方向为逆时针方向。记被封闭曲线LL围成的闭区域为DD,易见P(x,y)=yx2+y2P(x,y)=-\frac{y}{x^2+y^2}Q(x,y)=xx2+y2Q(x,y)=\frac{x}{x^2+y^2},这两个函数在点(0,0)D(0,0)\in D的偏导数不存在,不能直接应用格林公式。考虑利用LL的方程x2+y2=R2x^2+y^2=R^2化简曲线积分,有

Lxdyydxx2+y2=1R2Lxdyydx \oint_L\frac{x\mathrm{d}y-y\mathrm{d}x}{x^2+y^2}=\frac1{R^2}\oint_Lx\mathrm{d}y-y\mathrm{d}x

这样就可以应用格林公式了,有

1R2Lxdyydx=1R2D[1(1)]dxdy=2R2πR2=2π \frac1{R^2}\oint_Lx\mathrm{d}y-y\mathrm{d}x=\frac1{R^2}\iint\limits_D[1-(-1)]\mathrm{d}x\mathrm{d}y=\frac2{R^2}\cdot\pi R^2=2\pi

事实上,分别按P,QP,Q(0,0)(0,0)处是否存在偏导数分类讨论,不难证明,只要曲线LL是一条不过原点的分段光滑的简单闭曲线,取方向为逆时针方向,那么就有

Lxdyydxx2+y2=2π \oint_L\frac{x\mathrm{d}y-y\mathrm{d}x}{x^2+y^2}=2\pi

曲面积分

第一型曲面积分

如果说第一型曲线积分是定积分的推广,那么第一型曲面积分就可以被视为二重积分的推广。求曲面块的质心、转动惯量与引力等,都可以利用第一型曲面积分。

Sf(x,y,z)dS=limT0i=1nf(ξi,ηi,γi)ΔSi \iint\limits_Sf(x,y,z)\mathrm{d}S=\lim_{\Vert T\Vert\to0}\sum^n_{i=1}f(\xi_i,\eta_i,\gamma_i)\Delta S_i

f(x,y,z)1f(x,y,z)\equiv1时,第一型曲面积分SdS\displaystyle\iint\limits_S\mathrm{d}S在数值上等于曲面块SS的面积。

第一型曲面积分的计算:通常会化为二重积分以方便计算。设有光滑曲面

S:z=z(x,y), (x,y)D S:z=z(x,y),\ (x,y)\in D

f(x,y,z)f(x,y,z)是定义在SS上的连续函数,则有

Sf(x,y,z)dS=Df(x,y,z(x,y))1+zx2+zy2dxdy \color{#C80032}{\iint\limits_Sf(x,y,z)\mathrm{d}S=\iint\limits_Df\big(x,y,z(x,y)\big)\sqrt{1+z^2_x+z^2_y}\,\mathrm{d}x\mathrm{d}y}

第二型曲面积分

类似第二型曲线积分要求曲线的方向,第二型曲面积分要求曲面的侧,即区分曲面是单侧曲面还是双侧曲面。这里就不细致介绍了,只给出计算方法。

第二型曲面积分的计算

两类曲面积分的联系

第二型曲面积分的计算

高斯公式与斯托克斯公式

格林公式联系了沿封闭曲线的曲线积分与二重积分的关系,高斯公式则联系了沿空间闭曲面的曲面积分与三重积分的关系,可以说,高斯公式是格林公式的“另一个版本”。

高斯公式:设空间区域VV由分片光滑的双侧封闭曲面SS围成,若函数P,Q,RP,Q,RVV上连续且具有一阶连续偏导数,则

V(Px+Qy+Rz)dxdydz=SPdydz+Qdzdx+Rdxdy \iiint\limits_V\left(\frac{\partial P}{\partial x}+\frac{\partial Q}{\partial y}+\frac{\partial R}{\partial z}\right)\mathrm{d}x\mathrm{d}y\mathrm{d}z= \oiint\limits_{S} P\mathrm{d}y\mathrm{d}z+Q\mathrm{d}z\mathrm{d}x+R\mathrm{d}x\mathrm{d}y
曲面S取外侧

与之对应地,斯托克斯公式则建立了沿空间双侧曲面SS的曲面积分与沿SS的边界曲线LL的曲线积分间的关系。

斯托克斯公式:设光滑曲面SS的边界LL是按段光滑的连续函数,若函数P,Q,RP,Q,RSS连同LL上连续且具有一阶连续偏导数,则

S(RyQz)dydz+(PzRx)dzdx+(QxPy)dxdy=LPdx+Qdy+Rdz \iint\limits_S\textstyle\left(\frac{\partial R}{\partial y}-\frac{\partial Q}{\partial z}\right)\mathrm{d}y\mathrm{d}z+\left(\frac{\partial P}{\partial z}-\frac{\partial R}{\partial x}\right)\mathrm{d}z\mathrm{d}x+\left(\frac{\partial Q}{\partial x}-\frac{\partial P}{\partial y}\right)\mathrm{d}x\mathrm{d}y=\displaystyle\oint_LP\mathrm{d}x+Q\mathrm{d}y+R\mathrm{d}z

向量函数微分学(暂略)

暂略

补充例题

  • 设函数f(x)=x01ex2t2dt\displaystyle{f(x)=-x\int^1_0e^{-x^2t^2}\mathrm{d}t},则当0<a<x<b0\lt a\lt x\lt b时,有( )

    A. xf(x)>af(a)xf(x)>af(a)

    B. bf(b)>xf(x)bf(b)>xf(x)

    C. xf(a)>af(x)xf(a)>af(x)

    D. xf(b)>bf(x)xf(b)>bf(x)

    解:题目给出的f(x)f(x)形式很难做进一步讨论,应当通过换元将其改写为变限积分的形式:

    f(x)=x01ex2t2dt=01e(xt)2d(xt)=xt=u0xeu2du f(x)=-x\int^1_0e^{-x^2t^2}\mathrm{d}t=-\int^1_0e^{-(xt)^2}\mathrm{d}(xt)\xlongequal{xt=u}-\int^x_0e^{-u^2}\mathrm{d}u

    易见在x(0,b)x\in(0,b)上有f(x)<0f(x)<0f(x)=ex2<0f'(x)=-e^{-x^2}<0f(x)=2xex2>0f''(x)=2xe^{-x^2}>0,函数本身的性质研究完毕,接下来讨论各个选项(毕竟是选择题,留意观察选项,“给什么用什么”)。

    对于A、B选项,式中都出现了xf(x)xf(x),所以可以考虑构造辅助函数F(x)=xf(x)F(x)=xf(x);对FF求导得F(x)=f(x)+xf(x)<0F'(x)=f(x)+xf'(x)<0,因此FF严格单调递减,A、B选项均是错误的。

    对于C、D选项,本着“参变分离”的思想,将其分别改写为“C. f(a)a>f(x)x\frac{f(a)}a>\frac{f(x)}x”、“D. f(b)b>f(a)a\frac{f(b)}b>\frac{f(a)}a”,易见应当构造辅助函数G(x)=f(x)xG(x)=\frac{f(x)}x;对GG求导得G(x)=xf(x)f(x)x2G'(x)=\frac{xf'(x)-f(x)}{x^2},似乎GG的单调性无法直接求得。

    但是注意到GG'的分子xf(x)f(x)xf'(x)-f(x)ffff'的关系,为进一步讨论GG的单调性,应当联想到中值定理:

    G(x)=xf(x)f(x)x2=xf(x)[f(x)f(0)]x2=拉格朗日中值定理f(x)f(ξ)x G'(x)=\frac{xf'(x)-f(x)}{x^2}=\frac{xf'(x)-\big[f(x)-f(0)\big]}{x^2}\xlongequal{\text{拉格朗日中值定理}}\frac{f'(x)-f'(\xi)}{x}

    其中f(0)=0f(0)=0ξ(0,x)\xi\in(0,x),这样一来就能用上二阶导数大于零的信息——ff'单调递增,所以f(x)>f(ξ)f'(x)>f'(\xi),进而G(x)>0G(x)G'(x)>0\Rightarrow G(x)单调递增,因此C选项错误,D选项是正确答案。

    重要的是“给什么用什么”,多加注意题目中可能的提示,毕竟大部分题目都是被人为设计出来的。

  • 设函数f(x)f(x)[2,2][-2,2]上二阶可导、f(x)1|f(x)|\leqslant1且有[f(0)]22+[f(0)]3>32\displaystyle{\frac{\big[f'(0)\big]^2}2+\big[f(0)\big]^3>\frac32},求证存在一点ξ(2,2)\xi\in(-2,2),使得f(ξ)+3[f(ξ)]2=0f''(\xi)+3\big[f(\xi)\big]^2=0

    证:按“给什么用什么”的思路,根据条件“[f(0)]22+[f(0)]3>32\frac{\big[f'(0)\big]^2}2+\big[f(0)\big]^3>\frac32”想到可能需要设辅助函数F(x)=[f(x)]22+[f(x)]3F(x)=\frac{\big[f'(x)\big]^2}2+\big[f(x)\big]^3,观察到F(x)=f(x)[f(x)+3f2(x)]F'(x)=f'(x)\big[f''(x)+3f^2(x)\big],所以似乎这个问题可以使用罗尔定理解决,但我们并不能知道在端点处函数ff的值,所以不便使用罗尔定理。

    既然暂时没有什么头绪,那就研究一下由题目给出的三个点:2,0,2-2,0,2。首先对于两个端点我们无法探究更多,因为他们只是满足了可导和f(x)1|f(x)|\leqslant1。转而讨论x=0x=0,题目给出了条件F(0)>32F(0)>\frac32,在罗尔定理难以运用时应当考虑费马定理,所以问题转而变成了证明F(x)F(x)一定在(2,2)(-2,2)内取得最值。由于F(0)>32F(0)>\frac32,所以如果可以证明在(2,2)(-2,2)上存在分别位于x=0x=0左右的两个点使得FF在其上的值小于32\frac32,这个问题自然也就迎刃而解了。

    现在我们也没有别的办法,只能朝着这个方向,尝试在[2,0][-2,0][0,2][0,2]上对ff使用拉格朗日中值定理。尽管,事实上函数FF联系了ffff',我们也本应该联想到拉格朗日中值定理。

    由于ff[2,2][-2,2]上可导,利用拉格朗日中值定理、绝对值与条件f(x)1|f(x)|\leqslant1,分别有:

    • f(α)=f(0)f(2)0(2)=f(0)+f(2)21|f'(\alpha)|=\left|\frac{f(0)-f(-2)}{0-(-2)}\right|=\frac{|f(0)|+|f(-2)|}2\leqslant1,其中α(2,0)\alpha\in(-2,0)
    • f(β)=f(2)f(0)20=f(2)+f(0)21|f'(\beta)|=\left|\frac{f(2)-f(0)}{2-0}\right|=\frac{|f(2)|+|f(0)|}2\leqslant1,其中β(0,2)\beta\in(0,2)

    进一步地,有

    • F(α)=[f(α)]22+[f(α)]312+1=32F(\alpha)=\frac{\big[f'(\alpha)\big]^2}2+\big[f(\alpha)\big]^3\leqslant\frac12+1=\frac32
    • F(β)=[f(β)]22+[f(β)]312+1=32F(\beta)=\frac{\big[f'(\beta)\big]^2}2+\big[f(\beta)\big]^3\leqslant\frac12+1=\frac32

    由于FF二阶可导与F(0)>32F(α)F(0)>\frac32\geqslant F(\alpha)F(0)>32F(β)F(0)>\frac32\geqslant F(\beta),因此FF的一阶导函数连续、在区间[α,β][\alpha,\beta]内一定存在最大值,而且该最大值必然在(α,β)(\alpha,\beta)内取得,否则会出现F(α)F(0)F(\alpha)\geqslant F(0)F(β)F(0)F(\beta)\geqslant F(0),与已知矛盾。综上所述,不妨设FFx0(α,β)x_0\in(\alpha,\beta)处取得区间(α,β)(2,2)(\alpha,\beta)\subset(-2,2)上的最大值,易见该点同时也是极大值点,由费马定理知x=x0x=x_0必然是FF的驻点,所以有F(x0)=f(x0)+3[f(x0)]2=0F'(x_0)=f''(x_0)+3\big[f(x_0)\big]^2=0,最后取ξ=x0\xi=x_0即可,证毕。

    以上过程中我们没有直接在[2,0][-2,0][0,2][0,2]上直接对FF使用拉格朗日中值定理,这样子是证不出来的,而是通过在[2,0][-2,0][0,2][0,2]上对ff使用拉格朗日中值定理找出了另外两个点α,β\alpha,\beta,再在(α,β)(\alpha,\beta)上使用费马定理,这是该解法的巧妙之处。

  • 设函数f(x)f(x)在区间[0,1][0,1]上连续且a=01f(x)dx0\displaystyle{a=\int^1_0f(x)\mathrm{d}x\neq0},求证区间(0,1)(0,1)内至少存在不同的两点ξ1,ξ2\xi_1,\xi_2使得1f(ξ1)+1f(ξ2)=2a\frac1{f(\xi_1)}+\frac1{f(\xi_2)}=\frac2a

    证:由于f(x)f(x)[0,1][0,1]上连续,记其一个原函数为F(x)=0xf(t)dt\displaystyle{F(x)=\int^x_0f(t)\mathrm{d}t},有F(0)=0F(0)=0F(1)=a0F(1)=a\neq0,又FF连续,由介值定理,存在一点η(0,1)\eta\in(0,1)使得F(η)=a2F(\eta)=\frac{a}2

    由于FF[0,1][0,1]上可导(导数为[0,1][0,1]上的连续函数ff),所以分别在[0,η][0,\eta][η,1][\eta,1]上运用拉格朗日中值定理,有

    • F(η)F(0)η0=a2η=f(ξ1)\frac{F(\eta)-F(0)}{\eta-0}=\frac{a}{2\eta}=f(\xi_1),其中ξ1(0,η)\xi_1\in(0,\eta)
    • F(1)F(η)1η=a2(1η)=f(ξ2)\frac{F(1)-F(\eta)}{1-\eta}=\frac{a}{2(1-\eta)}=f(\xi_2),其中ξ2(η,1)\xi_2\in(\eta,1)

    易见ξ1,ξ2\xi_1,\xi_2是两个不同的点,且1f(ξ1)+1f(ξ2)=2(η+1η)a=2a\frac1{f(\xi_1)}+\frac1{f(\xi_2)}=\frac{2(\eta+1-\eta)}a=\frac2a,证毕。

  • f(x)f(x)[a,b][a,b]上有二阶导数且f(a)=f(b)=0,f(x)<0f(a)=f(b)=0,f''(x)<0,证明当x(a,b)x\in(a,b)时,f(x)<2baabf(t)dtf(x)<\displaystyle\frac2{b-a}\int^b_af(t)\mathrm{d}t

    证:易见f(x)f(x)是凹函数,实际上还能得到f(0)>0, x(a,b)f(0)>0,\ x\in(a,b)。对于任取定的一点x0(a,b)x_0\in(a,b),在x=x0x=x_0处对f(x)f(x)应用带拉格朗日余项的一阶泰勒公式,得

    f(x)=f(x0)+f(x0)(xx0)+f(ξ)2!(xx0)2<f(x0)+f(x0)(xx0) f(x)=f(x_0)+f'(x_0)(x-x_0)+\frac{f''(\xi)}{2!}(x-x_0)^2\lt f(x_0)+f'(x_0)(x-x_0)

    在不等式两端同时对dx0\mathrm{d}x_0aabb上的定积分——为过程整洁,不妨用tt代替x0x_0,得到

    abf(x)dt=f(x)(ba)<abf(t)dt+abf(t)(xt)dt=abf(t)dt+xf(t)t=at=babtdf(t)=abf(t)dt+xf(b)xf(a)tf(t)t=at=b+abf(t)dt=2abf(t)dt \begin{align} \int^b_af(x)\mathrm{d}t=f(x)(b-a)&<\int^b_af(t)\mathrm{d}t+\int^b_af'(t)(x-t)\mathrm{d}t\\ &=\int^b_af(t)\mathrm{d}t+xf(t)\Big|^{t=b}_{t=a}-\int^b_at\mathrm{d}f(t)\\ &=\int^b_af(t)\mathrm{d}t+xf(b)-xf(a)-tf(t)\Big|^{t=b}_{t=a}+\int^b_af(t)\mathrm{d}t\\ &=2\int^b_af(t)\mathrm{d}t \end{align}

    移项,即

    f(x)<2baabf(t)dt f(x)<\frac2{b-a}\int^b_af(t)\mathrm{d}t

    证毕。

    将参数bb变量化以讨论构造函数的单调性是一个好方法,可惜在这里并不适用。

  • f(x)=0xet2dt, x>0\displaystyle{f(x)=\int^x_0e^{t^2}\mathrm{d}t},\ x>0

    1. 证明f(x)=xf(xθ(x))f(x)=xf'\big(x\cdot\theta(x)\big),其中θ(x)(0,1)\theta(x)\in(0,1)且唯一
    2. 计算limx0+θ(x)\lim\limits_{x\to0^+}\theta(x)

    解:这个题目不是难题,但是比较典型。这里θ(x)\theta(x)实际上表示的是比例,是ξxaba\frac{\xi_x-a}{b-a},所以有θ(0,1)\theta\in(0,1)

    由于ff(0,+)(0,+\infty)上任意阶可导,故在[0,x][0,x]上利用拉格朗日中值定理,有f(x)f(0)x0=f(x)x=f(ξ)\frac{f(x)-f(0)}{x-0}=\frac{f(x)}{x}=f'(\xi),其中ξ(0,x)\xi\in(0,x),再令ξ=xθ(x)\xi=x\cdot\theta(x)即有f(x)=xf(xθ(x))f(x)=xf'\big(x\cdot\theta(x)\big)。下证θ(x)\theta(x)的唯一性。

    假设还有θ(x)\theta^{\ast}(x)也使得f(x)=xf(xθ(x))f(x)=xf'\big(x\cdot\theta^{\ast}(x)\big)成立,则f(x)f(x)=x[f(xθ(x))f(xθ(x))]=0f(x)-f(x)=x\big[f'\big(x\cdot\theta(x)\big)-f'\big(x\cdot\theta^{\ast}(x)\big)\big]=0,由于x>0x>0,所以f(xθ(x))=f(xθ(x))f'\big(x\cdot\theta(x)\big)=f'\big(x\cdot\theta^{\ast}(x)\big),再使用拉格朗日中值定理得f(xθ(x))f(xθ(x))x[θ(x)θ(x)]=f(η)=0\frac{f'\big(x\cdot\theta(x)\big)-f'\big(x\cdot\theta^{\ast}(x)\big)}{x[\theta(x)-\theta^{\ast}(x)]}=f''(\eta)=0,而f(x)=2xex2>0f''(x)=2xe^{x^2}>0,故而xθ(x)=xθ(x)θ(x)=θ(x)x\cdot\theta(x)=x\cdot\theta^{\ast}(x)\Rightarrow \theta(x)=\theta^{\ast}(x),这样便证明了θ(x)\theta(x)具有唯一性。

    接下来求极限limx0+θ(x)\lim\limits_{x\to0^+}\theta(x),由已证明的等式f(x)=xf(xθ(x))f(x)=xf'\big(x\cdot\theta(x)\big)0xet2dt=xex2θ2(x)\displaystyle{\int^x_0e^{t^2}\mathrm{d}t=xe^{x^2\theta^2(x)}},所以θ(x)=1xln0xet2dtx\theta(x)=\displaystyle{\frac1x\sqrt{\ln\frac{\int^x_0e^{t^2}\mathrm{d}t}x}},易见limx0+0xet2dtx=1\lim\limits_{x\to0^+}\frac{\int^x_0e^{t^2}\mathrm{d}t}x=1,所以

    limx0+θ(x)=limx0+1xln0xet2dtx=limx0+1x0xet2dtx1=33 \lim\limits_{x\to0^+}\theta(x)=\lim\limits_{x\to0^+}\frac1x\sqrt{\ln\frac{\int^x_0e^{t^2}\mathrm{d}t}x}=\lim\limits_{x\to0^+}\frac1x\sqrt{\frac{\int^x_0e^{t^2}\mathrm{d}t}x-1}=\frac{\sqrt3}3
  • f(x)=arctanxf(x)=\arctan x,若f(x)=xf(ξ)f(x)=xf'(\xi),求limx0ξ2x2\lim\limits_{x\to0}\frac{\xi^2}{x^2}

    解:和上一题类似,题干所给出的条件“f(x)=xf(ξ)f(x)=xf'(\xi)”其实就是间接告诉了我们比例θ(x)\theta(x)

    由于ff(0,+)(0,+\infty)上任意阶可导,因此当x>0x>0时在(0,x)(0,x)上使用拉格朗日中值定理,有f(x)0x0=f(ξ)=11+ξ2\frac{f(x)-0}{x-0}=f'(\xi)=\frac1{1+\xi^2},所以ξ2=xarctanx1\xi^2=\frac{x}{\arctan x}-1,从而limx0+ξ2x2=limx0+xarctanx1x2=13\lim\limits_{x\to0^+}\frac{\xi^2}{x^2}=\lim\limits_{x\to0^+}\frac{\frac{x}{\arctan x}-1}{x^2}=\frac13x<0x<0时同理,最终有limx0ξ2x2=13\lim\limits_{x\to0}\frac{\xi^2}{x^2}=\frac13

  • y=f(x)y=f(x)二阶可导且有f(0)=f(0)=0f(0)=f'(0)=0f(0)0f''(0)\neq0,记uu为曲线在点P(x,y)P(x,y)处切线在xx轴上的截距,求limx0f(u)f(x)\lim\limits_{x\to0}\frac{f(u)}{f(x)}

    解:容易求得曲线上的点(x0,y0)(x_0,y_0)处切线的表达式是y=f(x0)xf(x0)x0+f(x0)y=f'(x_0)x-f'(x_0)x_0+f(x_0),因此u=xf(x)f(x)u=x-\frac{f(x)}{f'(x)},接下来的问题就是如何处理极限limx0f(u)f(x)\lim\limits_{x\to0}\frac{f(u)}{f(x)}

    注意到,对f(u)f(x)\frac{f(u)}{f(x)}分子分母的函数同时在x=0x=0处使用带皮亚诺余项的泰勒公式(不要用拉格朗日余项等具体余项),有

    f(u)f(x)=f(0)+f(0)u+f(0)2!u2+ο(u2)f(0)+f(0)x+f(0)2!x2+ο(x2)=u2+ο(u2)x2+ο(x2) \frac{f(u)}{f(x)}=\frac{f(0)+f'(0)u+\frac{f''(0)}{2!}u^2+\omicron(u^2)}{f(0)+f'(0)x+\frac{f''(0)}{2!}x^2+\omicron(x^2)}=\frac{u^2+\omicron(u^2)}{x^2+\omicron(x^2)}

    所以

    limx0f(u)f(x)=limx0u2x2=limx0(xf(x)f(x)x)2=limx0(1f(0)+f(0)x+f(0)2!x2+ο(x2)x[f(0)+f(0)x+ο(x)])2=14 \begin{align}\lim\limits_{x\to0}\frac{f(u)}{f(x)}&=\lim\limits_{x\to0}\frac{u^2}{x^2}=\lim\limits_{x\to0}\left(\frac{x-\frac{f(x)}{f'(x)}}{x}\right)^2\\&=\lim\limits_{x\to0}\left(1-\frac{f(0)+f'(0)x+\frac{f''(0)}{2!}x^2+\omicron(x^2)}{x\big[f'(0)+f''(0)x+\omicron(x)\big]}\right)^2\\&=\frac14\end{align}
  • 已知f(x)f(x)为二阶可导的正值函数,f(0)=f(0)=1f(0)=f'(0)=1f(x)f(x)[f(x)]2f(x)f''(x)\geqslant[f'(x)]^2,则( )

    A. f(2)e2f(1)f(3)f(2)\leqslant e^2\leqslant\sqrt{f(1)f(3)}

    B. e2f(2)f(1)f(3)e^2\leqslant f(2)\leqslant\sqrt{f(1)f(3)}

    C. f(1)f(3)e2f(2)\sqrt{f(1)f(3)}\leqslant e^2\leqslant f(2)

    D. f(1)f(3)f(2)e2\sqrt{f(1)f(3)}\leqslant f(2)\leqslant e^2

    解:按“给什么用什么”的规律,需要构造的辅助函数一定是能联系到条件“f(x)f(x)[f(x)]2f(x)f''(x)\geqslant[f'(x)]^2”的。通常而言辅助函数不会特别复杂,如果真的复杂到了一定程度,通常题干会以某种方式直接给出。

    常见的简单辅助函数,无外乎egfe^gf型、fgfg型、fg\frac{f}g型、fkf^k型、x±nfx^{\pm n}f型(gg通常是简单的幂函数或者ff的导数、积分)。看到“f(x)f(x)[f(x)]2f(x)f''(x)\geqslant[f'(x)]^2”一定要迅速联想到这是f(x)f(x)\frac{f'(x)}{f(x)}的导数的分子,同时务必注意到f(x)f(x)\frac{f'(x)}{f(x)}本身是lnf(x)\ln f(x)的导数,这是一个十分关键的点。即使第一时间没有观察出来,逐个考虑所有可能的简单辅助函数形态,也能发现只有ff\frac{f'}f可以联系到给出的条件“f(x)f(x)[f(x)]2f(x)f''(x)\geqslant[f'(x)]^2”。

    综上所述,做辅助函数F(x)=lnf(x)F(x)=\ln f(x),有F(x)=f(x)f(x)[f(x)]2f2(x)0F''(x)=\frac{f''(x)f(x)-[f'(x)]^2}{f^2(x)}\geqslant0,因此F(x)F(x)是正值下凸函数,故而有F(1)+F(3)2F(2)\frac{F(1)+F(3)}{2}\geqslant F(2),即lnf(1)f(3)lnf(2)f(2)f(1)f(3)\ln\sqrt{f(1)f(3)}\geqslant\ln f(2)\Rightarrow f(2)\leqslant\sqrt{f(1)f(3)}

    那么如何分析e2e^2FF的关系呢?从凸性入手直接分析可能稍显繁琐,考虑在x=0x=0处展开的带拉格朗日余项的二阶泰勒公式,由于F(x)0F''(x)\geqslant0,所以有F(x)=F(0)+F(0)x+F(ξ)2!x2xF(x)=F(0)+F'(0)x+\frac{F''(\xi)}{2!}x^2\geqslant x,因此F(2)=lnf(2)2f(2)e2F(2)=\ln f(2)\geqslant 2\Rightarrow f(2)\geqslant e^2,从而有e2f(2)f(1)f(3)e^2\leqslant f(2)\leqslant\sqrt{f(1)f(3)}。综上,B选项是正确的。

  • 设正项数列{an},{bn}\{a_n\},\{b_n\}满足an=ln(an+ebn), nN+a_n=\ln\big(a_n+e^{b_n}\big),\ \,n\in\mathbb{N}^+,判断下述命题是否正确,并说明理由:

    1. n=1an\sum\limits^{\infty}_{n=1}a_n收敛,则n=1bn\sum\limits^{\infty}_{n=1}b_n收敛
    2. n=1an\sum\limits^{\infty}_{n=1}a_n发散,则n=1bn\sum\limits^{\infty}_{n=1}b_n发散

    解:第一个命题正确,第二个命题错误,下分别说明其理由。

    对于第一个命题,这种讨论两正项数列敛散性的问题,应当优先讨论两数列的大小关系,这是一个极其重要的突破口。由原式变形得eanebn=an>0e^{a_n}-e^{b_n}=a_n>0{an}\{a_n\}为正项数列),根据指数函数exe^x单调性知an>bn>0a_n>b_n>0,因此由正项级数的比较审敛法可知,如果n=1an\sum\limits^{\infty}_{n=1}a_n收敛,则必有n=1bn\sum\limits^{\infty}_{n=1}b_n收敛,从而命题成立。无论是像这里两数列关系涉及对数函数、指数函数,还是涉及三角函数、多项式函数,都应该优先观察两数列之间的大小关系。

    对于第二个命题,取an=1na_n=\frac1n即可,有bn=ln(eanan)=ln(e1n1n)b_n=\ln\big(e^{a_n}-a_n\big)=\ln\left(e^{\frac1n}-\frac1n\right),考察函数ln(exx)\ln(e^x-x)x=0x=0附近的性质,有

    ln(exx)  exx1  x22+o(x22) \ln(e^x-x)\ \sim\ e^x-x-1\ \sim\ \frac{x^2}2+\mathcal{o}\left(\frac{x^2}2\right)

    因此有limnln(e1n1n)1n2=12\displaystyle\lim_{n\to\infty}\frac{\ln\left(e^{\frac1n}-\frac1n\right)}{\frac1{n^2}}=\frac12,根据正项级数的比较原则极限形式可知,此时n=1bn\sum\limits^{\infty}_{n=1}b_n收敛,故命题不成立。

  • 设平面区域D={(x,y):x+y1,x0,y0}D=\{(x,y):x+y\leqslant1,x\geqslant0,y\geqslant0\},试计算De(x+y)xydσ\displaystyle{\iint\limits_D\frac{e^{-(x+y)}}{\sqrt{xy}}\mathrm{d}\sigma}

    这个二重积分难以直接计算,所以想到换元以消掉分母的根号。

    法一:做积分换元:

    {x=u2,x0y=v2,y0                          {u=xv=y \left\{\begin{aligned}&x=u^2,&&x\geqslant0\\&y=v^2 ,&&y\geqslant0\end{aligned}\ \ \ \ \ \ \ \ \ \ \ \ \ \right.\Leftrightarrow\ \ \ \ \ \ \ \ \ \ \ \ \ \left\{\begin{aligned}&u=\sqrt{x}\\&v=\sqrt{y}\end{aligned}\right.

    这样换元的好处是不仅能消掉分母的根号,还将积分区域化为了圆域,记D1={(u,v):u2+v21,u0,v0}D_1=\{(u,v):u^2+v^2\leqslant1,u\geqslant0,v\geqslant0\},有

    De(x+y)xydσ=D1e(u2+v2)uv2u002vdσ=4D1e(u2+v2)dσ \iint\limits_D\frac{e^{-(x+y)}}{\sqrt{xy}}\mathrm{d}\sigma=\iint\limits_{D_1}\frac{e^{-(u^2+v^2)}}{uv}\left|\begin{matrix}2u&0\\0&2v\end{matrix}\right|\mathrm{d}\sigma=4\iint\limits_{D_1}e^{-(u^2+v^2)}\mathrm{d}\sigma

    积分4D1e(u2+v2)dσ\displaystyle{4\iint\limits_{D_1}e^{-(u^2+v^2)}\mathrm{d}\sigma}通过简单的极坐标换元即可解出,可以计算出结果为ππe\pi-\frac{\pi}e

    法二:除了上述换元,注意到原式被积式中关于积分变量的式子只有x+yx+yxyxy,所以还可以做下述线性变换:

    {x=uvy=v    {u=x+yv=x \left\{\begin{aligned}&x=u-v\\&y=v\end{aligned}\ \ \right.\Leftrightarrow\ \ \left\{\begin{aligned}&u=x+y\\&v=x\end{aligned}\right.

    记新积分区域为D2D_2,有

    De(x+y)xydσ=D2euv(uv)1101dσ=201eu(arctanvuv)0udu=ππe \iint\limits_D\textstyle\frac{e^{-(x+y)}}{\sqrt{xy}}\mathrm{d}\sigma=\displaystyle\iint\limits_{D_2}\textstyle\frac{e^{-u}}{\sqrt{v(u-v)}}\left|\begin{matrix}1&-1\\0&1\end{matrix}\right|\mathrm{d}\sigma=2\displaystyle\int^1_0e^{-u}\textstyle\left.\left(\arctan\frac{\sqrt{v}}{\sqrt{u-v}}\right)\right|^u_0\mathrm{d}u=\pi-\frac{\pi}e

    这个换元显然就没有第一种换元的计算那么简便了。

    法三:还可以直接对原式做极坐标代换:

    De(x+y)xydσ=0π2dθ01sinθ+cosθer(sinθ+cosθ)sinθcosθdr=0π21(sinθ+cosθ)sinθcosθ(1e1)dr=(11e)0π2dtanθ(1+tanθ)tanθdθ=t=tanθ(11e)0+2dt1+(t)2dt=ππe \begin{align} \iint\limits_D\frac{e^{-(x+y)}}{\sqrt{xy}}\mathrm{d}\sigma&=\int^{\frac{\pi}2}_0\mathrm{d}\theta\int^{\frac1{\sin\theta+\cos\theta}}_0\frac{e^{-r(\sin\theta+\cos\theta)}}{\sqrt{\sin\theta\,\cos\theta}}\mathrm{d}r\\ &=\int^{\frac{\pi}2}_0-\frac1{(\sin\theta+\cos\theta)\sqrt{\sin\theta\cos\theta}}\cdot\left(\frac1e-1\right)\mathrm{d}r\\ &=(1-\frac1e)\int^{\frac{\pi}2}_0\frac{\mathrm{d}\tan\theta}{(1+\tan\theta)\sqrt{\tan\theta}}\mathrm{d}\theta\\ &\xlongequal{t=\tan\theta}(1-\frac1e)\int^{+\infty}_0\frac{2\mathrm{d}\sqrt{t}}{1+(\sqrt{t})^2}\mathrm{d}t\\ &=\pi-\frac{\pi}e \end{align}

    然而这样换元的结果是计算过程变得更加繁复了,不推荐。这也说明,应当选取合适的换元,事半功倍。

  • nN+, an<bn\forall n\in\mathbb{N}^+, \ a_n\lt b_n,若级数n=1an\sum\limits^{\infty}_{n=1}a_nn=1bn\sum\limits^{\infty}_{n=1}b_n均收敛,试证n=1an\sum\limits^{\infty}_{n=1}a_n绝对收敛是n=1bn\sum\limits^{\infty}_{n=1}b_n绝对收敛的充要条件。

    • 法一:由an<bna_n\lt b_n与级数n=1an\sum\limits^{\infty}_{n=1}a_nn=1bn\sum\limits^{\infty}_{n=1}b_n收敛知n=1(bnan)\sum\limits^{\infty}_{n=1}(b_n-a_n)是收敛的正项级数,自然也是绝对收敛的。

      注意到有如下的三角不等式

      {bn=bnan+anbnan+anan=anbn+bnbnan+bn \left\{\begin{aligned} &|b_n|=|b_n-a_n+a_n|\leqslant|b_n-a_n|+|a_n|\\ &|a_n|=|a_n-b_n+b_n|\leqslant|b_n-a_n|+|b_n| \end{aligned}\right.

      因此,如果n=1an\sum\limits^{\infty}_{n=1}a_n绝对收敛,由于bnbnan+an|b_n|\leqslant|b_n-a_n|+|a_n|,由比较原则知n=1bn\sum\limits^{\infty}_{n=1}b_n绝对收敛,必要性成立;

      如果n=1bn\sum\limits^{\infty}_{n=1}b_n绝对收敛,由于anbnan+bn|a_n|\leqslant|b_n-a_n|+|b_n|,由比较原则知n=1an\sum\limits^{\infty}_{n=1}a_n绝对收敛,充分性成立,证毕。

    • 法二:也可以通过构造级数分开证明必要性与充分性。

      先证必要性,这里会利用级数n=1bnbn2\sum\limits^{\infty}_{n=1}\frac{|b_n|-b_n}2。注意到当bn0b_n\geqslant0anbnbn2=0|a_n|\geqslant\frac{|b_n|-b_n}2=0,当an<bn<0a_n\lt b_n<0anbn=bnbn2|a_n|\geqslant|b_n|=\frac{|b_n|-b_n}2,所以恒有anbnbn2|a_n|\geqslant\frac{|b_n|-b_n}2成立,由比较原则知正项级数n=1bnbn2\sum\limits^{\infty}_{n=1}\frac{|b_n|-b_n}2绝对收敛,又由于

      n=1bn=n=1[2(bnbn2)+bn]=2n=1bnbn2+n=1bn \sum^{\infty}_{n=1}|b_n|=\sum^{\infty}_{n=1}\left[2\left(\frac{|b_n|-b_n}2\right)+b_n\right]=2\sum^{\infty}_{n=1}\frac{|b_n|-b_n}2+\sum^{\infty}_{n=1}b_n

      其中n=1bnbn2\sum\limits^{\infty}_{n=1}\frac{|b_n|-b_n}2绝对收敛、n=1bn\sum\limits^{\infty}_{n=1}b_n收敛,所以n=1bn\sum\limits^{\infty}_{n=1}|b_n|收敛,即n=1bn\sum\limits^{\infty}_{n=1}b_n绝对收敛。

      再证充分性。充分性是比较直观的,不妨记{an}\{a_n\}的负项子列为{αnk}\{\alpha_{n_k}\}、非负项子列为{βnk}\{\beta_{n_k}\},对于非负项子列,因为βnk<bnk\beta_{n_k}\lt b_{n_k},而n=1bn\sum\limits^{\infty}_{n=1}b_n绝对收敛k=1bnk\Rightarrow\sum\limits^{\infty}_{k=1}b_{n_k}收敛,从而k=1βnk\sum\limits^{\infty}_{k=1}\beta_{n_k}收敛;对于负项子列,因为n=1an\sum\limits^{\infty}_{n=1}a_n收敛,所以n=1ank=1βnk=k=1αnk\sum\limits^{\infty}_{n=1}a_n-\sum\limits^{\infty}_{k=1}\beta_{n_k}=\sum\limits^{\infty}_{k=1}\alpha_{n_k}收敛,等价于k=1αnk-\sum\limits^{\infty}_{k=1}\alpha_{n_k}收敛,从而n=1an=k=1αnk+k=1βnk\sum\limits^{\infty}_{n=1}|a_n|=-\sum\limits^{\infty}_{k=1}\alpha_{n_k}+\sum\limits^{\infty}_{k=1}\beta_{n_k}收敛,于是n=1an\sum\limits^{\infty}_{n=1}a_n绝对收敛,证毕。

  • f(x)f(x)[0,1][0,1]上可导且f(x)>0f'(x)>0,求极限limx0+0xf(t)dtxf(0)xf(x)xf(0)\displaystyle\lim_{x\to0^+}\frac{\displaystyle\int^x_0f(t)\mathrm{d}t-xf(0)}{xf(x)-xf(0)}

    解:这个问题本身比较简单,但其中蕴含的一些思想是极为重要的,我将其称为

    1. “无中生有”,例如将f(x)f(0)g(x)\frac{f(x)-f(0)}{g(x)}改写为f(x)f(ξ)+f(ξ)f(0)g(x)=f(x)f(ξ)g(x)+f(ξ)f(0)g(x)\frac{f(x)-f(\xi)+f(\xi)-f(0)}{g(x)}=\frac{f(x)-f(\xi)}{g(x)}+\frac{f(\xi)-f(0)}{g(x)}
    2. “承上启下”,例如将f(x)g(x)\frac{f(x)}{g(x)}改写为f(x)h(x) ⁣ ⁣h(x)g(x)\frac{f(x)}{h(x)}\!\cdot\!\frac{h(x)}{g(x)}

    这两种技巧在数学的各个领域中都是非常常见的,是需要掌握的基本方法。对于这个极限问题就需要用到“承上启下”的思路,因为题干没有提到是否有f(x)f(x)二阶可导,故不能一直使用洛必达法则,这时便需要用一些技巧凑出极限:

    limx0+0xf(t)dtxf(0)xf(x)xf(0)=limx0+0xf(t)dtxf(0)x2x2xf(x)xf(0)=limx0+f(x)f(0)2xxf(x)f(0)=12f(0)1f(0)=12 \begin{align} \lim_{x\to0^+}\frac{\displaystyle\int^x_0f(t)\mathrm{d}t-xf(0)}{xf(x)-xf(0)}&=\lim_{x\to0^+}\frac{\displaystyle\int^x_0f(t)\mathrm{d}t-xf(0)}{x^2}\cdot\frac{x^2}{xf(x)-xf(0)}\\ &=\lim_{x\to0^+}\frac{f(x)-f(0)}{2x}\cdot\frac{x}{f(x)-f(0)}\\ &=\frac12f'(0)\frac1{f'(0)}\\ &=\frac12 \end{align}

    这里之想到“承上启下”的原因是为了凑f(0)=limx0+f(x)f(0)x0f'(0)=\lim\limits_{x\to0^+}\frac{f(x)-f(0)}{x-0}

  • 设函数y=f(x)y=f(x)由方程ey+x=ecos(xy)e^y+x=e\cos (xy)确定,计算极限limn[f(1n)]1n(1cos1n)\displaystyle\lim_{n\to\infty}\left[f\left(\frac1n\right)\right]^{\frac1{n\left(1-\cos\frac1n\right)}}

    解:对于这类不能写出显式初等表达式的隐函数,计算其极限往往需要y(x0)y(x_0)yy的各阶导数在x0x_0处的值,因为这是我们唯一可以获得的有效信息——毕竟这个方程本身作为一个隐函数没办法直接代入极限式中。

    不难想到将极限式化为幂指函数再作讨论,因为底数和幂都是1n\frac1n的函数:

    limn[f(1n)]1n(1cos1n)=limne1n(1cos1n)lnf(1n)=elimn2nlnf(1n) \begin{align} \lim_{n\to\infty}\left[f\left(\frac1n\right)\right]^{\frac1{n\left(1-\cos\frac1n\right)}}&=\lim_{n\to\infty}e^{\frac1{n\left(1-\cos\frac1n\right)}\ln f\left(\frac1n\right)}\\ &=e^{\lim\limits_{n\to\infty}2n\ln f\left(\frac1n\right)} \end{align}

    现在想办法计算limn2nlnf(1n)\lim\limits_{n\to\infty}2n\ln f\left(\frac1n\right)即可,首先出计算f(0)f(0)——不仅是经验告诉我们后续计算中很可能会用到f(0)f(0)的值,更重要的是如果f(0)1f(0)\neq1,那么极限limn2nlnf(1n)\lim\limits_{n\to\infty}2n\ln f\left(\frac1n\right)根本不存在。当然,容易知道f(0)f(0)确为11

    接下来有两种不同的思路可以选择:

    思路一:利用ln(1+x)x\ln(1+x)\sim x,有

    limn2nlnf(1n)=limn2n[f(1n)1]=limn2f(1n)f(0)1n0=2f(0) \begin{align} \lim_{n\to\infty}2n\ln f\left(\frac1n\right)&=\lim_{n\to\infty}2n\left[f\left(\frac1n\right)-1\right]\\ &=\lim_{n\to\infty}2\cdot\frac{f\left(\frac1n\right)-f(0)}{\frac1n-0}\\ &=2f'(0) \end{align}

    由方程ey+x=ecos(xy)e^y+x=e\cos (xy)

    f(0)=ddx(ey+xecos(xy))ddy(ey+xecos(xy))x=0=1e f'(0)=-\left.\frac{\frac{\mathrm{d}}{\mathrm{d}x}\big(e^y+x-e\cos(xy)\big)}{\frac{\mathrm{d}}{\mathrm{d}y}\big(e^y+x-e\cos(xy)\big)}\right|_{x=0}=-\frac1e

    从而limn[f(1n)]1n(1cos1n)=e2e\displaystyle\lim_{n\to\infty}\left[f\left(\frac1n\right)\right]^{\frac1{n\left(1-\cos\frac1n\right)}}=e^{-\frac2e};注意到lnf(0)=ln1=0\ln f(0)=\ln 1=0,也有一种不使用等价无穷小的办法。

    思路二:和上面的方法没有本质区别,按定义直接凑lnf(1n)\ln f\left(\frac1n\right)的导数,有

    limn2nlnf(1n)=limn2lnf(1n)lnf(0)1n0=2ddxlnf(x)x=0=2f(0)f(0) \begin{align} \lim_{n\to\infty}2n\ln f\left(\frac1n\right)&=\lim_{n\to\infty}2\cdot\frac{\ln f\left(\frac1n\right)-\ln f(0)}{\frac1n-0}\\ &=2\left.\frac{\mathrm{d}}{\mathrm{d}x}\ln f(x)\right|_{x=0}\\ &=2\frac{f'(0)}{f(0)} \end{align}

    同样能计算得limn[f(1n)]1n(1cos1n)=e2e\displaystyle\lim_{n\to\infty}\left[f\left(\frac1n\right)\right]^{\frac1{n\left(1-\cos\frac1n\right)}}=e^{-\frac2e}。以上两种方法虽然思考过程不同,但最终殊途同归。

  • 曲线x32+y32=1x^{\frac32}+y^{\frac32}=1x>0,y>0x>0,y>0)上任意一点处的切线在两坐标轴上的截距之和为ll,试求ll的最大值。

    解:这类涉及曲线切线与坐标轴交点的问题,都应该使用点斜式表示切线,如果用斜截式表示则会非常麻烦。

    首先按点斜式写出切线方程:Yy=y(Xx)Y-y=y'(X-x),接着对原方程两端同时对xx求导,得32x12+32y12y=0\frac32x^{\frac12}+\frac32y^{\frac12}y'=0,即y=(xy)12y'=-\big(\frac{x}y\big)^{\frac12}

    接下来是如何化简截距之和方程ll的问题,否则就要求解一个四次方程了。这道题本身不难,关键是要留意截距之和方程ll是可以化简的。直接对切线方程Yy=y(Xx)Y-y=y'(X-x)分别代入Y=0Y=0X=0X=0,得到两个截距

    X=yy+x X=-\frac{y}{y'}+x Y=xy+y Y=-xy'+y

    y=(xy)12y'=-\big(\frac{x}y\big)^{\frac12}代入上式,一定要注意到结果是可以通过原曲线方程x32+y32=1x^{\frac32}+y^{\frac32}=1化简的

    X=y(xy)12+x=y32x12+x=y32+x32x12=1x X=-\frac{y}{-\big(\frac{x}y\big)^{\frac12}}+x=\frac{y^{\frac32}}{x^{\frac12}}+x=\frac{\boxed{y^{\frac32}+x^{\frac32}}}{x^{\frac12}}=\frac1{\sqrt{x}} Y=x[(xy)12]+y=x32y12+y=x32+y32y12=1y Y=-x\left[-\left(\frac{x}y\right)^{\frac12}\right]+y=\frac{x^{\frac32}}{y^{\frac12}}+y=\frac{\boxed{x^{\frac32}+y^{\frac32}}}{y^{\frac12}}=\frac1{\sqrt{y}}

    所以l=X+Y=1x+1yl=X+Y=\frac1{\sqrt{x}}+\frac1{\sqrt{y}},问题就转化成了在约束x32+y32=1x^{\frac32}+y^{\frac32}=1下求l=1x+1yl=\frac1{\sqrt{x}}+\frac1{\sqrt{y}}极值的约束优化问题。最后,简单利用拉格朗日乘子法即可知道x=y=1223x=y=\frac1{2^{\frac23}}是拉格朗日函数的唯一驻点,因此lmax=213+213=243l_{\max}=2^{\frac13}+2^{\frac13}=2^{\frac43}

    这道题给了我们一个启示,那就是不仅在曲线积分、曲面积分中可以用曲线方程或曲面方程化简被积式,在优化问题中有时同样需要用原方程化简目标函数,否则计算会变得十分复杂。一定要多观察、多留意。

  • D={(x,y):0x2,0y2xx2}D=\Big\{(x,y):0\leqslant x\leqslant2,0\leqslant y\leqslant\sqrt{2x-x^2}\Big\},计算二重积分I=Dx+y2dσ\displaystyle{I=\iint\limits_D|x+y-2|\mathrm{d}\sigma}

    解:这是一道很好的二重积分计算题,有很多可以降低计算量的小窍门。

    D1={(x,y):0x2,0y2xx2,yx+2}D_1=\Big\{(x,y):0\leqslant x\leqslant2,0\leqslant y\leqslant\sqrt{2x-x^2},y\geqslant -x+2\Big\},无论采取什么方法都避不开分割区域DD

    法一,直接计算:这是最常见的做法,计算上相比法二会繁琐一点。第一步当然是去掉绝对值,易见

    I=D(x+y2)dσI1+2D1(x+y2)dσI2 I=\underbrace{-\iint\limits_D(x+y-2)\mathrm{d}\sigma}_{I_1}+\underbrace{2\iint\limits_{D_1}(x+y-2)\mathrm{d}\sigma}_{I_2}

    分别计算I1,I2I_1,I_2即可,先算I1I_1,对半圆域上的二重积分I1I_1做极坐标换元处理:

    I1=0π2dθ02cosθ(r2(cosθ+sinθ)2r)dr=0π2(83cos4θ+83cos3θsinθ4cos2θ)dθ=83×34×12×π2+23cos4θ0π2+4×12×π2=23+π2 \begin{align} I_1&=-\int^{\frac{\pi}2}_0\mathrm{d}\theta\int^{2\cos\theta}_0\Big(r^2(\cos\theta+\sin\theta)-2r\Big)\mathrm{d}r\\ &=-\int^{\frac{\pi}2}_0\big(\frac83\cos^4\theta+\frac83\cos^3\theta\sin\theta-4\cos^2\theta\big)\mathrm{d}\theta\\ &=-\frac83\times\frac34\times\frac12\times\frac{\pi}2+\frac23\cos^4\theta\Big|^{\frac{\pi}2}_0+4\times\frac12\times\frac{\pi}2\\ &=-\frac23+\frac{\pi}2 \end{align}

    再算I2I_2,由于I2I_2做极坐标变换后计算上更为复杂,所以不做换元:

    I2=212dxx+22xx2(x+y2)dy=212(x2)(2xx2)dx+212(x+2)dx=x1=sint20π2(sint1)cos2tdt+1=213cos3t0π22×12×π2+1=53π2 \begin{align} I_2&=2\int^2_1\mathrm{d}x\int^{\sqrt{2x-x^2}}_{-x+2}(x+y-2)\mathrm{d}y\\ &=2\int^2_1(x-2)\Big(\sqrt{2x-x^2}\Big)\mathrm{d}x+2\int^2_1(-x+2)\mathrm{d}x\\ &\xlongequal{x-1=\sin t}2\int^{\frac{\pi}2}_0(\sin t-1)\cos^2t\,\mathrm{d}t+1\\ &=-2\cdot\frac13\cos^3t\Big|^{\frac{\pi}2}_0-2\times\frac12\times\frac{\pi}2+1\\ &=\frac53-\frac{\pi}2 \end{align}

    综上所述,I=I1+I2=1I=I_1+I_2=1。这是最常规的做法,唯一要提醒的是简单的积分换元最好一步到位,不要分多次代换,这会大大增加计算量——计算步骤越多,错误概率越大。这里做换元x1=sintx-1=\sin t是很容易处理的,首先x=sint+1x=\sin t+1,所以dx=costdt\mathrm{d}x=\cos t\,\mathrm{d}t(x2)=(cost2)(x-2)=(\cos t-2)2xx2=1(x1)2=cost\sqrt{2x-x^2}=\sqrt{1-(x-1)^2}=\cos t,于是12(x2)(2xx2)dx=0π2(sint1)cos2tdt\displaystyle{\int^2_1(x-2)\Big(\sqrt{2x-x^2}\Big)\mathrm{d}x=\int^{\frac{\pi}2}_0(\sin t-1)\cos^2t\,\mathrm{d}t}。而我起初的思路是首先处理根式2xx2\sqrt{2x-x^2},也就是先换元t2=2xx2t^2=2x-x^2以消去根式,观察式子出现了新的根式1t2\sqrt{1-t^2},于是再换元t=sinzt=\sin z——这样做大大增加了计算量。明明只需要一步的事,我硬是做成了两步,硬生生徒增了许多计算量。

    法二,利用条件化简,“偷懒”:注意到区域DD是关于x=1x=1对称的一个半圆,这意味着

    D(x1)dσ=0 \iint\limits_D(x-1)\mathrm{d}\sigma=0

    由二重积分的几何应用知,Ddσ\displaystyle{\iint\limits_D\mathrm{d}\sigma}正是半圆的面积,所以

    Dkdσ=kSD=kπ2,     kR \iint\limits_Dk\mathrm{d}\sigma=k\cdot S_D=\frac{k\pi}2,\ \ \ \ \ k\in\mathbb{R}

    因此

    I1=D((x1)+y1)σ=π2+Dydσ=极坐标变换积分π2+23 -I_1=\iint\limits_{D}\Big((x-1)+y-1\Big)\sigma=-\frac{\pi}2+\iint\limits_Dy\mathrm{d}\sigma\xlongequal{\text{极坐标变换积分}}-\frac{\pi}2+\frac23

    接下来处理I2I_2,首先在几何上可以看出SD2=SD4S_{D_2}=\frac{S_D}4,因此

    I2=2D(x+y)dσπ+2 I_2=2\iint\limits_D(x+y)\mathrm{d}\sigma-\pi+2

    在继续计算I2I_2时,相较于法一中先积dy\mathrm{d}y再积dx\mathrm{d}x的做法,换序后先积dx\mathrm{d}x再积dy\mathrm{d}y会更容易,即

    I2=201dy2y1+1y2(x+y)dxπ+2=201(y1y2+1y2+y1)dyπ+2=53π2 \begin{align}I_2&=2\int^1_0\mathrm{d}y\int^{1+\sqrt{1-y^2}}_{2-y}(x+y)\mathrm{d}x-\pi+2\\&=2\int^1_0(y\sqrt{1-y^2}+\sqrt{1-y^2}+y-1)\mathrm{d}y-\pi+2\\&=\frac53-\frac{\pi}2\end{align}

    其中,对01y1y2dy\displaystyle{\int^1_0y\sqrt{1-y^2}\mathrm{d}y}可以直接凑微分,对011y2dy\displaystyle{\int^1_0\sqrt{1-y^2}\mathrm{d}y}可以直接由单位圆面积的定积分表示得到(当然也可以用牛顿-莱布尼茨公式,但没有必要),基本不需要什么计算——起码相对于法一而言。

    可以看出,法二几乎没有什么计算量。有时,“偷懒”是有必要的,毕竟计算得越多,越可能出错。

    彻底了解如何“偷懒”后(尤其是涉及绝对值与圆域的二重积分),读者可以尝试一下这道题,检验检验是否真的懂了“怎样偷懒”:设D={(x,y):x2+y21,0x1}D=\big\{(x,y):x^2+y^2\leqslant1,0\leqslant x\leqslant1\big\},计算二重积分I=Dx+y1dxdy\displaystyle{I=\iint\limits_D\Big||x+y|-1\Big|\mathrm{d}x\mathrm{d}y}。这个二重积分最后计算得的正确结果应该是53223\frac53-\frac{2\sqrt2}3,如果选择“硬算”,要处理太多的项,这既浪费时间,又增大错误的风险。