37. 双向学习下的市场扩散#

37.1. 概览#

信息的设计与定价 中,一个垄断者拥有信息并出售信息。

本讲研究这样一个市场:没有人出售信息,而每个人都在生产信息。

我们遵循 Bergemann and Välimäki [1997] 的思路,他们研究了一个双头垄断市场,其中一家老牌企业与一家销售质量未知的新产品的企业进行价格竞争。

买家只能通过使用新产品才能了解其价值,而他们经验的总体记录是公开的。

因此,每一次新产品的购买同时也是一个消费决策和一次实验,其信息价值会外溢给所有人。

市场的双方都从同一个公开记录中学习,这正是这里”双向学习”的含义:买家和卖家在每个时点都持有相同的信念,从不出现信息不对称的情况。

本讲围绕三个结果展开。

第一,两家企业都希望获得更多信息,但只有新企业的销售能产生信息。

这种不对称性会削弱价格竞争:老牌企业的定价不如一次性博弈中那样激进,而进入者在早期能够获取更大的市场份额。

第二,当信念偏悲观时,均衡实验是过度的;当信念偏乐观时,均衡实验是不足的,中间存在唯一的交叉点。

第三,成功的新产品的扩散路径呈S形,这与一个悠久的经验传统相符,而拐点恰好出现在我们可以精确确定的某个信念处。

备注

与本节其余内容的联系是通过信息的价值建立的。

布莱克韦尔的实验比较定理 表明,当决策问题的价值函数在信念上是凸的时,决策者恰好会从更具信息性的实验中获益,因为更具信息性的实验会以凸序展开后验分布。

在这里,信念是一个鞅,而实验决定了信念展开的速度,因此每个企业从实验中获得的收益取决于其价值函数的凸性。

信念本身由一个对数似然比过程驱动,这与 似然比过程 中研究的过程类似,只是现在运行在连续时间中。

让我们从导入相关模块开始。

import matplotlib.pyplot as plt
import numpy as np

plt.rcParams['figure.figsize'] = (10, 5)
np.set_printoptions(precision=4, suppress=True)

37.2. 市场#

买家在 \([0, 1]\) 上均匀分布,每人在每个瞬间需求一单位商品。

老牌产品为买家 \(n\) 带来的价值为

(37.1)#\[ s_n = s + n h \]

新产品带来的价值为

(37.2)#\[ \mu_n = \mu + (1 - n) h . \]

参数 \(h > 0\) 衡量水平差异化程度,因此接近 \(n = 0\) 的买家天然更倾向于新产品,而接近 \(n = 1\) 的买家则更倾向于老牌产品。

这是标准的霍特林结构,但有一个变化:新产品的纵向质量 \(\mu\)未知的,可以取两个值之一,

(37.3)#\[ \mu \in \{\mu_L, \mu_H\}, \qquad 0 < s - h < \mu_L < s < \mu_H < s + h . \]

内部的不等式表明新产品可能比老牌产品更好或更差。

外部的不等式表明,在完全信息下,两家企业都会保留正的市场份额,因此这种创新不是颠覆性的。

两家企业的边际成本均为零。

如果新企业服务于 \([0, n]\) 范围内的买家,则每种产品所带来的平均流量价值为

(37.4)#\[ \bar\mu(n) = \mu + \frac{(2 - n)h}{2}, \qquad \bar s(n) = s + \frac{(1 + n)h}{2} , \]

因此单位时间内的总剩余为 \(n \bar\mu(n) + (1-n)\bar s(n)\)

\(\mu(\alpha)\) 记为在信念 \(\alpha = \Pr[\mu = \mu_H]\) 下的预期质量,经过一些代数运算,可将流量剩余写成方便的二次形式,

(37.5)#\[ F(n, \alpha) = s + \frac h2 + n\bigl(\mu(\alpha) - s + h\bigr) - n^2 h . \]
class Market:
    """The duopoly of Bergemann and Valimaki (1997)."""

    def __init__(self, s=4.0, h=1.0, mu_L=3.1, mu_H=4.9, sigma=1.0):
        self.s, self.h = s, h
        self.mu_L, self.mu_H, self.sigma = mu_L, mu_H, sigma
        assert 0 < s - h < mu_L < s < mu_H < s + h, 'condition (4) fails'

    def mu(self, a):
        """Expected quality of the new product under belief a."""
        return (1 - a) * self.mu_L + a * self.mu_H

    def flow_surplus(self, n, a):
        return (self.s + self.h / 2 + n * (self.mu(a) - self.s + self.h)
                - n ** 2 * self.h)

37.3. 双向学习#

买家的个体经验是关于 \(\mu\) 的一个带噪声的抽样,由于每个买家的测度为零,因此只有总体记录才重要。

当有一部分 \(n\) 的买家使用新产品时,累积市场结果 \(X\) 按以下方式演变:

(37.6)#\[ dX = n \mu \, dt + \sigma \sqrt{n} \, dB , \]

因此漂移项和方差都随实验规模 \(n\) 成比例变化。

每个人都观察到 \(X\),因此信念保持一致。

由于 \(\mu\) 只能取两个值,信念 \(\alpha_t = \Pr[\mu = \mu_H \mid \mathcal F_t]\) 是一个充分统计量。

命题 37.1 (后验信念)

信念 \(\alpha_t\) 是一个漂移为零的鞅,其瞬时方差为

(37.7)#\[ n \Sigma^2(\alpha) = n\left[\frac{\alpha(1-\alpha)(\mu_H - \mu_L)}{\sigma}\right]^2 . \]

这是通过扩散过程观察到的两点先验的标准滤波结果;参见 Liptser and Shiryaev [1977]

(37.7) 的两个特征驱动了一切。

方差\(n\) 呈线性关系,因此信息的到达速率与实验规模成比例,而只有新企业的销售才能产生信息。

方差与 \(\alpha^2(1-\alpha)^2\) 成比例,因此当信念最分散时学习速度最快,而当 \(\alpha\) 接近 \(0\)\(1\) 时学习就趋于停滞。

37.3.1. 作为似然比过程的学习#

值得探究一下 (37.7) 的来源,因为其机制正是 似然比过程 中研究的机制,只是被移植到了连续时间中。

在长度为 \(\Delta\) 的短时间间隔内,增量 \(\Delta X\) 在任一假设下均服从均值为 \(n \mu \Delta\)、方差为 \(\sigma^2 n \Delta\) 的正态分布,因此对数似然比的增量为

(37.8)#\[ \Delta \ell = \log\frac{f_H(\Delta X)}{f_L(\Delta X)} = \frac{(\mu_H - \mu_L)\,\Delta X - \tfrac12 n \Delta (\mu_H^2 - \mu_L^2)}{\sigma^2} . \]

信念随后遵循贝叶斯法则的对数比形式,与离散时间讲座中完全相同,

(37.9)#\[ \log\frac{\alpha_{t+\Delta}}{1 - \alpha_{t+\Delta}} = \log\frac{\alpha_t}{1 - \alpha_t} + \Delta \ell . \]

我们直接实现 (37.8)(37.9),这在每一步都得到精确的贝叶斯更新,而不是对随机微分方程的离散化近似。

def simulate_beliefs(mkt, alpha0, T, dt, mu_true, rng, policy):
    """Simulate beliefs by exact Bayesian updating of the log odds.

    `mu_true` holds the true quality for each path, so the paths run in parallel.
    Returns an array of shape (number of paths, number of steps + 1).
    """
    mu_true = np.atleast_1d(np.asarray(mu_true, dtype=float))
    M, steps = len(mu_true), int(T / dt)
    a = np.empty((M, steps + 1))
    a[:, 0] = alpha0
    ell = np.full(M, np.log(alpha0 / (1 - alpha0)))
    dmu, half = mkt.mu_H - mkt.mu_L, (mkt.mu_H ** 2 - mkt.mu_L ** 2) / 2
    for k in range(steps):
        n = policy(a[:, k])
        dX = n * mu_true * dt + mkt.sigma * np.sqrt(n * dt) * rng.standard_normal(M)
        ell += (dmu * dX - n * dt * half) / mkt.sigma ** 2
        a[:, k + 1] = 1 / (1 + np.exp(-ell))
    return a

在使用它之前,我们通过蒙特卡洛方法检验 命题 37.1

def Sigma2(mkt, a):
    return (a * (1 - a) * (mkt.mu_H - mkt.mu_L) / mkt.sigma) ** 2


mkt = Market()
rng = np.random.default_rng(0)
dt, n_draw = 1e-4, 400_000

print(f'{"alpha":>7s}{"simulated var/dt":>19s}{"formula n*Sigma^2":>20s}'
      f'{"mean/dt (s.e.)":>22s}')
for a0 in [0.2, 0.5, 0.8]:
    n = 0.5                                   # hold the experiment size fixed
    ell0 = np.log(a0 / (1 - a0))
    steps = []
    for mu_true, w in [(mkt.mu_H, a0), (mkt.mu_L, 1 - a0)]:
        k = int(n_draw * w)
        dX = n * mu_true * dt + mkt.sigma * np.sqrt(n * dt) * rng.standard_normal(k)
        ell = ell0 + ((mkt.mu_H - mkt.mu_L) * dX
                      - n * dt * (mkt.mu_H ** 2 - mkt.mu_L ** 2) / 2) / mkt.sigma ** 2
        steps.append(1 / (1 + np.exp(-ell)) - a0)
    d = np.concatenate(steps)
    se = d.std() / np.sqrt(len(d)) / dt
    print(f'{a0:7.2f}{d.var() / dt:19.6f}{n * Sigma2(mkt, a0):20.6f}'
          f'{d.mean() / dt:14.4f} ({se:.3f})')
  alpha   simulated var/dt   formula n*Sigma^2        mean/dt (s.e.)
   0.20           0.041586            0.041472        0.0034 (0.032)
   0.50           0.101145            0.101250        0.0606 (0.050)
   0.80           0.041428            0.041472        0.0096 (0.032)

模拟出的方差与 (37.7) 相符,而均值增量与零没有明显差异,这证实了信念构成一个鞅。

37.4. 高效实验#

一个选择 \(n(\alpha)\) 的规划者会在当前剩余和销售所产生的信息之间进行权衡。

Bergemann and Välimäki [1997] 通过在无贴现的极限情形下开展研究,避免了贴现会带来的非线性微分方程,他们使用了 Dutta [1991] 提出的强长期平均准则。

在这个极限下的最优策略是贴现策略在贴现率趋于零时的极限,因此跨期权衡依然存在。

贝尔曼方程变为

(37.10)#\[ \max_{n} \left\{ F(n, \alpha) - v(\alpha) + \tfrac12 n \Sigma^2(\alpha) V''(\alpha) \right\} = 0 , \]

其中 \(v(\alpha)\) 是完全信息下可达到的长期平均值,最后一项是信息的价值:即实验规模 \(n\) 乘以学习速度 \(\Sigma^2\) 再乘以影子价格 \(V''\)

由于信念是一个鞅,因此不会出现一阶导数项。

由于 \(\mu\) 最终会被了解,因此 \(v\) 恰好是两个完全信息值的线性插值,

(37.11)#\[ v(\alpha) = \frac{s + \mu(\alpha) + \frac32 h}{2} + (1 - \alpha)\frac{(\mu_L - s)^2}{4h} + \alpha\frac{(\mu_H - s)^2}{4h} . \]

巧妙之处在于,(37.10) 中最大化括号内的值等于零,因此我们可以将其两边同除以 \(n\) 而不改变最大化解。

这样做便将 \(V''\) 完全从一阶条件中移除,只剩下

\[ \max_n \left\{ \frac{s + \frac h2 - v(\alpha)}{n} - h n \right\} + \text{terms free of } n , \]

其一阶条件以封闭形式给出了高效策略。

命题 37.2 (高效实验)

新产品的高效市场份额为

(37.12)#\[ n^*(\alpha) = \sqrt{\frac{v(\alpha) - s - \frac h2}{h}} . \]

那位忽略销售的信息价值的短视规划者,会设定 \(m^*(\alpha) = \arg\max_n F(n,\alpha)\)

def v_social(mkt, a):
    s, h = mkt.s, mkt.h
    return ((s + mkt.mu(a) + 1.5 * h) / 2
            + (1 - a) * (mkt.mu_L - s) ** 2 / (4 * h)
            + a * (mkt.mu_H - s) ** 2 / (4 * h))


def n_star(mkt, a):
    """Efficient share, equation (nstar)."""
    return np.sqrt((v_social(mkt, a) - mkt.s - mkt.h / 2) / mkt.h)


def m_star(mkt, a):
    """Myopically efficient share."""
    return (mkt.mu(a) - mkt.s + mkt.h) / (2 * mkt.h)

\(\alpha \in \{0, 1\}\) 处已没有更多东西可以学习,因此这两者必须相符,事实也确实如此。

for a, mu_i in [(0.0, mkt.mu_L), (1.0, mkt.mu_H)]:
    direct = (mu_i - mkt.s + mkt.h) / (2 * mkt.h)
    print(f'alpha = {a}:  n* = {n_star(mkt, a):.6f}   '
          f'full-information share = {direct:.6f}')

A = np.linspace(1e-6, 1 - 1e-6, 4001)          # full grid, for plotting
A_int = np.linspace(0.05, 0.95, 1801)          # strictly interior grid

gap_myopic = n_star(mkt, A_int) - m_star(mkt, A_int)
print(f'\nn*(alpha) - m*(alpha) on [0.05, 0.95]:  '
      f'min {gap_myopic.min():.5f},  at alpha = 0.5 it is '
      f'{float(n_star(mkt, 0.5) - m_star(mkt, 0.5)):.5f}')
alpha = 0.0:  n* = 0.050000   full-information share = 0.050000
alpha = 1.0:  n* = 0.950000   full-information share = 0.950000

n*(alpha) - m*(alpha) on [0.05, 0.95]:  min 0.02101,  at alpha = 0.5 it is 0.17268

规划者总是比短视基准进行实验,这体现了信息价值的跨期性,其表现形式为新产品销售量的额外增加。

37.5. 均衡#

现在让两家企业分别设定价格 \(p_1\)\(p_2\),并让买家进行选择。

\(s + nh - p_1 = \mu(\alpha) + (1-n)h - p_2\) 时,边际买家 \(n\) 无差异, 这将市场份额锚定在价格上。

每家企业都求解一个动态规划问题,其中出现了各自的信息价值,同样的除以 \(n\) 的技巧从一阶条件中消去了二阶导数。

命题 37.3 (均衡)

存在唯一的马尔可夫完美均衡,其中

(37.13)#\[ p_1(\alpha) = \tfrac23\bigl(s - \mu(\alpha)\bigr) + \sqrt{2 h v_2(\alpha)}, \qquad p_2(\alpha) = \tfrac13\bigl(\mu(\alpha) - s\bigr) + h , \]

新企业的市场份额为

(37.14)#\[ n(\alpha) = \sqrt{\frac{v_2(\alpha)}{2h}} , \]

其中 \(v_i(\alpha)\) 是企业 \(i\) 在完全信息下的长期平均收入。

def v1(mkt, a):
    s, h = mkt.s, mkt.h
    return ((1 - a) * ((s - mkt.mu_L) / 3 + h) ** 2 / (2 * h)
            + a * ((s - mkt.mu_H) / 3 + h) ** 2 / (2 * h))


def v2(mkt, a):
    s, h = mkt.s, mkt.h
    return ((1 - a) * ((mkt.mu_L - s) / 3 + h) ** 2 / (2 * h)
            + a * ((mkt.mu_H - s) / 3 + h) ** 2 / (2 * h))


def n_eq(mkt, a):
    return np.sqrt(v2(mkt, a) / (2 * mkt.h))


def p1(mkt, a):
    return 2 / 3 * (mkt.s - mkt.mu(a)) + np.sqrt(2 * mkt.h * v2(mkt, a))


def p2(mkt, a):
    return (mkt.mu(a) - mkt.s) / 3 + mkt.h


def p1_myopic(mkt, a):
    return (mkt.s - mkt.mu(a)) / 3 + mkt.h


def n_myopic(mkt, a):
    return ((mkt.mu(a) - mkt.s) / 3 + mkt.h) / (2 * mkt.h)

将动态均衡与逐期博弈的静态均衡进行比较,揭示了本文核心的不对称性。

print('comparing the dynamic equilibrium with the static one, on [0.05, 0.95]')
print(f'  max |p2 - p2_myopic|   {np.abs(p2(mkt, A_int) - p2(mkt, A_int)).max():.2e}')
print(f'  min (p1 - p1_myopic)   {(p1(mkt, A_int) - p1_myopic(mkt, A_int)).min():.5f}')
print(f'  min (n_eq - n_myopic)  {(n_eq(mkt, A_int) - n_myopic(mkt, A_int)).min():.5f}')
comparing the dynamic equilibrium with the static one, on [0.05, 0.95]
  max |p2 - p2_myopic|   0.00e+00
  min (p1 - p1_myopic)   0.00671
  min (n_eq - n_myopic)  0.00336

新企业的价格恰好等于它的短视价格,这是线性偏好结构和无贴现假设的一个边缘性结果。

而老牌企业的定价则高于一次性博弈中的水平,从而让出了市场份额。

这正是那个令人瞠目的结果:老牌企业软化竞争,并不是因为力量薄弱,而是因为进入者的销售是信息的唯一来源,而老牌企业希望获得信息。

37.5.1. 谁更看重信息?#

贝尔曼方程表明,每家企业的信息价值等于其完全信息下的预期收入与当前收入之间的差距。

voi_1 = v1(mkt, A) - (1 - n_eq(mkt, A)) * p1(mkt, A)
voi_2 = v2(mkt, A) - n_eq(mkt, A) * p2(mkt, A)

print(f'established firm, minimum value of information  {voi_1.min():.3e}')
print(f'new firm, minimum value of information          {voi_2.min():.3e}')
print(f'ratio voi_1 / voi_2:  min {np.min(voi_1 / voi_2):.6f}, '
      f'max {np.max(voi_1 / voi_2):.6f}')
established firm, minimum value of information  1.800e-07
new firm, minimum value of information          9.000e-08
ratio voi_1 / voi_2:  min 2.000000, max 2.000000

两者都为正,因此两个价值函数都在信念上是凸的。

这正是 布莱克韦尔的实验比较定理 的逻辑在起作用:信念是一个鞅,更多的实验会使其进一步展开,而拥有凸值函数的企业会从这种展开中获益。

更令人意外的是,这个比值在任何信念下都恰好等于 \(2\)

老牌企业对信息的重视程度是进入者的两倍,因为在均衡中,正是老牌企业相对于不确定性消解后本可获得的收入,放弃了当前的收入。

37.6. 先过度实验,后不足实验#

现在我们可以比较均衡份额与高效份额。

gap = n_star(mkt, A) - n_eq(mkt, A)
cross = A[np.argmin(np.abs(gap))]

fig, axes = plt.subplots(1, 2, figsize=(12, 4.2))
axes[0].plot(A, n_star(mkt, A), lw=2, label=r'efficient $n^*(\alpha)$')
axes[0].plot(A, n_eq(mkt, A), lw=2, label=r'equilibrium $n(\alpha)$')
axes[0].plot(A, m_star(mkt, A), lw=1.5, ls='--', color='0.5',
             label=r'myopic planner $m^*(\alpha)$')
axes[0].set(xlabel=r'$\alpha$', ylabel='market share of the new firm',
            title='experimentation policies')
axes[0].legend(fontsize=9)

axes[1].plot(A, gap, lw=2, color='C3')
axes[1].axhline(0, color='0.3', lw=1)
axes[1].axvline(cross, color='0.6', ls=':', lw=1.5)
axes[1].fill_between(A, gap, 0, where=gap < 0, alpha=0.15, color='C3')
axes[1].fill_between(A, gap, 0, where=gap > 0, alpha=0.15, color='C0')
axes[1].annotate('equilibrium\nexperiments too much', (0.05, gap.min() / 2),
                 fontsize=9)
axes[1].annotate('too little', (0.75, gap.max() / 2), fontsize=9)
axes[1].set(xlabel=r'$\alpha$', ylabel=r'$n^*(\alpha) - n(\alpha)$',
            title=f'single crossing at ' + rf'$\alpha = {cross:.3f}$')
fig.tight_layout()
plt.show()

print(f'gap is monotone increasing: {np.all(np.diff(gap) > 0)}')
print(f'number of sign changes:     {int(np.sum(np.diff(np.sign(gap)) != 0))}')
_images/ef674c82ab074a8cd9d92cb2c595364938b55ffabd15f162805c8c9bc67bd3e5.png

图 37.1 Equilibrium versus efficient experimentation#

gap is monotone increasing: True
number of sign changes:     1

这里的直觉在于谁必须降价来争取一个买家。

在悲观信念下,进入者规模较小,因此再吸引一个买家在存量收入上的成本很低,而老牌企业规模较大,不愿通过对所有人降价来保住自己的份额。

因此进入者会积极扩张,而市场则会出现过度实验。

在乐观信念下,情况正好相反,老牌企业会更努力地竞争,因而实验水平会低于高效水平。

37.7. 随时间的扩散#

到目前为止,一切都是状态 \(\alpha\) 的函数。

要在日历时间上跟踪某个产品,我们需要知道当产品真的好时信念的运动规律。

\(\mu = \mu_H\) 的条件下,信念会获得一个向上的漂移,因为数据是由 \(\mu_H\) 产生的,而市场仍将 \(1 - \alpha\) 的权重放在 \(\mu_L\) 上,

(37.15)#\[ d\alpha = \frac{n(\alpha)(\mu_H - \mu_L)^2 \alpha (1-\alpha)^2}{\sigma^2}\, dt + \frac{(\mu_H - \mu_L)\alpha(1-\alpha)\sqrt{n(\alpha)}}{\sigma}\, dB . \]

去除噪声后,得到平均信念的确定性路径。

def mean_belief_path(mkt, alpha0, T, dt, policy):
    """Deterministic path of the mean posterior when mu = mu_H."""
    steps = int(T / dt)
    a = np.empty(steps + 1)
    a[0] = alpha0
    dmu2 = (mkt.mu_H - mkt.mu_L) ** 2 / mkt.sigma ** 2
    for k in range(steps):
        drift = policy(a[k]) * dmu2 * a[k] * (1 - a[k]) ** 2
        a[k + 1] = min(max(a[k] + drift * dt, 1e-12), 1 - 1e-12)
    return a

命题 37.4 (S形扩散)

在产品确实优质的条件下,平均市场份额 \(\hat n(t)\) 随时间递增。

\(\hat\alpha(t) \leq 1/3\) 时,其增长速率本身是递增的;此后则是递减的。

两种力量的结合产生了S形曲线。

随着信念远离零,学习会加速,从而加快进入者份额的增长;但均衡份额 \(n(\alpha)\) 是凹的,因此信念的进一步改善所带来的份额增益会越来越小。

T, dt, alpha0 = 8.0, 1e-3, 0.03
policy = lambda a: n_eq(mkt, a)

a_mean = mean_belief_path(mkt, alpha0, T, dt, policy)
t_grid = np.linspace(0, T, len(a_mean))

rng = np.random.default_rng(12)
paths = simulate_beliefs(mkt, alpha0, T, dt, np.full(6, mkt.mu_H), rng, policy)

fig, axes = plt.subplots(1, 2, figsize=(12, 4.2))
for pth in paths:
    axes[0].plot(t_grid, pth, lw=0.7, alpha=0.55, color='C0')
axes[0].plot(t_grid, a_mean, lw=2.5, color='C3', label='mean path')
axes[0].axhline(1 / 3, color='0.5', ls=':', lw=1.5)
axes[0].set(xlabel='time', ylabel=r'$\alpha(t)$', title='beliefs')
axes[0].legend(fontsize=9)

for pth in paths:
    axes[1].plot(t_grid, n_eq(mkt, pth), lw=0.7, alpha=0.55, color='C0')
axes[1].plot(t_grid, n_eq(mkt, a_mean), lw=2.5, color='C3', label='mean path')
axes[1].set(xlabel='time', ylabel=r'$n(t)$',
            title='market share of the new firm')
axes[1].legend(fontsize=9)
fig.tight_layout()
plt.show()
_images/d0e73bec65d31179949e46d77bb38b570b6937a854f6927eb3d3c35811a5e161.png

图 37.2 The S-shaped diffusion path of a successful new product#

拐点恰好出现在 命题 37.4 所说的位置。

n_mean = n_eq(mkt, a_mean)
growth = np.gradient(n_mean, t_grid)
k = np.argmax(growth)
print(f'share grows fastest at t = {t_grid[k]:.3f}, '
      f'where alpha = {a_mean[k]:.4f}   (theory: 1/3)')

drift = policy(A) * (mkt.mu_H - mkt.mu_L) ** 2 * A * (1 - A) ** 2
print(f'belief drift peaks at alpha = {A[np.argmax(drift)]:.4f}   '
      f'(theory: between 1/3 and 2/3)')
share grows fastest at t = 2.490, where alpha = 0.3334   (theory: 1/3)
belief drift peaks at alpha = 0.3830   (theory: between 1/3 and 2/3)

价格随份额同步变动。

fig, ax = plt.subplots()
for pth in paths:
    ax.plot(t_grid, p1(mkt, pth), lw=0.7, alpha=0.5, color='C0')
    ax.plot(t_grid, p2(mkt, pth), lw=0.7, alpha=0.5, color='C1')
ax.plot(t_grid, p1(mkt, a_mean), lw=2.5, color='C0',
        label=r'$p_1$, established firm')
ax.plot(t_grid, p2(mkt, a_mean), lw=2.5, color='C1', label=r'$p_2$, new firm')
ax.set(xlabel='time', ylabel='price',
       title='the incumbent retreats as the entrant is vindicated')
ax.legend()
fig.tight_layout()
plt.show()
_images/c0443b9f7d43ea598fd2bc47615458162cdbf73e92c907d751c2ebe6aaf9b586.png

图 37.3 Price paths of the two firms#

37.8. 鞅性质#

Bergemann and Välimäki [1997] 从概率角度刻画了均衡的各个对象:进入者的价格是一个鞅,老牌企业的价格和进入者的份额是上鞅,两者的收入都是下鞅。

由于 \(\alpha\) 是一个鞅,以上每一条性质都可以从 \(\alpha\) 对应函数的形状中导出,我们可以通过模拟对这一切逐一进行检验。

rng = np.random.default_rng(3)
a0, M = 0.5, 20_000

# draw the true quality from the prior, one value per path
mu_true = np.where(rng.random(M) < a0, mkt.mu_H, mkt.mu_L)
ends = simulate_beliefs(mkt, a0, 4.0, 2e-3, mu_true, rng, policy)[:, -1]

rows = [
    ('belief', a0, ends.mean(), 'martingale'),
    ('share of new firm', n_eq(mkt, a0), n_eq(mkt, ends).mean(), 'supermartingale'),
    ('price of new firm', p2(mkt, a0), p2(mkt, ends).mean(), 'martingale'),
    ('price of incumbent', p1(mkt, a0), p1(mkt, ends).mean(), 'supermartingale'),
    ('revenue of incumbent', (1 - n_eq(mkt, a0)) * p1(mkt, a0),
     ((1 - n_eq(mkt, ends)) * p1(mkt, ends)).mean(), 'submartingale'),
    ('revenue of new firm', n_eq(mkt, a0) * p2(mkt, a0),
     (n_eq(mkt, ends) * p2(mkt, ends)).mean(), 'submartingale')]

print(f'{"":24s}{"t = 0":>10s}{"E[t = 4]":>11s}{"change":>10s}   prediction')
for name, x0, xT, pred in rows:
    print(f'{name:24s}{x0:10.4f}{xT:11.4f}{xT - x0:+10.4f}   {pred}')
                             t = 0   E[t = 4]    change   prediction
belief                      0.5000     0.5010   +0.0010   martingale
share of new firm           0.5220     0.5072   -0.0148   supermartingale
price of new firm           1.0000     1.0006   +0.0006   martingale
price of incumbent          1.0440     1.0132   -0.0308   supermartingale
revenue of incumbent        0.4990     0.5310   +0.0320   submartingale
revenue of new firm         0.5220     0.5389   +0.0168   submartingale

每一个符号都与预测相符。

进入者的预期份额随时间下降,尽管在产品真的优质的条件下其份额会上升,这是因为早期的积极扩张反映的是信息的价值,而不是对产品本身的信心。

两家企业都预期在未来赚得更多,这正是它们为了获取信息而牺牲当前利润的意义所在。

37.9. 结语#

本节现在有两讲的内容涉及价值完全是工具性的信息。

信息的设计与定价 中,卖方设计并对实验定价,其中有趣的经济学源自布莱克韦尔序是不完全的这一事实。

在这里,没有人为信息定价,而有趣的经济学源自这样一个事实:只有一家企业的销售能够产生信息。

两者都建立在 布莱克韦尔的实验比较定理 提出的同一基础之上:对决策者而言,信息恰好在决策问题的价值函数在信念上是凸的这一程度上才具有价值。

Bergemann and Välimäki [1997] 的独特之处在于,这种凸性是由竞争对手共同分享的。

由于两家企业都更愿意面对一个已经厘清了新产品质量的市场,关于纵向质量的不确定性缓和了价格竞争,这与 Shaked and Sutton [1982] 中确定性差异化所起的作用类似。

这正是为什么老牌企业一开始会以低价让进入者进入市场的原因,也是为什么一个成功的产品会沿着S形路径扩散的原因。

这里使用的连续时间技巧,特别是采取无贴现极限以使贝尔曼方程保持可处理性的手法,来自 Bolton and Harris [1999],他们是最早在连续时间中研究战略实验的学者。

一篇相关论文,Bergemann and Välimäki [2000],研究了同一个双头垄断问题,但假设存在无穷多个完全相同的消费者。

在那种同质性假设下,市场分割不复存在,因此本讲中产生扩散路径的水平差异化因素也不存在,分析转而集中于信息外部性如何影响市场效率。

37.10. 练习#

练习 37.1

条件 (37.3) 要求对两个质量水平都满足 \(|\mu_i - s| < h\)

  1. 通过代数推导证明,这一条件将新企业在完全信息下的均衡份额限制在区间 \((1/3, 2/3)\) 之内,因而对任意信念都有 \(n(\alpha) \in (1/3, 2/3)\)

  2. 用几组符合条件的 \((\mu_L, \mu_H)\) 数对进行数值验证。

  3. Bergemann and Välimäki [1997] 在绘制扩散图时使用了 \(s = 4\)\(h = 1\)\(\mu_L = 2\)\(\mu_H = 6\)

    检查这些参数是否满足 (37.3),计算 \(\alpha \in \{0, 1\}\) 处的均衡份额,并计算每个质量水平下的短视高效份额 \(m^*\)

    哪里出了问题?本讲的哪些结果仍然成立?

练习 37.2

本讲找到了一个使均衡实验从过度切换为不足的单一信念点。

  1. 编写一个通过二分法定位该交叉点的函数。

  2. 在保持中点 \(\tfrac12(\mu_L + \mu_H) = s\) 不变的情况下,计算该交叉点随质量差 \(\mu_H - \mu_L\) 扩大而变化的情况;然后再计算它随水平差异化参数 \(h\) 变化的情况。

  3. 只要比值 \((\mu_H - \mu_L)/h\) 相同,两组实验都会得到相同的结果。

    猜测该交叉点的封闭形式,并进行数值检验。

  4. 当质量中点偏离 \(s\) 时,你的公式是否依然成立?

练习 37.3

本练习将与 布莱克韦尔的实验比较定理 的联系精确化。

在那一讲中,决策者恰好在决策问题的价值函数在信念上是凸的时才能从更具信息性的实验中获益,因为更具信息性的实验会产生后验分布的均值保持展开。

在这里,信念是一个鞅,而实验决定了它展开的速度,因此同样的逻辑适用于每一家企业。

  1. 绘制每家企业的信息价值(即 \(v_i(\alpha)\) 减去当前均衡收入)对 \(\alpha\) 的曲线图。

  2. 确认这两条曲线在内点处都为正,并在 \(\alpha \in \{0, 1\}\) 处趋于零,解释为何它们必须在那里趋于零。

  3. 信息价值也等于 \(\tfrac12 n(\alpha)\Sigma^2(\alpha)V_i''(\alpha)\)

    利用这一点求出 \(V_i''(\alpha)\),并确认两个价值函数都是凸函数。