乐于分享
好东西不私藏

预警过多次股灾的量化模型,这次盯上了 AI 芯片股?

预警过多次股灾的量化模型,这次盯上了 AI 芯片股?

用 Python 揭秘均值回归策略:你的收益从何而来?

2026年重磅升级已全面落地!欢迎加入专注财经数据与量化投研的【数据科学实战】知识星球!您将获取持续更新的《财经数据宝典》与《量化投研宝典》,双典协同提供系统化指引;星球内含 500 篇以上独有高质量文章,深度覆盖策略开发、因子分析、风险管理等核心领域,内容基本每日更新;同步推出的「量化因子专题教程」系列(含完整可运行代码与实战案例),系统详解因子构建、回测与优化全流程,并实现日更迭代。我们持续扩充独家内容资源,全方位赋能您的投研效率与专业成长。无论您是量化新手还是资深研究者,这里都是助您少走弯路、事半功倍的理想伙伴,携手共探数据驱动的投资未来!

引言

2026 年 6 月底,市场上演了一幕耐人寻味的行情:韩国 KOSPI 一周之内两次触发熔断,三星和 SK 海力士单日早盘暴跌 12%;两年涨了近 800% 的美光(Micron)单日下跌 13%;而就在纳斯达克持续走弱的同一周,道琼斯工业指数却创下 52,900 点的历史新高。

科技股崩、传统股涨,这种「冰火两重天」到底意味着什么?在量化研究者眼中,这不是混乱,而是一种有名字、有公式、有历史先例的信号——LPPL(对数周期幂律)模型给出的「泡沫临界」信号。

本文将带你梳理这一事件背后的量化逻辑,并用 Python 代码演示 LPPL 模型和凯利公式的核心思想,适合正在学习 Python、又对量化投资感兴趣的你。

一、先看时间线:发生了什么?

  • • 6 月 23 日:KOSPI 熔断 20 分钟,三星、SK 海力士早盘跌 12%;当天纳斯达克跌 2.2%,美光单日跌 13%,费城半导体指数录得年内最大单日跌幅之一。
  • • 6 月 26 日:KOSPI 同一周内第二次熔断;纳斯达克较高点回撤 5%;Oracle 五个交易日跌 19%,创下互联网泡沫以来最差单周表现;应用材料、迈威尔各跌约 10%,泰瑞达跌 13.6%,KLA 跌 11.5%。
  • • 7 月 2 日:道琼斯指数单日大涨 594 点,收于 52,900 点历史新高。金融板块涨 2.2%,通信服务涨 2.4%,工业板块涨 1.4%。

半导体在崩,传统板块在涨——这正是量化模型关注的「分化信号」。

二、LPPL 模型:给泡沫拍 X 光片

LPPL(Log-Periodic Power Law,对数周期幂律)模型由物理学家 Didier Sornette 及其合作者在 20 世纪 90 年代末提出,核心观察是:泡沫破裂前,资产价格并非匀速上涨,而是呈现「超指数增长 + 频率越来越高的振荡」这一特定数学模式。

模型的核心公式为:

各参数的含义:

  • • p(t):t 时刻的资产价格
  • • A:基准价格水平
  • • B:超指数增长项系数,经典泡沫中 B < 0
  • • C:对数周期振荡的振幅
  • • m:临界指数,有效泡沫信号通常要求 0.1 < m < 0.9,越小代表加速越剧烈
  • • ω:振荡的角频率,经验上有效泡沫多落在 6 到 13 之间
  • • tc:临界时间,即模型预测的「变盘时点」,可能是崩盘,也可能只是切换到新的价格状态

振荡背后的直觉是行为金融学的「羊群效应」:泡沫膨胀时,投资者互相模仿而非独立定价,乐观与怀疑反复拉锯,且随着临界点逼近,拉锯的频率越来越快——就像钟摆在系统接近临界点时摆动得越来越急。

三、用 Python 实现一个极简 LPPL 拟合

下面用 numpy 和 scipy 演示 LPPL 模型的基本拟合思路(教学示例,实际研究需要更严谨的多起点优化和参数约束):

import numpy as np
from
 scipy.optimize import curve_fit

def
 lppl(t, A, B, C, m, omega, phi, tc):
    """LPPL 模型:返回对数价格的拟合值"""

    dt = tc - t                      # 距离临界时间的剩余时间
    dt = np.maximum(dt, 1e-8)        # 防止出现负数或零导致数值错误
    power_term = B * dt ** m         # 超指数增长项
    osc_term = C * dt ** m * np.cos(omega * np.log(dt) + phi)  # 对数周期振荡项
    return
 A + power_term + osc_term

# 构造一段模拟的泡沫价格数据(真实场景中请替换为实际收盘价)

t = np.linspace(0, 100, 300)         # 时间轴:300 个交易日
true_params = (5.0, -0.5, 0.1, 0.5, 8.0, 1.0, 110.0)
log_price = lppl(t, *true_params) + np.random.normal(0, 0.02, len(t))  # 加入噪声

# 用非线性最小二乘拟合 LPPL 参数

p0 = (5.0, -0.3, 0.05, 0.5, 7.0, 0.0, 105.0)   # 初始猜测值
bounds = ([0, -5, -1, 0.1, 6, -np.pi, 100],     # 参数下界:m>0.1,ω>6
          [10, 0, 1, 0.9, 13, np.pi, 150])      # 参数上界:m<0.9,ω<13
params, _ = curve_fit(lppl, t, log_price, p0=p0, bounds=bounds, maxfev=20000)

print
(f"拟合得到的临界时间 tc ≈ 第 {params[-1]:.1f} 个交易日")
print
(f"临界指数 m ≈ {params[3]:.2f},角频率 ω ≈ {params[4]:.2f}")

几个学习者容易踩的坑:

  • • LPPL 是高度非线性的模型,对初始值敏感,实践中通常从多组随机初始值出发,取残差最小的解;
  • • tc 的估计天然带有置信区间,它是一个「时间窗口」而不是精确日期——模型说的是「进入临界区」,不是「某天必崩」;
  • • 参数约束(如 0.1 < m < 0.9、6 < ω < 13)是过滤伪信号的关键,不加约束很容易拟合出无意义的结果。

四、HLPPL:给价格信号加上「情绪维度」

纯价格版 LPPL 有一个盲区:它分不清「基本面驱动的超指数上涨」和「情绪炒作驱动的超指数上涨」。前者可能平稳过渡到新的估值中枢,后者才更可能以急跌收场。

2025 年提出的 HLPPL(Hyped LPPL)模型在价格信号之外加入了两个行为学输入:

  • • 情绪得分(Sentiment Score):从财经新闻中提取的情绪指标
  • • 炒作指数(Hype Index):衡量媒体关注度的指标

在 2018 至 2024 年美股回测中,HLPPL 策略取得了 34.13% 的年化收益、1.19 的夏普比率和 72.30% 的胜率,跑赢了买入持有策略和不含行为输入的纯 LPPL 策略。

用伪代码表达 HLPPL 的思路:

# HLPPL 的核心思路(伪代码示意)
lppl_score = fit_lppl(price_series)          # 价格维度:超指数 + 振荡信号强度
sentiment = get_news_sentiment(ticker)        # 情绪维度:财经新闻情绪得分
hype = get_media_attention(ticker)            # 炒作维度:媒体关注度指数

# 三个维度综合判断:价格信号强 + 情绪与炒作同步放大 = 高风险泡沫状态

bubble_confidence = combine(lppl_score, sentiment, hype)

五、循环资本开支:泡沫信号背后的基本面隐患

模型信号之外,还有一笔值得算清的账。

五大云计算巨头 2024 年资本开支合计 2,410 亿美元,2026 年预计将突破 5,000 亿美元,两年翻倍以上。2026 至 2029 年全生态 AI 相关支出预计超过 1.6 万亿美元;有机构估计 2025 至 2028 年全球数据中心支出约 3 万亿美元,其中约一半由私募信贷提供资金。

简单做一道 ROIC(投入资本回报率)算术题:

capex = 500          # 2026 年 AI 资本开支(单位:十亿美元)
useful_life = 5      # 基础设施折旧年限(年)
hurdle_rate = 0.15   # 科技公司常用的资本回报门槛:15%

amortization = capex / useful_life   # 每年折旧摊销:1000 亿美元
# 要覆盖折旧并赚取 15% 的资本回报,所需的增量年收入约为:

required_revenue = 175               # 约 1750 亿美元/年

print
(f"仅 2026 年一年的开支,就需要约 {required_revenue} 十亿美元的年增量收入来支撑")

而当前全球云计算市场规模约为每年 7,000 亿美元,AI 服务只占其中的少数份额。更棘手的是「循环性」:巨头们的资本开支,很大程度上由其他 AI 公司的需求来论证合理性,而这些公司的收入增长又依赖于生态内其他环节的持续投入。某头部 AI 模型公司承诺八年投入 1.4 万亿美元建设数据中心,但其当前年收入约为 130 亿美元,资本开支与收入之比超过 100 倍,在现代商业史上没有可比先例。

一份 2026 年 2 月的研究还发现:90% 的受访企业表示 AI 尚未对其生产率产生可测量的影响,但同一批高管却预测 AI 将带来 1.4% 的生产率提升。「预期」与「实测」之间的这道缺口,正是行为信号所放大的结构性脆弱点。

六、道指新高 + 纳指下跌 = 崩盘?不,是轮动

从量化因子模型的语言看,当前发生的是市场领导力从「窄」到「宽」的切换:

  • • 2025 年 10 月,英伟达市值一度超过 5 万亿美元,约占标普 500 总市值的 7.3%;
  • • 标普 500 前 10 大成分股占总市值超过 40%,超过了 1999 至 2000 年互联网泡沫顶峰时约 27% 的集中度纪录;
  • • 道指创新高而纳指下跌,正是这种极端集中度「解绑」的统计学特征:资金没有离开股市,而是从少数权重股流向金融、医疗、工业、消费等此前掉队的板块。

历史也提醒我们:一项技术可以真正重要,同时其相关股票仍然出现泡沫。铁路重塑了美国经济,但 19 世纪 40 年代的铁路股曾下跌 85%;互联网改变了世界,但纳斯达克在 2000 年后从高点回撤了 78%。技术的价值和股价的泡沫,是两个独立的问题。

七、泡沫名单 vs 基建名单:信号并不均匀

对 AI 基础设施股票的多方法评估显示,泡沫信号呈现明显的「两极分化」:

  • • 基本面支撑组:云计算巨头和台积电。台积电以 16 倍的 2026 年预期市盈率对应 30% 的预期收入增长,在控制了实际收入增长和利润率之后,LPPL 泡沫信号显著较弱。
  • • 强泡沫信号组:内存制造商(美光、三星、SK 海力士)和测试设备商(泰瑞达、KLA、迈威尔、应用材料)。它们「卖铲子给挖矿的人」,收入依赖巨头资本开支的持续加速,而这一假设正在被巨头自己动摇——某巨头近期表态可能对外出售富余算力,暗示其内部算力利用率低于当初支出所预设的水平。

6 月底跌得最惨的,几乎正是强信号组的名单。

八、凯利公式:信号不确定时,先降仓位

量化投资对这类信号的标准应对不是「预测崩盘日期」,而是仓位管理。凯利公式(Kelly Criterion)的核心思想是:仓位应与你对「优势(edge)」的确定性成正比。当 LPPL 信号活跃时,意味着你对未来收益分布的估计误差变大,正确做法是缩小仓位,而不是加仓。

def kelly_fraction(win_prob, win_loss_ratio):
    """经典凯利公式:计算最优仓位比例"""

    # win_prob: 获胜概率;win_loss_ratio: 平均盈利与平均亏损之比

    return
 win_prob - (1 - win_prob) / win_loss_ratio

# 场景一:基本面清晰的标的,胜率估计较有把握

f1 = kelly_fraction(win_prob=0.60, win_loss_ratio=1.5)

# 场景二:LPPL 信号活跃的标的,胜率估计误差大,主动下调胜率假设

f2 = kelly_fraction(win_prob=0.52, win_loss_ratio=1.5)

# 实践中常用"半凯利"进一步压缩仓位,以应对参数估计误差

print
(f"基本面标的建议仓位(半凯利):{f1 / 2:.1%}")
print
(f"泡沫信号标的建议仓位(半凯利):{f2 / 2:.1%}")

小知识:实盘中很少有人用「全凯利」,因为凯利公式对输入参数极其敏感,胜率高估一点点就可能导致仓位严重过重。「半凯利」或「四分之一凯利」是更常见的工程化做法。

总结

  • • LPPL 模型通过「超指数增长 + 加速振荡」的数学指纹识别泡沫状态,tc 是带置信区间的时间窗口,不是精确的崩盘日期;
  • • HLPPL 在价格信号上叠加新闻情绪与媒体炒作指标,回测中取得 34.13% 年化收益、1.19 夏普比率和 72.30% 胜率;
  • • 当前 AI 半导体板块的信号是「分化」的:巨头与台积电的基本面支撑较强,内存与设备供应链环节的泡沫信号最强;
  • • 道指新高与纳指下跌并存,更像是极端集中度解绑后的健康轮动,而非系统性崩盘的前奏;
  • • 对 Python 学习者而言,LPPL 拟合和凯利公式都是练手非线性优化与风险管理的绝佳案例——但请记住,模型给出的是框架,不是水晶球。

风险提示:本文仅为技术与知识分享,不构成任何投资建议。历史表现不代表未来收益,请独立研究、审慎决策。

参考文章

加入专注于财经数据与量化投研的知识星球【数据科学实战】,获取本文完整研究解析、代码实现细节。

财经数据与量化投研知识社区

2026年全面升级已落地!【数据科学实战】知识星球核心权益如下:

  1. 1. 双典系统赋能:获赠《财经数据宝典》与《量化投研宝典》完整文档,凝练多年实战经验,构建系统化知识框架;
  2. 2. 量化因子日更教程(2026重磅新增):每日更新「量化因子专题教程」,配套完整可运行代码与实战案例,深度拆解因子构建、回测与优化全流程;
  3. 3. 量化文章专题教程库:500+篇星球独有高质量教程式文章,系统覆盖策略开发、因子研究、风险管理等核心领域,内容基本每日更新,并配套精选学习资料与实战参考;
  4. 4. 量化投研实战课程:赠送《AKQuant-入门及实战》《PyBroker-入门及实战》视频课程,手把手教学,快速掌握量化策略开发技能;
  5. 5. 财经数据支持:定期更新国内外财经数据,为策略研发提供精准、可靠的数据基础;
  6. 6. 顶尖学者与行业专家分享:年度邀请学术界博士与业界资深专家开展前沿论文精讲与实战案例分享,不少于4场,直击研究前沿与产业实践;
    专家直连答疑:与核心开发者及领域专家实时互动,高效解决投研实战难题;
  7. 7. 专业社群与专属福利:加入高质量交流社群,获取课程折扣及更多独家资源。

星球已沉淀丰富内容生态——涵盖量化文章专题教程库、因子日更系列、高频数据集、PyBroker实战课程、专家深度分享与实时答疑服务。无论您是初探量化的学习者,还是深耕领域的从业者,这里都是助您少走弯路、高效成长的理想平台。诚邀加入,共探数据驱动的投资未来!

好文推荐

1. 用 Python 打造股票预测系统:Transformer 模型教程(一)

2. 用 Python 打造股票预测系统:Transformer 模型教程(二)

3. 用 Python 打造股票预测系统:Transformer 模型教程(三)

4. 用 Python 打造股票预测系统:Transformer 模型教程(完结)

5. 揭秘隐马尔可夫模型:因子投资的制胜武器

6. YOLO 也能预测股市涨跌?计算机视觉在股票市场预测中的应用

7. 金融 AI 助手:FinGPT 让你轻松掌握市场分析

8. 量化交易秘籍:为什么专业交易员都在用对数收益率?

9. Python 量化投资利器:Ridge、Lasso 和 Elastic Net 回归详解

10. 掌握金融波动率模型:完整 Python 实现指南