GLM 5.2 触发"DeepSeek 时刻"恐慌测试;效率提升叙事 vs. 算力需求质疑

2026-06-21 周日 (ET) · 主帖 10 / 回复 54
以下部分引用 AI 总结,现阶段 AI 仍然有幻觉。请以内容的原文为准。
一些重点
  1. GLM 5.2 实测≈ Opus 4.6,仅编码强,速度慢 7-8 倍,缺多模态
  2. 效率 vs 需求效率提升 更多使用 总需求未降,Jevons 悖论在行动
  3. 国产芯片适配Day 0 适配 8 家国产算力,Ascend 950 下半年是关键
  4. SubQ 架构1M token 窗口 FLOP 降 64x,进化型改进非颠覆
  5. CerebrasGemma-4 推理最快,但客户集中度是隐忧
  6. Mythos 网络攻击数小时攻破美方几乎所有机密系统
  7. 散户流入韩台散户追涨 ETF 反馈 O/N 波动 20%

1 开源模型冲击波 — GLM 5.2 重新点燃"DeepSeek 时刻"争论

GLM 5.2 实测 争论·新叙事

GLM 5.2 不是 DeepSeek 时刻 2.0 — 实测差距明显 能力 ≈ Opus 4.6,但只有编码强,速度慢 7-8 倍,缺多模态 [1]中国国内共识也指向蒸馏 + 编码优化结果 [2]

  • 实测打回原形: 一位重度用户(40-50B token 用量)对比:GLM 5.2 单任务 30min vs GPT 5.5/Opus 4.8 的 4min 切回 Codex/Claude code [3]
  • 资深成员反叙事: DeepSeek 时刻本质是媒体 / 技术评论不懂技术制造的恐慌,不是真的;这种节奏每月 1-2 次强迫去杠杆,"永不过时的提款机" [4][5]
  • 群里内部冲突: 发起讨论者被批用播客操纵 chat、缺乏 credibility [6];群管理员调解——"常驻怀疑论者有用,但要更客观、先亮论点" [7]
  • 发起人澄清立场: 不是 short AI infra,只是 95% 的人太 long,感觉像 short;GLM + token maxxing + 大厂增速放缓 心理层面影响一切 [8][9]

对 PM 来说 = 开源模型追赶速度很快,但实测 still 差距 3-4 个月;关键看产品化能力和生态 不是直接 AI capex 利空,但心理层面可能压制半导体板块情绪 [8]

效率提升 vs. 算力需求 争论·多空

效率提升没有减少算力需求 —— 这是群里赢得的论点 一位群友反击:同样任务去年用 1M token 现在用 10k token,但 capex 预测没降 [10]

  • Jevons 悖论在行动: 效率提升 更多使用 总需求上升。回应者暗示这就是 Jevons 但不直接说 ("won't use the J-P word") [11]
  • Tokenmaxxing 收入放缓: 发起人将 GLM + token 效率提升 + 大厂增速放缓串联:效率越高,token 用量边际增长越慢,对算力需求预期形成心理压制 [8]。被反驳称这是将"模型竞争"与"AI infra 资本开支"混为一谈 [12]
  • Jensen "Tokens = revenues": 有人引用老黄公式说明 token 总量才是收入锚 [13]

SubQ 注意力架构 观察·新技术

SubQ 的 64x FLOP 削减不是革命,是 DeepSeek 动态注意力的进化版 MIT Tech Review 报道,1M token 窗口 FLOP 降 64x [14]

  • 技术要点: 非 n×n 权重相乘 选择性稀疏乘法。长上下文窗口(1M-2M token)效果更好,多智能体协同的未来方向 [15]
  • 性能限制: 表现介于 Opus 4.8(下)和 Sonnet 4.6(上)之间 — 因为 startup 没预算从头训练 [15]
  • 质疑:没人在意 有人猜测群里没人相信 SubQ,但 MIT Tech 背书不该忽略 [16]

Cerebras 短期看涨 多·潜力

Cerebras 在铺正确的路,但客户集中度是软肋

  • Gemma-4 推理最快: Cerebras 声称是运行 Gemma-4 推理最快的平台 [17]
  • 需要新收入客户: 一位分析师点评:种子都种好了,但需看到新收入客户来 offset 现有客户集中风险 [18]

2 宏观与地缘 — Mythos 网络攻击 + 散户套利链

Mythos 入侵 空·地缘风险

AI 辅助攻击能力已跨越关键阈值 — Mythos 数小时攻破美方几乎全部机密系统 NSA / 网络司令部负责人 Joshua Rudd 向参议院情报委副主席 Warner 确认 [19]

  • 速度前所未有: "不是几周,是几小时" — 表明 AI 辅助攻击的能力已经跨越关键阈值

韩台散户套利链 观察·资金流

散户买入 ETF 自我反馈 O/N 波动 20% — 跟 2008 中国一模一样

  • 链条解析: 韩台散户买 Samsung / Hynix 涨 20% O/N MU 跟涨 8% 隔夜。基本面没变 [20]
  • 分析师提醒: 跟 2008 中国一模一样,这波的可持续性存疑 [21]
  • 图表争议: GS 的散户资金流入图被批 y 轴非归一化,10yr 时间序列用名义美元 misleading [22]

INTC/AMD 异动 观察·盘前

INTC +$7, AMD −$7 — 回复:盘前而已不说明什么

  • 时间窗口注意: 有人提醒盘前交易不代表正式开盘方向 [23]
数据新鲜度群聊 08-18 ✓卖方 08-18 ✓Wrap 断档51天 ✕News 断档None天 ✕X 断档48天 ✕页面生成 08-20
📊 今日群聊 ATOMS
14 atoms 🟦 fact 2 🟥 take 12 5 / ▼ 5 / ◆ 4
实体 (今日): Maverick (3), H-Cap (2), SubQ (2), John (2), GLM 5.2 (1)
主题 (本周): 估值 (12), 管理层表态 (7), 定价权 (6), 通胀 (5), 监管 (4)
Δ 今日变化
  • AWS forecast 本月到期: 「Q2 营业利润指引需达 $14-15bn 高端才能推动股价」(2026-04-27 由 chat 提出)
  • Meta forecast 本月到期: 「META 指引需达 $61bn (28% yoy) 以支撑 AI 投资」(2026-04-27 由 chat 提出)
📜 今日原 atoms (按 entity 折叠展开)
Maverick · 3 atoms
  • 🟥 讨论 credibility 评价 · 群内冲突/credibility
    被批用播客操纵 chat、缺乏 credibility
  • 🟥 仓位立场 · 仓位信号
    95% 的人太 long,感觉像 short
  • 🟥 Tokenmaxxing 对算力需求预期影响 · 叙事框架/需求预期
    GLM + token 效率提升 + 大厂增速放缓 → 心理层面影响一切
H-Cap · 2 atoms
  • 🟥 节奏触发频率 · 交易节奏/杠杆风险
    这种节奏每月 1-2 次强迫去杠杆,'永不过时的提款机'
  • 🟥 效率提升与算力需求关系 · Jevons 悖论/效率与需求
    同样任务去年用 1M token 现在用 10k token,但 capex 预测没降
SubQ · 2 atoms
  • 🟥 技术改进描述 · 架构创新/注意力机制
    非 n×n 权重相乘 → 选择性稀疏乘法。1M-2M token 长上下文窗口更好
  • 🟥 性能表现 · 模型能力/创业限制
    表现介于 Opus 4.8(下)和 Sonnet 4.6(上)之间 — 因为 startup 没预算从头训练
John · 2 atoms
  • 🟥 韩台散户对 SMH 波动影响 · 资金流/套利链
    韩台散户买 → Samsung / Hynix 涨 20% O/N → MU 跟涨 8% 隔夜
  • 🟥 与 2008 中国市场类比 · 资金流/历史类比
    跟 2008 中国一模一样,可持续性存疑
GLM 5.2 · 1 atoms
  • 🟥 单任务耗时对比 · 模型能力/性能对比
    GLM 5.2 单任务 30min vs GPT 5.5/Opus 4.8 的 4min
Tae Kim · 1 atoms
  • 🟥 DeepSeek 时刻定性 · 叙事纠正/模型恐慌
    DeepSeek 时刻本质是媒体/技术评论不懂技术制造的恐慌,不是真的
Jensen Huang · 1 atoms
  • 🟦 Tokens = revenues 公式 · 收入锚/AI 经济
    'Tokens = revenues'
Cerebras · 1 atoms
  • 🟥 客户集中风险 · 风险因素/客户结构
    需看到新收入客户来 offset 现有客户集中风险
Mythos · 1 atoms
  • 🟦 攻击速度 · 地缘风险/AI 攻击
    '不是几周,是几小时' — AI 辅助攻击能力已跨越关键阈值
SUMMARY COVERAGE

Market chatter · 总结覆盖率

历史口径未留档
该日生成时尚未记录覆盖率;未知不记为 0。