QUANTA · 证据墙

世界正在走向 Noeton

我们不需要说服你。把 2024 年以来的产业事件按五条原则归档——让趋势自己说话。点击徽章可按原则过滤。

  1. 2026-01 P2 · 数据流计算

    HBM4 量产爬坡:逻辑走进内存栈

    定制 base die 成为 HBM4 标配(逻辑裸片代工进入先进工艺)——「计算向内存移动」从论文方向变成 DRAM 产品路线图。

  2. 2025-12 P1 · 内存中心

    Mooncake 并入 vLLM v1 主线

    Transfer Engine 成为 P/D 分离的官方 KV Connector,随后进入 PyTorch 生态——KV 池化从私有系统变成开源基建。

  3. 2025-12 P3 · Model-OS

    MCP 捐入 Linux 基金会 AAIF

    从私有协议到中立治理只用 13 个月——计算史上最快的「系统调用面」标准化,POSIX 当年走了十几年。

  4. 2025-11 P1 · 内存中心

    三星 & SK 海力士联手标准化 LPDDR6-PIM

    两大 DRAM 巨头共推低功耗存内计算标准;SK 路线图把 PIM × CXL 排到 2028——「展品到商品」的分水岭开始铺设。

  5. 2025-09 P5 · 意图交互

    Computer-Use Agent 成为产品形态

    Anthropic/OpenAI 的计算机操作智能体进入公测;鸿蒙 Intents Kit 把应用能力注册为系统级意图——「表达意图而非下指令」开始落进操作系统。

  6. 2025-09 P2 · 数据流计算

    NVIDIA Rubin CPX:只为 prefill 而生的 GPU

    30 PFLOPS 算力刻意搭配 GDDR7 而非 HBM,与 HBM 版 Rubin 分工解码——在位者亲手把「两种物理分两种芯片」做成产品。

  7. 2025-08 P1 · 内存中心

    澜起 CXL 3.1 内存扩展控制器送样

    PCIe 6.2 ×8、DDR5-8000 双通道;三星/AMD/英特尔站台——CXL 控制器生态位上中国公司居第一梯队。

  8. 2025-06 P1 · 内存中心

    华为 CloudMatrix 384:灵衢统一总线超节点

    NPU/CPU/DRAM/SSD 经 UnifiedBus 直连、无需 CPU 中介;对比 NVL72 内存容量 ~3.6×、带宽 ~2.1×——机柜级池化内存成为商用现实。

  9. 2025-03 P3 · Model-OS

    OpenAI 全线采用 MCP,Google 跟进

    最大的竞争对手采用对手发布的协议——N×M 适配爆炸的痛感压倒了生态壁垒。

  10. 2025-03 P4 · 分层认知

    NVIDIA 发布 Dynamo 分域推理框架

    GTC 2025:官方的「分域推理操作系统」——KV 感知路由 + prefill/decode 资源池调度,P/D 分离成为厂商一等公民。

  11. 2025-02 P1 · 内存中心

    Mooncake 获 FAST 2025 最佳论文

    存储顶会把最佳论文颁给「以缓存为中心组织推理集群」——学术共同体为内存中心路线背书。

  12. 2024-11 P3 · Model-OS

    Anthropic 发布 MCP

    用类型化 Schema 统一「模型 × 工具」连接——「Schema 即 ABI」从论文类比变成开源协议。

  13. 2024-09 P0 · 总前提

    推理模型把算力搬向解码

    o1 开启 test-time compute 范式(R1 随后开源化):token 预算大规模转向解码阶段——带宽受限负载在推理中的占比被进一步抬高。

  14. 2024-06 P1 · 内存中心

    Mooncake:KV 缓存中心架构发表

    清华 & 月之暗面公开 Kimi 的推理平台:以 KV 缓存为中心重组集群,P/D 分簇 + 闲置内存/SSD 池化。

  15. 2024-06 P4 · 分层认知

    Apple Intelligence + Private Cloud Compute

    端侧 ~3B 模型保底线、复杂请求升级到自研芯片云端——两级降级设计装进数亿台消费设备,升级决策对用户透明。

这面墙的论文版,是 v2 新增的第 12 章「产业轨迹」。

收录标准:可公开核实的产品发布、论文获奖、标准化事件;不收传闻与路线图 PPT。持续更新。