QUANTA · 证据墙
我们不需要说服你。把 2024 年以来的产业事件按五条原则归档——让趋势自己说话。点击徽章可按原则过滤。
定制 base die 成为 HBM4 标配(逻辑裸片代工进入先进工艺)——「计算向内存移动」从论文方向变成 DRAM 产品路线图。
Transfer Engine 成为 P/D 分离的官方 KV Connector,随后进入 PyTorch 生态——KV 池化从私有系统变成开源基建。
两大 DRAM 巨头共推低功耗存内计算标准;SK 路线图把 PIM × CXL 排到 2028——「展品到商品」的分水岭开始铺设。
Anthropic/OpenAI 的计算机操作智能体进入公测;鸿蒙 Intents Kit 把应用能力注册为系统级意图——「表达意图而非下指令」开始落进操作系统。
30 PFLOPS 算力刻意搭配 GDDR7 而非 HBM,与 HBM 版 Rubin 分工解码——在位者亲手把「两种物理分两种芯片」做成产品。
PCIe 6.2 ×8、DDR5-8000 双通道;三星/AMD/英特尔站台——CXL 控制器生态位上中国公司居第一梯队。
NPU/CPU/DRAM/SSD 经 UnifiedBus 直连、无需 CPU 中介;对比 NVL72 内存容量 ~3.6×、带宽 ~2.1×——机柜级池化内存成为商用现实。
GTC 2025:官方的「分域推理操作系统」——KV 感知路由 + prefill/decode 资源池调度,P/D 分离成为厂商一等公民。
用类型化 Schema 统一「模型 × 工具」连接——「Schema 即 ABI」从论文类比变成开源协议。
o1 开启 test-time compute 范式(R1 随后开源化):token 预算大规模转向解码阶段——带宽受限负载在推理中的占比被进一步抬高。
清华 & 月之暗面公开 Kimi 的推理平台:以 KV 缓存为中心重组集群,P/D 分簇 + 闲置内存/SSD 池化。
端侧 ~3B 模型保底线、复杂请求升级到自研芯片云端——两级降级设计装进数亿台消费设备,升级决策对用户透明。
这面墙的论文版,是 v2 新增的第 12 章「产业轨迹」。
收录标准:可公开核实的产品发布、论文获奖、标准化事件;不收传闻与路线图 PPT。持续更新。