NOETON 五层栈 · L4 / L5
L4 网络织物 · 分层认知
NETWORK FABRIC · TIERED COGNITION
完整能力来自网络化的权重池。
Noeton 不假装一台终端能装下全部智能。L4 把机器的能力延伸进网络:端侧小模型提供毫秒级响应与离线底线,边缘节点托管区域权重池,云端供给最大模型与全量能力。请求由调度器路由到能满足它的最便宜层级,一次请求甚至可以把 prefill 与 decode 放在不同层级完成。
这是 Noeton 最有争议的一层:强制联网意味着断网的 Noeton「故意做不了多少事」。我们认为能力密度值得这个代价——但论文专门用一节讨论它对自主、隐私与公平的影响,而不是轻轻带过。你可以在分层认知实验里亲手拉下断网开关,体验这个取舍。
端侧小模型
听写、本地检索、基础控制——降级模式的底线
边缘权重池
区域共享的中型模型,十毫秒级往返
云端全量池
最大模型与最全工具,能力的上限
Split 路由器
按算力/带宽特征把请求阶段分派到不同层级
交互演示 · LIVE
「便宜优先」不是口号,是账单。切换两种策略,看同一股请求流的成本分叉。
01
便宜优先
调度只问一个问题:满足质量约束的最低成本层级是哪一层。
02
能力即网络
升级模型像换自来水厂——用户端无感。
03
代价被直面
强制联网换能力密度,风险在论文中如实讨论。