NOETON 五层栈 · L4 / L5

L4 网络织物 · 分层认知

NETWORK FABRIC · TIERED COGNITION

完整能力来自网络化的权重池。

Noeton 不假装一台终端能装下全部智能。L4 把机器的能力延伸进网络:端侧小模型提供毫秒级响应与离线底线,边缘节点托管区域权重池,云端供给最大模型与全量能力。请求由调度器路由到能满足它的最便宜层级,一次请求甚至可以把 prefill 与 decode 放在不同层级完成。

这是 Noeton 最有争议的一层:强制联网意味着断网的 Noeton「故意做不了多少事」。我们认为能力密度值得这个代价——但论文专门用一节讨论它对自主、隐私与公平的影响,而不是轻轻带过。你可以在分层认知实验里亲手拉下断网开关,体验这个取舍。

端侧小模型

听写、本地检索、基础控制——降级模式的底线

边缘权重池

区域共享的中型模型,十毫秒级往返

云端全量池

最大模型与最全工具,能力的上限

Split 路由器

按算力/带宽特征把请求阶段分派到不同层级

交互演示 · LIVE

「便宜优先」不是口号,是账单。切换两种策略,看同一股请求流的成本分叉。

01

便宜优先

调度只问一个问题:满足质量约束的最低成本层级是哪一层。

02

能力即网络

升级模型像换自来水厂——用户端无感。

03

代价被直面

强制联网换能力密度,风险在论文中如实讨论。

相关实验:端·边·云路由器(含断网开关) →