---
title: "华为最年轻23级离职创业，王云鹤赌Agentic Routing能活下来"
date: 2026-08-13
category: AI大模型
site: 脑机网
canonical: https://aiai.cafe/a/njw-e63e1c
language: zh-CN
---

# 华为最年轻23级离职创业，王云鹤赌Agentic Routing能活下来

> 8月13日，晚点 LatePost 发布对王云鹤的深度对谈。这个名字多数人陌生，但履历很硬：在华为待了 7 年半，是体系里最年轻的 23 级，2025 年初接手

8月13日，晚点 LatePost 发布对王云鹤的深度对谈。这个名字多数人陌生，但履历很硬：在华为待了 7 年半，是体系里最年轻的 23 级，2025 年初接手诺亚方舟实验室和盘古大模型，今年 3 月离职，和同实验室的韩凯创办基元律动。他选的方向不那么“华为”——不是具身智能，也不是世界模型，而是 Agentic Routing，一个听起来很底层、却可能决定 AI 成本生死的赛道。

王云鹤的创业，是今天国内 AI 创业者最典型的样本：足够年轻、真训过模型、带过大团队，还懂应用。投资人说，满足这几个条件的，两只手数得过来。

Routing 解决的是一个真问题：Token 太贵他做的产品 OpenSquilla，是一个开源 AI Agent 框架，核心是“按请求级别调度模型”。一个复杂任务往往十几轮对话，有的轮次要深度推理，有的只是格式整理。OpenSquilla 逐轮判断该调哪个模型，重的给强模型，轻的给便宜模型。

> 他做过一张“Token 电表”：最贵的模型只干了 10% 的活，却拿走了 80% 的钱。全程用一个贵模型效果也好，但浪费惊人。
这套路由不靠另一个大模型做判断，而是用本地 LightGBM+ONNX 分类器，按消息长度、语言、代码块、语义嵌入打分，把任务分到 T0-T3 四个档位最便宜的可用模型。在 DRACO 深度研究评测里，全国产模型组合跑出 60.85 分，反超旗舰 Fable5 的 59.80，单任务成本仅约 0.39 美元，是后者的三分之一。

最大的质疑：模型会不会吞噬一切围绕 Routing 的最大质疑是：模型越来越强，今天要调度的任务，明天一个模型全干，中间层迟早消失。王云鹤部分同意，但认为“这是一种相对傲慢的观点”——不同模型公司的差异化不会很快消失，这是训练特性决定的。他甚至想得更远：通过 Harness 积累多模型博弈的信号，再杀回大模型牌桌。

对想创业的人，王云鹤给了一个冷静的样本：不追最热的方向，而是找“贵”这个永恒痛点，用工程而非堆参数去解决。Agentic Routing 能不能活下来没人能保证，但他选的，是一条还没被巨头挤满的窄门。

一条还没被挤满的窄门王云鹤的选择，折射出 2026 年创业的一个转向：不追最热的大模型，而去解决“贵”这个永恒痛点。当所有人在卷参数、卷榜单，路由层这种“苦活”反而少有巨头深耕。

> 对想入场的工程师创业者，这是一条可复制的思路：找一个被验证会付费的场景，用工程而非堆算力去降本，先活下来，再谈颠覆。
更大的背景是 Harness 工程成了今年行业核心议题。月之暗面、谷歌、腾讯都在把“如何编排模型”做成生产级能力，国泰海通甚至发深度报告，预测投研 Agent 市场 2030 年达 392 亿美元。王云鹤的巧思在于：别人在搭 Harness 卖服务，他先把路由开源，用社区换信号、用信号换模型侧的议价权。这条路能不能成另说，但“用开源换数据、再杀回牌桌”的算盘，打得比大多数同类清醒。

脑机派对

2026.08.13

---

来源：脑机网（https://aiai.cafe/）｜原文：https://aiai.cafe/a/njw-e63e1c
本内容仅供参考，不构成投资建议。
