拓冰建站拓冰建站
首页 / 资讯中心 / 正文

王兴兴与梁文锋“错配”背后:具身智能与大模型的真实差距

这次我们不聊具体的模型权重、推理框架或者一键部署脚本而是聊一个最近技术社区里反复出现的讨论王兴兴“错配”梁文锋先说清楚讨论对象。王兴兴是宇树科技创始人主要做四足机器人、人形机器人属于具身智能和智能硬件方向。梁文锋是深度求索DeepSeek创始人主要做大语言模型、深度推理、开源模型和 API 服务属于基础模型与 AI Infra 方向。两个人都被外界视为杭州 AI 创业的代表人物但做的事情差异很大。所谓“错配”在不同语境里有完全不同的含义有人指人才错配有人指技术路线错配有人指资本和舆论关注度的错配。这篇文章想把这个问题拆开来看。不讲情绪化评价只从技术路线、组织能力、商业化路径、人才结构、产业生态几个维度做一次对照分析。如果你在关注具身智能、大模型、AI 创业或技术团队建设这篇内容可以直接收藏。1. 王兴兴与梁文锋核心信息速览对照项王兴兴 / 宇树科技梁文锋 / 深度求索主营业务四足机器人、人形机器人、运动控制与整机硬件大语言模型、深度推理、开源模型、API 服务技术侧重点机械结构、电机驱动、运动控制、嵌入式系统、端侧智能Transformer 架构、训练框架、推理优化、数据工程、分布式训练产品形态实体硬件终端可演示、可交付、可直接运行云端模型服务、开源权重、本地可部署推理服务核心用户科研机构、高校、行业客户、极客开发者开发者、企业客户、研究者、AI 应用团队训练与推理环境边缘算力、嵌入式设备、低功耗硬件大规模 GPU 集群、高性能推理服务器对外合作方式硬件销售、行业解决方案、开发者套件API 调用、开源社区生态、企业私有化部署人才结构机械、电子、控制、嵌入式、工业设计占比较高算法、系统工程、数据标注、分布式计算占比较高典型评价维度运动能力、稳定性、功耗、量产能力、价格模型效果、推理成本、开放程度、长上下文、稳定性从表格能看出来两家公司表面都在“AI”大伞下但实际做的事情所处产业链环节差异非常大。所谓“错配”很大程度上来自这种差异被外界无意或有意地拉近对比。有一点需要提前说明两家公司的具体融资数据、团队规模、最新产品版本公开渠道随时都在变化。本文只基于可公开获取的一般信息做定性分析不涉及未经证实的具体数字。具体参数以官方口径为准。2. “错配”说法的几种理解2.1 人才错配做硬件的不被当 AI 公司做模型的被当成万能药技术社区里最常见的一种“错配”讨论集中在人才评价体系上。宇树科技的核心竞争力在机械设计、电机控制、嵌入式软件、整机量产这些能力在传统的 AI 算法岗评价体系里并不占优势。一个能把四足机器人做到稳定量产、成本压下来的团队核心成员可能更多来自机械工程、自动化、电子工程等专业而不是单纯来自计算机视觉、自然语言处理等 AI 方向。梁文锋的深度求索则是一个典型的算法驱动团队核心优势在模型架构、训练策略、分布式工程和数据质量。这种团队的人才画像放到传统硬件公司里去评价同样会显得“不匹配”。所以“王兴兴错配梁文锋”可以理解为外界习惯用同一套标准评价所有 AI 创业者导致硬件创业者被低估、算法创业者被高估或者反过来。这种错配是评价体系的错配不是能力本身的错配。2.2 技术路线错配具身智能需要端侧模型大模型重心却在云端宇树科技做机器人最终需要的是端侧智能也就是机器人在不依赖稳定网络的情况下能完成感知、决策、运动控制。DeepSeek 这类大模型公司优势在云端训练和云端推理两者之间存在一条天然的“部署落差”。机器人本体上的算力通常远低于云端数据中心。机器人的决策延迟要求远高于普通对话应用。这意味着大模型能力要真正落到人形机器人上不能只是把大模型 API 接进来还需要做模型压缩、量化、知识蒸馏、端侧推理优化甚至开发专门的具身基座模型。从这个角度看“错配”指的是技术供给和真实需求不在同一个环节上。大模型公司提供的能力很强但未必能直接解决机器人公司在硬件上的实时性和功耗约束。反过来机器人公司积累的物理交互数据也未必能直接转化为大模型训练所需的高质量文本数据。2.3 资本与舆论关注度的错配过去一段时间大模型赛道的融资热度、舆论关注度明显高于机器人硬件赛道这是比较直观的产业观察。同样是技术创业者梁文锋团队因为开源模型在国际社区获得大量关注而王兴兴团队虽然产品在全球销量可观但舆论声量很难比肩基础模型公司的讨论热度。这种关注度差异会导致资源流向的“错配”大量应届生优先投递大模型算法岗大量早期资金优先追逐大模型创业项目而机器人本体相关的机械、控制、嵌入式岗位相对更难吸引顶级人才。然而从产业落地角度看机器人硬件需要大量的工程迭代、供应链管理和现场部署这些工作的价值并不会因为关注度低而减少。越是关注度错配明显越会造成人才结构失衡。2.4 也可以理解为互补而不是错配如果换一个角度宇树科技和深度求索做的事情其实是同一波 AI 浪潮里的上下游。大模型提供通用理解和推理能力机器人提供物理世界的执行和感知能力。真正理想的组合不一定是两家公司合并而是各自把最擅长的环节做到极致然后通过接口、协议、端侧模型和行业解决方案完成协同。所谓“错配”更准确的描述可能是“匹配尚未完成”。不是两者不应该在一起而是当前技术栈、商业协议和行业标准还没准备好让它们顺畅地结合在一起。3. 技术路线拆解具身智能与大模型的交点3.1 宇树的技术栈从运动控制到端侧感知宇树科技起家于四足机器人核心能力集中在以下几个层面。机械结构层面需要解决关节电机、减速器、结构件、电池系统的一致性和可靠性。运动控制层面需要开发步态规划、平衡控制、地形适应算法这些算法对实时性要求很高通常在嵌入式控制器或工控机上运行。感知层面需要接入激光雷达、深度相机、惯性测量单元在本地完成建图、定位、避障。传统机器人公司的智能化升级路径是从运动控制向上延伸逐步增加视觉感知、语音交互和决策能力。这是一个自下而上的过程最难的是让机器在复杂物理环境里保持稳定和可靠。3.2 深度求索的技术栈从模型训练到推理服务深度求索这类大模型公司的技术栈重心在另一个方向。数据侧需要构建高质量文本语料做清洗、去重、配比。训练侧需要设计模型结构、训练超参、分布式并行策略处理大规模 GPU 集群的稳定性问题。推理侧需要做 KV Cache 优化、量化、投机采样、服务化部署降低单次请求成本。大模型的优势在于知识密度和泛化能力能处理开放域的语言理解和逻辑推理。但大模型本身没有物理世界的实时反馈不知道“轮子打滑”“电机过热”“机械臂碰撞”是什么感觉。这部分信息只能来自真实硬件和传感器数据。3.3 机器人的“大脑”和“小脑”不是一回事在机器人领域通常会把智能分为两层。上层是“大脑”负责理解任务、规划动作、进行常识推理这部分确实可以借助大模型。下层是“小脑”负责运动控制、姿态调整、避障、力反馈这部分需要毫秒级响应依赖的是控制算法和端侧模型。把一个大模型直接部署到机器人本体上让它完成毫秒级运动控制不是不可能但成本和功耗会非常高。更现实的做法是“云端大脑 端侧小脑”云端大模型理解任务端侧控制模型执行动作两者之间通过结构化指令通信。3.4 具身智能想要真正落地需要哪些新能力从技术趋势看具身智能真正要突破的不是单独的大模型能力而是几个交叉环节将视频、文本、力觉、本体感觉等多模态信息统一编码形成机器人可理解的“物理世界模型”。在保证推理精度的前提下把模型压缩到机器人本体能承受的算力范围内。建立一套从真实硬件数据到模型训练数据的回流机制让机器人执行任务时产生的数据能反哺模型迭代。解决长程任务中的错误累积问题让机器人在多步操作中具备自我纠错和重新规划能力。这些能力既有大模型团队擅长的地方也有机器人团队积累更深的领域。只看任何一边都很难独立完成全部闭环。4. 人才结构与组织能力对比4.1 硬件团队和算法团队的思维方式差异硬件团队的产品周期更长容错率更低。一个机械结构设计错误可能要经历开模、组装、测试、返工几个完整阶段才能暴露迭代成本很高。算法团队则更习惯快速实验训练失败可以调整参数重新跑试错成本相对集中在算力和时间上。这种差异会直接影响团队协作方式。硬件团队强调评审、验证、阶段交付算法团队强调快速迭代、自动评估、小步试错。如果一家公司同时要兼顾机器人和大模型两个方向两种文化极易发生碰撞。4.2 复合型人才比单一算法人才更稀缺目前行业里真正稀缺的不是单纯会训练大模型的算法工程师也不是单纯会画机械图的机械工程师而是能理解模型能力边界、又能理解硬件物理限制的复合型人才。这类人才需要同时具备模型部署经验、嵌入式优化经验、机器人控制基础还要能跟硬件团队顺畅沟通功耗、散热、算力和时延约束。从公开信息看宇树和 DeepSeek 都尚未明确宣布要大规模互相招聘。但如果“错配”讨论指向的是人才结构性短缺那么核心问题其实是我们怎么培养出更多既懂模型、又懂硬件的工程师。4.3 组织协作跨团队接口比代码接口更难定义如果未来出现更多“大模型公司 机器人公司”的合作项目真正的瓶颈往往不在模型效果而在两个团队之间的接口定义。模型团队需要明确输出格式、推理时延、失败模式、置信度评分硬件团队需要提出物理约束、状态反馈、传感器数据格式。这些内容如果不能形成标准文档和配套工具链合作很容易停留在 Demo 阶段。一个最简单的技能画像分析脚本可以帮你理解这个问题。假设你在看一份候选人简历想判断他更偏硬件还是更偏算法可以用关键词权重打分的方式做初步筛选。以下代码只是一个演示示例可以用在你自己的内部工具里实际字段需要按团队情况调整。def skill_profiling(resume_text: str) - dict: keywords { hardware: [机械设计, 嵌入式, 电机, 运动控制, 结构, 硬件, 电机驱动, 传感器], software: [Transformer, 训练, 推理, 分布式, 大模型, PyTorch, CUDA, 算法], cross: [端侧, 量化, 模型压缩, 机器人, 具身智能, 多模态, 部署] } scores {k: 0 for k in keywords} for category, words in keywords.items(): for w in words: scores[category] resume_text.count(w) return scores resume 做过机器人运动控制熟悉电机驱动和嵌入式系统后来参与大模型推理优化 主要做模型量化与端侧部署。 print(skill_profiling(resume))输出结果会显示“cross”类关键词覆盖度较高说明候选人有复合背景。这里的核心观点是判断一个人适不适合机器人 AI 岗位不能只看算法能力也不能只看硬件经验要分析他在“模型”和“物理系统”之间的连接能力。4.4 组织能力对比量产能力 vs 训练管线能力从长期竞争力来看宇树积累的是硬件量产和供应链管理能力这决定了它能不能以合理成本交付可靠产品。DeepSeek 积累的是训练管线、数据工程和推理优化能力这决定了它能不能以更低成本提供更强的智能服务。这两类能力都很难短期复制都是“规模效应”的体现只是规模化的对象不同。5. 商业化落地与路径差异5.1 宇树的商业化路径先卖硬件再谈智能增值宇树这类硬件公司的商业化路径通常分三个阶段。早期以开发者套件和科研机型为主卖给高校、研究所和极客用户。中期推出行业级产品面向巡检、安防、物流、教育等场景。后期在人形机器人成熟后进入制造业、服务业等更广泛的市场。这种路径的特点是每一笔收入都要对应一台真实的物理设备。硬件有成本、有库存、有售后营收增长高度依赖供应链效率和渠道能力。好处是商业模式清晰坏处是规模化速度受产能约束。5.2 DeepSeek 的商业化路径模型开源引流服务收费大模型公司的商业化路径通常以开源模型建立生态再通过 API 服务、企业私有化部署、技术支持等方式实现收入。模型本身的边际复制成本很低服务可以弹性扩展只要单次推理成本控制住收入规模可以和调用量同比例增长。这种模式的增长逻辑更接近互联网软件前期看开发者生态中期看企业客户粘性长期看推理成本和模型能力的综合竞争力。5.3 各自的短板在哪里宇树目前的短板更多在“智能化”和“通用性”。硬件可以量产但机器人在开放环境下的通用任务能力还不足很多场景仍然需要人为预设和遥控。DeepSeek 目前的短板更多在“物理交互”和“实时反馈”。模型可以回答复杂问题但没有办法直接感知物理世界也没有办法直接控制机械臂、机器狗和人形机器人。两家如果把视角放在对方的短板上就会觉得彼此“错配”。但如果把视角放在产业链协同上会发现它们的短板正好需要对方的长板来补。5.4 如果“错配”成立意味着什么如果“错配”是指“两家公司本来不应该被放在一起对比”那这个说法是有道理的。硬件公司和基础模型公司在产品形态、商业模式、人才结构上差异巨大用同一套标准对比没有意义。但如果“错配”是指“大模型公司不懂机器人、机器人公司不懂大模型”这就不是价值判断而是一个真实的技术缺口。这个缺口不是某一家公司能单独填上的需要整个产业生态共同建设。6. 资源分配与创新生态影响6.1 AI 产业不缺“想法”缺的是跨场景的连接层当前 AI 产业里模型能力已经很强硬件能力也在快速进步真正缺的是连接层。连接层包括把模型输出的自然语言指令转成机器人可执行的动作序列把机器人传感器数据转成模型可理解的结构化信息把模型推理时延控制在机器人控制可接受的范围内。如果没有这层连接再强的云端模型、再好的机器人硬件都只能各自为战。这就是为什么“错配”讨论真正应该关心的问题不是谁和谁匹配而是我们什么时候能把“模型 - 机器人”这套工具链标准化。6.2 对创业者和技术决策者的启示如果你在创业或者正在做技术选型可以从这个案例里提炼出几条实用判断原则。第一先定义清楚自己做的是哪个环节。是做模型、做硬件、做连接层、还是做行业应用每个环节的估值逻辑、人才需求和竞争格局完全不同。第二不要用“AI 公司”一个词混掉所有阶段。芯片、模型、硬件、应用是四种生意。第三找合作伙伴时重点看双方接口能不能对齐而不是看对方名气大不大。6.3 人才市场的结构性变化随着具身智能讨论升温人才市场的需求结构也会逐渐变化。纯算法岗的竞争会越来越激烈同时具备模型优化和硬件部署经验的人才溢价会更明显。如果你现在是算法工程师可以考虑补一点嵌入式或机器人控制的基础知识如果你是硬件工程师可以开始接触模型量化、端侧推理和提示词工程。这样在未来无论是进大模型公司还是机器人公司你都比单一背景的人更有选择空间。7. 常见误读与澄清常见误读更合理的理解王兴兴和梁文锋是竞争对手两家公司处于产业不同环节直接竞争关系并不存在更多是协同和互补关系大模型公司很快能接管机器人智能机器人需要毫秒级实时控制和物理世界反馈这是云端大模型无法直接覆盖的部分机器人公司应该立刻自研大模型自研大模型成本高、周期长大部分机器人公司更适合采用端侧小模型 云端大模型的混合方案“错配”说明其中一位不行所谓的错配更多是评价标准、资源流向和产业成熟度的问题而非个人或团队能力问题具身智能 给机器人接一个 GPT具身智能需要感知、控制、运动规划、安全机制等多层技术栈不是简单地把大模型 API 接进来开源模型可以直接驱动机器人开源模型可以做任务规划但要落到物理控制需要额外的控制策略和安全验证流程这张表值得收藏。后续你在讨论群里看到类似话题可以直接把表格丢出去比长篇解释更高效。8. 后续观察方向与技术从业者建议8.1 值得重点观察的指标未来判断这个领域有没有从“错配”走向“匹配”可以关注几个具体指标宇树或同类机器人公司是否发布适配大模型端侧部署的硬件参数和接口文档。深度求索或同类大模型公司是否推出面向具身智能的领域模型或工具链。市场上是否出现成熟的“大模型 机器人”中间件能把自然语言指令转成机器人动作序列。高校和培训机构是否开始设置“模型部署 机器人控制”的交叉课程这是人才培养转向的信号。机器人公司发布的岗位里是否出现更多复合背景要求比如“懂模型量化熟悉 ROS能调电机”。这些指标比单纯看融资新闻更能反映真实产业变化。8.2 给开发者的行动建议如果你想让自己的技能跟上这波变化建议按下面几条来做。先把一种主流推理框架用熟掌握模型量化、批处理、显存管理和接口封装这是端侧部署的基础。再学习一种机器人开发环境的基础概念理解坐标变换、运动规划、传感器数据读取和实时控制循环。找一块便宜的开发板尝试在端侧跑一个小模型做一次“语音指令 - 控制 LED / 电机 / 舵机”的闭环实验。把项目文档、代码、硬件接线图和数据日志放在同一个仓库里训练自己跨环节沟通的能力。参与一次机器人比赛、Maker Faire 或本地硬件社区的动手活动这类经验在招聘中的区分度往往比刷题更高。具体的最小闭环实验可以用下面这个伪代码来理解。假设你有一块 Linux 开发板和一个小电机驱动模块你要做的事情就是加载一个极小的端侧模型 - 输入文本 - 输出动作编号 - 控制 GPIO 引脚 - 让电机转动。# 伪代码示例端侧模型控制 GPIO 输出 import torch from transformers import AutoTokenizer, AutoModelForCausalLM import RPi.GPIO as GPIO # 加载极小模型实际项目按目标设备替换 tokenizer AutoTokenizer.from_pretrained(your-tiny-model) model AutoModelForCausalLM.from_pretrained(your-tiny-model) GPIO.setmode(GPIO.BCM) GPIO.setup(18, GPIO.OUT) def parse_command(text: str) - int: inputs tokenizer(text, return_tensorspt) outputs model.generate(**inputs, max_new_tokens10) action tokenizer.decode(outputs[0], skip_special_tokensTrue) return 1 if turn_on in action else 0 while True: cmd input( ) if cmd.strip() quit: break value parse_command(cmd) GPIO.output(18, GPIO.HIGH if value 1 else GPIO.LOW) print(GPIO 18 set to, value) GPIO.cleanup()这段代码只是演示“端侧模型 硬件控制”的流程实际设备上还要处理模型体积、推理时延、电源管理、异常恢复等问题。关键不是代码本身而是建立起“模型输出最终要变成物理动作”的闭环意识。8.3 安全与合规边界最后必须强调合规边界。无论是机器人公司、大模型公司还是做连接层的小团队只要涉及物理设备控制和真实场景部署都要注意三点任何涉及人类肖像、声音、私有数据的采集和处理必须获得明确授权遵守个人信息保护相关法规。机器人设备在公共空间运行必须有急停机制、安全隔离区域和完备的异常处理预案。模型生成的内容和动作指令在进入实际生产环境前要经过人工复核和安全测试不能直接让模型在无人监督状态下控制物理设备。这些要求不是限制创新而是保证创新能持续下去的前提。9. 总结王兴兴“错配”梁文锋这个讨论本质上不是两个人的对比而是 AI 产业局部过热与结构性缺口的一次集中体现。硬件公司有量产能力但缺通用智能大模型公司有智能能力但缺物理实感两者之间的连接层才是真正值得投入的地方。当前最值得先做的事不是争论谁更厉害而是把“模型 - 机器人”这条链路里的接口、工具链、人才标准和安全规范补齐。对技术从业者来说与其纠结加入哪一家公司不如先问自己你更擅长在哪个环节创造价值以及对另一个环节有没有足够的好奇心。这个话题后续还有很多变量建议收藏备用。等产业再往前走半年再回来看这些判断会发现最初讨论的那些“错配”很多其实只是时间差和评价视角的问题。
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门