小鹏VLA 2.0的“神秘涌现”:从痛苦到突破,自动驾驶与机器人如何突然“开窍”?

小鹏VLA 2.0的“神秘涌现”:从痛苦到突破,自动驾驶与机器人如何突然“开窍”?

大家好,我是数据与算法架构提升之路,专注于AI、自动驾驶和机器人领域的最新动态。今天,我们来聊聊小鹏汽车在2025科技日上爆出的重磅消息:VLA 2.0和人形机器人IRON的“涌现”过程。这不仅仅是技术迭代,更是像科幻小说一样的突然“觉醒”。如果你对自动驾驶的未来感兴趣,这篇文章绝对值得一读!我们将基于小鹏自动驾驶负责人刘先明和机器人副总裁米良川的独家对话,揭秘背后的故事。

  • 刘先明 | 小鹏汽车自动驾驶负责人
于2016年博士毕业于伊利诺伊大学厄巴纳-香槟分校(UIUC),曾在Facebook(现Meta)、Cruise任职,从事机器学习与计算机视觉领域的前沿研究工作。现全面负责小鹏汽车自动驾驶中心业务和组织管理工作。
  • 米良川 | 小鹏汽车机器人副总裁及AI技术委员会负责人
他是机器人与AI领域的资深专家。曾在NVIDIA任职十余年,有深厚的GPU并行计算、移动计算、深度学习及自动驾驶技术功底;并曾于CMU机器人研究所深造,且拥有创办机器人公司的实践经验。

涌现的奇迹:从失败边缘到全新大陆

想象一下:一个项目经历了数月的失败,团队内部甚至多次讨论是否要停掉它。突然有一天,一切都变了——系统自己学会了此前难以攻克的场景,步态僵硬的机器人瞬间走得像真人一样。这就是小鹏VLA 2.0的“涌现”过程,何小鹏在2025科技日上形容它“极其突然”。

刘先明透露,小鹏从2024年起投入了3万张卡的算力,烧掉20多亿训练费用。直到今年二季度某一天,模型发生了巨大跳跃。但这不是运气,而是坚持“第一性原理”的结果:简化架构,告别复杂计算,直接用真实世界数据训练。结果?模型不再需要数据标注,就能泛化到新城市甚至海外市场。

一个惊喜案例:测试车在红灯即将转绿时,会缓缓向前蠕动,就像人类预备起步。更牛的是,即使前方灯没变,它也能通过两侧灯的变化推测。这不是人为教的,而是数据量大到一定程度,自然“理解”了。

VLA 2.0的核心秘密:为什么甩掉“Language”?

VLA(Vision-Language-Action)是自动驾驶的核心,但传统架构有三大痛点:

  1. 输入信号损失:从视频到离散Token,信息大量丢失。
  2. 输出连续性:控制信号是连续的,无法简单离散化。
  3. 缺乏真实反馈:强化学习往往被简化成监督微调,没法模拟物理世界。

小鹏的解决方案?拆掉“Language”部分,直接从Vision到Action!刘先明强调:“简单就是美。”输入用真实视频流,输出用连续信号,网络结构极简。文字作为Token输入,但去掉了图文对模块,训练效率大幅提升。

结果:不需要任何指令,就能实现园区漫游。部署时,直接内嵌推理逻辑,去掉云端计算,完美适配量产车。

量产部署的硬核优化:本地化、低延时

世界模型计算庞大,但小鹏VLA 2.0实现了本地部署。刘先明介绍,他们从模型到软件,再到编译器和硬件联合优化,让大规模模型在图灵芯片上实时运行,与摄像头帧率一致。传统方法如剪枝、蒸馏、量化当然用了,但关键是“榨取每一比特算力”。

激光雷达?小鹏说:不会装回来了!

Robotaxi会用激光雷达吗?刘先明一口否定:“为什么一定要用?”激光雷达扫描频率仅10Hz,高功率不符合车规,雨雾天气还易噪点。相反,摄像头信息量巨大(500-800万像素,三通道8比特),过去算法弱才依赖激光。现在,优化算法后,摄像头远超激光。

他指出,摄像头原始数据28比特,转RGB时损失16比特,但通过更好算法,能在暗光、逆光环境下捕捉更多信息。小鹏坚信纯视觉端到端是未来。

人形机器人IRON:从焦虑到惊艳“涌现”

转向机器人,小鹏的IRON同样经历了“涌现”。米良川回忆,4月上海车展前一个月,团队还为步态僵硬焦虑。但3月某晚,IRON在倒退行走时突然拟人化!这是生成式控制器的拐点,数据和算力积累的结果。

IRON的秘密:

  • 脊柱设计:不是简单腰部,而是仿人类“脊柱+肌肉群+腹腔+皮肤”,自由度更高。
  • 前脚掌自由度:加上生成式控制器,实现大师级太极、叶问蹲。
  • 第四代控制器:“反重力器”,对抗重力本质,输入连续姿态,就能执行动作。

米良川认为,机器人能力是“螺旋上升”:从30分场景应用,解决问题到40分,再循环。未来,IRON不只工具,还能情感链接——甚至做成亲人模样。

IRON丝滑打太极,步态超拟人,让人怀疑“里面是不是真人”?

涌现背后的启示:坚持与上限

刘先明和米良川的对话,让我们看到“涌现”不是玄学,而是投入+原理的产物。小鹏倾全公司资源自研机器人(除了螺丝),证明了VLA在操纵上的潜力。米良川说:“发展缓慢,但上限高。人类100分,机器人至少80分才能进家庭。”

结语:自动驾驶与机器人的新时代

小鹏的VLA 2.0和IRON,标志着AI从“模仿”到“涌现”的跃迁。这不只技术故事,更是关于坚持的励志篇。未来,自动驾驶无标注泛化,机器人情感陪伴,都指日可待。

Read more

Visual C++运行库智能修复工具:彻底解决软件依赖问题

Visual C++运行库智能修复工具:彻底解决软件依赖问题 【免费下载链接】vcredistAIO Repack for latest Microsoft Visual C++ Redistributable Runtimes 项目地址: https://gitcode.com/gh_mirrors/vc/vcredist 当你满怀期待地打开新下载的游戏或专业软件,却遭遇"应用程序无法正常启动"的尴尬时,问题很可能出在Visual C++运行库上。这款由微软开发的系统组件是许多Windows应用程序正常运行的基础,一旦缺失或损坏,就会导致各种软件故障。 工具核心优势 智能检测系统 * 自动扫描系统中所有已安装的Visual C++组件 * 验证运行库文件完整性 * 检查注册表项状态 * 核对版本一致性 精准修复机制 * 智能识别具体损坏的组件 * 自动下载或提取正确的安装文件 * 执行事务性修复确保系统稳定 实战操作指南 基础修复方案 对于大多数用户,推荐使用以下命令进行一键修复:

By Ne0inhk
Java 二叉树从入门到精通-遍历与递归详解

Java 二叉树从入门到精通-遍历与递归详解

Java 二叉树从入门到精通-遍历与递归详解 二叉树不难,就是"递归+队列" 一、什么是二叉树? 1.1 生活中的二叉树 想象一个家族族谱: 爷爷 / \ 爸爸 叔叔 / \ / \ 我 弟弟 堂哥 堂妹 这就是一棵二叉树: * 爷爷是根节点(最顶层) * 爸爸和叔叔是爷爷的子节点 * 我和弟弟是爸爸的子节点 * 每个节点最多有2个子节点(左孩子、右孩子) 1.2 二叉树的定义 二叉树: 每个节点最多有两个子节点的树形结构 LeetCode标准节点结构: /** * Definition for a binary tree node. * 这是LeetCode所有二叉树题目使用的标准结构 */publicclassTreeNode{int val;// 节点存储的值TreeNode left;// 指向左子节点的引用TreeNode right;// 指向右子节点的引用/

By Ne0inhk
Java之String类常用操作

Java之String类常用操作

Java之String类 * 一、String类的理解 * 1、类的声明 * 2、内部声明的属性 * 3、字符串常量的存储位置 * 4、字符串的不可变性的理解 * 5、String实例化的两种方式 * 6、字符串的拼接 * 二、String的构造器 * 1、构造器 * 2、String和char之间相互转换 * 3、String和byte之间相互转换 * 三、String中常用方法 一、String类的理解 1、类的声明 publicfinalclassStringimplementsjava.io.Serializable,Comparable<String>,CharSequence{ final:String是不可以被继承的; Serializable:可序列化的接口,凡是实现此接口的类的对象就可以通过网络或者本地流进行数据的传输。 Comparable:凡是实现此接口的类,其对象都可以比较大小。 2、内部声明的属性 privatefinalchar value[]; 存储字符串数据的容器

By Ne0inhk
【Java】synchronized关键字详解:从字节码到对象头与锁升级

【Java】synchronized关键字详解:从字节码到对象头与锁升级

👨‍💻程序员三明治:个人主页 🔥 个人专栏: 《设计模式精解》《重学数据结构》 🤞先做到 再看见! 目录 * synchronized底层原理(总结版) * `synchronized` 底层原理(详解版) * 1. 字节码层面:monitorenter 和 monitorexit * 2. JVM 底层实现:对象头与 Monitor * 2.1 Java 对象头(Mark Word) * 2.2 Monitor(管程/监视器锁) * 3. 锁的升级与优化 * 3.1 偏向锁 * 3.2 轻量级锁 * 3.3 重量级锁 * 4. 硬件层面:内存屏障与 CAS * JVM锁升级是什么?

By Ne0inhk