小鹏VLA 2.0的“神秘涌现”:从痛苦到突破,自动驾驶与机器人如何突然“开窍”?

小鹏VLA 2.0的“神秘涌现”:从痛苦到突破,自动驾驶与机器人如何突然“开窍”?

大家好,我是数据与算法架构提升之路,专注于AI、自动驾驶和机器人领域的最新动态。今天,我们来聊聊小鹏汽车在2025科技日上爆出的重磅消息:VLA 2.0和人形机器人IRON的“涌现”过程。这不仅仅是技术迭代,更是像科幻小说一样的突然“觉醒”。如果你对自动驾驶的未来感兴趣,这篇文章绝对值得一读!我们将基于小鹏自动驾驶负责人刘先明和机器人副总裁米良川的独家对话,揭秘背后的故事。

  • 刘先明 | 小鹏汽车自动驾驶负责人
于2016年博士毕业于伊利诺伊大学厄巴纳-香槟分校(UIUC),曾在Facebook(现Meta)、Cruise任职,从事机器学习与计算机视觉领域的前沿研究工作。现全面负责小鹏汽车自动驾驶中心业务和组织管理工作。
  • 米良川 | 小鹏汽车机器人副总裁及AI技术委员会负责人
他是机器人与AI领域的资深专家。曾在NVIDIA任职十余年,有深厚的GPU并行计算、移动计算、深度学习及自动驾驶技术功底;并曾于CMU机器人研究所深造,且拥有创办机器人公司的实践经验。

涌现的奇迹:从失败边缘到全新大陆

想象一下:一个项目经历了数月的失败,团队内部甚至多次讨论是否要停掉它。突然有一天,一切都变了——系统自己学会了此前难以攻克的场景,步态僵硬的机器人瞬间走得像真人一样。这就是小鹏VLA 2.0的“涌现”过程,何小鹏在2025科技日上形容它“极其突然”。

刘先明透露,小鹏从2024年起投入了3万张卡的算力,烧掉20多亿训练费用。直到今年二季度某一天,模型发生了巨大跳跃。但这不是运气,而是坚持“第一性原理”的结果:简化架构,告别复杂计算,直接用真实世界数据训练。结果?模型不再需要数据标注,就能泛化到新城市甚至海外市场。

一个惊喜案例:测试车在红灯即将转绿时,会缓缓向前蠕动,就像人类预备起步。更牛的是,即使前方灯没变,它也能通过两侧灯的变化推测。这不是人为教的,而是数据量大到一定程度,自然“理解”了。

VLA 2.0的核心秘密:为什么甩掉“Language”?

VLA(Vision-Language-Action)是自动驾驶的核心,但传统架构有三大痛点:

  1. 输入信号损失:从视频到离散Token,信息大量丢失。
  2. 输出连续性:控制信号是连续的,无法简单离散化。
  3. 缺乏真实反馈:强化学习往往被简化成监督微调,没法模拟物理世界。

小鹏的解决方案?拆掉“Language”部分,直接从Vision到Action!刘先明强调:“简单就是美。”输入用真实视频流,输出用连续信号,网络结构极简。文字作为Token输入,但去掉了图文对模块,训练效率大幅提升。

结果:不需要任何指令,就能实现园区漫游。部署时,直接内嵌推理逻辑,去掉云端计算,完美适配量产车。

量产部署的硬核优化:本地化、低延时

世界模型计算庞大,但小鹏VLA 2.0实现了本地部署。刘先明介绍,他们从模型到软件,再到编译器和硬件联合优化,让大规模模型在图灵芯片上实时运行,与摄像头帧率一致。传统方法如剪枝、蒸馏、量化当然用了,但关键是“榨取每一比特算力”。

激光雷达?小鹏说:不会装回来了!

Robotaxi会用激光雷达吗?刘先明一口否定:“为什么一定要用?”激光雷达扫描频率仅10Hz,高功率不符合车规,雨雾天气还易噪点。相反,摄像头信息量巨大(500-800万像素,三通道8比特),过去算法弱才依赖激光。现在,优化算法后,摄像头远超激光。

他指出,摄像头原始数据28比特,转RGB时损失16比特,但通过更好算法,能在暗光、逆光环境下捕捉更多信息。小鹏坚信纯视觉端到端是未来。

人形机器人IRON:从焦虑到惊艳“涌现”

转向机器人,小鹏的IRON同样经历了“涌现”。米良川回忆,4月上海车展前一个月,团队还为步态僵硬焦虑。但3月某晚,IRON在倒退行走时突然拟人化!这是生成式控制器的拐点,数据和算力积累的结果。

IRON的秘密:

  • 脊柱设计:不是简单腰部,而是仿人类“脊柱+肌肉群+腹腔+皮肤”,自由度更高。
  • 前脚掌自由度:加上生成式控制器,实现大师级太极、叶问蹲。
  • 第四代控制器:“反重力器”,对抗重力本质,输入连续姿态,就能执行动作。

米良川认为,机器人能力是“螺旋上升”:从30分场景应用,解决问题到40分,再循环。未来,IRON不只工具,还能情感链接——甚至做成亲人模样。

IRON丝滑打太极,步态超拟人,让人怀疑“里面是不是真人”?

涌现背后的启示:坚持与上限

刘先明和米良川的对话,让我们看到“涌现”不是玄学,而是投入+原理的产物。小鹏倾全公司资源自研机器人(除了螺丝),证明了VLA在操纵上的潜力。米良川说:“发展缓慢,但上限高。人类100分,机器人至少80分才能进家庭。”

结语:自动驾驶与机器人的新时代

小鹏的VLA 2.0和IRON,标志着AI从“模仿”到“涌现”的跃迁。这不只技术故事,更是关于坚持的励志篇。未来,自动驾驶无标注泛化,机器人情感陪伴,都指日可待。

Read more

JAVA 动态代理:从原理剖析到实战应用

JAVA 动态代理:从原理剖析到实战应用

JAVA 动态代理:从原理剖析到实战应用 1.1 本章学习目标与重点 💡 掌握动态代理的核心概念与分类,理解动态代理在 Java 开发中的核心价值。 💡 熟练掌握 JDK 动态代理的实现流程与核心 API,能够独立编写 JDK 动态代理代码。 💡 了解 CGLIB 动态代理的实现原理与适用场景,对比 JDK 动态代理与 CGLIB 动态代理的差异。 💡 结合实际业务场景,掌握动态代理在 AOP 编程、权限控制、日志记录等场景中的实战应用。 ⚠️ 本章重点是 JDK 动态代理的核心实现 和 动态代理在 AOP 中的实战应用,这是 Java 高级开发与框架设计的必备技能。 1.2 动态代理的核心概念与价值 1.2.1 什么是动态代理 💡 动态代理 是

By Ne0inhk
AI 代码辅助产品安利「飞算 JavaAI」,智能引导 + 协同交互驱动全流程提效:重塑 Java 开发模式的 AI 编码利器

AI 代码辅助产品安利「飞算 JavaAI」,智能引导 + 协同交互驱动全流程提效:重塑 Java 开发模式的 AI 编码利器

AI 代码辅助产品安利「飞算 JavaAI」,智能引导 + 协同交互驱动全流程提效:重塑 Java 开发模式的 AI 编码利器 前言 飞算 JavaAI 专注于 Java 开发领域的 AI 辅助工具,深度适配 Spring Boot、MyBatis 等主流框架及国产化中间件,通过智能代码生成、实时补全、优化重构、bug 检测修复等功能,赋能开发全流程,同时支持中文指令与主流 IDE 集成,助力开发者提升编码效率与代码质量,尤其适配国内企业级 Java 项目需求。 功能介绍 飞算 JavaAI 凭借全量代码语义索引与上下文分析,深度理解项目架构和业务逻辑,能自动关联老项目并智能预分析,合并场景精准对接,本地化保障代码安全,通过自然语言编规则,生成代码合规复用;需求助手支持文本 / 语音输入,结合专属模型自动生成接口、

By Ne0inhk
飞算JavaAI—AI编程助手 | 编程领域的‘高科技指南针’,精准导航开发!

飞算JavaAI—AI编程助手 | 编程领域的‘高科技指南针’,精准导航开发!

目录 一、引言 1.1 什么是飞算JavaAI? 1.2 告别"996的孤独感":AI成为你的编码搭子 1.3 成就感加速器:从"能运行"到"优雅实现" 1.4 极简下载体验:3步开启"开挂"模式 二、深入体验飞算JavaAI——智能引导 2.1 一键生成完整工程代码 2.2 合并项目 【本地化智能分析与精准分析老项目】 【自动关联项目与生成专属工程规范】 【模块化智能引导与精准控制接口】 【全局集成与精细化管理】 三、其他功能 3.1 Java

By Ne0inhk
Java 基础知识总结(超详细整理)

Java 基础知识总结(超详细整理)

Java基础知识总结(超详细整理) Java是一种跨平台、面向对象的编程语言,其设计理念为“一次编写,到处运行”(Write Once, Run Anywhere),广泛应用于后端开发、Android开发、大数据处理等领域。以下从核心概念、语法、进阶特性等维度,系统梳理Java基础知识。 一、Java语言核心概念 1.1 跨平台原理 Java的跨平台依赖JVM(Java Virtual Machine,Java虚拟机) : * 开发者编写的.java源文件,通过javac编译器编译为字节码文件(.class) ; * 不同操作系统(Windows、Linux、macOS)安装对应的JVM,JVM负责将字节码解析为本地机器指令并执行; * 注意:JVM是跨平台的核心,但JVM本身不跨平台(需为不同系统安装对应版本的JVM)。 1.2 JDK、JRE、JVM的关系 三者是Java开发和运行的基础,关系如下(包含关系:

By Ne0inhk