讲师中心微信公众号

首页

文章

后端开发 web前端数据库开发工具 php框架常见问题科技 Java 系统教程电脑教程硬件教程手机教程软件教程游戏教程自媒体新闻

专题

后端开发 web前端数据库开发工具 php框架科技 Java 系统教程电脑教程硬件教程手机教程软件教程游戏教程新闻

AI工具

AI 聊天问答 Agent智能体 AI 文本写作 AI 绘画作图 AI 设计工具 AI 视频创作 AI 音频制作 AI 办公学习 AI 编程开发 Prompt指令

学习

大前端后端开发数据库移动端运维开发计算机基础

编程手册

大前端后端开发数据库移动端运维开发计算机基础

下载

js特效网站源码工具下载类库下载网站素材学习资源插件扩展手机游戏

最近更新

首页 > 硬件教程 > 硬件测评 > 正文

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

花韻仙語

发布： 2025-10-30 10:41:45

转载

806人浏览过

特斯拉世界模拟器来了！

这些看似真实的驾驶场景，全都是用模拟器生成：

这个模拟器在今年的计算机视觉顶会 ICCV 上亮相，由特斯拉自动驾驶副总裁 Ashok Elluswamy 亲自讲解。

网友看了之后表示，这个模型实在是泰裤辣。

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

同时，Elluswamy 也首次揭秘了特斯拉的自动驾驶技术路线图，表示端到端才是智能驾驶的未来。

世界模拟器生成自动驾驶场景

除了开头看到的多场景驾驶视频，特斯拉的世界模拟器还可以为自动驾驶任务生成新的挑战场景。

比如右侧的车辆突然连并两条线，闯入预设的驾驶路径。

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

也可以让 AI 在已有的场景中执行自动驾驶任务，躲避行人和障碍物。

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

模型生成的场景视频，除了让自动驾驶模型在里面练手，也可以当成电子游戏，供人类玩耍体验。

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

当然除了驾驶相关，对其他具身智能场景——比如特斯拉的擎天柱机器人——也同样有用。

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

与这个模型一同被揭秘的，还有特斯拉在自动驾驶上的一整套方法论。

特斯拉 VP：端到端才是自动驾驶的未来

ICCV 演讲中，特斯拉自动驾驶副总裁 Ashok Elluswamy 揭秘了特斯拉 FSD 的技术细节，同时还在 X 上发表了文字版本。

Ashok 首先明确，端到端 AI 才是自动驾驶的未来。

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

特斯拉利用端到端神经网络实现自动驾驶，这个端到端神经网络会利用来自各个摄像头的图像、运动信号（例如车速）、音频、地图等数据，生成驱动汽车的控制指令。

与端到端相对的另一种方法是采用大量传感器的模块化驾驶，这类系统的优势是在初期更容易开发和调试，但相比之下，端到端的优势更加明显：

将人类价值观规则化极其困难，但从数据中学习则容易；

模块化方法中感知、预测和规划之间的接口定义不明确，但在端到端中梯度从控制一直流向传感器输入，从而整体优化整个网络；

端到端方法可轻松扩展以处理现实世界机器人的繁重和长尾问题；

端到端具有确定性延迟的同质计算。

Ashok 举了一些例子，比如车辆行驶过程中发现前方路面存在积水，此时有两种策略，一是直接从积水上开过，二是借用对向车道绕过积水。

驶入对向车道是危险的，但在这个具体场景中视野开阔，在避开水坑所需的路程之内对向车道没有车辆，借用对向车道避开水坑是一种可行的选择。

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

这种权衡取舍就很难用传统的编程逻辑来表达，而对于人类来说，这在观察场景时却相当简单。

基于以上考虑及其他因素，特斯拉采用了端到端的自动驾驶架构，当然，端到端系统也仍有许多挑战需要克服。

特斯拉如何解决端到端自动驾驶困难

端到端自动驾驶面临的困难，其中之一就是评估。特斯拉推出的世界模拟器，也正是针对这一难题。

该模拟器使用特斯拉筛选出的同样的海量数据集进行训练，其功能并非预测给定状态下的行动，而是根据当前状态和下一步行动来合成未来状态。

这样的状态可以与智能体或策略 AI 模型连接起来，以闭环方式运行，从而评估性能。

同时，这些视频并不局限于评估，它还可以用于闭环大规模强化学习，从而实现超越人类的表现。

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

风声雨声

风声雨声

基于 gpt-3.5 的翻译服务、内容学习服务

风声雨声

124

风声雨声

除了评估之外，端到端自动驾驶还面临 " 维数灾难 "，以及可解释性和安全性保证的问题。

在现实世界中，想让自动驾驶系统安全运行，就需要处理高帧率、高分辨率、长上下文输入。

假设输入信息包括 7 个摄像头 × 36FPS × 5 百万像素 × 30 秒的场景画面、未来几英里的导航地图和路线、100Hz 的运动数据，以及 48KHz 的音频数据，大约会有 20 亿输入 Token。

神经网络需要学习正确的因果映射，将这 20 亿个 Token 精简为 2 个，即车辆的下一个转向和加速动作。在不学习虚假相关性的情况下学习正确的因果关系是一个极其棘手的问题。

为此，特斯拉通过庞大的车队，每天收集相当于 500 年驾驶总和的数据，并使用复杂的数据引擎筛选最高质量的数据样本。

使用这样的数据进行训练，就能让模型获得极高的泛化能力，从而应对极端情况。

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

对于可解释和安全性问题，如果车辆的行为不符合预期，端到端系统的调试可能就会变得很困难，但模型也可以生成可解释的中间 Token，可以根据情况用作推理 Token。

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

特斯拉的生成式高斯泼溅就是这样一项任务，它具有出色的泛化能力，无需初始化即可建模动态物体，并可与端到端模型联合训练。

其中所有的高斯函数都是基于量产车配置的摄像头生成的。

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

除了 3D 几何之外，推理还可以通过自然语言和视频背景进行。该推理模型的一个小版本已经在 FSD v14.x 版本中运行。

特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线

更多技术细节，可以到 Ashok 的文章和原始演讲视频当中一探究竟。

端到端自动驾驶两大路线：VLA 还是世界模型？

虽然端到端被视为自动驾驶的未来，但在业界，具体的软件算法路线也一直存在 VLA 和世界模型之争。

以国内为例，华为和蔚来都是世界模型路线的代表，元戎启行和理想则选择 VLA 路线，另外也有一些玩家认为应该将两者结合。

VLA 玩家认为，该范式一方面可以应用互联网已有的海量数据，积累丰富常识，进而理解世界。另一方面模型通过语言能力实际上是具备了思维链能力，能够理解长时序数据并进行推理。

更尖锐的观点认为，有些厂家不用 VLA 是因为算力不够，带不动 VLA 模型。

世界模型玩家们则坚持世界模型更接近问题本质，例如华为车 BU CEO 靳玉志认为 "VLA 这样的路径看似取巧，并不能真正走向自动驾驶 "。

而现在，特斯拉的方案之所以备受关注，也正是因为在自动驾驶发展历程中，马斯克从未有过 " 选错 "。

特斯拉选什么路线，VLA 还是世界模型，关于端到端自动驾驶两大技术路线的历史性决战。

你看好 VLA，还是世界模型？

参考链接：

[ 1 ] https://x.com/Tesla/status/1982255564974641628

[ 2 ] https://x.com/aelluswamy/status/1981644831790379245

一键三连「点赞」「转发」「小心心」

欢迎在评论区留下你的想法！

— 完 —

年度科技风向标「2025 人工智能年度榜单」评选报名火热进行中！我们正在寻找 AI+ 时代领航者点击了解详情

企业、产品、人物 3 大维度，共设立了 5 类奖项，欢迎企业报名参与

一键关注点亮星标

科技前沿进展每日见

以上就是特斯拉世界模拟器亮相 ICCV！VP 亲自解密端到端自动驾驶技术路线的详细内容，更多请关注php中文网其它相关文章！

相关标签：

特斯拉计算机人工智能华为 ai 神经网络马斯克蔚来智能驾驶模拟器架构 Token 接口算法人工智能 https 传感器

大家都在看：

多核处理器负载均衡机制如何工作？ AMD 承诺 MI450 GPU 将实现全面性能领先挑战英伟达首轮融资快速落地，追觅汽车全球化进程提速佳能 EOS R6 Mark III 或于 9 月中旬发布升级 3000 万像素中美智驾大 PK！四大魔鬼场景实测，华为激光雷达对纯视觉，谁更强？

最佳 Windows 性能的顶级免费优化软件

最佳 Windows 性能的顶级免费优化软件

每个人都需要一台速度更快、更稳定的 PC。随着时间的推移，垃圾文件、旧注册表数据和不必要的后台进程会占用资源并降低性能。幸运的是，许多工具可以让 Windows 保持平稳运行。

来源：ZAKER网

上一篇：华为两款典藏版平板新品开售售价 5999 元 -7799 元下一篇：OPPO 小平板曝光，大量新品待发布

本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

作者最新文章

鸠摩搜索怎么使用

2025-12-15 12:29:02
《三角洲行动》加强打击鼠标宏：最高十年封号

2025-12-15 12:33:07
广汽高域飞行汽车试飞检测基地在韶关运营，配备垂直起降点与滑行跑道

2025-12-15 12:38:02
MaxKey 4.1.10 已经发布，单点登录认证系统

2025-12-15 12:39:13
黑皮大雷美人！《噬血代码2》角色预告片：柯莉・阿斯图里亚斯

2025-12-15 12:39:20
优化Web交互：利用CSS实现无闪烁的鼠标悬停效果

2025-12-15 12:44:23
D加密如此遭人恨？P5R成功破解引外网热议

2025-12-15 12:57:12
万代类魂《噬血代码2》新预告！黑皮贵妇「荷莉‧阿斯图里亚斯」

2025-12-15 13:07:02
Flex布局中防止文本换行并实现横线填充剩余空间

2025-12-15 13:12:09
JavaScript事件处理：高效获取具有相同类名按钮的Value值

2025-12-15 13:47:01

最新问题

华硕ROG Zephyrus G16 2024款上手：星云屏下的轻薄性能猛兽华硕ROGZephyrusG162024款是少数将高性能、轻薄机身与专业OLED屏深度融合的游戏本，搭载2.5K240HzOLED星云屏、三风扇散热、RTX4070/4090显卡及AI创作优化，兼顾游戏、生产力与便携性。

2025-12-16 23:56:07

368

NVIDIA GeForce RTX 5090 深度评测：新一代卡皇诞生与AI性能前瞻 RTX5090是AI时代GPU的重新定义，核心优势在于FP4/FP8原生支持、32GBGDDR7高带宽及sm_120计算架构，多卡部署需适配PCIeGen5与新版通信框架。

2025-12-16 23:55:02

556

大疆 Mini 5 Pro 飞行测评：更小机身蕴含的旗舰级影像力量大疆Mini5Pro是首款将1英寸5000万像素影像系统塞入249克机身的消费级无人机，支持D-LogM10-bit视频、48mm中焦模式、225°无损竖拍、智能跟随3.0与焦点跟随、31分钟实测续航及-10℃稳定飞行，兼顾轻便性与专业画质。

2025-12-16 23:48:07

490

大疆DJI Mini 4 Pro全面评测：口袋无人机的画质与智能巅峰大疆DJIMini4Pro是首款兼顾专业影像、全向安全与真·口袋便携的249克无人机，搭载1/1.3英寸传感器、双原生ISO、4K/60fpsHDR及10-bitD-LogM，配备六向视觉感知与APAS4.0，支持O4图传、竖拍无裁切和34分钟续航。

2025-12-16 23:45:21

687

AMD Radeon RX 7900 GRE评测：精准卡位，中高端市场的性价比搅局者 RX7900GRE是AMD为中国及全球中高端市场定制的精准卡位产品，基于Navi31GPU，配备5120流处理器、16GBGDDR6显存、256-bit带宽、RDNA3架构与260W功耗，性能对标RTX4070/4070Super，在1440P光追游戏、AV1编码及DP2.1输出等场景表现均衡突出。

2025-12-16 23:44:12

711

苹果M4芯片MacBook Pro评测前瞻：性能飞跃，续航或成唯一短板 M4芯片MacBookPro续航并非短板而是最大亮点，官方标称24小时、实测14–18小时，远超前代；性能、屏幕、接口、能效全面跃升。

2025-12-16 23:40:48

362

三星 Galaxy S25 Ultra 影像体验：两亿像素再进化与AI相机新玩法三星GalaxyS25Ultra影像体验以2亿像素主摄与超拟人AI深度协同为核心，实现从“手动调参”到“自然成片”的跃迁；通过AIISP实时分析13类画面要素、200+场景预判响应、夜景多帧智能优化及S-Pen辅助构图，全面提升日常、动态、逆光、暗光等全场景成像质量与创作效率。

2025-12-16 23:39:56

231

多家评测机构证实：新款iPad Pro的OLED屏幕峰值亮度行业领先新款iPadProOLED屏幕峰值亮度达2500尼特、全屏持续亮度1000尼特，位居行业第一梯队；高亮度提升HDR观感、户外可用性与色彩准确性，但仅在HDR小面积高光场景触发，受温度、电量与内容限制。

2025-12-16 23:38:17

947

英特尔酷睿i9-14900KS首发测试：6.2GHz频率下的功耗与性能王者英特尔酷睿i9-14900KS是当前消费级CPU中单核睿频达6.2GHz、满载功耗高达330–409W的性能怪兽，单核性能提升3–5%，但需高端散热与1000W电源支持，适合极致玩家而非大众用户。

2025-12-16 23:22:37

328

索尼A7C II相机深度体验：全画幅入门新标杆，为旅行而生索尼A7CII是专为旅行设计的全画幅相机，514克轻量化机身、759点对焦覆盖、3300万像素背照式传感器、4K60p视频与7级防抖兼备，兼顾便携性与专业性能。

2025-12-16 23:02:23

784

相关专题

更多>

热门推荐

开源免费商场系统

广告

热门教程

更多>

相关推荐

热门推荐

最新课程

Git版本控制工具

14767次学习
收藏
Perl 入门教程

165262次学习
收藏
Vue 教程

49165次学习
收藏

最新下载

更多>

网站特效

网站源码

网站素材

前端模板

关于我们免责申明举报中心意见反馈讲师合作广告合作最新更新: php中文网：公益在线php培训，帮助PHP学习者快速成长！; 关注服务号技术交流群

PHP中文网订阅号: 每天精选资源文章推送

Copyright 2014-2025 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号

PHP学习

技术支持

返回顶部