首页 > 阅读笔记 > 阅读笔记 > 理想汽车启动端到端+视觉语言模型早鸟计划:车辆具备思考能力

理想汽车启动端到端+视觉语言模型早鸟计划:车辆具备思考能力

发布时间:2024-07-06 21:19:20

7 月 5 日消息,在今晚的理想智能驾驶夏季发布会期间,理想汽车宣布,端到端 + 视觉语言模型早鸟计划正式启动,号称可让车更智能、更像人。

IT之家汇总主要信息如下:

理想汽车称端到端模型的优势在于“高效传递”和“高效计算”两方面:端到端是一体化的模型,信息都在模型内部传递,具有更高上限,用户所能感受到的整套系统的动作、决策都“更加拟人”;一体化模型可在 GPU 里一次完成推理,且端到端延迟更低,用户可感知到“眼”“手”协调一致,车辆动作响应及时。

一体化模型可实现端到端的可训,完全数据驱动。官方表示,对于用户来说最大的感受就是 OTA 的速度越来越快

视觉语言模型方面,其整体算法架构由统一的 Transformer 模型组成,将 Prompt(提示词)文本进行 Tokenizer(分词器)编码,然后将前视 120 度和 30 度相机的图像以及导航地图信息进行视觉信息编码,通过图文对齐模块进行模态对齐,统一交给 VLM 模型进行自回归推理;VLM 输出的信息包括对环境的理解、驾驶决策和驾驶轨迹,并传递给系统 1 控制车辆。

官方表示,该系统整体设计存在三个亮点:设计了流式视频编码器,能缓存更长时序视觉信息;增加了记忆模块,缓存了多帧历史信息,可解决超长上下文推理时延问题;设计了智能驾驶 Prompt 问题库,系统 2 可以“思考”当前驾驶环境并给系统 1 合理驾驶建议,系统 1 也可在不同场景下调用不同 Prompt 问题,主动向系统 2 进行“求助”。

阅读笔记更多>>

马斯克SpaceX背后的她:现实版钢铁侠小辣椒 极速120km/h 九号M5 P千万台纪念版电摩今日开售:23999元起 性能真超RTX4060!砺算科技母公司发财报:自研6nm GPU已交付 vivo V70 Elite手机曝光:骁龙8s Gen 3芯片,6500mAh电池 苹果宣布Apple Cash即时提现手续费上调至1.7%,最多25美元封顶 千亿市场的赛博宠物,也逃不过“吃灰”现实? 宝马纯电M3将配备模拟V10发动机声浪,重现历代经典车型引擎轰鸣 当AI遇上残障群体,开始挑战生命的“不可能” 华硕2025年营收预估突破7000亿元新台币创历史新高 小鹏全球总部向公众开放体验:1月12日起可预约参观 高通CEO安蒙2026年致辞:2028年推出6G预商用终端 卢伟冰选出2025小米三个高光瞬间:玄戒O1发布排第一 罗永浩回应播客广告增多:实在讨厌就忍着吧 免费看还想怎样 纯电续航最高210km!比亚迪2026款海豹05、海豹06DM-i加推长续航版:8.98万起 吉利2025年Q3核心净利39.6亿元,同比增长19% 宝马与Momenta共研辅助驾驶系统将首搭BMW iX3车型 三星、现代宣布3,100亿美元韩国本土投资计划 丹诺德集团签约落地上海嘉定 半固态先行,全固态瞄准2030年后大规模商业化​ 奇瑞汽车就天门山挑战测试意外致歉:全力修复并承担赔偿责任 宇树推出首款轮式人形机器人 比亚迪汉L广州车展发布:19.48万起配 “车位到车位” 智驾 新能源与新势力,把市场铺满 第六代全新荣放:当经典给出新时代答案 传采埃孚因安世半导体芯片短缺放缓生产 福耀玻璃开启“曹晖时代”:新老传承,迈向新发展 德国豪华汽车品牌奥迪证实,产品阵容革新计划将包含一款名为Q9的全新旗舰级跨界车 苏州芯检荣获2025盖世汽车金辑奖——最具成长价值奖 宏光MINIEV狂飙!10月销6.15万辆,创造180万传奇 雷克萨斯加速本土化 上海研发中心启用 2027年在华国产电动车