首页 > 技术知识 > 技术知识 > 理想汽车启动端到端+视觉语言模型早鸟计划:车辆具备思考能力

理想汽车启动端到端+视觉语言模型早鸟计划:车辆具备思考能力

发布时间:2024-07-06 21:19:20来源: 15210273549

7 月 5 日消息,在今晚的理想智能驾驶夏季发布会期间,理想汽车宣布,端到端 + 视觉语言模型早鸟计划正式启动,号称可让车更智能、更像人。

IT之家汇总主要信息如下:

理想汽车称端到端模型的优势在于“高效传递”和“高效计算”两方面:端到端是一体化的模型,信息都在模型内部传递,具有更高上限,用户所能感受到的整套系统的动作、决策都“更加拟人”;一体化模型可在 GPU 里一次完成推理,且端到端延迟更低,用户可感知到“眼”“手”协调一致,车辆动作响应及时。

一体化模型可实现端到端的可训,完全数据驱动。官方表示,对于用户来说最大的感受就是 OTA 的速度越来越快

视觉语言模型方面,其整体算法架构由统一的 Transformer 模型组成,将 Prompt(提示词)文本进行 Tokenizer(分词器)编码,然后将前视 120 度和 30 度相机的图像以及导航地图信息进行视觉信息编码,通过图文对齐模块进行模态对齐,统一交给 VLM 模型进行自回归推理;VLM 输出的信息包括对环境的理解、驾驶决策和驾驶轨迹,并传递给系统 1 控制车辆。

官方表示,该系统整体设计存在三个亮点:设计了流式视频编码器,能缓存更长时序视觉信息;增加了记忆模块,缓存了多帧历史信息,可解决超长上下文推理时延问题;设计了智能驾驶 Prompt 问题库,系统 2 可以“思考”当前驾驶环境并给系统 1 合理驾驶建议,系统 1 也可在不同场景下调用不同 Prompt 问题,主动向系统 2 进行“求助”。

技术知识更多>>

意优科技发布三大量产关节方案 韩国将充电设施补贴与性能标准挂钩,未达标设备不得享受支持 ​佛瑞亚新项目签约落地常熟,配套奇瑞新能源 奕境首款车型预告图公布,定位家庭旗舰大六座SUV 广汽集团:与华为合作暂不涉及渠道领域 比亚迪2025年菲律宾销量达26,122辆,跃居当地车企销量第三位 受益于机器人,现代汽车股价一月飙涨60% 奥迪2025年全球交付约162万辆汽车,同比下降2.9% 小鹏今年将推4款新车,冲击55万-60万销量目标 中汽信息研究所:建议扩大L3在典型城市群和特定场景下的试点范围 IDC:2025年华为重返中国市场第一,OPPO四季度增长超10% 华尔街日报:韩国押注“主权AI”,却发现本土大模型引用中国代码 “死了么”引发美媒关注,《连线》采访创始人:被60多家投资者接触、将整合AI 王小川押注严肃医疗,AI能比普通医生强吗? 荣耀AI键新功能曝光,一键启动BOOST模式 vivo更激进了,2亿像素+100倍变焦+6510mAh,旗舰新机“一跌再跌” 2nm芯片太贵了!部分厂商下代旗舰继续用3nm处理器 法雷奥温岭工厂扩建项目正式落成并投产 雷诺任命新战略与产品负责人 极豆科技完成近亿元新一轮融资,国际芯片巨头领投,加速汽车座舱AI技术迭代与全球化布局 车企“不务正业”,是焦虑还是远见? 耐世特亚太区智能制造总部项目在苏州正式奠基 余承东不云游,雷军缺席,广州车展“寂寞到底”? 对话乐道沈斐:把纯电和换电做好,根本不用做增程 仰望U8L新增平行横移功能:至多3米 不支持自动刹停 在广州车展期间,小米YU7 Max紫水晶首次对外展出 智元机器人推出灵心平台:用户可零代码定制机器人“灵魂”与人设 苹果与OpenAI恩怨加深:硬件部门遭全方位挖角,小程序抽成目标不只是腾讯 3D打印钛金属壳,苹果新工艺太炸裂了:不只是改变手表 Meta内部文件:1年靠诈骗广告赚约160亿美元 每日曝光150亿则