多模态大模型能够将语音、文字、图像、手势、视频等各种模态进行高效且深度地融合,相较于手机,智能汽车才是更适合承载多模态大模型的落地场景。因为智能汽车内外的各种摄像头是常开的,用户可以实时跟汽车通过多模态的方式进行交互。

大家希望车上的多模态大模型实现什么样的功能?

#42how##新能源汽车##2024世界人工智能大会#

via 42号车库的微博