多模態大模型能夠將語音、文字、圖像、手勢、視頻等各種模態進行高效且深度地融合,相較於手機,智能汽車才是更適合承載多模態大模型的落地場景。因為智能汽車內外的各種攝像頭是常開的,用户可以實時跟汽車通過多模態的方式進行交互。

大家希望車上的多模態大模型實現什麼樣的功能?

#42how##新能源汽車##2024世界人工智能大會#

via 42號車庫的微博