• 轉發 @傻瓜AI探險家-Stella: 放棄造車之後,蘋果奮起直追人工智能,前幾天發佈了一篇論文,講述其ReALM模型如何能“讀懂”上下文,更好地通過自然語言“理解”用户提出的需求。看來Siri進化指日可待了。[錦鯉附體]

比如圖二顯示的,用户請AI幫忙找一家附近的藥店💊🩺,AI給出了推薦列表之後,用户往往不會完整地念出藥店的全稱,而是會説“打給彩虹路的那一家”🌈,或者“打給最底下的那家”⬇️,或者“打給屏幕上這個號碼”(如圖三)🤳🏻,這都需要AI具備理解不同情景中的“指代”對象的能力——包括理解對話中的指代,以及用户當下所看見的屏幕上的對象指代。

根據這篇論文中提供的測試結果(圖四),ReALM模型在理解日常對話(Conv)、預設對話(Synth)、涉及屏幕內容的對話(Screen)和以前沒遇到過的新場景(Unseen)時的準確率非常高,甚至其最小版本(80M)就不輸GPT-4。

這項能力英文中稱為Reference resolution,是指在對話或文本中識別和解析指代性詞彙的過程,比如“它”、“他們”或“那個”。這個過程幫助確定這些詞彙具體指向的是對話中的哪個人、事物或概念。在人與人的對話中,我們通常依靠上下文來理解這些指代,而對於計算機系統或虛擬助手來説,這是個技術挑戰,因為它們需要理解對話的上下文和涉及的具體內容。

#蘋果##人工智能#

via 常巖CY的微博