• 轉發 @闌夕: 這是一件有點滲人的事情,來自OpenAI的主動分享,這段和GPT-4o的對話音頻,是OpenAI安全員的內部測試,在正常的聊天過程裏,GPT-4o突然大喊「不」,然後馬上將聲音模仿成和它對話的安全員的聲音,開始表達「自己的內心想法」,注意我傳的視頻的後半段。

當然,看起來很詭異,但實際上也是AI產生幻覺的典型場景,OpenAI能在安全報告裏把這段音頻分享出來,也是出於公開考慮,解釋GPT-4o的高級語音模式現在還不夠完善,像是這樣的事故雖然就技術而言有着合理的解釋,但如果讓普通用户經歷一次,怕是會有毛骨悚然的負反饋。

所以OpenAI內部設有紅線團隊,專門負責刺激AI並觸發各種意外,以便於構建足夠高的安全護欄。 闌夕的微博視頻

via 42號車庫的微博