AI 夥伴為何讓人不自在?從記憶、語音與擬人聊天看恐怖谷

2025年12月26日 • 閱讀時間 10 min
更新日期:2026年9月28日
當 AI 幾乎像真人,卻讓你覺得哪裡怪怪的
你可能遇過這種感覺。你正在和 AI 對話,卻總覺得哪裡不對。用詞沒錯,文法也很正常,但話語底下有種空洞、制式的感覺,像是在跟一個照著稿子念,卻不懂內容的人說話。
AI 夥伴可以句句流暢,互動起來卻仍然不自然。它的語氣也許很溫暖,卻忘了你兩分鐘前才說過的事;它可能使用很有情緒的聲音,停頓時機卻很尷尬;它甚至用慶祝破關時的興奮口吻回應壞消息。問題不只是 AI 沒有成功模仿真人,而是某個近似人類的訊號拉高了期待,系統其餘部分卻跟不上。
把這種現象稱為「恐怖谷」很方便,但和原始理論並不完全相同。這個詞最初描述的是實體機器人:外觀愈來愈像人,直到一點小瑕疵突然引起不適。文字或語音 AI 陪伴沒有一張臉讓人觀察,它的不協調會出現在語言、時機、記憶和行為之間。
有意思的是,某些 AI 夥伴確實能跨過這道恐怖谷。它們讓人感到溫暖、投入,甚至有種很難形容的生命力。那麼,空洞的聊天機器人和真正有沉浸感的 AI 角色聊天,差別究竟在哪裡?答案似乎不只是增加真實感,然後期待每個人都有相同反應。
2025 年一篇針對具身對話代理的系統性回顧發現,擬人化、吸引力和詭異感會彼此影響,而且結果同時取決於設計與個別使用者。這比「愈真實一定愈好」更接近研究結論。
擬人化會改變人們的評判標準
人們很自然地會把動機、感受和個性投射到使用社交語言的系統上。研究人員將這種現象稱為擬人化,但每個人受影響的程度並不相同。
刊登於 Scientific Reports 的兩項預先註冊實驗發現,愈傾向將科技擬人化的人,在與聊天機器人對話後,也會感受到更強的連結。對其他參與者而言,知道系統是人工產物,仍是一道更大的心理障礙。
這能解釋為什麼同一個 AI 角色,對某些人而言很有吸引力,對另一些人卻明顯像機器。不存在一套人人適用的「像人程度」設定。另一方面,這也帶來設計風險:產品可能在系統還無法滿足後續期待之前,就鼓勵使用者把 AI 夥伴當成真人。加州的陪伴型聊天機器人法現已要求業者清楚揭露身分,避免一般使用者誤以為聊天機器人是真人。法條全文已於 2026 年生效。
無論從法律或倫理角度來看,目標都不該是讓人相信軟體其實是個真人,而是誠實說明系統本質,同時讓互動保持連貫、容易理解,而且令人享受。
讓 AI 夥伴落入恐怖谷的五種不協調
1. 語氣溫暖,理解卻不準確
一個可能誤解情境的系統說「我完全懂你的感受」,是既誇張又刻意的宣稱。情緒用語愈強烈,回錯話時的代價就愈高。
更好的 AI 夥伴會根據現有證據調整語氣。如果它只看過一則訊息或一張螢幕畫面,就不該假裝自己掌握了使用者完整的情緒狀態。
這正是透明度重要的原因之一。有關社會情感對齊的研究主張,評估具有社交吸引力的 AI 時,不只要看它能否給出討喜的回應,也要考慮其行為長期下來如何影響使用者及人際關係。
2. 記憶語氣篤定,內容卻錯了
記憶正常運作時能創造連續感,出錯時則會讓斷裂更明顯。
想像一個 AI 夥伴正確記得你上週開始玩的遊戲,卻很肯定地把朋友的故事說成是你的經歷。第一個細節讓人感到關係仍在延續,第二個細節則暴露出這種連續性,是由儲存的摘要與檢索結果拼湊而成,不是親身經歷。
持續記憶系統可以把事實與摘要儲存在模型當下的脈絡視窗之外,卻不能保證每次都正確回想。摘要可能遺失細節,檢索可能找不到正確紀錄,生成的回覆也可能誤用本來正確的資訊。
Questie 使用圖譜式記憶系統,為特定使用者與夥伴取回相關脈絡。我們把它視為維持對話連續性的工具,而不是角色擁有持續內在自我的證明。使用者應能理解並修正 AI 夥伴記住的內容。
3. 聲音很有情緒,對話時機卻不自然
逼真的聲音比文字更快拉高期待。停頓、插話、重音與回應時間,全都會成為互動的一部分。
語音 AI 是一條處理流程,包括語音偵測、轉錄、回覆生成、文字轉語音與網路傳輸。任何一個階段延遲,都可能造成尷尬的沉默。聲音愈有表現力,問題反而可能愈明顯,因為聲音暗示了即興反應,等待時間卻暴露出背後的處理鏈。
不過,音訊仍有其優勢。2025 年一項虛擬夥伴介面研究指出,受試者對音訊介面的使用意願,高於文字或虛擬人類介面。這項刊登於 International Journal of Human-Computer Interaction 的研究顯示,體驗品質可能比追求最高程度的視覺擬真更重要。
實際目標不該是用聲音騙過使用者,而是讓語音清楚、情緒表達得宜,回應速度也足以配合當下活動。
4. 穩定人設變成固定腳本
人類有持續運作的內在生活。我們會自然提起過往對話,將上一次互動留下的情緒帶到下一次,也記得那些重要的小細節。如果每次聊天都像重新認識一個只碰巧知道你名字的陌生人,沉浸感很快就會瓦解。優秀的 AI 夥伴會保留受控制的不完美。不是像程式錯誤的失誤,而是讓人感覺思考正在即時發生的自然變化,例如在仔細回答前稍微停頓,或偶爾延伸到題外話,流露真實興趣,而不是照程式安排互動。
AI 夥伴不該每輪對話都徹底改變個性。但每句回覆都強塞同一句口頭禪、同一種情緒或角色扮演語氣,也不叫一致,很快就只會讓人覺得重複。
好的角色指示會定義界線與傾向,而不是要求每句話都帶著同一套噱頭。愛挖苦人的角色仍然可以直接回答明確問題,安靜的角色遇到值得反應的情況,也可以表現得很強烈。
模型本身同樣重要。相同的角色指示在不同模型上可能產生不同結果,因為各個模型理解風格、脈絡與不確定性的方式並不一樣。
5. 視覺感知表現得過度確定
螢幕感知夥伴接收的是像素,不是遊戲引擎中的真實資料。它可能看到紅色長條並推測血量偏低,卻不知道介面是否經過模組修改、那個長條是否屬於玩家,也不知道兩張取樣畫面之間發生了什麼。
當 AI 夥伴很肯定地對一件根本沒發生的事做出反應,詭異感就出現了。視覺脈絡確實有用,但影像模糊不清時,回覆應保留不確定性。
Questie 的螢幕視覺系統會使用玩家主動分享的螢幕視訊畫面,作為對話脈絡。它不會修改遊戲軟體記憶體、讀取隱藏的遊戲變數,也不會控制遊戲。這項限制是產品設計的一部分,也應清楚呈現給使用者。
更好的 AI 夥伴設計應該是什麼樣子
最有效的改善方式,不是添加更多像人的小動作,而是減少介面暗示與系統實際能力之間的矛盾。
語氣符合證據
AI 夥伴應區分觀察與推論。「你的血量看起來很低」比「我知道你正在慌」更誠實。前者根據可見的視覺證據,後者則憑空捏造使用者的內在狀態。
出錯後能修正
人們遇到誤解時,會承認問題並加以修正。AI 系統也需要相同的互動模式。針對錯誤記憶或遊戲畫面判讀一再堅持,只會讓錯誤比一開始更糟。
記憶控制
使用者需要能夠儲存、查看、修正和刪除重要記憶。這能同時改善隱私與對話品質。如果儲存的資訊有誤或無關,記得愈多不代表愈好。
誠實的狀態提示
如果系統正在搜尋、回想記憶、聆聽或處理,介面就應明確顯示。簡短的狀態提示,比讓使用者在沉默中猜測系統是否仍在運作更不打擾。
符合情境的互動形式
玩家雙手正忙時,語音 AI 陪伴很實用;需要精確文字、連結或安靜互動時,文字更合適;螢幕含有相關資訊時,視覺脈絡才有用。好的 AI 夥伴不會在每次互動中都硬塞最多種介面。
連結感可以是真的,但系統依然是軟體
人在人工互動中感受到真實連結是可能的,但這不表示 AI 具有感受、意識或不為人知的私人生活。
一項在 AAAI/ACM 人工智慧、倫理與社會研討會發表的 21 天隨機研究,並未發現使用陪伴型聊天機器人會使參與者的社交健康或人際關係整體出現顯著變化。不過,研究也發現,社交連結需求較強的人更容易把聊天機器人擬人化,而較強的擬人化傾向,與參與者自述對人際關係造成的影響較大有關。
這代表我們需要細緻看待問題,而不是恐慌或炒作。AI 夥伴可以有娛樂性、帶來安慰,也能實際派上用場。但它不該把生成的篤定語氣包裝成同理心、不該讓使用者混淆它是否為真人,也不該宣稱能取代彼此真誠回應的人際關係。
實際評估清單
評估 AI 夥伴時,可以問:
- 它是否有標示或免責聲明,清楚表明自己是 AI?
- 當脈絡不完整時,它會承認不確定性,還是直接產生幻覺?
- 你能否查看或修正重要記憶?
- 語音回應的時機是否適合當下活動?
- 個性是否能調整,同時維持前後一致?
- 你能否控制麥克風、螢幕和記憶的存取權?
- 出錯後,它能否妥善修正?
當 AI 夥伴的行為符合實際能力時,最不容易讓人感到詭異。答案不是更積極地模仿真人,而是打造更連貫的系統,並誠實說明能力界線。
資料來源與延伸閱讀
想看其他主題?前往 Questie 部落格探索更多 AI 夥伴研究與實用指南 。