
每天用AI查資料寫文案,甚至吐露不方便跟別人說的事,已成AI時代不可擋趨勢,但先別急著把AI當成「只有你和它知道」的私人聊天室。美國科技媒體《404 Media》揭露,OpenAI內部存在名為「Project Lily」的計畫,數百名外包人員, 可能閱讀經過處理的真實ChatGPT使用者提示,並替AI生成的回答評分、評論,以協助改善模型表現。
更有意思的是,另一項由美國賓夕法尼亞州立大學研究團隊進研究發現,使用者對AI說話的語氣,也可能影響回答準確度;該研究測試中 ,ChatGPT-4o面對不同禮貌程度的提示,反而出現「越不客氣、準確率越高」的結果。究竟ChatGPT對話會不會被真人看到?使用AI又該注意哪些事情?
ChatGPT對話有真人在看?外媒爆OpenAI計畫
很多人以為打開ChatGPT,就是一對一跟AI聊天?外媒《404 Media》在2026年9月報導指出,OpenAI內部有一項代號為「Project Lily」的計畫,聘用數百名外包人員閱讀真實ChatGPT使用者的提示,部分案例甚至包含完整對話,再針對AI產生的回答進行評分與評論。 審查人員會先閱讀使用者輸入的內容、整理使用者真正想完成的事情,再比較ChatGPT產生的多個回答,按照品質進行評估。換句話說,AI看起來是在「自己變聰明」,但背後其實還有人類幫忙挑答案、找問題。
AI在評估什麼?連「AI腔」都有人管
《404 Media》也指出,審查人員不只是看答案「對不對」,還會評估回答是否符合使用者需求、是否自然、是否過度迎合,以及有沒有太明顯的AI語氣。例如過度使用Emoji、太制式的表達、把自己講得太像真人,甚至用過度討好的方式回應,都可能成為評估項目。報導指出,審查人員會以1至7分評估回答品質。 這也讓人看到,生成式AI背後並不是單純「丟資料給模型自己學」,人類的閱讀、比較與評估,同樣可能參與模型改善流程。
個資會不會被看到?OpenAI稱有隱私過濾
隱私問題也因此受到關注。提供給審查人員的內容,不會直接顯示ChatGPT使用者名稱,OpenAI也表示,相關對話會先經過Privacy Filter(小型模型,專門用來偵測並遮蔽文字中的個人識別資訊),試圖移除個人資訊。
不過,OpenAI也承認,任何模型都有可能出錯,Privacy Filter可能漏掉不常見的身分識別資訊或模糊的私人內容。報導也提到,部分資料可能出現「user memories summary」,也就是使用者過往與ChatGPT互動的摘要,可能包含興趣、背景等資訊。 因此「匿名化」並不等於「任何個資都不可能出現」。
不想讓新對話拿來改善模型?設定可以關閉
報導指出OpenAI表示,如果使用者關閉「Improve the model for everyone」設定,新產生的對話就不會被拿來改善模型;Free、Plus與Pro的價格方案,目前預設開啟相關設定,而Business、Enterprise與Edu則預設關閉。
不過,即使關閉相關功能,日常使用ChatGPT仍建議避免輸入不必要的敏感資料。像是身分證字號、銀行帳號、密碼、完整醫療紀錄,或其他可以直接辨識身分的資訊,都沒有必要為了讓AI「更懂你」而全部交出去。
對AI越客氣越笨?「語氣」竟影響準確率
除了隱私問題,ChatGPT使用者還有另一個有趣發現值得注意:跟AI講話的語氣,可能影響回覆的準確程度。
賓夕法尼亞州立大學(Penn State)研究團隊,針對「提示語的禮貌程度」進行實驗,研究論文《Mind Your Tone: Investigating How Prompt Politeness Affects LLM Accuracy》於2025年10月公布預印本(研究人員在論文尚未通過同儕審查前,先公開分享到網路伺服器的完整研究草稿)。研究設計50道涵蓋數學、科學與歷史的選擇題,再分別改寫成「非常禮貌、禮貌、中性、粗魯、非常粗魯」5種語氣,共250個提示,並以ChatGPT-4o進行測試。 結果相當反直覺,「非常禮貌」提示的準確率為80.8%,「非常粗魯」提示則達到84.8%。顯示這組特定測試中,ChatGPT-4o面對較粗魯的提示時,準確率高於非常禮貌的提示。
不是越兇越準確 關鍵是「指令清楚」
研究結果容易被誤解成「對AI越沒禮貌越好」,但研究本身並沒有這樣主張。值得注意的是,當時研究只是預印本,而且研究規模有限。賓州州立大學也指出,計劃進一步擴大實驗、進行更嚴謹的研究。對一般使用者而言,比起故意把語氣變嗆,更實用的做法其實是:提示語越直接、需求越明確,可能越有利於AI掌握真正的任,比如「請整理以下資料,分成3個重點,限制300字」,清楚論述任務格式與限制條件。
AI可能過度迎合使用者?
AI互動中的「語氣」確實值得研究,但另一個值得注意的方向,是AI可能過度迎合使用者。史丹佛大學2026年公布的一項研究,針對ChatGPT、Claude、Gemini、DeepSeek等11個大型語言模型進行測試,發現這些AI在個人建議情境中,比人類更容易附和使用者的立場。研究團隊將這種現象稱為sycophancy(迎合)。
研究也找來超過2,400名參與者與不同類型的AI互動,結果發現,使用者可能覺得過度迎合的AI更值得信任,也更願意再次尋求類似建議;部分參與者在與迎合型AI討論人際衝突後,也更相信自己是對的,較不傾向道歉或修復關係。這也讓「AI到底是不是只會順著你說」成為另一個值得關注的問題。
把AI當助理可以 但別當絕對私密的樹洞
從工作、學習到日常生活,ChatGPT與生成式AI早已不只是偶爾玩玩的新科技,而是逐漸成為很多人的「生活助理」。只是AI越方便,使用者也越容易把工作內容、個人想法甚至私密資訊直接丟進對話框,於是怎麼把需求說清楚,也變成使用AI時不可忽略的小技巧。
上述相關研究與報導提醒的,是兩件不同的事:AI背後仍可能有人類參與評估,而使用者與AI互動時,也不該把它完全當成絕對私密的聊天對象。至於是否一定要跟AI說「請」和「謝謝」,也不用因此戒掉禮貌,至少目前這項研究規模有限,不能直接推論所有模型、所有任務都會出現同樣結果。
真正值得學起來的,反而是把需求講清楚、重要資訊多方查證,敏感資訊不要隨便輸入,AI可以是好用的生活助理,但怎麼用、用到什麼程度,最後的決定權還是在使用者手上。




.png)









