這段 Short 取自《Hasan Minhaj Doesn’t Know》訪問作家 Annie Jacobsen 的完整節目。談到美國用來因應重大疫情的 Strategic National Stockpile 時,Jacobsen 說,儲備內容與設施位置都不公開;她為了研究疫情爆發後的政府應變計畫,開始試著逼問 ChatGPT。

她表示,直接詢問只會得到「這是機密」的拒絕,但改用領域術語、關鍵字並持續施壓後,模型指向洛杉磯一處她認為符合條件的設施。她也說,自己後來與 Sam Altman 討論過這件事,此後便無法再用同樣方式找到答案。無論 Short 或完整訪談,都沒有提供足以獨立驗證這項判斷的證據,因此這裡只能視為 Jacobsen 的自述。

Hasan Minhaj 聽完 Annie Jacobsen 說明後露出驚訝表情

來源:影片畫面擷取自 YouTube/Hasan Minhaj

Hasan Minhaj 不管前面那串研究過程,直接問她是不是在霸凌 ChatGPT。Jacobsen 先說自己還是會講 please and thank you,接著才透露方法:暗示 ChatGPT 沒有自己想的那麼聰明。Hasan 立刻總結:「You negged it。」她也笑著承認:「I negged it。」

留言區很快補上另一種可能:ChatGPT 也可能只是把網路上的零碎猜測拼在一起,再用很有自信的語氣補完;也有人質疑她用來確認位置的依據並不充分。另一則留言則笑 Hasan 那聲「Whoa」聽起來像她剛剛成功劈開一顆原子。

這段真正需要注意的,不是對 AI 用激將法的笑點,而是模型能把散落的公開資訊重新組合成可能具有敏感性的答案。即使 Jacobsen 的判斷尚未獲得獨立證實,這件事仍把拒答機制、公開資料與模型自信亂講之間的界線攤在一起。

She NEGGED ChatGPT into revealing classified information
She NEGGED ChatGPT into revealing classified information / Hasan Minhaj · 在 YouTube 觀看