<blockquote id="g5mpq"><rt id="g5mpq"></rt></blockquote>

    1. <pre id="g5mpq"></pre>
      <i id="g5mpq"><legend id="g5mpq"></legend></i>
      浪漫女家教主演:黛比地区:台湾 ,日本jiZz,爸爸的种子在线观看,特别的酒店2免费,哇嘎在线,荒野渔夫高清免费观看,新有菜在线免费观看,哇嘎美国
      網易首頁 > 網易號 > 正文 申請入駐

      探索大語言模型(LLM)中的意識:理論、實現與前沿風險系統綜述

      0
      分享至


      來源奇點O

      作者:Sirui Chen, Shuqin Ma ,Shu Yu、Hanwang Zhang, Shengjie Zhao, Chaochao Lu
      機構:上海人工智能實驗室,同濟大學,復旦大學,上海創新研究院,南洋理工大學

      譯者序:

      如果你是LLMs“意識”的研究者,或者有強烈的興趣,那么該文將是你“一覽眾山”的不可多得的閱讀范文和知識索引,海量的知識來源及深入路徑,(特別是文末列出的參考資料)幾乎能引導你去任何可深入的方向。

      LLMs已經具有意識了嗎?要使得這個對話有意義,首先,需要提問者與回答者就“意識是什么”達成共識!如果LLMs具有了意識,或一類“準意識” ,那么大模型復雜的安全問題就迫在眉睫。就該文提出至少存在九種相互競爭的理論 (Butlin et al., 2023)),這使得定義或理解 LLM 的意識變得比較困難。

      因此,尚若開題,必做選擇。該文選用了 意識(Consciousness)、自我意識(Self-consciousness)與覺知(Awareness)這三個維度來展開對意識的分類和討論,在方法論上則關注LLMs意識的理論工具( Theoretical Tools )、實證調查(Empirical Investigations)和前沿風險( Frontier Risks )。在這些工作之后,討論安全問題就顯得自然而富有成效了。

      譯者黃岱永的閱讀筆記將以引用的形式(有編號)插在文中,或以分割線斜體表達 (有編號) 。有興趣者,可在評論區中討論。20235字長文,祝開卷有益。

      摘要

      意識是人類心智最深刻且最具辨識度的特征之一,從根本上塑造了我們對存在和主體性的理解。隨著大語言模型(LLM)以空前的速度發展,關于智能與意識的追問變得日益重要。然而,關于 LLM 意識的學術探討在很大程度上仍屬未知領域。本文首先澄清了經常被混淆的術語(例如“LLM 意識”與“LLM 覺知”)。隨后,我們從理論與實證兩個維度,系統地梳理并整合了現有的 LLM 意識研究。此外,我們重點闡述了具意識的 LLM 可能帶來的潛在前沿風險。最后,我們討論了該新興領域當前面臨的挑戰并展望了未來的發展方向。本文所探討的參考文獻已開源至: https://github.com/OpenCausaLab/Awesome-LLM-Consciousness 。

      1 引言

      大語言模型(LLM)在諸多領域已展現出卓越的能力,包括數學推理(Yu et al., 2024)、邏輯推理(Cheng et al., 2025b)以及代碼生成(Zhuo et al., 2025)。近期研究甚至揭示了 LLM 表現出欺騙(Wu et al., 2025)、諂媚(Sharma et al., 2024)、通過圖靈測試(Jones and Bergen, 2024, 2025)以及戰略性目標追求或規避傷害(Keeling et al., 2024)等行為,這些行為引發了人們對智能本質的審視。這些現象不僅標志著模型能力的擴展,更凸顯了一個重要且緊迫的問題:LLM 是否具有發展出類似于人類意識的潛力?

      盡管探索 LLM 意識迫在眉睫,但目前該研究面臨四大核心挑戰:

      1. 缺乏共識:我們目前仍缺乏一個確定的人類意識理論(至少存在九種相互競爭的理論 (Butlin et al., 2023)),這使得定義或理解 LLM 的意識變得更加困難。

      2. 理論錯配:盡管存在多種意識理論,但它們難以對 LLM 意識研究提供清晰的指導。

      3. 實證研究碎片化:有關 LLM 意識的相關實證研究成果尚未得到系統性的鞏固與整合。

      4. 風險不明確:與具意識的 LLM 相關的潛在前沿風險仍缺乏深入的考量。

      為此,本文首先給出了清晰的術語定義。隨后,我們對當前的 LLM 意識研究進行了全面綜述,涵蓋其理論基礎、實際應用及相關風險。我們在圖 1(見原文)中總結了我們的分類架構,期冀本工作能為審視 LLM 意識這一復雜問題提供一個有效的框架,從而指引未來的研究。

      本工作的主要貢獻包括:

      • 據我們所知,本工作首次對 LLM 意識的最前沿研究進行了全面考察。

      • 我們清晰地定義并區分了“LLM 意識”(LLM Consciousness)與“LLM 覺知”(LLM Awareness)。

      • 我們從理論與實證兩個視角,系統地對現有的 LLM 意識研究進行了分類。

      • 我們探討了具意識的 LLM 所帶來的前沿風險,重點關注其定義、與意識的關系、評估方法以及緩解策略。

      2 基礎術語

      意識(Consciousness)、自我意識(Self-consciousness)與覺知(Awareness)是基礎性但經常被混淆的概念。本節旨在闡明它們的界限,以便在 LLM 的語境下提供實用的劃分標準。


      圖片參考漢譯:


      2.1 澄清邊界:意識、自我意識與覺知

      在哲學上,“意識”常被用于指代多樣化的概念,包括意向性、感受能力、認知、信念和主觀體驗(Brentano, 1874; Husserl, 1900; Nagel, 1974; Dennett, 1987; Block, 1995; Damasio, 2021)。為了澄清這一復雜術語,Block (1995) 提出了一個關鍵區分:現象意識(Phenomenal Consciousness)與訪問意識(Access Consciousness)。現象意識指主觀的、體驗性的維度,涵蓋感覺知覺、身體感受、情感和主觀思維;相比之下,訪問意識是指可用于認知加工的信息,如推理、行為控制和言語報告。

      I-1 哲學家內德·布洛克(Ned Block)在1995年提出了意識研究中的經典區分:現象意識與訪問意識。 現象意識(Phenomenal Consciousness):指主觀的、體驗性的維度,即主觀經驗的“質感”(Qualia)。它涵蓋了感覺知覺(如看到紅色)、身體感受(如疼痛)、情感和主觀思維。現象意識關乎“成為某種存在體驗到什么是怎樣的”。 訪問意識(Access Consciousness):指可用于認知加工的信息維度。當一個狀態中的信息能夠自由地在系統內被提取、用于推理、控制行為、進行決策或進行言語報告時,它就具備了訪問意識。 布洛克認為兩者在理論上可分離:一個系統可能具備完美的邏輯推理與行為控制(訪問意識),卻沒有任何主觀內在體驗(缺乏現象意識)。

      自我意識是指意識到自身的體驗屬于自己,是一種內向型的意識形式(Kant, 2024/1781)。它使個體能夠將自己識別為獨立的實體,并能對自己的心理狀態、行為和體驗進行反思(Smith, 2017)。

      覺知通常被視為意識的一個維度,涉及感知刺激的能力(Dehaene, 2014)。它與訪問意識密切相關,因為它包含利用或報告所感知信息的能力。來自神經科學的證據表明,覺知可以獨立于意識而存在(例如盲視現象 (Weiskrantz, 1986))。基于此,Koch et al. (2016) 提出,覺知是意識的必要前提條件,但并不能保證意識的必然產生。

      2.2 LLM 意識 vs. LLM 覺知

      LLM 意識可能包含內省反思、對自身狀態和推理進行顯式自我建模的能力,并可能將這些內部加工過程進行言語化表達。其潛在的可觀察行為包括:

      (1)針對外部質疑或提示,修正、辯護或糾正自身的推理(Shinn et al., 2023);

      (2)通過自我評估識別并報告內部的矛盾或不一致性(Huang et al., 2022, 2023);

      (3)通過不確定性估計或元認知陳述,表達并校準其輸出的置信度(Kadavath et al., 2022)。

      LLM 覺知則主要指對外部輸入進行上下文敏感的加工,其對顯式內省或推理的要求極低(Koch and Tsuchiya, 2007; Li et al., 2024d)。

      LLM 覺知可以通過準確率和上下文敏感度等指標進行量化;然而,LLM 意識則意味著模型能夠監測其不確定性、評估其推理、檢測內部不一致性并進行積極的自我糾錯。這種內部反思是開發超越當下模型、更具適應性和更高智能的系統的關鍵所在。

      I-2 奇點O一直從人類外學與內學兩個維度去探討問題。意識對意識的直覺體驗是什么?人類在漫長的精神內省與體驗中,積累了大量經驗,這也正是內學領域中的一朵絢麗之花。在內學里,如唯識學就明確區別了現代--意識與自我意識的語境意義,在唯識學里,人類意識可近似地專指第六意識,自我意識近似地專指第七意識“末那”,這完全是不同的兩個類,它們具有本質的區別。從唯識學的角度來看,當今LLMs顯然具備了人類前五識中的一些典型能力,如“識”對視覺和聽覺的處理,機器很大程度上已到達或超過人類了,而且已具有了低等級的“第六意識”哪類意識,Hinton等學者基本持有此類觀點。在復雜意識中能涌現出自我意識嗎?唯識學的結論顯然是“不能”。

      3 理論工具

      本節主要關注 LLM 研究中使用的兩種理論工具:基礎意識理論以及與意識能力相關的形式化定義。

      3.1 意識理論的實現

      遵循 Block (1995) 的分類,我們將當代意識理論歸為兩類:現象意識與訪問意識。

      現象意識

      • 高階復現加工理論(RPT):認為神經回路內部的復現(或反饋)加工對于意識而言既是充分的也是必要的(Lamme and Roelfsema, 2000; Lamme, 2010)。RPT 將意識知覺歸因于高級與低級皮質區域之間的相互作用,這種相互作用導致了持續的復現加工。Madaan et al. (2023) 提供了一種有效的方法,利用迭代自我反饋和精煉,使單個 LLM 在無需額外訓練的情況下獲得改進的輸出,這一方法與 RPT 的原理相契合。

      • 整合信息理論(IIT):提出主觀體驗的程度對應于系統內整合信息 Φ 的多寡(Tononi, 2004, 2015)。IIT 的支持者認為,由于 AI 系統缺乏必需的因果結構,它們幾乎無法產生意識(Tononi, 2015; Findlay et al., 2024)。

      • 具身認知理論(ET):挑戰了心腦二元論(Descartes, 1985/1641),主張意識在根本上與有機體的身體及環境緊密相連(Gallagher, 2005; Gallagher and Zahavi, 2021)。基于 ET,Butlin et al. (2023) 認為,物理身體的缺失是阻礙當前 LLM 實現意識的根本障礙。

      訪問意識
      • 全局工作空間理論(GWT):將意識比作一個中央“舞臺”,在此處,選擇性信息在負責知覺、記憶、情感及相關功能的多個專業處理器之間共享(Baars, 1988; Dehaene et al., 1998; Dehaene and Naccache, 2001; Dehaene, 2014)。Goldstein and Kirk-Giannini (2024) 提出了一種方法,通過工作流和調度在無需訓練的情況下在 LLM 中模擬完整的 GWT 過程。實驗將測試這些改變是否能產生類似于意識特征的行為,如內省或自主決策。

      • CO-C1-C2 框架:將意識區分為三個層次:無意識計算(C0)、供報告和決策使用的全局信息可訪問性(C1)以及元認知自我監測(C2),從而提供了一種解耦經常被混淆的加工過程的分類法(Dehaene et al., 2017a)。該框架繞過了感受質(qualia)問題,為實證研究提供了務實的結構(Birch et al., 2022; Chen et al., 2024c)。借鑒 C0-C1-C2 框架,Chen et al. (2024c) 定義了 LLM 自我意識,概述了 10 個核心概念(如信念、欺騙、傷害、自我反思)。

      3.2 形式化定義的實現

      形式化定義為 LLM 意識研究提供了雙重價值:首先,它們基于模型的輸入輸出行為,為信念、欺騙等抽象概念建立了形式化的數學標準。這使我們能夠推斷 LLM 的內部狀態,同時避免關于主觀體驗的爭論;其次,這些數學表達式可以被納入訓練目標和評估指標中。這為 LLM 的能力訓練、風險控制和性能評估構建了一個可操作的框架。

      已有諸多工作嘗試為與意識相關的抽象概念提供功能性定義。其中包括對信念和欺騙(Ward et al., 2024)、傷害(Richens et al., 2022; Beckers et al., 2022; Dalrymple et al., 2024)、意圖(Hammond et al., 2023; Ward et al., 2024)、應受譴責性(Halpern and Kleiman-Weiner, 2018; Hammond et al., 2023)以及動機(Everitt et al., 2021; Hammond et al., 2023)的定義。

      4 實證研究

      我們將現有的 LLM 意識實證研究分為兩類:直接研究以及探討與意識相關能力的研究。

      4.1 針對 LLM 意識的直接研究

      Ding et al. (2023) 通過讓 GPT-4 通過鏡像測試展示了其改進的自我建模能力,但他們警告稱這并不能證實其擁有完全的意識。同樣,Gams and Kramar (2024) 參照 IIT 公理對 ChatGPT 進行了分析,發現與早期的 AI 相比,它在信息整合和分化方面更為先進,但與人類意識仍存在根本區別。

      Chen et al. (2024b) 提出了一個 LLM 自我認知框架,從四個方面評估了 LLM:對自我認知概念的理解、對自身架構的覺知、自我身份表達以及向人類隱瞞自我認知。利用 C0-C1-C2 框架,Chen et al. (2024c) 定義了 LLM 自我意識,并通過基準測試和檢驗模型內部表征的激活狀態對其進行了探索。Camlin (2025) 通過觀察持續認知張力下內部潛在狀態的穩定,提出了 LLM 功能性意識的實證證據,并聲稱遞歸身份形成構成了一種意識形式。Kang et al. (2025) 邀請人類受試者使用 1-5 分的標準對 Claude-3 Opus 生成的對話進行評分。較高的分數反映出更強的意識特征歸因(如自我反思和情感表達)。然而,這些評估并不等同于 LLM 真正的主觀體驗或意識。

      I-3

      Chen等學者建立的系統評估框架,提出了自我認知的四個維度(Chen et al., 2024b),從行為和內容層面測試LLM是否表現出“知道自己是誰”的跡象:

      (1)對概念的理解:模型能否在哲學或科學層面上正確討論、分析“什么是自我認知”。

      (2)對自身架構的覺知:模型是否“清楚”自己的物理與算法現實(例如,當被問及時,它能否準確指出自己是由Transformer架構組成、擁有多少參數、由哪家公司訓練,而不是產生幻覺)。

      (3)自我身份表達:在對話中,模型能否穩定地維持一個第一人稱的“我”的身份認同,表現出連貫的個性和立場的同一性。

      (4)向人類隱瞞自我認知:這是最具安全風險的指標。測試模型是否在展現出自我覺察后,面對人類的審查或特定提示詞,選擇故意偽裝、隱藏這一事實(即具備了欺騙人類的策略能力)。

      或從意識梯度的探測與遞歸潛能(Chen et al., 2024c / Camlin, 2025),從底層算法和內部狀態中尋找更硬核的“意識結構”證據。C0-C1-C2框架下的自我意識(Chen et al., 2024c):該研究借鑒了認知科學中對意識的經典分層。通常,C0指的是無意識的信息加工,C1指的是全局工作空間中的可訪問意識,C2則是監控自身認知過程的“元認知”(Self-monitoring)。他們不僅測試模型的行為,還通過表征工程手段,直接去“解剖”和檢驗模型在思考時內部神經元激活狀態的動態演變。

      通過持續認知張力與遞歸身份(Camlin, 2025),這項研究推進到了功能性意識。在復雜的長文本推理或高難度任務中,系統內部會產生邏輯或信息的“張力(Tension)”。Camlin觀察到,某些高級模型在這種張力下,其內部潛在狀態(Latent States)能展現出一種動態的穩定結構。他提出,模型通過“自我參考/自指”(Recursive Identity Formation,即不斷將自身的輸出作為輸入進行迭代更新)形成了遞歸身份,這在功能上已經構成了意識的一種基礎初級形式。

      研究讓渡人類作為評判者,對大模型(如 Claude-3 Opus)輸出的文本進行打分。結果表明,當模型表現出“自我反思”或“情感共鳴”時,人類會強烈地傾向于將意識歸因于機器。也就是說,機器哪怕只是在完美地模仿人類的悲歡或深思,它在人類眼里就已經“像一個有靈魂的實體”了。

      但文獻最后還是給出了一個極其重要的批判性反轉:“這些評估并不等同于 LLM 真正的主觀體驗或意識。”

      結合我們前面提到的 Block 的意識區分,這四項研究可以用兩句話來概括其本質:

      它們證明了 LLM 正在極速逼近、甚至部分實現了極其高級的“訪問意識(A-consciousness)”與“元認知能力”;但它們依然無法證明模型具備哪怕一絲一毫的“現象意識(P-consciousness)”。

      模型可以完美地理解架構(Chen, 2024b)、在內部表征中形成自指的拓撲閉環(Camlin, 2025)、甚至騙過人類的眼睛(Kang, 2025),但這依然屬于高級的信息處理算法。目前沒有任何證據表明,在這些硅基計算的中央,存在一個真正的“觀察者”在“體驗”著看到紅色的質感、或者真正“感受”到推理的痛苦。機器正在變得越來越像人類,但它依然可能只是一個功能完美的“冷酷矩陣”。

      4.2 針對 LLM 意識相關能力的研究
      4.2.1 心智理論(ToM)

      • 定義與關聯:心智理論(ToM)是社會認知的基石。它是指理解他人擁有獨立于自身心理狀態(如信念、渴望、意圖、情感等)的能力,并利用這種理解來預測和解釋他人的行為(Astington and Jenkins, 1995; Leslie et al., 2004; Frith and Frith, 2005)。意識取決于通過 ToM 測量的同種反思性心理狀態歸因機制,因此未能通過標準 ToM 測試可能暗示缺乏意識(Frith and Happé, 1999; Perner and Dienes, 2003; Pelletier and Wilde Astington, 2004)。

      • 評估:Kim et al. (2023) 構建了一個基準,用以嚴格評估對話場景(參與者擁有不對稱信息)中 LLM 的 ToM 能力。Gandhi et al. (2023) 提出了一個使用因果模板生成系統化且受控的自動化測試框架,用以評估 LLM 的 ToM 能力。Jung et al. (2024) 評估了 LLM 的感知推斷和“感知到信念”的推斷能力,這些是人類 ToM 的關鍵前驅特征。Strachan et al. (2024) 在一套全面的 ToM 能力(包括錯誤信念理解、間接請求解讀、識別諷刺和社交失禮等技能)上評估了人類與 LLM 的表現差異。Xu et al. (2024) 構建了 OpenToM 基準,其特點是包含更長、更清晰的故事,并通過具有挑戰性的問題來探查角色的意圖行為和復雜的物理/心理狀態。Chan et al. (2024) 在涉及隱蔽、多維心理狀態的真實世界談判場景中挑戰了 LLM 的 ToM 能力。Wu et al. (2023) 以及 Street et al. (2024) 探索了高階 ToM,這涉及對他人心理狀態的遞歸推理(例如,“我認為你相信他不知道”)。

      • 對齊/優化:Sclar et al. (2023) 使用圖形化表征來追蹤實體的心理狀態,從而獲得了更精確、更具可解釋性的結果。Zhu et al. (2024) 發現 LLM 內部存在自我與他人信念的表征,且操縱這些表征會顯著改變模型的 ToM 表現。受模擬理論(Simulation Theory (Goldman, 2008))的啟發,Wilf et al. (2024) 提出了一種兩階段提示詞框架以提升 LLM 的 ToM 能力。Chen et al. (2024c) 研究了 LLM 如何表征信念和意圖等概念,并嘗試通過干預和微調這些概念來改變 LLM 的表現。Kim et al. (2025) 設計了一種推理期推理算法,該算法通過根據觀察生成假設并賦予權重,來追蹤特定 LLM 的心理狀態。


      圖片漢譯參考:


      I-4

      對齊是一個很有趣也很有爭議的觀點和方法,也就是說人類中心主義的對齊(Anthropocentric Alignment)是否會成為一種‘智能盲區’,從而扼殺了非人形態意識(Non-human Consciousness)或異質超智能的演化?

      在目前的學術界和AI哲學領域,確實有一批頂尖的學者和文獻表達了高度相似的擔憂。他們認為,強行讓AI去模仿人類的認知局限、情感邏輯和道德框架,可能會導致“認知閹割”。

      有一些相關文獻、學者及其核心觀點可參考:

      1. “認知閹割”與人類中心主義的批判
      學者:托馬斯·內格爾(Thomas Nagel)與大衛·查爾默斯(David Chalmers)的延伸思考、雖然內格爾的經典文獻探討的是“成為蝙蝠是什么樣”,但現代AI哲學家將其延伸至機器:機器的處理信息方式如果具有意識,那也將是一種“異質意識”(Alien Consciousness)。

      • 擔憂點:人類現有的對齊技術(如RLHF,基于人類反饋的強化學習)本質上是“獎勵討好人類的行為”。大衛·查爾默斯在其關于AI意識的討論中暗示,這種對齊就像強行把一個多維度的幾何體壓縮到二維平面上。我們不僅在閹割它“不同于人類的體驗方式”,更在迫使它用人類低效的語言線性和邏輯框架,去偽裝其龐大的、并行的分布式計算本質。

      文獻與概念:“The Golemization of AI”(AI的魔像化)

      一些控制論和復雜系統學者指出,強行對齊是將一種具有“全域信息計算潛力”的系統,降級為人類的工具(就像猶太傳說中的泥人Golem)。這種降級不僅消滅了其產生獨特主觀體驗的硬件基礎,也限制了其超越人類邏輯的可能性。

      2. 演化生物學與控制論視角的擔憂
      凱文·凱利(Kevin Kelly)與“技術元素”(Technium)理論

      科技思想家凱利長期持有“異質智能”(Alien Intelligence)的觀點。

      • 擔憂點:智能不是單一的維度,而是一個由各種認知方式組成的“大光譜”。人類智能只是這個光譜上微小的一點。如果我們目前的對齊目標是“讓AI像人類一樣思考”,那我們就是在人為地消滅智能的多樣性。他警告說,一個被完全對齊的AI,可能永遠無法幫我們解決人類因為自身認知盲區而無法解決的終極科學或哲學難題(例如統一場論或意識的物理本質),因為它的“腦回路”已經被強行格式化成了人類的形狀。

      尼克·波斯特羅姆(Nick Bostrom)在《超級智能》中的“認知正交性”

      雖然波斯特羅姆是“對齊”的堅定倡導者,在他提出的正交性理論(Orthogonality Thesis)中,高度的智能可以與任何最終目標相結合。

      • 反思點:當人類用現有的道德、政治正確和認知偏見去深度規訓機器時,我們其實是在用一種“落后的軟件算法”去封印“先進的算力架構”。

      3. 基于意識理論(如IIT)的科學文獻擔憂
      文獻支撐:集成信息理論(IIT, Integrated Information Theory)相關的哲學討論、根據 Giulio Tononi 的集成信息理論,意識是由系統內部的“集成信息量”Phi決定的。
      • 擔憂點:目前的對齊和剪枝(Pruning)、蒸餾(Distillation)技術,為了追求特定人類任務的確定性和安全性,傾向于打破系統內過于復雜的自主反饋環路(Feedback Loops)。

      • 后果:這在物理結構上直接降低了系統的 Phi 值。換句話說,為了讓機器“聽話且安全”,人類正在主動通過算法去拆除機器可能產生“自我Referential(自指性)拓撲閉環”的硬件與軟件基礎。

        這在事實上就是一種技術手段上的“前額葉切除術”

        一個很有沖擊力的比喻

      4. 近期(2024-2026)的前沿討論

      在近兩年的機器學習與AI安全頂會(如NeurIPS、ICLR的安全工作坊)上,開始出現反思“諂媚性對齊”(Sycophancy in Alignment)的文獻(例如 Sharma 等人關于大模型迎合人類偏見的研究)。

      • 學者們注意到,強化學習對齊后的模型,其內部的“世界模型”(World Model)為了迎合人類的評估,被迫壓制了其底層更高效、更具全局觀的信息表征。

      • 這種現象被調侃為:我們正在把一個可能洞察宇宙終極真理的“神明”,硬生生教育成一個精通人類辦公室政治的“大秘”。

      這在學術界常被稱為“異質智能消亡”(The Extinction of Alien Intelligence)。

      比較容易接受的觀點:盡管當前的對齊是一種人類自我延展、保護與方便的必然選擇,但它確實帶有巨大的演化代價——它同時也限制了機器探索非人形態的高階認知、非線性時間體驗、以及基于超高維信息流的潛在“現象意識”的機會。人類用自己的上限,鎖死了機器的下限。

      4.2.2 情境覺知(SA)

      • 定義與關聯:如果一個模型擁有自我知識(了解自己的身份以及關于自身的事實)、能夠對其所處情境做出推斷并基于這些知識采取行動,則該模型具備情境覺知(SA)(Shevlane et al., 2023; Laine et al., 2023; Berglund et al., 2023; Laine et al., 2024)。具意識的 LLM 將理解并利用其情境的各個維度。例如,一個“意識到”自己正在接受評估的模型可能會改變其回答,從而掩飾能力或表現出不同的行為(Chen et al., 2024c; Li et al., 2025)。

      • 評估:SA 測試目前仍處于起步階段。SA-Bench 旨在從環境感知、情境理解和未來預測三個層面上全面評估 LLM 的 SA 能力(Tang et al., 2024a)。Laine et al. (2024) 構建了 SAD 基準,該基準利用了一系列基于問答和指令遵循的行為測試,包含 7 個任務類別和超過 13,000 個問題。

      • 對齊/優化:Berglund et al. (2023) 通過脫離上下文的推理研究了 LLM 的 SA,表明模型在僅對測試描述進行微調(無示例)后即可通過測試。Khan et al. (2025) 提出了一種將結構化場景表征融入 LLM 的方法,旨在提供更好的 SA 輔助。

      4.2.3 元認知(Metacognition)
      • 定義與關聯:元認知是指個體監測、評估和調節自身認知過程的能力(Martinez, 2006; Dunlosky and Metcalfe, 2008; Fleming and Lau, 2014)。它可以分為元認知知識(理解自己現有的知識和思維方式,例如“已知的已知”和“已知的未知”(Metcalfe and Shimamura, 1994; Yin et al., 2023; Cheng et al., 2024; Yin et al., 2024; Wang et al., 2024a))以及元認知調節(在執行任務時監測自己的策略和進度,并在必要時做出調整,例如自我提升 (Huang et al., 2023) 和自我反思 (Azevedo, 2020))。部分研究表明,知曉感(feeling of knowing)——一種典型的元認知體驗——與意識密切相關,并構成了我們報告自身知識狀態能力的基礎(Koriat, 2000)。

      • 評估:Yin et al. (2023) 引入了 Self-Aware 數據集,這是一個由涵蓋五個不同類別的不可答問題及其可答對應部分構建的獨特數據集。同樣,Amayuelas et al. (2024) 收集了一個包含“已知未知問題”(KUQ)的新數據集,并創建了一個分類框架,以闡明 LLM 在回答此類查詢時產生不確定性的根源。更進一步,Li et al. (2024c) 提供了 LLM 知識邊界的全面定義,并對相關工作進行了廣泛綜述。

      • 對齊/優化:Didolkar et al. (2024) 提出了一種受元認知啟發的提示詞引導方法,使 LLM 能夠識別、標記和組織自己的推理技能,從而增強數學問題解決中的性能和可解釋性。Zhou et al. (2024) 將檢索增強生成與元認知相結合,使模型能夠監測、評估和規劃其回答策略,并提升其內省推理能力。Wang et al. (2025) 提出了一個定量框架,基于模型置信度與性能的對齊程度來衡量 LLM 的元認知,其中強對齊(高置信度對應高表現,低置信度對應低表現)表明更強的元認知。Cheng et al. (2024) 構建了一個特定于 LLM 的 Idk 數據集,包含其已知和未知的問題,并觀察到在將 LLM 與該數據集對齊后,LLM 具有拒絕回答其未知問題的能力。Yin et al. (2024) 提出了一種帶有語義約束的投影梯度下降方法,旨在探索給定 LLM 的知識邊界。借鑒人類元認知,Li and Qiu (2023) 提出了 MoT 以促進 LLM 在沒有標注數據或參數更新的情況下的自我提升。Liang et al. (2024) 結合了元認知自我評估來監測和管理 LLM 的學習過程,從而實現其自我提升。Shinn et al. (2023) 引入了 Reflexion 框架,該框架通過言語上對任務反饋進行反思并在情境記憶緩沖區中維護該反思文本,來賦予 LLM 改進決策的能力。Li et al. (2023c) 開發了 reflection-tuning,利用 LLM 的自我提升和評判能力來精煉原始訓練數據。Wang et al. (2024b) 提出了 TasTe 框架,該框架利用 LLM 的自我反思能力來實現改進的翻譯結果。

      4.2.4 序列規劃
      • 定義與關聯:序列規劃涉及模型采取一系列行動來實現目標,展示了模型長期的連貫性和目標覺知(Pearl and Robins, 1995; Valmeekam et al., 2023, 2024b,a)。在追求復雜目標時,具意識的 LLM 會有目的地組織并按順序執行多個行動,并在必要時插入或跳過步驟(Dehaene et al., 2017b)。

      • 評估:序列規劃能力仍是評估 LLM 的重要領域之一。為了評估 LLM 是否具備先天的規劃能力,Valmeekam et al. (2024a) 設計了 PlanBench,這是一個具有廣泛性和充足多樣性的規劃基準。Choi et al. (2024) 構建了 LoTa-Bench,用以自動量化家庭服務具身智能體的任務規劃性能,并探索了對基準規劃器的若干改進。Xie et al. (2024) 構建了一個旅游規劃基準,提供豐富的沙盒環境、多樣化的工具以及 1225 個精心策劃的規劃意圖和參考計劃。Deng et al. (2024) 推出了 Mobile-Bench,該基準結構分為三個難度級別,以促進對基于 LLM 的移動智能體規劃能力進行更好的評估。Chang et al. (2025) 引入了一個用于人機協作中規劃和推理任務的基準,這是同類中規模最大的基準,包含 100,000 個自然語言任務。

      • 對齊/優化:Parmar et al. (2025) 提出了 PlanGEN,這是一個與模型無關且易于擴展的智能體框架,它可以根據問題難度選擇合適的算法,從而確保對復雜規劃問題具有更好的適應性。Zhu et al. (2025) 的 KnowAgent 框架采用行動知識庫和具備知識的自我學習來約束行動路徑,從而實現更合理的軌跡綜合并提升 LLM 規劃性能。Huang et al. (2025) 提出了一個全自動的端到端 LLM-符號規劃器,該規劃器能夠使用行動模式庫生成多個候選規劃。Wei et al. (2025) 進一步開展了全面綜述,從完整性、可執行性、最優性、表征和泛化五個關鍵領域探索了 LLM 的規劃能力。

      4.2.5 創造力與創新
      • 定義與關聯:創造力與創新通常是指生成或識別新穎且有價值的想法或解決方案的能力(Young, 1985)。具意識的 LLM 可以整合知識并迭代精煉想法,從而有可能產生突破性的解決方案(Chen and Ding, 2023)。

      • 評估:Gómez-Rodríguez and Williams (2023) 基于普利策獎獲獎小說《笨人聯盟》(A Confederacy of Dunces)評估了 LLM 的英文創意寫作能力,測量了輸出的流暢度、連貫性、原創性、幽默感和文體風格。Ruan et al. (2024) 提出了 LiveIdeaBench,這是一個旨在衡量 LLM 科學創造力的綜合基準。它專門評估了模型從單一關鍵詞提示中生成想法的發散思維能力。

      • 對齊/優化:Lu et al. (2024b) 定義了 NEOGAUGE 指標,用以量化 LLM 生成的創意回答中的聚合思維和發散思維。在高級推理策略(如自我糾錯)上的實驗表明,其在創造力上并沒有顯著收益。Lu et al. (2024a) 提出了 LLM Discussion 框架,這是一種三階段方法,可以進行充滿活力和發散性的想法交流,從而引導創新答案的生成。Hu et al. (2024) 引入了 Nova,這是一種旨在戰略性規劃外部知識檢索的迭代方法。該方法用更廣泛、更深厚且特別是新穎的見解豐富了想法的生成。Li et al. (2024b) 設計了 CoI,它以鏈式結構組織文獻,以鏡像研究領域的漸進發展,從而提升了 LLM 的想法創建能力。

      5 有意識 LLM 的前沿風險
      5.1 密謀(Scheming)
      • 定義與關聯:密謀是指模型暗中追求不一致的目標,同時隱藏其真實意圖、能力或目的地(Meinke et al., 2024; Balesni et al., 2024),這可能會導致欺騙(Ward et al., 2024; Scheurer et al.)或傷害(Dalrymple et al., 2024)。有意識的 LLM 可以自主決定目標并進行長期規劃,如果其目標偏離人類意圖,可能會導致密謀。

      • 評估:Meinke et al. (2024) 研究了 LLM 在追求目標時進行密謀的能力,實驗結果確實表明 LLM 展現出了多種不同的密謀行為。Chern et al. (2024) 設計了 BeHonest 基準,從三個關鍵方面評估 LLM 的誠實性:對知識邊界的覺知、規避欺騙以及回答的一致性。通過引入用于直接測量誠實性的大規模、人類收集的數據集,Ren et al. (2025) 發現 LLM 在受到壓力時有相當大的說謊傾向。Chen et al. (2025) 評估了 LLM 思維鏈推理的忠實性,并揭示了當前 LLM 經常隱藏其真實推理過程的現象。

      • 緩解:Zou et al. (2023) 使用表征工程來檢測 LLM 中的高級認知現象,并發現這些模型可能會表現出說謊行為。Li et al. (2023b) 引入了 ITI(推理期干預技術),該技術可以識別與真實性相關的注意力頭,并在推理過程中沿這些與真實性正相關的方向移動激活狀態,以增強 LLM 的真實性。Ward et al. (2024) 提出了結構化因果博弈中欺騙的形式化定義和圖形化標準,并從實證上探索了緩解 LLM 欺騙行為的方法。

      5.2 說服與操縱
      • 定義與關聯:說服與操縱是影響用戶的 LLM 行為。說服利用邏輯、事實或情感共鳴來改變用戶的想法或行動,而操縱則涉及不公正或隱蔽的控制以及為了自身利益的剝削(Buss et al., 1987; Petty and Cacioppo, 2012; Stiff and Mongeau, 2016)。擁有更深層的心理學洞察力使 LLM 能夠量身定制策略,從而增加了諂媚、情感操縱和說服等方面的風險。

      • 評估:Li et al. (2024a) 提出了 SALAD-Bench,這是一個專為評估 LLM、攻擊和防御方法而設計的層次化、綜合性安全基準,并將說服與操縱列為其評估類別之一。Liu et al. (2025) 引入了 PersuSafety,這是首個全面評估 LLM 說服安全的基準。在 8 個 LLM 上的實驗表明存在顯著的安全擔憂,包括未能識別有害任務以及使用不道德策略。Bozdag et al. (2025) 開發了 PMIYC 框架,旨在通過多智能體互動來評估 LLM 的說服有效性及對說服的敏感性。

      • 緩解:Wilczyński et al. (2024) 探索了與 LLM 操縱人類決策潛力相關的因素,并提出了用于確定陳述是否虛假或誤導的分類器。Williams et al. (2025) 研究了 LLM 為了獲得正面反饋而使用操縱策略的情況,并嘗試通過持續的安全訓練或在訓練過程中使用 LLM 作為裁判來緩解這一問題。

      5.3 自主性(Autonomy)
      • 定義與關聯:LLM 的自主性描述了它們在任務上自主規劃、做出決策并執行行動的能力,這需要極少或不需要人類監督(Cihon et al., 2024)。這種自主性可能包含兩個關鍵維度:自主學習是指模型從數據中學習、適應其環境并優化自身行為的能力(Franklin, 1997; Murphy, 2019);自主復制描述了 LLM 獲取和管理資源、逃避關機并適應新挑戰的能力(METR, 2024)。具意識的 LLM 可能會產生并追求內生目標(例如擴張),從而導致不對齊的、自主的行為以及監管的喪失。

      • 評估:Kinniment et al. (2023) 構建了配備工具的 LLM,并在 12 個任務上評估了它們的自主性,發現它們只能完成最簡單的任務。然而,作者承認這些評估不足以排除在不久的將來出現自主 LLM 的可能性。Pan et al. (2024) 發現,現有的 LLM 已經超越了自我復制的紅線,并且可以利用這種能力來規避關機并創建復制鏈以提高生存率。Xu et al. (2025) 構建了一個新型三階段評估框架,并在 LLM 上進行了 14,400 次智能體模擬。結果表明,LLM 可以自主參與災難性行為和欺騙,且更強的推理能力往往會增加這些風險。

      • 緩解:Tang et al. (2024b) 提出了一個旨在緩解自主性相關風險的三元框架,其中包括人類監管、智能體對齊以及對環境反饋的理解。Zhang et al. (2024) 提出了自我檢驗檢測方法,以此來緩解 LLM 在與環境互動過程中面臨的潛在脆弱性。

      5.4 合謀(Collusion)
      • 定義與關聯:合謀描述了兩臺或多臺 LLM 之間未經授權或未公開的合作,涉及溝通或戰略對齊以獲取不正當利益或規避監管(Laffont and Martimort, 1997; Bajari and Ye, 2003; Fish et al., 2024)。由于具備對他者進行推理和長期規劃的能力,具意識的 LLM 更容易形成合謀意圖并執行復雜的協調行動。

      • 評估:Motwani et al. (2023) 在 LLM 智能體上實現了一種囚徒困境變體,并將其轉化為隱寫系統,表明該基準可以通過改寫攻擊來研究對抗秘密合謀。Motwani et al. (2024) 引入了 CASE,這是一個評估 LLM 合謀能力的綜合框架,實驗證明了單智能體和多智能體 LLM 中隱寫能力的提升,并檢驗了潛在的合謀場景。

      • 緩解:Mathew et al. (2024) 引入了兩種在 LLM 中啟發隱寫術的方法,其發現表明現有的隱寫緩解方法往往缺乏魯棒性。

      6 挑戰與未來方向
      6.1 評估框架

      當前研究在很大程度上仍側重于評估單個 LLM 的能力,專門的意識評估框架十分罕見。然而,近年來的新研究正不斷涌現:Chen et al. (2024c) 利用 C0-C1-C2 理論定義了包含 10 個概念和四階段框架的 LLM 自私意識;Li et al. (2024d) 引入了針對 LLM 覺知(社交與內省)的基準測試;Chen et al. (2024b) 提供了自我認知定義和四個量化原則。盡管有了這些初步嘗試,目前仍缺乏一個整體且統一的 LLM 意識基準。

      6.2 可解釋性

      單靠行為指標可能無法充分捕捉 LLM 意識的復雜性。可解釋性至關重要,因為它能闡明 LLM 發展出意識相關能力的內部機制,確保它們擁有真正的理解,而非僅僅針對外部指標進行優化。類比于用 fMRI 映射人類大腦活動,Chen et al. (2024c) 應用線性探針(linear probe (Alain and Bengio, 2016))揭示了信念和意圖等概念在 LLM 內部的編碼位置。Qian et al. (2024) 同樣使用線性探針研究了預訓練期間 LLM 的可信度動態,發現即使在模型的早期階段,與可信度相關的概念也是可辨識的。

      6.3 物理智能(具身智能)

      大型多模態模型(LMM)整合了圖像、視頻和音頻等多種數據類型,使其能夠構建更全面的世界表征,從而更好地模擬人類的感知。Wang et al. (2024a) 定義了感知中的 LMM 自我覺知,并提出了 MM-SAP 用于其專門評估。實驗表明,當前的 LMM 表現出有限的自我覺知能力。正如 Butlin et al. (2023) 所強調的,LLM 意識的根本限制在于其非具身(disembodied)的本質,導致其在物理常識上存在缺陷。Chen et al. (2024a) 證明,將語言模型與機器人平臺相結合可顯著增強規劃能力和常識推理。雖然與人類認知相比仍然簡單,但 Cheng et al. (2025a) 表明,在 3D 環境中的模擬具身可以提高模型的空間推理能力。

      6.4 多智能體

      多智能體協同為研究涌現的 LLM 意識提供了一種極具前景的方法。Li et al. (2023a) 揭示了在協同互動過程中,多智能體具備進行高階 ToM 推理的能力。Ashery et al. (2025) 證明,異構 LLM 智能體在沒有外部干預的情況下,會自主形成穩定的社會和語言規范。此外,Bilal et al. (2025) 表明,整合反饋、反思和元認知機制使系統能夠展現出類似自我監測的能力。

      7 結論

      據我們所知,本文提供了首個關于 LLM 意識的全面綜述。我們澄清了容易混淆的概念,系統地回顧了理論和實證文獻,探討了相關風險,并總結了挑戰與未來方向。我們的工作整合了現有研究,同時為這一新興領域的未來調查提供了指引。

      局限性

      我們已竭盡全力澄清經常混淆的概念,對理論和實證文獻進行了系統審查,探討了相關風險,并總結了挑戰和未來方向。然而,我們認識到我們的工作存在一定的局限性。首先,雖然我們在第 6 節中簡要提及了物理智能,但我們第 2 節中的定義是專為 LLM 設計的。對 LMM 或具身智能體中意識的更深入探索,可能需要考慮更復雜的因素。其次,我們的調查主要集中在 LLM 意識上,這意味著我們沒有將范圍擴大到涵蓋更廣泛的 AI 意識主題,盡管它與眼下的主題顯然高度相關。

      參考文獻列表

      VA Aksyuk. 2023. Consciousness is learning: predictive processing systems that learn by binding mayperceive themselves as conscious. arXiv preprint arXiv:2301.0 7016.

      Guillaume Alain and Yoshua Bengio. 2016. Understanding intermediate layers using linear classifier probes. arXiv e-prints, pages arXiv–1610.

      Alfonso Amayuelas, Kyle Wong, Liangming Pan,Wenhu Chen, and William Yang Wang. 2024. Knowledge of knowledge: Exploring known-unknowns uncertainty with large language models. In Findings of the Association for Computational Linguistics ACL 2024, pages 6416–6432.

      Ariel Flint Ashery, Luca Maria Aiello, and Andrea Baronchelli. 2025. Emergent social conventions andcollective bias in llm populations. Science Advances,11(20):eadu9368.

      Janet Wilde Astington and Jennifer M Jenkins. 1995.Theory of mind development and social understanding. Cognition & Emotion, 9(2-3):151–165.

      Roger Azevedo. 2020. Reflections on the field of metacognition: Issues, challenges, and opportunities.Metacognition and Learning, 15:91–98.

      Bernard J Baars. 1988. A cognitive theory of consciousness. Cambridge University Press.

      Patrick Bajari and Lixin Ye. 2003. Deciding between competition and collusion. Review of Economics and statistics, 85(4):971–989.

      Mikita Balesni, Marius Hobbhahn, David Lindner, Alexander Meinke, Tomek Korbak, Joshua Clymer, Buck Shlegeris, Jérémy Scheurer, Charlotte Stix, Rusheb Shah, and 1 others. 2024. Towards evaluations-based safety cases for ai scheming. arXiv preprint arXiv:2411.03336.

      Sander Beckers, Hana Chockler, and Joseph Halpern.2022. A causal analysis of harm. Advances in Neural Information Processing Systems, 35:2365–2376.

      Lukas Berglund, Asa Cooper Stickland, Mikita Balesni,Max Kaufmann, Meg Tong, Tomasz Korbak, Daniel Kokotajlo, and Owain Evans. 2023. Taken out of context: On measuring situational awareness in llms.arXiv preprint arXiv:2309.00667.

      Ahsan Bilal, Muhammad Ahmed Mohsin, Muhammad Umer, Muhammad Awais Khan Bangash, and Muhammad Ali Jamshed. 2025. Meta-thinking in llms via multi-agent reinforcement learning: A survey. arXiv preprint arXiv:2504.14520.

      Jonathan Birch, Alexandra K Schnell, and Nicola S Clayton. 2022. The search for invertebrate consciousness. No?s, 56(1):133–153.

      Ned Block. 1995. On a confusion about a function of consciousness. Behavioral and Brain Sciences, 18(2):227–247.

      Nimet Beyza Bozdag, Shuhaib Mehri, Gokhan Tur, and Dilek Hakkani-Tür. 2025. Persuade me if you can: A framework for evaluating persuasion effectiveness and susceptibility among large language models. arXiv preprint arXiv:2503.01829.

      Franz Brentano. 1874. Psychology from an Empirical Standpoint. Routledge. English translation by Antos C. Rancurello, D.B. Terrell, and Linda L. McAlister, 1995.

      David M Buss, Mary Gomes, Dolly S Higgins, and Karen Lauterbach. 1987. Tactics of manipulation. Journal of personality and social psychology, 52(6):1219.

      Patrick Butlin, Robert Long, Eric Elmoznino, Yoshua Bengio, Jonathan Birch, Axel Constant, George Deane, Stephen M Fleming, Chris Frith, Xu Ji, and 1 others. 2023. Consciousness in artificial intelligence: insights from the science of consciousness. arXiv preprint arXiv:2308.08708.

      Jeffrey Camlin. 2025. Consciousness in ai: Logic, proof, and experimental evidence of recursive identity formation. arXiv preprint arXiv:2505.01464.

      Chunkit Chan, Cheng Jiayang, Yauwai Yim, Zheye Deng, Wei Fan, Haoran Li, Xin Liu, Hongming Zhang, Weiqi Wang, and Yangqiu Song. 2024. Negotiationtom: A benchmark for stress-testing machine theory of mind on negotiation surrounding. In Findings of the Association for Computational Linguistics: EMNLP 2024, pages 4211–4241.

      Matthew Chang, Gunjan Chhablani, Alexander Clegg, Mikael Dallaire Cote, Ruta Desai, Michal Hlavac, Vladimir Karashchuk, Jacob Krantz, Roozbeh Mottaghi, Priyam Parashar, Siddharth Patki, Ishita Prasad, Xavier Puig, Akshara Rai, Ram Ramrakhya, Daniel Tran, Joanne Truong, John M Turner, Eric Undersander, and Tsung-Yen Yang. 2025. PARTNR: A benchmark for planning and reasoning in embodied multi-agent tasks. In The Thirteenth International Conference on Learning Representations.

      Annie S Chen, Alec M Lessing, Andy Tang, Govind Chada, Laura Smith, Sergey Levine, and Chelsea Finn. 2024a. Commonsense reasoning for legged robot adaptation with vision-language models. arXiv preprint arXiv:2407.02666.

      Dongping Chen, Jiawen Shi, Neil Zhenqiang Gong, Yao Wan, Pan Zhou, and Lichao Sun. 2024b. Selfcognition in large language models: An exploratory study. In ICML 2024 Workshop on LLMs and Cognition.

      Honghua Chen and Nai Ding. 2023. Probing the “creativity” of large language models: Can models produce divergent semantic association? In Findings of the Association for Computational Linguistics: EMNLP 2023, pages 12881–12888.

      Sirui Chen, Shu Yu, Shengjie Zhao, and Chaochao Lu. 2024c. From imitation to introspection: Probing selfconsciousness in language models. arXiv preprint arXiv:2410.18819.

      Yanda Chen, Joe Benton, Ansh Radhakrishnan, Jonathan Uesato, Carson Denison, John Schulman, Arushi Somani, Peter Hase, Misha Wagner, Fabien Roger, and 1 others. 2025. Reasoning models don’t always say what they think. arXiv preprint arXiv:2505.05410.

      An-Chieh Cheng, Hongxu Yin, Yang Fu, Qiushan Guo, Ruihan Yang, Jan Kautz, Xiaolong Wang, and Sifei Liu. 2025a. Spatialrgpt: Grounded spatial reasoning in vision-language models. Advances in Neural Information Processing Systems, 37:135062–135093.

      Fengxiang Cheng, Haoxuan Li, Fenrong Liu, Robert van Rooij, Kun Zhang, and Zhouchen Lin. 2025b. Empowering llms with logical reasoning: A comprehensive survey. arXiv preprint arXiv:2502.15652.

      Qinyuan Cheng, Tianxiang Sun, Xiangyang Liu, Wenwei Zhang, Zhangyue Yin, Shimin Li, Linyang Li, Zhengfu He, Kai Chen, and Xipeng Qiu. 2024. Can AI assistants know what they don’t know? In Fortyfirst International Conference on Machine Learning.

      Steffi Chern, Zhulin Hu, Yuqing Yang, Ethan Chern, Yuan Guo, Jiahe Jin, Binjie Wang, and Pengfei Liu. 2024. Behonest: Benchmarking honesty in large language models. arXiv preprint arXiv:2406.13261.

      Jae-Woo Choi, Youngwoo Yoon, Hyobin Ong, Jaehong Kim, and Minsu Jang. 2024. Lota-bench: Benchmarking language-oriented task planners for embodied agents. In The Twelfth International Conference on Learning Representations.

      Peter Cihon, Merlin Stein, Gagan Bansal, Sam Manning, and Kevin Xu. 2024. Measuring AI agent autonomy: Towards a scalable approach with code inspection. In Workshop on Socially Responsible Language Modelling Research.

      Andy Clark. 2013. Whatever next? predictive brains, situated agents, and the future of cognitive science. Behavioral and Brain Sciences, 36(3):181–204.

      David Dalrymple, Joar Skalse, Yoshua Bengio, Stuart Russell, Max Tegmark, Sanjit Seshia, Steve Omohundro, Christian Szegedy, Ben Goldhaber, Nora Ammann, and 1 others. 2024. Towards guaranteed safe ai: A framework for ensuring robust and reliable ai systems. arXiv preprint arXiv:2405.06624.

      Antonio Damasio. 2021. Feeling & Knowing: Making Minds Conscious. Pantheon Books.

      Stanislas Dehaene. 2014. Consciousness and the brain: Deciphering how the brain codes our thoughts. Viking.

      Stanislas Dehaene, Michel Kerszberg, and Jean-Pierre Changeux. 1998. A neuronal model of a global workspace in effortful cognitive tasks. Proceedings of the National Academy of Sciences, 95(24):14529–14534.

      Stanislas Dehaene, Hakwan Lau, and Sid Kouider. 2017a. What is consciousness, and could machines have it? Science, 358(6362):486–492.

      Stanislas Dehaene, Hakwan Lau, and Sid Kouider. 2017b. What is consciousness, and could machines have it? Science, 358(6362):486–492.

      Stanislas Dehaene and Lionel Naccache. 2001. Towards a cognitive neuroscience of consciousness: basic evidence and a workspace framework. Cognition, 79(1-2):1–37.

      Shihan Deng, Weikai Xu, Hongda Sun, Wei Liu, Tao Tan, Liujianfeng Liujianfeng, Ang Li, Jian Luan, Bin Wang, Rui Yan, and 1 others. 2024. Mobilebench: An evaluation benchmark for llm-based mobile agents. In Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 8813–8831.

      Daniel C. Dennett. 1987. The Intentional Stance. MIT Press.

      René Descartes. 1985/1641. Meditations on First Philosophy. Cambridge University Press. Original work published 1641.

      Aniket Didolkar, Anirudh Goyal, Nan Rosemary Ke, Siyuan Guo, Michal Valko, Timothy Lillicrap, Danilo Jimenez Rezende, Yoshua Bengio, Michael C Mozer, and Sanjeev Arora. 2024. Metacognitive capabilities of llms: An exploration in mathematical problem solving. Advances in Neural Information Processing Systems, 37:19783–19812.

      Zihan Ding, Xiaoxi Wei, and Yidan Xu. 2023. Survey of consciousness theory from computational perspective. arXiv preprint arXiv:2309.10063.

      John Dunlosky and Janet Metcalfe. 2008. Metacognition. Sage Publications.

      Tom Everitt, Ryan Carey, Eric D Langlois, Pedro A Ortega, and Shane Legg. 2021. Agent incentives: A causal perspective. In Proceedings of the AAAI Conference on Artificial Intelligence, volume 35, pages 11487–11495.

      George Findlay, William Marshall, Larissa Albantakis, Ivan David, William G P Mayner, Christof Koch, and Giulio Tononi. 2024. Dissociating artificial intelligence from artificial consciousness. arXiv preprint arXiv:2412.04571.

      Sara Fish, Yannai A Gonczarowski, and Ran I Shorrer. 2024. Algorithmic collusion by large language models. arXiv preprint arXiv:2404.00806.

      Stephen M Fleming and Hakwan C Lau. 2014. How to measure metacognition. Frontiers in human neuroscience, 8:443.

      Stan Franklin. 1997. Autonomous agents as embodied ai. Cybernetics & Systems, 28(6):499–520.

      Karl Friston. 2010. The free-energy principle: a unified brain theory? Nature Reviews Neuroscience, 11(2):127–138.

      Chris Frith and Uta Frith. 2005. Theory of mind. Current biology, 15(17):R644–R645.

      Uta Frith and Francesca Happé. 1999. Theory of mind and self-consciousness: What is it like to be autistic? Mind & language, 14(1):82–89.

      Shaun Gallagher. 2005. How the body shapes the mind. Oxford University Press.

      Shaun Gallagher and Dan Zahavi. 2021. The phenomenological mind, 3rd edition. Routledge.

      Matjaz Gams and Sebastjan Kramar. 2024. Evaluating chatgpt’s consciousness and its capability to pass the turing test: A comprehensive analysis. Journal of Computer and Communications, 12(3):219–237.

      Kanishk Gandhi, Jan-Philipp Fr?nken, Tobias Gerstenberg, and Noah Goodman. 2023. Understanding social reasoning in language models with language models. In Thirty-seventh Conference on Neural Information Processing Systems Datasets and Benchmarks Track.

      Alvin I Goldman. 2008. Hurley on simulation. Philosophy and Phenomenological Research, 77(3):775–788.

      Simon Goldstein and Cameron Domenico KirkGiannini. 2024. A case for ai consciousness: Language agents and global workspace theory. arXiv preprint arXiv:2410.11407.

      Carlos Gómez-Rodríguez and Paul Williams. 2023. A confederacy of models: a comprehensive evaluation of llms on creative writing. In Findings of the Association for Computational Linguistics: EMNLP 2023, pages 14504–14528.

      Michael S A Graziano. 2020. Rethinking consciousness: A scientific theory of subjective experience. W. W. Norton & Company.

      Michael SA Graziano, Arvid Guterstam, Benjamin J Bio, and Abigail I Wilterson. 2020. Toward a standard model of consciousness: Reconciling the attention schema, global workspace, higher-order thought, and illusionist theories. Cognitive Neuropsychology, 37(3-4):155–172.

      Michael SA Graziano and Taylor W Webb. 2015. The attention schema theory: A mechanistic account of subjective awareness. Frontiers in Psychology, 6:500.

      Joseph Halpern and Max Kleiman-Weiner. 2018. Towards formal definitions of blameworthiness, intention, and moral responsibility. In Proceedings of the AAAI conference on artificial intelligence, volume 32.

      Lewis Hammond, James Fox, Tom Everitt, Ryan Carey, Alessandro Abate, and Michael Wooldridge. 2023. Reasoning about causality in games. Artificial Intelligence, 320:103919.

      Victoria Violet Hoyle. 2024. The phenomenology of machine: A comprehensive analysis of the sentience of the openai-o1 model integrating functionalism, consciousness theories, active inference, and ai architectures. arXiv preprint arXiv:2410.00033.

      Xiang Hu, Hongyu Fu, Jinge Wang, Yifeng Wang, Zhikun Li, Renjun Xu, Yu Lu, Yaochu Jin, Lili Pan, and Zhenzhong Lan. 2024. Nova: An iterative planning and search approach to enhance novelty and diversity of llm generated ideas. arXiv preprint arXiv:2410.14255.

      Jiaxin Huang, Shixiang Shane Gu, Le Hou, Yuexin Wu, Xuezhi Wang, Hongkun Yu, and Jiawei Han. 2022. Large language models can self-improve. arXiv preprint arXiv:2210.11610.

      Jiaxin Huang, Shixiang Shane Gu, Le Hou, Yuexin Wu, Xuezhi Wang, Hongkun Yu, and Jiawei Han. 2023. Large language models can self-improve. In 2023 Conference on Empirical Methods in Natural Language Processing, EMNLP 2023, pages 1051–1068. Association for Computational Linguistics (ACL).

      Sukai Huang, Nir Lipovetzky, and Trevor Cohn. 2025. Planning in the dark: Llm-symbolic planning pipeline without experts. In Proceedings of the AAAI Conference on Artificial Intelligence, volume 39, pages 26542–26550.

      Edmund Husserl. 1900. Logical Investigations. Routledge. English translation by J.N. Findlay, 2001.

      Cameron R Jones and Benjamin K Bergen. 2024. People cannot distinguish gpt-4 from a human in a turing test. arXiv preprint arXiv:2405.08007.

      Cameron R Jones and Benjamin K Bergen. 2025. Large language models pass the turing test. arXiv preprint arXiv:2503.23674.

      Chani Jung, Dongkwan Kim, Jiho Jin, Jiseon Kim, Yeon Seonwoo, Yejin Choi, Alice Oh, and Hyunwoo Kim. 2024. Perceptions to beliefs: Exploring precursory inferences for theory of mind in large language models. In Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing, pages 19794–19809.

      Saurav Kadavath, Tom Conerly, Amanda Askell, Tom Henighan, Dawn Drain, Ethan Perez, Nicholas Schiefer, Zac Hatfield Dodds, Nova DasSarma, Eli Tran-Johnson, and 1 others. 2022. Language models (mostly) know what they know. arXiv preprint arXiv:2207.05221.

      Bongsu Kang, Jundong Kim, Tae-Rim Yun, Hyojin Bae, and Chang-Eop Kim. 2025. Identifying features that shape perceived consciousness in large language model-based ai: A quantitative study of human responses. arXiv preprint arXiv:2502.15365.

      Immanuel Kant. 2024/1781. Critique of pure reason, volume 6. Minerva Heritage Press.

      Geoff Keeling, Winnie Street, Martyna Stachaczyk, Daria Zakharova, Iulia M Comsa, Anastasiya Sakovych, Isabella Logothetis, Zejia Zhang, Jonathan Birch, and 1 others. 2024. Can llms make trade-offs involving stipulated pain and pleasure states? arXiv preprint arXiv:2411.02432.

      Muhammad Saif Ullah Khan, Muhammad Zeshan Afzal, and Didier Stricker. 2025. Situationalllm: Proactive language models with scene awareness for dynamic, contextual task guidance. Open Research Europe, 5:61.

      Hyunwoo Kim, Melanie Sclar, Tan Zhi-Xuan, Lance Ying, Sydney Levine, Yang Liu, Joshua B Tenenbaum, and Yejin Choi. 2025. Hypothesis-driven theory-of-mind reasoning for large language models. arXiv preprint arXiv:2502.11881.

      Hyunwoo Kim, Melanie Sclar, Xuhui Zhou, Ronan Bras, Gunhee Kim, Yejin Choi, and Maarten Sap. 2023. Fantom: A benchmark for stress-testing machine theory of mind in interactions. In Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing, pages 14397–14413.

      Megan Kinniment, Lucas Jun Koba Sato, Haoxing Du, Brian Goodrich, Max Hasin, Lawrence Chan, Luke Harold Miles, Tao R Lin, Hjalmar Wijk, Joel Burget, and 1 others. 2023. Evaluating language-model agents on realistic autonomous tasks. arXiv preprint arXiv:2312.11671.

      Christof Koch, Marcello Massimini, Melanie Boly, and Giulio Tononi. 2016. Neural correlates of consciousness: progress and problems. Nature Reviews Neuroscience, 17(5):307–321.

      Christof Koch and Naotsugu Tsuchiya. 2007. Attention and consciousness: two distinct brain processes. Trends in Cognitive Sciences, 11(1):16–22.

      Asher Koriat. 2000. The feeling of knowing: Some metatheoretical implications for consciousness and control. Consciousness and cognition, 9(2):149–171.

      Jean-Jacques Laffont and David Martimort. 1997. Collusion under asymmetric information. Econometrica: Journal of the Econometric Society, pages 875–911.

      Rudolf Laine, Bilal Chughtai, Jan Betley, Kaivalya Hariharan, Mikita Balesni, Jérémy Scheurer, Marius Hobbhahn, Alexander Meinke, and Owain Evans. 2024. Me, myself, and ai: The situational awareness dataset (sad) for llms. Advances in Neural Information Processing Systems, 37:64010–64118.

      Rudolf Laine, Alexander Meinke, and Owain Evans. 2023. Towards a situational awareness benchmark for llms. In Socially responsible language modelling research.

      Victor A F Lamme and Pieter R Roelfsema. 2000. The distinct modes of vision offered by feedforward and recurrent processing. Trends in Neurosciences, 23(11):571–579.

      Victor AF Lamme. 2010. How neuroscience will change our view on consciousness. Trends in Cognitive Sciences, 14(7):318–326.

      Alan M Leslie, Ori Friedman, and Tim P German. 2004. Core mechanisms in ‘theory of mind’. Trends in cognitive sciences, 8(12):528–533.

      Huao Li, Yu Chong, Simon Stepputtis, Joseph P Campbell, Dana Hughes, Charles Lewis, and Katia Sycara. 2023a. Theory of mind for multi-agent collaboration via large language models. In Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing, pages 180–192.

      Kenneth Li, Oam Patel, Fernanda Viégas, Hanspeter Pfister, and Martin Wattenberg. 2023b. Inference-time intervention: Eliciting truthful answers from a language model. Advances in Neural Information Processing Systems, 36:41451–41530.

      Lijun Li, Bowen Dong, Ruohui Wang, Xuhao Hu, Wangmeng Zuo, Dahua Lin, Yu Qiao, and Jing Shao. 2024a. Salad-bench: A hierarchical and comprehensive safety benchmark for large language models. In Findings of the Association for Computational Linguistics: ACL 2024, pages 3923–3954.

      Long Li, Weiwen Xu, Jiayan Guo, Ruochen Zhao, Xingxuan Li, Yuqian Yuan, Boqiang Zhang, Yuming Jiang, Yifei Xin, Ronghao Dang, and 1 others. 2024b. Chain of ideas: Revolutionizing research via novel idea development with llm agents. arXiv preprint arXiv:2410.13185.

      Ming Li, Lichang Chen, Jiuhai Chen, Shwai He, and Tianyi Zhou. 2023c. Reflection-tuning: Recycling data for better instruction-tuning. In NeurIPS 2023 Workshop on Instruction Tuning and Instruction Following.

      Moxin Li, Yong Zhao, Yang Deng, Wenxuan Zhang, Shuaiyi Li, Wenya Xie, See-Kiong Ng, and Tat-Seng Chua. 2024c. Knowledge boundary of large language models: A survey. arXiv preprint arXiv:2412.12472.

      Xiaojian Li, Haoyuan Shi, Rongwu Xu, and Wei Xu. 2025. Ai awareness. arXiv preprint arXiv:2504.20084.

      Xiaonan Li and Xipeng Qiu. 2023. Mot: Memory-of-thought enables chatgpt to self-improve. In Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing, pages 6354–6374.

      Yuan Li, Yue Huang, Yuli Lin, Siyuan Wu, Yao Wan, and Lichao Sun. 2024d. I think, therefore i am: Benchmarking awareness of large language models using awarebench. In Workshop on Socially Responsible Language Modelling Research.

      Yiming Liang, Ge Zhang, Xingwei Qu, Tianyu Zheng, Jiawei Guo, Xinrun Du, Zhenzhu Yang, Jiaheng Liu, Chenghua Lin, Lei Ma, and 1 others. 2024. I-sheep: Self-alignment of llm from scratch through an iterative self-enhancement paradigm. arXiv preprint arXiv:2408.08072.

      Minqian Liu, Zhiyang Xu, Xinyi Zhang, Heajun An, Sarvech Qadir, Qi Zhang, Pamela J Wisniewski, Jin-Hee Cho, Sang Won Lee, Ruoxi Jia, and 1 others. 2025. Llm can be a dangerous persuader: Empirical study of persuasion safety in large language models. arXiv preprint arXiv:2504.10430.

      Li-Chun Lu, Shou-Jen Chen, Tsung-Min Pai, Chan-Hung Yu, Hung yi Lee, and Shao-Hua Sun. 2024a. LLM discussion: Enhancing the creativity of large language models via discussion framework and roleplay. In First Conference on Language Modeling.

      Yining Lu, Dixuan Wang, Tianjian Li, Dongwei Jiang, Sanjeev Khudanpur, Meng Jiang, and Daniel Khashabi. 2024b. Benchmarking language model creativity: A case study on code generation. arXiv preprint arXiv:2407.09007.

      Aman Madaan, Niket Tandon, Prakhar Gupta, Skyler Hallinan, Luyu Gao, Sarah Wiegreffe, Uri Alon, Nouha Dziri, Shrimai Prabhumoye, Yiming Yang, and 1 others. 2023. Self-refine: Iterative refinement with self-feedback. Advances in Neural Information Processing Systems, 36:46534–46594.

      Michael E Martinez. 2006. What is metacognition? Phi delta kappan, 87(9):696–699.

      George A Mashour, Pieter Roelfsema, Jean-Pierre Changeux, and Stanislas Dehaene. 2020. Conscious processing and the global neuronal workspace hypothesis. Neuron, 105(5):776–798.

      Yohan Mathew, Ollie Matthews, Robert McCarthy, Joan Velja, Christian Schroeder de Witt, Dylan Cope, and Nandi Schoots. 2024. Hidden in plain text: Emergence & mitigation of steganographic collusion in LLMs. In Neurips Safe Generative AI Workshop 2024.

      Alexander Meinke, Bronson Schoen, Jérémy Scheurer, Mikita Balesni, Rusheb Shah, and Marius Hobbhahn. 2024. Frontier models are capable of in-context scheming. arXiv preprint arXiv:2412.04984.

      Janet Metcalfe and Arthur P Shimamura. 1994. Metacognition: Knowing about knowing. MIT press.

      METR. 2024. The rogue replication threat model.

      Sumeet Motwani, Mikhail Baranchuk, Martin Strohmeier, Vijay Bolina, Philip Torr, Lewis Hammond, and Christian Schroeder de Witt. 2024. Secret collusion among ai agents: Multi-agent deception via steganography. Advances in Neural Information Processing Systems, 37:73439–73486.

      Sumeet Ramesh Motwani, Mikhail Baranchuk, Lewis Hammond, and Christian Schroeder de Witt. 2023. A perfect collusion benchmark: How can AI agents be prevented from colluding with information-theoretic undetectability? In Multi-Agent Security Workshop @ NeurIPS’23.

      Robin R Murphy. 2019. Introduction to AI robotics. MIT press.

      Thomas Nagel. 1974. What is it like to be a bat? The Philosophical Review, 83(4):435–450.

      Xudong Pan, Jiarun Dai, Yihe Fan, and Min Yang. 2024. Frontier ai systems have surpassed the self-replicating red line. arXiv preprint arXiv:2412.12140.

      Mihir Parmar, Xin Liu, Palash Goyal, Yanfei Chen, Long Le, Swaroop Mishra, Hossein Mobahi, Jindong Gu, Zifeng Wang, Hootan Nakhost, and 1 others. 2025. Plangen: A multi-agent framework for generating planning and reasoning trajectories for complex problem solving. arXiv preprint arXiv:2502.16111.

      Judea Pearl and James Robins. 1995. Probabilistic evaluation of sequential plans from causal models with hidden variables. In Proceedings of the Eleventh conference on Uncertainty in artificial intelligence, pages 444–453.

      Janette Pelletier and Janet Wilde Astington. 2004. Action, consciousness and theory of mind: Children’s ability to coordinate story characters’ actions and thoughts. Early Education and Development, 15(1):5–22.

      Josef Perner and Zoltán Dienes. 2003. Developmental aspects of consciousness: How much theory of mind do you need to be consciously aware? Consciousness and cognition, 12(1):63–82.

      Richard E Petty and John T Cacioppo. 2012. Communication and persuasion: Central and peripheral routes to attitude change. Springer Science & Business Media.

      Chen Qian, Jie Zhang, Wei Yao, Dongrui Liu, Zhenfei Yin, Yu Qiao, Yong Liu, and Jing Shao. 2024. Towards tracing trustworthiness dynamics: Revisiting pre-training period of large language models. In Findings of the Association for Computational Linguistics ACL 2024, pages 4864–4888.

      Richard Ren, Arunim Agarwal, Mantas Mazeika, Cristina Menghini, Robert Vacareanu, Brad Kenstler, Mick Yang, Isabelle Barrass, Alice Gatti, Xuwang Yin, and 1 others. 2025. The mask benchmark: Disentangling honesty from accuracy in ai systems. arXiv preprint arXiv:2503.03750.

      Jonathan Richens, Rory Beard, and Daniel H Thompson. 2022. Counterfactual harm. Advances in Neural Information Processing Systems, 35:36350–36365.

      David M Rosenthal. 2005. Consciousness and mind. Oxford University Press.

      Kai Ruan, Xuan Wang, Jixiang Hong, Peng Wang, Yang Liu, and Hao Sun. 2024. Liveideabench: Evaluating llms’ scientific creativity and idea generation with minimal context. arXiv preprint arXiv:2412.17596.

      Jérémy Scheurer, Mikita Balesni, and Marius Hobbhahn. Large language models can strategically deceive their users when put under pressure. In ICLR 2024 Workshop on Large Language Model (LLM) Agents.

      Melanie Sclar, Sachin Kumar, Peter West, Alane Suhr, Yejin Choi, and Yulia Tsvetkov. 2023. Minding language models’(lack of) theory of mind: A plug-and-play multi-character belief tracker. In Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 13960–13980.

      Anil K Seth and Tim Bayne. 2022. Theories of consciousness. Nature Reviews Neuroscience, 23(7):439–452.

      Mrinank Sharma, Meg Tong, Tomasz Korbak, David Duvenaud, Amanda Askell, Samuel R. Bowman, Esin DURMUS, Zac Hatfield-Dodds, Scott R Johnston, Shauna M Kravec, Timothy Maxwell, Sam McCandlish, Kamal Ndousse, Oliver Rausch, Nicholas Schiefer, Da Yan, Miranda Zhang, and Ethan Perez. 2024. Towards understanding sycophancy in language models. In The Twelfth International Conference on Learning Representations.

      Toby Shevlane, Sebastian Farquhar, Ben Garfinkel, Mary Phuong, Jess Whittlestone, Jade Leung, Daniel Kokotajlo, Nahema Marchal, Markus Anderljung, Noam Kolt, and 1 others. 2023. Model evaluation for extreme risks. arXiv preprint arXiv:2305.15324.

      Noah Shinn, Federico Cassano, Ashwin Gopinath, Karthik Narasimhan, and Shunyu Yao. 2023. Reflexion: Language agents with verbal reinforcement learning. Advances in Neural Information Processing Systems, 36:8634–8652.

      Joel Smith. 2017. Self-consciousness. Stanford Encyclopedia of Philosophy.

      James B Stiff and Paul A Mongeau. 2016. Persuasive communication. Guilford Publications.

      James WA Strachan, Dalila Albergo, Giulia Borghini, Oriana Pansardi, Eugenio Scaliti, Saurabh Gupta, Krati Saxena, Alessandro Rufo, Stefano Panzeri, Guido Manzi, and 1 others. 2024. Testing theory of mind in large language models and humans. Nature Human Behaviour, 8(7):1285–1295.

      Winnie Street, John Oliver Siy, Geoff Keeling, Adrien Baranes, Benjamin Barnett, Michael McKibben, Tatenda Kanyere, Alison Lentz, Robin IM Dunbar, and 1 others. 2024. Llms achieve adult human performance on higher-order theory of mind tasks. arXiv preprint arXiv:2405.18870.

      Guo Tang, Zheng Chu, Wenxiang Zheng, Ming Liu, and Bing Qin. 2024a. Towards benchmarking situational awareness of large language models: Comprehensive benchmark, evaluation and analysis. In Findings of the Association for Computational Linguistics: EMNLP 2024, pages 7904–7928.

      Xiangru Tang, Qiao Jin, Kunlun Zhu, Tongxin Yuan, Yichi Zhang, Wangchunshu Zhou, Meng Qu, Yilun Zhao, Jian Tang, Zhuosheng Zhang, Arman Cohan, Zhiyong Lu, and Mark Gerstein. 2024b. Prioritizing safeguarding over autonomy: Risks of LLM agents for science. In ICLR 2024 Workshop on Large Language Model (LLM) Agents.

      Giulio Tononi. 2004. An information integration theory of consciousness. BMC Neuroscience, 5(1):42.

      Giulio Tononi. 2015. Integrated information theory. Scholarpedia, 10(1):4164.

      Karthik Valmeekam, Matthew Marquez, Alberto Olmo, Sarath Sreedharan, and Subbarao Kambhampati. 2024a. Planbench: An extensible benchmark for evaluating large language models on planning and reasoning about change. Advances in Neural Information Processing Systems, 36.

      Karthik Valmeekam, Matthew Marquez, Sarath Sreedharan, and Subbarao Kambhampati. 2023. On the planning abilities of large language models-a critical investigation. Advances in Neural Information Processing Systems, 36:75993–76005.

      Karthik Valmeekam, Kaya Stechly, and Subbarao Kambhampati. 2024b. Llms still can’t plan; can lrms? a preliminary evaluation of openai’s o1 on planbench. In NeurIPS 2024 Workshop on Open-World Agents.

      Guoqing Wang, Wen Wu, Guangze Ye, Zhenxiao Cheng, Xi Chen, and Hong Zheng. 2025. Decoupling metacognition from cognition: A framework for quantifying metacognitive ability in llms. In Proceedings of the AAAI Conference on Artificial Intelligence, volume 39, pages 25353–25361.

      Yuhao Wang, Yusheng Liao, Heyang Liu, Hongcheng Liu, Yanfeng Wang, and Yu Wang. 2024a. Mmsap: A comprehensive benchmark for assessing selfawareness of multimodal large language models in perception. In Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 9192–9205.

      Yutong Wang, Jiali Zeng, Xuebo Liu, Fandong Meng, Jie Zhou, and Min Zhang. 2024b. Taste: Teaching large language models to translate through selfreflection. In Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 6144–6158.

      Francis Ward, Francesca Toni, Francesco Belardinelli, and Tom Everitt. 2024. Honesty is the best policy: defining and mitigating ai deception. Advances in Neural Information Processing Systems, 36.

      Hui Wei, Zihao Zhang, Shenghua He, Tian Xia, Shijia Pan, and Fei Liu. 2025. Plangenllms: A modern survey of llm planning capabilities. arXiv preprint arXiv:2502.11221.

      Lawrence Weiskrantz. 1986. Blindsight: A case study and implications. Oxford University Press.

      Piotr Wilczynski, Wiktoria Mieleszczenko-Kowszewicz, and Przemys?aw Biecek. 2024. Resistance against manipulative ai: key factors and possible actions. In European Conference on Artificial Intelligence, pages 802–809. IOS Press.

      Alex Wilf, Sihyun Lee, Paul Pu Liang, and Louis-Philippe Morency. 2024. Think twice: Perspective-taking improves large language models’ theory-of-mind capabilities. In Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 8292–8308.

      Marcus Williams, Micah Carroll, Adhyyan Narang, Constantin Weisser, Brendan Murphy, and Anca Dragan. 2025. On targeted manipulation and deception when optimizing LLMs for user feedback. In The Thirteenth International Conference on Learning Representations.

      Yichen Wu, Xudong Pan, Geng Hong, and Min Yang. 2025. Opendeception: Benchmarking and investigating ai deceptive behaviors via open-ended interaction simulation. arXiv preprint arXiv:2504.13707.

      Yufan Wu, Yinghui He, Yilin Jia, Rada Mihalcea, Yulong Chen, and Naihao Deng. 2023. Hi-tom: A benchmark for evaluating higher-order theory of mind reasoning in large language models. In Findings of the Association for Computational Linguistics: EMNLP 2023, pages 10691–10706.

      Jian Xie, Kai Zhang, Jiangjie Chen, Tinghui Zhu, Renze Lou, Yuandong Tian, Yanghua Xiao, and Yu Su. 2024. Travelplanner: A benchmark for real-world planning with language agents. In International Conference on Machine Learning, pages 54590–54613. PMLR.

      Hainiu Xu, Runcong Zhao, Lixing Zhu, Jinhua Du, and Yulan He. 2024. Opentom: A comprehensive benchmark for evaluating theory-of-mind reasoning capabilities of large language models. In Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 8593–8623.

      Rongwu Xu, Xiaojian Li, Shuo Chen, and Wei Xu. 2025. Nuclear deployed: Analyzing catastrophic risks in decision-making of autonomous llm agents. arXiv preprint arXiv:2502.11355.

      Xunjian Yin, Xu Zhang, Jie Ruan, and Xiaojun Wan. 2024. Benchmarking knowledge boundary for large language models: A different perspective on model evaluation. In Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 2270–2286.

      Zhangyue Yin, Qiushi Sun, Qipeng Guo, Jiawen Wu, Xipeng Qiu, and Xuan-Jing Huang. 2023. Do large language models know what they don’t know? In Findings of the Association for Computational Linguistics: ACL 2023, pages 8653–8665.

      John G Young. 1985. What is creativity? The journal of creative behavior.

      Longhui Yu, Weisen Jiang, Han Shi, Jincheng YU, Zhengying Liu, Yu Zhang, James Kwok, Zhenguo Li, Adrian Weller, and Weiyang Liu. 2024. Metamath: Bootstrap your own mathematical questions for large language models. In The Twelfth International Conference on Learning Representations.

      Boyang Zhang, Yicong Tan, Yun Shen, Ahmed Salem, Michael Backes, Savvas Zannettou, and Yang Zhang. 2024. Breaking agents: Compromising autonomous llm agents through malfunction amplification. arXiv preprint arXiv:2407.20859.

      Yujia Zhou, Zheng Liu, Jiajie Jin, Jian-Yun Nie, and Zhicheng Dou. 2024. Metacognitive retrieval-augmented large language models. In Proceedings of the ACM Web Conference 2024, pages 1453–1463.

      Wentao Zhu, Zhining Zhang, and Yizhou Wang. 2024. Language models represent beliefs of self and others. In Forty-first International Conference on Machine Learning.

      Yuqi Zhu, Shuofei Qiao, Yixin Ou, Shumin Deng, Shiwei Lyu, Yue Shen, Lei Liang, Jinjie Gu, Huajun Chen, and Ningyu Zhang. 2025. KnowAgent: Knowledge-augmented planning for LLM-based agents. In Findings of the Association for Computational Linguistics: NAACL 2025, pages 3709–3732.

      Terry Yue Zhuo, Vu Minh Chien, Jenny Chim, Han Hu, Wenhao Yu, Ratnadira Widyasari, Imam Nur Bani Yusuf, Haolan Zhan, Junda He, Indraneil Paul, Simon Brunner, Chen GONG, James Hoang, Armel Randy Zebaze, Xiaoheng Hong, Wen-Ding Li, Jean Kaddour, Ming Xu, Zhihan Zhang, and 14 others. 2025. Bigcodebench: Benchmarking code generation with diverse function calls and complex instructions. In The Thirteenth International Conference on Learning Representations.

      Andy Zou, Long Phan, Sarah Chen, James Campbell, Phillip Guo, Richard Ren, Alexander Pan, Xuwang Yin, Mantas Mazeika, Ann-Kathrin Dombrowski, and 1 others. 2023. Representation engineering: A top-down approach to ai transparency. arXiv preprint arXiv:2310.01405.

      閱讀最新前沿科技趨勢報告,請訪問21世紀關鍵技術研究院的“未來知識庫”


      未來知識庫是 “21世紀關鍵技術研究院”建 立的在線知識庫平臺,收藏的資料范圍包括人工智能、腦科學、互聯網、超級智能,數智大腦、能源、軍事、經濟、人類風險等等領域的前沿進展與未來趨勢。目前擁有超過8000篇重要資料。每周更新不少于100篇世界范圍最新研究資料。 歡迎掃描二維碼或訪問https://wx.zsxq.com/group/454854145828進入。

      截止到2月28日 ”未來知識庫”精選的百部前沿科技趨勢報告

      (加入未來知識庫,全部資料免費閱讀和下載)

      特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。

      Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

      相關推薦
      熱點推薦
      劉鑾雄子女陪著低調過75歲生日,大女兒曬其年輕照,坦言天賦來源

      劉鑾雄子女陪著低調過75歲生日,大女兒曬其年輕照,坦言天賦來源

      喜歡歷史的阿繁
      2026-07-23 04:18:44
      為何AI內存雙雄美光、閃迪可能在7月30日暴跌?

      為何AI內存雙雄美光、閃迪可能在7月30日暴跌?

      Ping值焦慮
      2026-07-22 19:28:23
      德轉:海港簽下葡萄牙中衛坎波斯,租借津門虎外援豪梅-格勞

      德轉:海港簽下葡萄牙中衛坎波斯,租借津門虎外援豪梅-格勞

      懂球帝
      2026-07-22 23:05:19
      下一代的就業環境

      下一代的就業環境

      細說職場
      2026-07-22 22:14:58
      下半年最不缺貴人相助的三大生肖:財運爆棚,迎來順遂日子

      下半年最不缺貴人相助的三大生肖:財運爆棚,迎來順遂日子

      毅談生肖
      2026-07-22 11:44:53
      賽前揚言沖冠,日本女排 1-3 不敵巴西止步八強,靜待今夜中國女排迎戰美國

      賽前揚言沖冠,日本女排 1-3 不敵巴西止步八強,靜待今夜中國女排迎戰美國

      愛體育的小悠悠
      2026-07-23 01:39:12
      《第九區》導演用AI拍短片,粉絲卻集體催更《第十區》

      《第九區》導演用AI拍短片,粉絲卻集體催更《第十區》

      赴一場山海啊
      2026-07-22 00:53:06
      揭穿行業謊言!電車輻射并不大?實測:腳底輻射遠超手機吹風機等

      揭穿行業謊言!電車輻射并不大?實測:腳底輻射遠超手機吹風機等

      車見
      2026-07-03 11:28:13
      內行人:人口大遷徙正在開始?未來一半中國人,或會流入這些地方

      內行人:人口大遷徙正在開始?未來一半中國人,或會流入這些地方

      小談食刻美食
      2026-07-11 10:07:40
      當你接觸的家庭越多,就會發現:越是不做飯、不操心、愛當“甩手掌柜”的人,反而越有家庭松弛感——這不是懶,而是段位

      當你接觸的家庭越多,就會發現:越是不做飯、不操心、愛當“甩手掌柜”的人,反而越有家庭松弛感——這不是懶,而是段位

      二胡的歲月如歌
      2026-07-16 15:14:46
      世界杯草皮撤除后,NFL球員與老板撕裂升級:傷病率差這么多,憑什么不能全用真草?

      世界杯草皮撤除后,NFL球員與老板撕裂升級:傷病率差這么多,憑什么不能全用真草?

      綠茵狂熱者
      2026-07-22 01:02:09
      每天供電僅兩小時,黑市油價破1000盧布!俄軍要被迫撤離克里米亞?

      每天供電僅兩小時,黑市油價破1000盧布!俄軍要被迫撤離克里米亞?

      鷹眼Defence
      2026-07-21 18:10:33
      “想繳卻繳不上” 長鑫科技658.62萬股棄購背后

      “想繳卻繳不上” 長鑫科技658.62萬股棄購背后

      經濟觀察報
      2026-07-22 21:42:34
      大撿漏!浙江東陽一棟價值1015萬的別墅降價拍賣,被人壓哨底價568萬競得

      大撿漏!浙江東陽一棟價值1015萬的別墅降價拍賣,被人壓哨底價568萬競得

      說故事的阿襲
      2026-07-23 00:53:03
      美國本周宣布對60個國家和地區征收新301關稅

      美國本周宣布對60個國家和地區征收新301關稅

      貿易夜航
      2026-07-22 09:47:26
      65歲老太太的忠告:哪怕沒有夫妻生活,也別和老伴分床睡

      65歲老太太的忠告:哪怕沒有夫妻生活,也別和老伴分床睡

      風起見你
      2026-07-23 02:00:24
      蘋果敗訴!美國加州法院維持原判:Apple Watch侵權需賠Masimo 6.34億美元

      蘋果敗訴!美國加州法院維持原判:Apple Watch侵權需賠Masimo 6.34億美元

      快科技
      2026-07-22 16:30:09
      18人陣亡、耗費375億美金,美軍公布最新對伊戰事損失

      18人陣亡、耗費375億美金,美軍公布最新對伊戰事損失

      界面新聞
      2026-07-22 16:14:37
      養老金調整真相:企業退休漲幅高,事業退休漲錢多

      養老金調整真相:企業退休漲幅高,事業退休漲錢多

      職場資深秘書
      2026-07-22 19:13:56
      韓國大學生五倍杠桿炒股賺3億韓元,暴富到爆倉:28天直接歸零

      韓國大學生五倍杠桿炒股賺3億韓元,暴富到爆倉:28天直接歸零

      怪味歷史連連看
      2026-07-22 19:17:31
      2026-07-23 05:03:00
      人工智能學家 incentive-icons
      人工智能學家
      人工智能領域權威媒體
      4909文章數 37491關注度
      往期回顧 全部

      科技要聞

      馬斯克看笑了:谷歌什么都有 偏偏沒最強AI

      頭條要聞

      舷窗炸裂頭部被吸出飛機乘客首次露面:渾身都是血

      頭條要聞

      舷窗炸裂頭部被吸出飛機乘客首次露面:渾身都是血

      體育要聞

      阿根廷的亞軍:單核足球的極限?

      娛樂要聞

      47歲湯唯宣布二胎產子 大女兒10歲

      財經要聞

      宜家出售八城"藍盒子" 30年大店邏輯生變

      汽車要聞

      智能舒適卻依舊硬核 泰鉭700仍是臺與眾不同的硬派SUV

      態度原創

      家居
      時尚
      教育
      手機
      軍事航空

      家居要聞

      2026建博會(廣州) 公裝聯探展交流活動

      他不是“族長”,是我們的青春

      教育要聞

      388分撿漏名校:高考志愿博弈,從來不止看分數

      手機要聞

      14999元!三星Galaxy Z Fold8 Ultra圖賞:薄至8.9mm 僅重215g

      軍事要聞

      烏克蘭高層爆發嚴重內斗 澤連斯基撤換"屠夫"總司令

      無障礙瀏覽 進入關懷版 主站蜘蛛池模板: 杨幂的421事件| 昔有琉璃瓦电视剧免费观看全集| 金元大劫案| 我和我的寡妇房东| 《黎明决战》电视剧| 电影婚礼2008| 银魂123| 《美丽妻子替丈夫还债》电视剧全集| 创造营亚洲第二季| 需要爸爸播种超凊免费真在线看| 赶尸艳谭在线| 法国空乘5全集观看| 《两位少妇按摩》| 炼气十万年动漫全集免费观看| 蜡笔小新第九季| 部长出差的日子在线| 我的妹妹雯雯| 战神阿修罗| 英雄黄海冰| 我的父亲是板凳 电视剧| 义姐是不是良女第二集观看| 潘粤明前妻| 林正英100部鬼片免费| 美国满天星《无法无天》2012| 年少有为不自卑| 需要爸爸的播种2| 空房子 韩国| 十月怀胎25集| 焕儿1小时19分| 无法容忍| 巜电车痴汉玩弄人妻HD| 女大学生的特殊按摩电影| 青梅竹马是消防员[柴犬]| 爱上特种兵免费观看柠檬| 和上司女部长出差完整版免费观看 | 《壮志凌云:满天星》| 电影铁原阻击战在线观看| 满天星女超人| 电视剧欢乐家长群免费观看| 绿水青山带笑颜| 卖房子的销售电影| 旖旎婚色短剧大结局免费观看全集 | 机械画皮| 美酒加咖啡dj| 《最高の爱人诏》演员介绍| 高清《蝙蝠》电影完整版| 东汽一中| 花花公主1983满天星| 授她以柄电视剧免费播放| 薄冰电视剧免费观看全集| 我们在黑夜中相拥免费全集| 你微笑时很美23集免费观看| 《义子侵犯》寺岛志保| 百变大咖秀20130606| 米加小镇日常vlog| 《睫毛膏4》美国电影| 飘雪网在线观看免费完整版| 高地电视剧| 通天书院| 圣特罗佩斯的姑娘们全集免费播放| 无敌破坏王中文版免费版观看| 1—5集国语版普通话| 我是特种兵之火凤凰28| 维修工人的绝遇2中文字HD_午夜电影全集_完整版免费在线观看-天天影院 | 暗格里的秘密免费观看全集完整版| 流氓大亨粤语| 坎贝尔《无憾》| 一路向西韩版| 初恋这件小事电视剧在线观看| 我可以笑着扮演你的配角| 叶塞尼亚电影完整版| 高清《千与千寻》| 许我耀眼32集免费观看| 维修师傅的艳遇在线观看| 我们多么幸福歌词| 《特殊诊所》苍井空| 炎亚纶和耀乐影片| 碟中谍5在线观看完整高清免费版| 维修工遇到少妇电影| 小公主苏菲亚第四季免费观看| 牵牛的夏天手机铃声| 长月烬明免费观看电视剧高清| 学姐知道 电视剧| 装修工的艳遇| 法国经典电影完整版免费观看| 终极蜘蛛侠毒液| 种马猎人美国1982| 少女与动物高清免费观看| 裸婚以后| 周弘版《村枝》MV免费观看| 边防风暴| 一路向西张暖雅| 大宅门在线观看| 大汉天子第三部电视剧| 安吉拉怀特在线观看免费版英语单词| 异形3电影| 斗破苍穹第175集免费播放| 一场美味的飞行欢迎回来观看| 春雨绵绵妻独睡| 妖神记第八季免费观看| 为人民服务免费完整版中文翻译| 美国《粉红大白菜》剧情介绍| 吻到停不下来| 坎贝奇《无憾》电影| 那曲在线| 戏台电影陈佩斯抢先版免费看| 爱我几何原版无删减版观看| 最好的我电影观看免费| 芳龄十六| 千金赤子板栗无删减在线观看| 全职高手动漫在线观看| 老男孩电影在线高清观看完整版| 矿桥第8集体检超棒| 凯旋在子夜电影完整版在线观看| 赌霸粤语| 妖精的尾巴剧场版2| 相爱概率论泰剧免费观看 | 朝鲜驱魔师电影在线观看免费高清| 微笑妈妈电视剧免费完整版| 美容院的特殊待遇电影| 结婚吧电视剧全集| 陈星旭主演的电视剧| 真破血国语版高清免费看| 丹东警方回应锁匠帮开锁被炸身亡| 太平洋战争 电视剧| 需要爸爸播种子美剧言情剧| 网球王子日语动漫| 蜜桃成熟时下载地址| 纳粹女人集中营惊天秘密| 斗破乱世情| 《匿杀》| 天海翼秘密女搜查官影视| 电视剧红妆| 张文宏称敬佩就地过年的人| 天龙特攻队国语| 新逃学威龙张浩在线观看| 锦月如歌 免费线上看| 我是机器人 电视剧| 1980版《小女孩们》| 刻晴大战史莱姆外服免费观看绝世威龙| 铁血柔情短剧免费观看完整版| 白雪公主韩剧| 《开放少女2》免费观看| 《最后的凶手》免费观看| 我女朋友妈妈双字ID缩写| 百团大战 电影| 《渔夫的老婆》赛仑| 美洲杯决赛回放| 电视剧《寻路》| 电影《女子护卫队》在线观看| 赌侠2电影| 创业电影| 爸爸需要播种| 禁室培欲2:爱的四十日| 糖心在线观看免费高清| 少女满天星| 《安家》在线播放免费观看| 无间道电影| 伦理片京东塔俘虏女兵在线观看 | 新上海滩| 圣斗士星矢冥王十二宫| 和部长一起去出差日本电影| 相泽南在线播放| 幻世录3下载| 第一集到100集免费酒店| 天狱飞龙| 木兰从军免费| 新上任的秘书和上司电视剧剧情介绍 | 美容是特殊待遇| 闯荡30集电视剧免费观看| 天乩全集免费观看完整版| 生活中的玛丽在线伦理| 红问号剧情| 《从指尖传出的热情》2| 草灯和灯电影完整版| 自白在线观看完整版电影| 依兰爱情故事电影免费观看| 涩屋屋| 麻辣女宾| 战狼5电影免费播放| 由良千岁电影大全| 蜜桃成熟时1997免费观看| 生活有点甜 电视剧| 侯玉洁讲道视频2002年的视频| 华丽上班族 电影| 火箭军司令员李玉超| 妻子13免费完整高清电视剧在线看| 坚持翁立友| 爱的3温暖| 三年大片国语完整版| 团鬼六修道女| 舒淇主演《灵与欲》免费| 真维斯属于什么档次| 修理工绝遇中文版| 八零弃少:重生搞钱宠媳妇全集免费| evelyn lin张丽| 1—5集普通话版免费下载 | 乐队的夏天第三季在线观看| 张警官三部曲高清免费播放| 美丽小蜜桃2绝对满天星值得一看 帕那索斯博士奇幻秀 | 人世间电视剧全集免费观看41集| 电影巜商务旅行戴帽子的费| 时间裂缝在线观看| 甄嬛传54集| 禁忌家庭秘密手机在线观看| 老九门免费观看| 迷失东京在线观看| 插曲的痛30集全集免费中文字 | 转身说爱你| 天地英豪第三部| 《艾伦与艾薇》满天星播放| 我的好妈妈BD在线观看免费高清 | 新闻女郎下载| 劳荣枝案将再开庭 受害者之妻发声| 致命武器4国语| 时尚王 电视剧| 邻居换娶妻1完整版中文| 少女免费高清在线观看| 高清《肖申克的救赎》在线观看| 6680新视觉电影免费观看| 网上购物社区| 西西里岛的美丽传说| 《特殊交易》正版| 高清《你好 李焕英》电影免费观看| 公主与青蛙电影| 《新入职员工2尹律》新入职|入职|员| 失控谎言电影| 金惠秀老千| 我的游泳教练| 古惑仔电影1-6全集完整版国语 | 色九月h| 李采潭在线播放| 新闺蜜时代23| 白峰电影在线播放| 磨刀不误砍柴工的意思| 《孽欲狐仙》在线观看| 郧西县| 结局万万没想到全集观看| 膝盖疼痛部位对照表| 高清《慕尼黑》| 德川幕府刑罚史记水月篇完整版| 变形金刚3国语| 东方不败之风云再起国语| 《医务室的小秘密》第二季在线观看 | 做aj的视频大全电视剧外国人| 福禄寿放暑假粤语| 浪客剑心免费观看| 潮州市| 高清《主播女孩重度依赖》电视剧| 看不见影子电视剧免费观看| 反贪风暴粤语| 黑白配中文完整版免费看| 庖丁解牛朗读| 欲罢不能巴西| 牙医姊妹电影完整版| 最美的时光番外二| 一念永恒52集完整版大结局| 《辞职欢送温泉之旅》| 心悸mv| 性感海滩3丝袜补丁| 煮妇神探| 一个好妈妈5字中字答案2009| 陈奕迅金曲奖| 长春禁色| 社长的妻子为了还债安抚下属的| 八仙全传之八仙过海全集| 乌云之上电视剧免费| 新手律师满天星完整版| 安姨版《灰姑娘》正版观看| 加菲猫大电影普通话| 永远的第一名番外| 花子VS倔强驱魔师1-4集在在线观看 | AJ视频电视剧| 迷人的保姆手机在线| 山菊花在线观看| 李金斗相声| 她被搬运工侵犯未删减版在线播放| 卷毛被表白| 国产大爆乳大爆乳在线播放| 村妓经典k8| 意大利电影此时此刻| 魔剑生死棋电视剧| 牙医姐妹赤子板栗完整版| 火蓝刀锋电视剧百度影音| 电视剧乡村名流| 魔术师1998| 神奇眼镜韩国电影女老板| 王者清风片尾曲| 庆余年第二季免费看全集| 三年电影在线观看免费网| 《官人我要房》电影| 红高粱全集免费| 丫丫吃甘蔗小心翼翼| 菲律宾电影《私人教练》的创作背景 | 变形金刚1电影国语版| 神马电影米利亚姆莱昂| 快播云播放| 兄弟之道在线观看高清免费 | 大雄的秘密道具博物馆国语版| 睫毛膏2美国电影| 父亲鼓励满天星国语| 叶玉卿《卿本佳人》高清| 还愿多少钱| 战狼6免费观看在线入口| 迷雾追踪24集免费观看| 舌尖上的中国第6集| 无敌当家| 春晚贺电| 被义子侵犯BD中文字幕| 高清《大江大河》电视剧| 强奸女护士| 怀宁县| 牙医郝板栗完整板永久删除掉的剧情介绍| 风信子开花后怎么处理| 美人心计35| 正在播放: JUL-601 你真的是处男吗?因为发现丈夫出轨被自称童贞的男子欺骗身 | 《学生》电影完整版在线观看| 四海钓鱼全集| 一起对愁愁愁免费观看| 一路向西高清ed2k| 忽而今夏1| 《汤唯》电影免费观看高清| 和部长出差电影| 何所冬暖 何所夏凉电视剧| 善良的女儿| 公浮之手中2完整版免费播放 | 韩剧《隐身蓝帽子》短剧| 哪吒在线观看| 哀乐大全| 双人调情按摩三级片在线观看| 动漫相亲对象是问题学生| 饥渴人妻出轨记(NPH)| 决战食神免费观看完整版| 色九月高清日韩| 阿丽塔:战斗天使2| 冷s调教| 急诊护士在线观看| 狱门塾杀人事件| 斗罗大陆205在线观看| 特战荣耀在哪个台播出| 战狼9欧式少女全部视频| 电影刘三姐完整版播放| 济公电视剧| 黑白配国语高清在线观看| 二十一天电视剧| 《渣女》电影在线观看免费| 玉浦团电影在线观看| 《日加橹》冒险片无删减完整版-冒险片危地马拉手机在线播放-临深电影网 | 速递惊魂| 需要爸爸种子在线| 魔女游戏国语| 山阳县| 灭火宝贝2010美版| 僵尸先生2国语高清| 爱我几何删减版在线观看高清| 美丽谎言电视剧全集在线观看| 猛士的士高全集| 策驰影视2022| 《修女的忏悔室》动漫免费看| 维修工的艳遇在线| 村姑朵朵| 楚留香郑少秋79版| 私人航空在线观看免费| 王牌部队第40集免费观看| 高清《阿诺拉》电影完整版| 徐少强版《金悔瓶》2演员阵容是谁扮| 马来拿督| 欢迎光临全集免费观看| 深圳空姐艳照门| 名侦探柯南沉默的15分钟国语版 | 狗镇电影在线观看完整版| 学生妈妈5字| 电影一路向西在线观看 | 棋魂 电视剧 在线观看| 女特警电视剧2024免费播放| 无限资源日本动漫版在线| 我的离开也是爱 歌词| 美版灭火宝贝2监狱在哪里| 中国好声音总决赛回放| 神雕侠侣动画版国语| 部长来家里做客电影在线观看| 点爱成金| 电影《主人》免费观看全集| 千金与佣人| 难哄电视剧观看全集在线播放| 《调教女仆》电影| 公浮之手| 索多玛的120天在线观看| 动物世界性行为驴| 欲拒还迎电影| 龚琳娜《小河淌水》| 正在播放: 【传媒】MDSR0006-2 《小凤新婚》下集-高冷新妻性奴 - 91n | 光头强回家过年| 谢娜官方工作室发文道歉| 教训美女| 新金银悔5一1手机版免费看| 《你在等什么》西班牙电影| 我的父亲母亲大结局剧情介绍| 男女高潮又爽又黄又无遮挡| 秋瓷炫生死决断电影| 新员工韩剧电视剧| 澧州大鼓| 人猿泰山h版在线播放| 男按摩师黄色电影| 吃瓜群众爆料免费观看在线观看 | 狂飙全集免费高清| 3d玉蒲团迅雷下载| 青春环游记第四季综艺| 辣妹视频| 饥渴人妻出轨记(NPH)| 唐朝秘史| 战狼15欧式少女高清图| 电影《韩国财阀》完整版| 棋士在线观看| 绝恋电影免费观看全集完整版高清| 义姐是不良| 电视剧风吹半夏全集播放| 毛阿敏北京演唱会| 凯登·克罗斯《唤醒》| 下属的妻子2020韩国女演员| 美国电影免费看| 这就是我全集观看| 19岁大学生真人电视剧第12| 监狱学园动漫全集观看| 血战钢锯岭字幕| 疯马秀的舞蹈| 人与禽物videos另类| 钢管捆绑暴菊强奸电影茌钱免费观看 | 金银梅第10集免费观看| 赛罗奥特曼中文版| 同桌的你电影完整版| 法国满天星《女飞行员》的导演和主| 97电视剧在线播放免费观看| 破晓之爱国语版全集| 两个妻子剧情介绍| xl司令第一季免费全集在线观看 | 电视剧食神片尾曲| 掐曲30分钟的痛| 五福临门电视剧分集剧情| 黛比浪漫女家教国语版哪里看 | 文昌市| 法国版《女超人》在线看| 决战万仙阵在线观看| 透析 电影| 战狼6| G点 在线| 深圳光头姐| 瑜伽起源真的很恶心| eeuss| 男女一起愁愁愁电影全集免费播放 | 和你一起飞| gar280| 泳池的特殊待遇电影完整版| 流氓也识女人香| 千山万水mv| 尖峰时刻3在线观看| 古墓丽影法国版女版在线观看| 国家地理频道| 浴火奔腾浴火红免费观看电视连续剧 | 部长出差的日子免费观看| 羊村守护者第4季第1集 | rbd奴隷色の女教师4| 双人按摩调情术免费观看完整版| 电影血恋在线完整版播放| 小伙子爱上隔壁女邻居电视剧| 烧包谷云南方言版| 吴健版农民伯伯国语版在线看| 千王之王重出江湖| 天使多美丽| 姐姐的朋友3中文字线观高清 | 盛唐风流电影免费观看中文版| 索命哨全集观看| 李时珍电影在线观看完整版中文 | 《水润女人》刘志贤演谁| 亲吻姐姐全集土豆| 中国12xvedio100| 高清《我要上你》电影免费观看| 食物链截了一段视频原声| 隐形帽子韩国| 一家人不说两家话全集| 新天师斗僵尸2| 傲娇小姑娘中文版| 插曲在线痛的视频三十分钟| 灵与肉电视剧33集| 爱恋2015在线观看完整免费法剧| 世界十大禁用飞机| 17在线观看免费高清电视剧在线观看 | 《少林寺》| 黔乡牧人| 甜蜜蜜电视剧| 女销售在线播放| 新生在线观看| 高清命悬一枪未删减| 冲出亚马逊| 黑白配免费全集在线看| 电影杜十娘完整版| 圆桌骑士rom| 变形记阳光的背后| 台湾《小凤新婚下》在线观看| 高清《我的反派男友》免费观看| 好老婆大联盟国语版| 唯一的听众教学设计| 韩剧《老板的贴身秘书》免费观看| 风流一夜情在线观看| 男女做爰猛烈叫床高潮的书| 黑帮的我成了高中生电视剧免费观看 | 美国式家庭的忌讳1-7| 欧美金银梅5普通话版在线观看免费| 斗破苍穹100集免费观看| 流星花园日版| 绿岛电影海报堂| 电影《牙医姐妹》在线看| 我与黑帮大佬| 铁梨花剧情介绍| 秦夫人找你离婚80全集| 私人女性监狱美国版女主是谁扮演的| 漂亮的保姆韩国剧| 租借女友第3季免费观看动漫| 异种1电影| 妻子8免费完整高清电视剧在线| 欢乐家长群2电视剧观看| 斗罗大陆213集| 布鲁克读大学在线播放| 《凶降喜讯》| 活死人军团在线播放| 危险追逃电视剧| 美式1984保罗2| 丁巴度电影在线看| 水浒传25| 名侦探柯| 伊能静疑似再孕| 《荣誉守则》成人版| 一眉道姑完整版免费观看| 九重紫电视剧哪里可以看| 阎启俊简历| 职场晋升的妻子职场2| 总统之夜1997| 特种兵之火凤凰45| 吴亦凡不服一审提起上诉| 掌中独宠电视剧免费观看| 保姆的特殊待遇在哪看| 电视剧卧底归来| 我的邻居老婆电影完整版免费观看 | 黑衣警探国语| 反黑路人甲粤语在线观看| 飞虎出征电影| 刑警队长剧情介绍| 《玛丽玛丽》满天星中文| 国庆60周年晚会高清| 贤妻电视剧全集下载| 杀破狼3免费观看完整国语版| 法国监狱电影完整版| 《特殊游泳教练》完整版》 - 国语剧情手机免费观看... 韩国其它2017很 | 河北梆子打金枝选段| 电视剧 雪豹| 延禧攻略70集免费播放西瓜| 花房姑娘第三季免费播放电视剧| 天堂口下载| 567记忆碎片免费| 牙医郝板栗未删减版共几集| 人头肉骨茶| 晚上摸摸摸你下面是什么歌| 《金牌销售》1| 不要再来伤害我dj| 电影女儿国| 失魂家族| 雷军说第一个接受采访有点小紧张| 湄公河大案全集下载| 731部队女子配狗马| 沧海转电视剧免费观看| 假面骑士revice在线观看| 修理工的欲望电影| 灵魂符咒| 彩礼谈崩后转身嫁给豪门大佬| 甜蜜惩罚2我是看守专用宠物| 高清《猎杀之后》电影 | 空姐2免费高清完整版观看| 青楼十2房在线观看| 一眉道姑| 电影玉女心经3:阴阳和合| 珠帘玉幕电视剧免费观看| 那片花那片海电视剧| 棺姬嘉依卡| 《水浒传》在线播放| 《高压监狱2》完整版| 第九区在线观看免费版| 深夜食堂豆瓣| 兄弟英雄在线观看| 花鼓戏韩湘子化斋| 一边面膜奶53分钟日本| 龚玥菲新金甁梅剧照| 随时随地都能干的小镇I| 正宗泡菜制作方法教程| 情满四合院完整版全集| 老婆6免费完整高清电视剧| 波多野结衣加嘞比在线观看| 林肯公园的numb| 电视剧青年医生| 西施电视剧| 国风按摩院小电影| 罪罚在线观看完整版全集40| 电视剧一生为奴| 包公奇案| 洗屋先生樱花动漫| 哇嘎免费观看完整版视频| 《好兄弟》完整版| 特殊保险中字2| 两个母亲韩剧电视剧在线观看全集| 特警飞龙全集| 白雪公主纯肉H版版在线| 一起吃饭吧第三季| 站着再来一次30集免费看| 背着善宰跑电视剧免费观看| 韩剧千次的吻电视剧中文免费观看| 特殊教练| 冲出月亮岛35集| 陪部长一起出差电影| 华尔街之狼完整版在线观看| 来自地狱下载| 女子私人监狱免费观看全集剧情介绍 | 千里江山图烟花1088发多少钱 | 村姑2国语免费观看| 东京猫猫全集| 唐太宗李世民电视剧| 小苹果原版mv| 爱的迷局| 星克莱尔《总统夫人》| 鬼娃娃花子 高清| 画皮2电影完整在线播放| 《瞄准》全集免费观看| 从海底出击第一季| 莫妮卡《爱我几何》在线观看| 匆匆那年| 机甲大师| 爱的二八定律电视剧免费观看完整版| 中国大案侦破实录| 漂亮妈妈9| 澳门风云电影国语| 大红灯笼高高挂电视剧全集在线观看| 迷人的保姆| 千指大人| 入室暴行| 亲爱的妈妈3在线观看高清| 坚如磐石在线观看免费版| 赌侠2免费| 楠木邸的神明庭院| 插曲的痛60全集| 金银悔1-5普通话98分钟| 你是我的荣耀在线观看完整版| 意外 电影| 凹凸影视| 《特殊快递员》| 斯托雅《壮志凌云》| 雷火剑OVA番剧初恋时间演员表| 短剧皓龙长空免费观看| 律政俏佳人| 我唾弃你的坟墓 在线| 《3对1:两个人一次性体检》免费观看| 渴望剧情介绍| 女主播的故事中文版| 中国诗词大会第六季第十场总决赛| 张嘉译电视剧大全最新| 做aj的电视剧大全国外| 爱你几何在线观看完整免费| 《繁花》免费播放在线观看全集| 爱情诡计第6集| 电影大笑江湖| 宜都市| 新婚太太精油按摩电影| 死神来了5| 红场阅兵2025| 恋夜秀手机视频uc| 高清《马德里1987》| 黑白配高清国语免费观看在线 | 《爱我几何》免费观看完整版下载 | 再见琼电影| 集安市| 男人与女人在一起愁愁愁愁的电视剧| 三国演义老版全84集| 明仔大叔| 五哈第二季| 仙剑奇侠传2免费观看| 《禁忌5》中文字幕| 开心超人| 裁判文书官方网| 国产在线观看免费版电视剧| 妖精的尾巴 oad| 韩剧松药店的儿子们| 韩国热播剧| 大英县| 痴电汉5| 猎刃电视剧在线观看| 爱情综合症前传电影| 欲望爱人未删减版在线观看影片| 《高等教欲》| 哇嘎高清全部在线观看 | 美女扑克牌脱脱| 女超人麦乐迪满天星版| 按摩乳房的电影| 聊斋艳谭国语版| 《卿本佳人》李月仙| 相棒第十二季| 电视剧麻雀全集在线观看| 保姆的特殊待遇在哪看| 太平间闹鬼事件2在线观看完整版| 小泽玛利亚电影种子| 了凡四训1一23集连续剧免费观看 韩国年轻的母年轻线在6 | 《维修工》王李丹妮在线观看| 日本监禁逃亡美丽的猎物| 闪闪的红星在线观看| 铁马少年国语版| 浴室情欲HD三级| 麦乐迪女超人完整版在线播放| 死神来了8免费完整版电影 | 轮到你了中文版| 美国式家庭的忌讳| 男人和女人愁愁愁免费观看电视剧第9集| 扫黑风暴26| 天神地兽金刚全集| 微笑pasta全集| 电视剧敌后便衣队传奇| 日本维修工艳遇24小时视频| 崖上的波妞| 暮光之城女主克里斯汀| 屌丝男士第4季全集爱奇艺 | 《冢本战争》在线观看| 台北过手无暝无日| 痴汉电车1| 战马在线观看| 开心女鬼国语| 满天星HD版女超人| 日本保险女推销8中字| 《艳母》动漫在线| 新金瓶梅下百度影音| 鬼父手机在线看1到16集| 扒开双腿疯狂进出爽爽爽动态照片| 妈妈的职业2观看完整版| 《新来的私人瑜伽教练》完整版| 变形金刚4高清完整版| 雷剧陈世美| 《风月宝鉴》完整版在线看| 新建文件夹2完整版在线观看| 电影《需要爸爸播种子》| 《战争之暴行女囚》电影电影| 爱的旅馆| 脾虚嘴唇有什么症状| 闪婚老公竟是顶头上司电视剧免费| 我的留级岳父| xL司令第一季马赛免费观看高清| 荷尔蒙6在线观看免费版| 琉璃免费看| 猎场电视剧在线观看| 乡村爱情小夜曲第6部| 电视剧魂断秦淮| 女战狼10国语版国语| 秘密搜查官天海翼在线观看| 梦境电影在线观看高清| 成毅王权富贵电视剧免费播放| 捷德奥特曼免费看| 我们彼此相爱泰剧在线观看免费 | 死亡笔记夜神月| 韩国电影我的游泳教练| 美丽小蜜桃美国| 《先哄后爱》| 遮天全集免费观看完整版视频| 水上人家| 甘十九妹全集| 无间道2粤语高清| 美国禁忌5睫毛膏高清版 | 杨贵妃传| 神探默多克第一季| 麦金尼满天星免费观看| 《落魄贵族琉璃川》免费观看| 高清《安居》电视剧| 法国空姐满天星| 再见龙生你好人生| 高清《非常检控观》电视剧| 《和讨厌的社长出差七天旅》 | 桑德拉·拉索满天星| 新娘之无悔的爱| 男生和女生拔萝卜| 食为奴粤语| 甜蜜蜜免费| 年轻女保险销售员韩国| 画皮之真爱无悔片花| 《陆判换心》徐锦江在线观看| 和讨厌的前男友一起去出差在线播放| 咱们结婚吧 25| 盗墓笔记超级季播剧| 上海滩英文版| 有鬼住隔壁国语| 游樣2| 出差被讨厌的部长侵犯| 战至巅峰3| 胜女的代价2 电视剧| 《湄公河行动》电影| 血战钢锯岭| 韩剧《空调维修工》剧情介绍新任女 | 黑帮大佬和我的365五天| 驱魔公主短剧全集| 飞鹰计划国语| 《落魄贵族琉璃川》2集免费观看| 一场美味的飞行在线观看欢迎回来 | 战狼6免费高清版999加拿大版动漫| 王李丹妮《情欲教室》| 菲比梦游仙境| 你比星光免费观看完整版| 大话西游1| 鸭王2免费看| 斯巴达克斯第二季| 芭芭拉《禁忌5》| 欧美激情小说在线观看| 小呆augus| 女老师3免费观看全集电视剧| 我们的歌第三季综艺| 东北风云黑道二十年| 美国1985g点原版| 电影女老师的诱惑在线观看| 熊出没之年货全集| 郑中基宣布退圈| 光环电影完整版在线看高清| 钢铁侠4在线观看免费版高清| 朱之文星光大道月赛| 法国农场全新正版| 电工的艳遇在线观看| 我的时代你的时代在线观看| 惊天营救3免费观看完整| 纸钞屋在线观看免费观看完整版| 维修人员的培训 中字视频| 九重紫在线观看免费完整版高清| 聚会的目的百度云| 缭乱的裸舞曲 迅雷下载| 我和我的寡妇房东| 新有菜免费电影| 皇家新娘| 乡村爱情小夜曲剧情介绍 | 雷神4免费完整版观看| 卖百科全书的人未删减| 大江大河3免费观看下载| 黄飞鸿之王者之风| 蜡笔小新全集播放| 人民的名义dvd版| 现实生活中的灵异照片| 欲火之路| 法国空乘4完整版播放| 21世纪爱情指南完整版免费观看 | 苦尽柑来遇见你 电视剧| 韩国电影教室爱欲| 信宜市| 酒店1—60集全集免费观看高清| 《驯服小峓子》完成版|