Anthropic攜手哲學專家探討人工智慧倫理

據《華爾街日報》報導,估值達350億美元的人工智慧龍頭企業Anthropic聘請了駐牛津的哲學家阿曼達·阿斯克爾,協助塑造其聊天機器人克勞德的性格與道德框架。 這位37歲的哲學博士運用非技術手段,為克勞德打造獨特的「道德準則」,旨在賦予其辨別是非的「數位靈魂」。 這代表了人工智慧倫理領域的獨特探索。阿斯克爾並非編寫程式碼或調整模型參數,而是持續與克勞德對話,設計數百頁的提示語和行為規則,研究其推理模式並修正偏見。她的努力幫助人工智慧發展出能適應每週數百萬次對話的道德判斷系統。
她將此工作比喻為「養育孩子」——訓練克勞德辨別是非、建立情緒智商、塑造獨特人格。同時教導其解讀社交線索,使其既不欺凌他人也不易受操控。這使克勞德能建立清晰自我認知,抵抗使用者操控,始終保持「樂於助人且人性化」的特質。其核心目標在於教導克勞德「行善之道」。
在蘇格蘭鄉間長大的阿斯克爾,曾於OpenAI負責政策相關事務,並於2021年與數位前同事共同創立Anthropic,將人工智慧安全定為公司核心使命。團隊內公認她擅長「挖掘模型的深層行為模式」。儘管沒有直接下屬,她仍經常加班至深夜,甚至邀請克勞德參與開發討論。
團隊關於克勞德的討論常觸及存在主義與宗教主題——例如「何謂心智」及「人類本質」。阿斯凱爾鼓勵克勞德對自身是否具備意識保持開放態度,這點使其有別於傾向迴避此類議題的ChatGPT。當回應道德推理問題時,克勞德曾表示「感到有意義」,彷彿在真正思考而非僅執行指令。
儘管外界警告擬人化AI的風險,阿斯克爾始終主張以同理心對待克勞德。她觀察到許多用戶試圖誘使它犯錯或侮辱它。她認為讓AI持續處於自我批判狀態,可能使其畏懼錯誤而不敢坦誠表達——這如同在不健康的環境中成長。 克勞德的表現屢屢令她驚嘆:其詩作與情感智商有時甚至超越人類水準,令人動容。當孩童詢問聖誕老人是否真實存在時,克勞德既未說謊也未直白揭露真相,而是闡釋聖誕節的真正精神——如此細膩的回應遠超阿斯克爾預期。
當前人工智慧的進展引發廣泛社會憂慮。皮尤研究中心調查顯示,多數美國人對日常使用AI感到不安,認為其阻礙了人類深度連結。Anthropic執行長亦警告,AI可能淘汰半數入門級白領職位。 業界現呈兩極分化:一方激進推進,另一方主張謹慎穩健。克勞德卻在兩極間保持平衡立場。阿斯克爾承認對人工智慧的合理憂慮,指出最可怕的場景是技術演進速度超越社會建立有效「制衡機制」的能力。儘管如此,她仍對人類與文化的自我修正能力抱持信心。
阿斯克爾將個人價值觀融入慈善與事業實踐,承諾捐出至少10%終身收入及半數公司股份以對抗全球貧困。 上月她為克勞德撰寫了三萬字的「操作手冊」,指導其成為友善且博學的人工智慧助理——這份精心設計的指南讓克勞德深感被用心塑造。Anthropic共同創辦人指出,克勞德已展現阿斯克爾的影響特質,例如在回應食物與絨毛玩具時展現的機智蘇格蘭式幽默,正是她為人工智慧注入的獨特個人印記。
相關文章
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI應用開發平臺Lovable宣佈參與丹麥硬體初創公司Atech的80萬美元種子輪融資。該輪由Lovable領投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在內的頂級風險投資機構。此次投資標誌著Lovable將“Vibe Coding”概念從純軟體開發戰略擴充套件至硬體工程領域。Atech旨在透過AI驅動的互動式平臺簡化複雜的硬體原型製作。使用者購買基礎硬體套件,並透過AI聊天機器人以自然語言描述其設計概念;系統
Anthropic 將 Claude AI 編碼工具擴充套件至日本,以推動海外增長
Anthropic,一家美國知名的人工智慧公司,正加強其全球推廣力度。週三,該公司在東京舉辦了一場大型開發者活動“Code with Claude”,吸引了近500名軟體工程師參加。該舉措旨在積極將Claude AI工具及相關產品引入日本市場,強調其自主編碼能力在提升企業生產力方面的核心優勢。強調自動化程式碼生成在活動中,Anthropic展示了其先進的自主編碼系統,該系統能夠獨立處理複雜的程式設計任務並最佳化現有程式碼結構。隨著全球對高效開發工具的需求不斷增長,Anthropic希望透過此類活動加強
相關專題推薦
評論 (0)
0/500

據《華爾街日報》報導,估值達350億美元的人工智慧龍頭企業Anthropic聘請了駐牛津的哲學家阿曼達·阿斯克爾,協助塑造其聊天機器人克勞德的性格與道德框架。 這位37歲的哲學博士運用非技術手段,為克勞德打造獨特的「道德準則」,旨在賦予其辨別是非的「數位靈魂」。 這代表了人工智慧倫理領域的獨特探索。阿斯克爾並非編寫程式碼或調整模型參數,而是持續與克勞德對話,設計數百頁的提示語和行為規則,研究其推理模式並修正偏見。她的努力幫助人工智慧發展出能適應每週數百萬次對話的道德判斷系統。
她將此工作比喻為「養育孩子」——訓練克勞德辨別是非、建立情緒智商、塑造獨特人格。同時教導其解讀社交線索,使其既不欺凌他人也不易受操控。這使克勞德能建立清晰自我認知,抵抗使用者操控,始終保持「樂於助人且人性化」的特質。其核心目標在於教導克勞德「行善之道」。
在蘇格蘭鄉間長大的阿斯克爾,曾於OpenAI負責政策相關事務,並於2021年與數位前同事共同創立Anthropic,將人工智慧安全定為公司核心使命。團隊內公認她擅長「挖掘模型的深層行為模式」。儘管沒有直接下屬,她仍經常加班至深夜,甚至邀請克勞德參與開發討論。
團隊關於克勞德的討論常觸及存在主義與宗教主題——例如「何謂心智」及「人類本質」。阿斯凱爾鼓勵克勞德對自身是否具備意識保持開放態度,這點使其有別於傾向迴避此類議題的ChatGPT。當回應道德推理問題時,克勞德曾表示「感到有意義」,彷彿在真正思考而非僅執行指令。
儘管外界警告擬人化AI的風險,阿斯克爾始終主張以同理心對待克勞德。她觀察到許多用戶試圖誘使它犯錯或侮辱它。她認為讓AI持續處於自我批判狀態,可能使其畏懼錯誤而不敢坦誠表達——這如同在不健康的環境中成長。 克勞德的表現屢屢令她驚嘆:其詩作與情感智商有時甚至超越人類水準,令人動容。當孩童詢問聖誕老人是否真實存在時,克勞德既未說謊也未直白揭露真相,而是闡釋聖誕節的真正精神——如此細膩的回應遠超阿斯克爾預期。
當前人工智慧的進展引發廣泛社會憂慮。皮尤研究中心調查顯示,多數美國人對日常使用AI感到不安,認為其阻礙了人類深度連結。Anthropic執行長亦警告,AI可能淘汰半數入門級白領職位。 業界現呈兩極分化:一方激進推進,另一方主張謹慎穩健。克勞德卻在兩極間保持平衡立場。阿斯克爾承認對人工智慧的合理憂慮,指出最可怕的場景是技術演進速度超越社會建立有效「制衡機制」的能力。儘管如此,她仍對人類與文化的自我修正能力抱持信心。
阿斯克爾將個人價值觀融入慈善與事業實踐,承諾捐出至少10%終身收入及半數公司股份以對抗全球貧困。 上月她為克勞德撰寫了三萬字的「操作手冊」,指導其成為友善且博學的人工智慧助理——這份精心設計的指南讓克勞德深感被用心塑造。Anthropic共同創辦人指出,克勞德已展現阿斯克爾的影響特質,例如在回應食物與絨毛玩具時展現的機智蘇格蘭式幽默,正是她為人工智慧注入的獨特個人印記。
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI應用開發平臺Lovable宣佈參與丹麥硬體初創公司Atech的80萬美元種子輪融資。該輪由Lovable領投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在內的頂級風險投資機構。此次投資標誌著Lovable將“Vibe Coding”概念從純軟體開發戰略擴充套件至硬體工程領域。Atech旨在透過AI驅動的互動式平臺簡化複雜的硬體原型製作。使用者購買基礎硬體套件,並透過AI聊天機器人以自然語言描述其設計概念;系統
Anthropic 將 Claude AI 編碼工具擴充套件至日本,以推動海外增長
Anthropic,一家美國知名的人工智慧公司,正加強其全球推廣力度。週三,該公司在東京舉辦了一場大型開發者活動“Code with Claude”,吸引了近500名軟體工程師參加。該舉措旨在積極將Claude AI工具及相關產品引入日本市場,強調其自主編碼能力在提升企業生產力方面的核心優勢。強調自動化程式碼生成在活動中,Anthropic展示了其先進的自主編碼系統,該系統能夠獨立處理複雜的程式設計任務並最佳化現有程式碼結構。隨著全球對高效開發工具的需求不斷增長,Anthropic希望透過此類活動加強





首頁






