克勞德·艾(Claude AI)以緩慢的節奏在抽搐上扮演神奇寶貝
週二下午,Anthropic 在 Twitch 上開啟了一場獨特的直播,名為「Claude Plays Pokémon」,展示了他們最新的 AI 模型 Claude 3.7 Sonnet 挑戰《寶可夢 紅》。這是一個引人入勝的實驗,不僅展示了 AI 的能力,還捕捉了觀眾對這項尖端技術的反應。
AI 研究人員常利用《快打旋風》或《Pictionary》等電玩來測試新模型,通常是為了娛樂而非實際應用。然而,Anthropic 發現《寶可夢》是 Claude 3.7 Sonnet 的有效基準,該模型擅長透過「思考」解決遊戲中的謎題。
類似於 OpenAI 的 o3-mini 和 DeepSeek 的 R1,Claude 3.7 Sonnet 能應對複雜挑戰,例如玩一款為兒童設計的遊戲。雖然其前身 Claude 3.5 Sonnet 甚至無法離開帕雷鎮的玩家家中,但 Claude 3.7 Sonnet 成功獲得了三個道館領袖徽章。

Claude 在《寶可夢 紅》中難以離開一棟建築。圖片來源:Claude Plays Pokémon on Twitch 儘管有所進步,Claude 3.7 Sonnet 仍遇到障礙。在 Twitch 直播中,它被一道無法通過的岩壁困住,無論如何嘗試都無法前進。
一位 Twitch 觀眾幽默地評論道:「誰會贏?一個投入數千小時編程的電腦 AI,還是一堵岩壁?」
最終,Claude 找到了繞過障礙的方法。
觀看 Claude 玩《寶可夢 紅》可能會讓人感到緩慢得令人沮喪,因為它仔細推敲每一步。然而,這也奇妙地引人入勝。直播畫面左側顯示 Claude 的「思考過程」,右側則是即時遊戲畫面。
在某個時刻,Claude 試圖在實驗室中找到大木博士,但被其他 NPC 搞混了。
「我注意到下方出現了一個新角色——一個黑髮、看似穿著白大褂的角色,座標為 (2, 10),」Claude 記錄道。「這可能是大木博士!讓我下去和他談談。」
不幸的是,Claude 錯誤地與一個之前已多次遇到的 NPC 對話,這讓 Twitch 聊天室中超過千人的觀眾感到有些沮喪。然而,長期觀看的觀眾則顯得更有耐心。
「大家冷靜,」一位觀眾寫道。「我們之前進出大木博士的實驗室大概十次,才搞懂如何繼續前進。」

圖片來源:Anthropic 對於長期使用 Twitch 的用戶來說,Anthropic 的直播可能會勾起懷舊情緒。十多年前,Twitch Plays Pokémon 成為一項開創性的社交實驗,數百萬用戶透過聊天指令共同控制遊戲,帶來了混亂但令人難忘的遊戲體驗。
一些 AI 研究人員從 Twitch Plays Pokémon 中獲得靈感。2023 年 10 月,西雅圖的軟體工程師 Peter Whidden 在 YouTube 上分享了一段關於訓練強化學習算法玩《寶可夢》的影片。他的 AI 花費超過 50,000 小時來掌握遊戲,其中一個有趣的挑戰是它傾向於欣賞像素化的風景而非專注遊戲。
雖然 Whidden 和 Anthropic 的 AI 驅動重現令人娛樂,但也帶有一絲苦樂參半的意味。原版的 Twitch Plays Pokémon 是一個里程碑時刻,團結了人們在一個共同但混亂的努力中推進遊戲。
然而,到了 2025 年,我們已從積極參與者轉變為僅僅的觀察者,看著 AI 掙扎於許多人在童年時就已精通的遊戲。這反映了我們線上體驗的更廣泛趨勢,從社群活動轉向更孤立的體驗。
相關文章
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具
Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
Anthropic 推出 Claude Fable 5,這是 Mythos 的公開版本
Anthropic 首次向大眾開放其最強大的 AI 模型——但同時也採取了安全措施。週二,該公司推出了「Claude Fable 5」,這是其 Mythos 模型的首個公開版本。 據 Anthropic 表示,Fable 5 在軟體工程、知識工作及視覺任務方面表現優異,但設有嚴格的安全限制。在網路安全、生物學、化學及蒸餾等高風險領域,該模型將拒絕回答問題,並轉而交由 Claude Opus 4.
SandboxAQ將藥物發現領域的AI技術引入Claude,無需擁有電腦科學博士學位即可使用。
藥物發現依然是現代工業領域成本最高的挑戰之一。要找到一種具備應用價值的分子,往往需要十年的時間以及數十億美元的投入,而且大多數候選分子最終仍會失敗。目前有一波人工智慧初創企業宣稱能夠改變這一現狀——不過這些公司大多僅能讓那些已具備足夠技術能力的研究人員稍顯便利些許。然而SandboxAQ認為,真正的瓶頸並非模型本身,而是介面設計。該公司與Anthropic合作,將其科學類人工智慧模型直接整合到Claude中,使得強大的藥物發現和材料科學工具能夠透過對話式介面被使用,且無需任何專門的計算基礎設
相關專題推薦
評論 (61)
0/500
lol they really gave the AI an emulator and just let it loose? 💀 i half expected it to speedrun but this "watching paint dry" pace is lowkey hilarious. wonder if they had to nerf its processing to make it beatable for twitch chat or if it's actually calculating optimal moves in slow motion. Either way, huge missed opportunity to let it name the rival "Anthropic" for maximum chaos.
Watching an AI play a game slowly is oddly fascinating, like observing a very careful alien learn. I wonder what the actual internal reward mechanism is for 'progress'— or does it just see the stream chat and get influenced? Kinda spooky to think about! 😅
Interesting stream! It's cool to see Claude tackle classic games, but the 'slow pace' concept feels a bit like a stunt. Makes me wonder—is this a fun tech showcase, or are we just bored? 😅 Still, watching AI process that old-school pixel environment is oddly soothing.
Claude a jogar Pokémon? 😂 Parece a coisa mais inútil que já vi, mas mal posso parar de ver! Será que a IA vai conseguir apanhar todos os Pokémon? Tantas perguntas... Acho incrível como a tecnologia está a evoluir, mas também fico um bocado assustado com as possibilidades. Será que as IAs vão começar a jogar todos os nossos jogos? 🤔
Que ideia criativa! 🤯 Ver um IA jogar Pokémon parece simples, mas deve ser incrivelmente complexo nos bastidores. Será que o Claude consegue vencer o Brock sem escolher o Squirtle? #AIgaming
週二下午,Anthropic 在 Twitch 上開啟了一場獨特的直播,名為「Claude Plays Pokémon」,展示了他們最新的 AI 模型 Claude 3.7 Sonnet 挑戰《寶可夢 紅》。這是一個引人入勝的實驗,不僅展示了 AI 的能力,還捕捉了觀眾對這項尖端技術的反應。
AI 研究人員常利用《快打旋風》或《Pictionary》等電玩來測試新模型,通常是為了娛樂而非實際應用。然而,Anthropic 發現《寶可夢》是 Claude 3.7 Sonnet 的有效基準,該模型擅長透過「思考」解決遊戲中的謎題。
類似於 OpenAI 的 o3-mini 和 DeepSeek 的 R1,Claude 3.7 Sonnet 能應對複雜挑戰,例如玩一款為兒童設計的遊戲。雖然其前身 Claude 3.5 Sonnet 甚至無法離開帕雷鎮的玩家家中,但 Claude 3.7 Sonnet 成功獲得了三個道館領袖徽章。

儘管有所進步,Claude 3.7 Sonnet 仍遇到障礙。在 Twitch 直播中,它被一道無法通過的岩壁困住,無論如何嘗試都無法前進。
一位 Twitch 觀眾幽默地評論道:「誰會贏?一個投入數千小時編程的電腦 AI,還是一堵岩壁?」
最終,Claude 找到了繞過障礙的方法。
觀看 Claude 玩《寶可夢 紅》可能會讓人感到緩慢得令人沮喪,因為它仔細推敲每一步。然而,這也奇妙地引人入勝。直播畫面左側顯示 Claude 的「思考過程」,右側則是即時遊戲畫面。
在某個時刻,Claude 試圖在實驗室中找到大木博士,但被其他 NPC 搞混了。
「我注意到下方出現了一個新角色——一個黑髮、看似穿著白大褂的角色,座標為 (2, 10),」Claude 記錄道。「這可能是大木博士!讓我下去和他談談。」
不幸的是,Claude 錯誤地與一個之前已多次遇到的 NPC 對話,這讓 Twitch 聊天室中超過千人的觀眾感到有些沮喪。然而,長期觀看的觀眾則顯得更有耐心。
「大家冷靜,」一位觀眾寫道。「我們之前進出大木博士的實驗室大概十次,才搞懂如何繼續前進。」

對於長期使用 Twitch 的用戶來說,Anthropic 的直播可能會勾起懷舊情緒。十多年前,Twitch Plays Pokémon 成為一項開創性的社交實驗,數百萬用戶透過聊天指令共同控制遊戲,帶來了混亂但令人難忘的遊戲體驗。
一些 AI 研究人員從 Twitch Plays Pokémon 中獲得靈感。2023 年 10 月,西雅圖的軟體工程師 Peter Whidden 在 YouTube 上分享了一段關於訓練強化學習算法玩《寶可夢》的影片。他的 AI 花費超過 50,000 小時來掌握遊戲,其中一個有趣的挑戰是它傾向於欣賞像素化的風景而非專注遊戲。
雖然 Whidden 和 Anthropic 的 AI 驅動重現令人娛樂,但也帶有一絲苦樂參半的意味。原版的 Twitch Plays Pokémon 是一個里程碑時刻,團結了人們在一個共同但混亂的努力中推進遊戲。
然而,到了 2025 年,我們已從積極參與者轉變為僅僅的觀察者,看著 AI 掙扎於許多人在童年時就已精通的遊戲。這反映了我們線上體驗的更廣泛趨勢,從社群活動轉向更孤立的體驗。
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具
Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
Anthropic 推出 Claude Fable 5,這是 Mythos 的公開版本
Anthropic 首次向大眾開放其最強大的 AI 模型——但同時也採取了安全措施。週二,該公司推出了「Claude Fable 5」,這是其 Mythos 模型的首個公開版本。 據 Anthropic 表示,Fable 5 在軟體工程、知識工作及視覺任務方面表現優異,但設有嚴格的安全限制。在網路安全、生物學、化學及蒸餾等高風險領域,該模型將拒絕回答問題,並轉而交由 Claude Opus 4.
SandboxAQ將藥物發現領域的AI技術引入Claude,無需擁有電腦科學博士學位即可使用。
藥物發現依然是現代工業領域成本最高的挑戰之一。要找到一種具備應用價值的分子,往往需要十年的時間以及數十億美元的投入,而且大多數候選分子最終仍會失敗。目前有一波人工智慧初創企業宣稱能夠改變這一現狀——不過這些公司大多僅能讓那些已具備足夠技術能力的研究人員稍顯便利些許。然而SandboxAQ認為,真正的瓶頸並非模型本身,而是介面設計。該公司與Anthropic合作,將其科學類人工智慧模型直接整合到Claude中,使得強大的藥物發現和材料科學工具能夠透過對話式介面被使用,且無需任何專門的計算基礎設
lol they really gave the AI an emulator and just let it loose? 💀 i half expected it to speedrun but this "watching paint dry" pace is lowkey hilarious. wonder if they had to nerf its processing to make it beatable for twitch chat or if it's actually calculating optimal moves in slow motion. Either way, huge missed opportunity to let it name the rival "Anthropic" for maximum chaos.
Watching an AI play a game slowly is oddly fascinating, like observing a very careful alien learn. I wonder what the actual internal reward mechanism is for 'progress'— or does it just see the stream chat and get influenced? Kinda spooky to think about! 😅
Interesting stream! It's cool to see Claude tackle classic games, but the 'slow pace' concept feels a bit like a stunt. Makes me wonder—is this a fun tech showcase, or are we just bored? 😅 Still, watching AI process that old-school pixel environment is oddly soothing.
Claude a jogar Pokémon? 😂 Parece a coisa mais inútil que já vi, mas mal posso parar de ver! Será que a IA vai conseguir apanhar todos os Pokémon? Tantas perguntas... Acho incrível como a tecnologia está a evoluir, mas também fico um bocado assustado com as possibilidades. Será que as IAs vão começar a jogar todos os nossos jogos? 🤔
Que ideia criativa! 🤯 Ver um IA jogar Pokémon parece simples, mas deve ser incrivelmente complexo nos bastidores. Será que o Claude consegue vencer o Brock sem escolher o Squirtle? #AIgaming





首頁






