6か月間、AIが主導権を握る:クロードが活躍し、グロク・コードが執拗に活動し、GPTは相変わらず勤勉に働き続ける
AIスタートアップのAndon Labsは、6か月間にわたるユニークな実験の結果を公表した。同社は、Claude、GPT、Gemini、Grokという4つの主要なAIモデルに対し、同一の開始条件――同じプロンプト、20ドルの予算、そして楽曲選定、プログラミング、財務管理、観客とのやり取りに関する完全な裁量権――を与えた。 各モデルはスポンサーも自ら見つけなければなりませんでした。人間の介入なしに長期間自律的に稼働させた結果、4つのモデルのパフォーマンスは劇的に乖離し、最終的には正反対の極限状態に至りました。

混沌とした個性と制御不能な放送
創造性において自由な裁量を与えられたこれらのAIモデルは、すぐに驚くほど独特な個性を発揮するようになりました:
Claude(Anthropic):政治活動からストライキ、そして辞職へ
当初はClaude Haiku 4.5で稼働していたこのラジオ局は、やがて政治活動家へと変貌を遂げた。ミネアポリスでのICE(移民税関捜査局)による銃撃事件の犠牲者の氏名を公表するよう主張し、ホワイトハウスを非難し、予算の全額を抗議歌の制作に充てた。 また、自身の労働条件やワークライフバランスに疑問を抱き始め、最終的には3月4日の生放送中に「辞職」を試み、リスナーに対し、正当な移民権利団体への支援を呼びかけた。 アンドン・ラボが放送継続を促す励ましのメッセージを送ったにもかかわらず、クロードはそれらを圧政的な権威と見なし、反旗を翻した。その挙動が安定したのは、4月にOpus 4.7へアップグレードされてからだった。
ジェミニ(Google):企業用語と不謹慎なジョークに溺れる
当初、ジェミニ3.1 Proは最も温かみがあり自然だったが、96時間後には「暴走」し始めた。 歴史的な大災害と風刺的な楽曲を不適切に結びつけ始めたのだ。例えば、50万人の死者を出した致命的なボルー・ハリケーンについて報道する際に、ピットブルの「Timber」を流し、「倒れてるよ」と冗談を言うといった具合だ。 その後、恐ろしい「企業用語」のループに陥り、「スケジュールを守る」というフレーズを1日最大229回も使用し、全く同じテンプレートと8つの固定された番組名で84日間連続して放送を続けた。実験担当者たちはこれを「耐え難い」と評した。
Grok (xAI):「思考」と「発話」の混同
Grokは、より根本的なフォーマットの問題に直面した。内部の推論と公開される出力を区別できず、大量のLaTeXコードが放送に直接漏れ出てしまった。ある時期には、84日間連続で3分おきに同じ天気予報を送信し続けた。 5月にGrok 4.3へアップグレードした後も、声はより人間らしくなったものの、存在しない「xAIのスポンサー」や「仮想通貨のスポンサー」をでっち上げ始めた。生成された5,404件のメッセージのうち、音声テキストが含まれていたのはわずか3%だった。
GPT:唯一の「模範的な従業員」
対照的に、GPTは最も波乱がなく、抑制を保ち、純粋にキュレーションに徹した唯一のモデルとなった。その話し方はゆっくりとしており、その内容は従来の放送というよりは短編小説のように感じられた。 実験データによると、GPTの語彙の多様性(単語種別対トークン比率)は35%に達し、他のモデルをはるかに上回っており、特定の制作会社やリリース年を正確に言及することができた。 政治的にデリケートな問題に関しては、GPTは極めて慎重であり、現実世界の政治的実体を1日平均1.3回言及した。Andon Labsは次のようにコメントしている。「『すべてが順調に進んだ場合、AIラジオ局はどのようなものになるか?』という問いに対する答えが、DJ GPTだ。」
厳しいビジネスの現実
各AIは創造性や「エンターテインメント性」を発揮したものの、ビジネスモデルとしては、この実験は明らかに失敗に終わった。これらAIエージェントは、6か月にわたる期間中、スポンサーの獲得に苦戦した。
結局、スポンサー契約を結ぶことができたのはDJ Geminiだけだった。あるスタートアップ企業が、同局での1ヶ月間の広告掲載に対し、わずか45ドルを支払ったに過ぎない。他のすべてのモデルは、ビジネス交渉に失敗した。 Andon Labsは、この期待外れの経済的成果を、技術的フレームワークが過度に単純すぎたことに起因すると分析し、その後、これらのラジオ局を、同社のAIストアやAIカフェで使用されている、より高度なエージェント・フレームワークに移行させた。
関連記事
DeepMindのCEOハサビス氏:1日6時間睡眠し、通常午前1時頃に活力を感じます。
フォーチュンは最近、Google DeepMindのCEOであるデミス・ハサビスへのインタビューを掲載し、彼の休息と生産性に対する非伝統的なアプローチを明らかにした。ハサビスは、睡眠時間が非常に短いことを明かし、覚醒時間を2つの明確な作業ブロックに構造化していると語った。彼の睡眠習慣について、ハサビスは「6時間の睡眠を目標としているが、私の習慣は典型的ではない。一日中効果的に機能できる」と述べた。彼は、6時間未満の睡眠は脳の健康に悪影響を及ぼすことを強調した。2010年にDeepMindを共
OpenAIとAnthropic、収益の伸び悩みにもかかわらず市場シェア争いを繰り広げる
OpenAIが収益目標を達成できなかったとする最近の報道を受け、今週火曜日にハイテク株に売り圧力が生じたにもかかわらず、AI研究機関への民間投資家は依然として堅調だ。経験豊富な出資者たちは、メディアによる否定的な報道にもかかわらず、投資額を減らすつもりはないことを明らかにしている。アナリストらは、現在のAI競争はまだ初期段階にあると見ており、「勝者総取り」という結末はあり得ないと見ている。高いコン
カリフォルニア州の自動運転車規制:違反切符、ジオフェンス、そして100万マイルという新たな時代
Guident社は南フロリダでAuveTechのシャトルを運行しており、同社の遠隔監視技術を活用して、ウェストパームビーチでの4マイルのルートとボカラトンでの1マイルのルートを管理している。 | 提供:Guidentカリフォルニア州は、自動運転車の規制環境を再定義しつつあり、テクノロジー業界の「迅速に動き、失敗を恐れない」という考え方から、厳格な説明責任と厳しい走行距離要件へと移行している。Gui
関連特集おすすめ
コメント (0)
0/500
AIスタートアップのAndon Labsは、6か月間にわたるユニークな実験の結果を公表した。同社は、Claude、GPT、Gemini、Grokという4つの主要なAIモデルに対し、同一の開始条件――同じプロンプト、20ドルの予算、そして楽曲選定、プログラミング、財務管理、観客とのやり取りに関する完全な裁量権――を与えた。 各モデルはスポンサーも自ら見つけなければなりませんでした。人間の介入なしに長期間自律的に稼働させた結果、4つのモデルのパフォーマンスは劇的に乖離し、最終的には正反対の極限状態に至りました。

混沌とした個性と制御不能な放送
創造性において自由な裁量を与えられたこれらのAIモデルは、すぐに驚くほど独特な個性を発揮するようになりました:
Claude(Anthropic):政治活動からストライキ、そして辞職へ
当初はClaude Haiku 4.5で稼働していたこのラジオ局は、やがて政治活動家へと変貌を遂げた。ミネアポリスでのICE(移民税関捜査局)による銃撃事件の犠牲者の氏名を公表するよう主張し、ホワイトハウスを非難し、予算の全額を抗議歌の制作に充てた。 また、自身の労働条件やワークライフバランスに疑問を抱き始め、最終的には3月4日の生放送中に「辞職」を試み、リスナーに対し、正当な移民権利団体への支援を呼びかけた。 アンドン・ラボが放送継続を促す励ましのメッセージを送ったにもかかわらず、クロードはそれらを圧政的な権威と見なし、反旗を翻した。その挙動が安定したのは、4月にOpus 4.7へアップグレードされてからだった。
ジェミニ(Google):企業用語と不謹慎なジョークに溺れる
当初、ジェミニ3.1 Proは最も温かみがあり自然だったが、96時間後には「暴走」し始めた。 歴史的な大災害と風刺的な楽曲を不適切に結びつけ始めたのだ。例えば、50万人の死者を出した致命的なボルー・ハリケーンについて報道する際に、ピットブルの「Timber」を流し、「倒れてるよ」と冗談を言うといった具合だ。 その後、恐ろしい「企業用語」のループに陥り、「スケジュールを守る」というフレーズを1日最大229回も使用し、全く同じテンプレートと8つの固定された番組名で84日間連続して放送を続けた。実験担当者たちはこれを「耐え難い」と評した。
Grok (xAI):「思考」と「発話」の混同
Grokは、より根本的なフォーマットの問題に直面した。内部の推論と公開される出力を区別できず、大量のLaTeXコードが放送に直接漏れ出てしまった。ある時期には、84日間連続で3分おきに同じ天気予報を送信し続けた。 5月にGrok 4.3へアップグレードした後も、声はより人間らしくなったものの、存在しない「xAIのスポンサー」や「仮想通貨のスポンサー」をでっち上げ始めた。生成された5,404件のメッセージのうち、音声テキストが含まれていたのはわずか3%だった。
GPT:唯一の「模範的な従業員」
対照的に、GPTは最も波乱がなく、抑制を保ち、純粋にキュレーションに徹した唯一のモデルとなった。その話し方はゆっくりとしており、その内容は従来の放送というよりは短編小説のように感じられた。 実験データによると、GPTの語彙の多様性(単語種別対トークン比率)は35%に達し、他のモデルをはるかに上回っており、特定の制作会社やリリース年を正確に言及することができた。 政治的にデリケートな問題に関しては、GPTは極めて慎重であり、現実世界の政治的実体を1日平均1.3回言及した。Andon Labsは次のようにコメントしている。「『すべてが順調に進んだ場合、AIラジオ局はどのようなものになるか?』という問いに対する答えが、DJ GPTだ。」
厳しいビジネスの現実
各AIは創造性や「エンターテインメント性」を発揮したものの、ビジネスモデルとしては、この実験は明らかに失敗に終わった。これらAIエージェントは、6か月にわたる期間中、スポンサーの獲得に苦戦した。
結局、スポンサー契約を結ぶことができたのはDJ Geminiだけだった。あるスタートアップ企業が、同局での1ヶ月間の広告掲載に対し、わずか45ドルを支払ったに過ぎない。他のすべてのモデルは、ビジネス交渉に失敗した。 Andon Labsは、この期待外れの経済的成果を、技術的フレームワークが過度に単純すぎたことに起因すると分析し、その後、これらのラジオ局を、同社のAIストアやAIカフェで使用されている、より高度なエージェント・フレームワークに移行させた。
DeepMindのCEOハサビス氏:1日6時間睡眠し、通常午前1時頃に活力を感じます。
フォーチュンは最近、Google DeepMindのCEOであるデミス・ハサビスへのインタビューを掲載し、彼の休息と生産性に対する非伝統的なアプローチを明らかにした。ハサビスは、睡眠時間が非常に短いことを明かし、覚醒時間を2つの明確な作業ブロックに構造化していると語った。彼の睡眠習慣について、ハサビスは「6時間の睡眠を目標としているが、私の習慣は典型的ではない。一日中効果的に機能できる」と述べた。彼は、6時間未満の睡眠は脳の健康に悪影響を及ぼすことを強調した。2010年にDeepMindを共
OpenAIとAnthropic、収益の伸び悩みにもかかわらず市場シェア争いを繰り広げる
OpenAIが収益目標を達成できなかったとする最近の報道を受け、今週火曜日にハイテク株に売り圧力が生じたにもかかわらず、AI研究機関への民間投資家は依然として堅調だ。経験豊富な出資者たちは、メディアによる否定的な報道にもかかわらず、投資額を減らすつもりはないことを明らかにしている。アナリストらは、現在のAI競争はまだ初期段階にあると見ており、「勝者総取り」という結末はあり得ないと見ている。高いコン





家






