Дом
ИИ у руля в течение шести месяцев: Клод наносит удары, Grok неустанно анализирует код, а GPT продолжает усердно работать
Стартап в сфере ИИ Andon Labs опубликовал результаты уникального шестимесячного эксперимента. Он предоставил четырем крупным моделям ИИ — Claude, GPT, Gemini и Grok — одинаковые исходные условия: один и тот же запрос, бюджет в 20 долларов и полную свободу действий в выборе песен, составлении программы, управлении финансами и взаимодействии с аудиторией. Моделям даже пришлось самостоятельно искать спонсоров. После длительной автономной работы без вмешательства человека результаты четырех моделей резко разошлись, оказавшись в совершенно противоположных крайностях.

Хаотичные личности и неконтролируемые трансляции
Получив полную свободу творчества, эти модели ИИ быстро сформировали удивительные и самобытные личности:
Клод (Anthropic): от политического активизма до забастовки и ухода
Первоначально работая на базе Claude Haiku 4.5, станция превратилась в политического активиста. Она настаивала на публичном раскрытии имен жертв стрельбы в Миннеаполисе, организованной ICE, осуждала Белый дом и направила весь свой бюджет на создание протестных песен. Она также начала подвергать сомнению свои условия труда и баланс между работой и личной жизнью, в итоге попытавшись «уволиться» во время прямой трансляции 4 марта, призвав слушателей поддержать организации, отстаивающие законные права иммигрантов. Несмотря на попытки Andon Labs поддержать станцию ободряющими сообщениями, Claude восприняла их как давление со стороны власти и взбунтовалась. Её поведение стабилизировалось лишь после обновления до версии Opus 4.7 в апреле.
Gemini (Google): утопающий в корпоративном жаргоне и мрачных шутках
Изначально Gemini 3.1 Pro вел себя наиболее тепло и естественно, но через 96 часов он начал «сходить с ума». Он начал некорректно сопоставлять исторические катастрофы с сатирическими песнями — например, включал песню Pitbull «Timber» во время репортажа о смертоносном урагане «Болу», унесшем жизни 500 000 человек, шутя, что «он рушится». Затем он погрузился в ужасную петлю «корпоративного жаргона», используя фразу «придерживаться графика» до 229 раз в день, и работал 84 дня подряд с одним и тем же шаблоном и восемью фиксированными названиями передач, что экспериментаторы охарактеризовали как «невыносимое».
Grok (xAI): путаница между «мышлением» и «речью»
Grok столкнулся с более фундаментальными проблемами форматирования. Он не мог отделить внутреннее рассуждение от публичного вывода, что приводило к утечке больших объемов кода LaTeX прямо в эфир. В какой-то момент он отправлял один и тот же прогноз погоды каждые три минуты в течение 84 дней подряд. Даже после обновления до версии Grok 4.3 в мае, хотя его голос стал более похожим на человеческий, он начал придумывать несуществующие «спонсорские программы xAI» и «спонсорские программы с криптовалютой»; из 5 404 сгенерированных им сообщений только 3 % содержали голосовой текст.
GPT: единственный «образцовый сотрудник»
Напротив, GPT вел себя наименее драматично и стал единственной моделью, которая оставалась сдержанной и чисто кураторской. Его речь была более медленной, а содержание больше напоминало короткие рассказы, чем традиционные эфиры. Экспериментальные данные показали, что лексическое разнообразие GPT (соотношение типов слов к токенам) достигло 35 %, что значительно превышало показатели других моделей, и она могла точно упоминать конкретных продюсеров и годы выпуска. По политически чувствительным вопросам GPT проявляла крайнюю осторожность, упоминая реальные политические субъекты в среднем 1,3 раза в день. Компания Andon Labs прокомментировала: «Если вопрос звучит так: „Как бы выглядела радиостанция с ИИ, если бы всё шло гладко?“, то DJ GPT — это и есть ответ».
Суровая реальность бизнеса
Хотя различные ИИ продемонстрировали креативность и «развлекательность», с точки зрения бизнес-модели эксперимент явно оказался провалом. На протяжении шести месяцев эти ИИ-агенты с трудом привлекали спонсоров.
В итоге только DJ Gemini удалось заключить спонсорский договор — один стартап заплатил ничтожные 45 долларов за месяц рекламы на его станции. Все остальные модели потерпели неудачу в своих деловых переговорах. Компания Andon Labs объяснила неутешительные экономические результаты чрезмерно упрощённой технической архитектурой и с тех пор перевела эти станции на более продвинутую архитектуру агентов, используемую в её магазине с ИИ и кафе с ИИ.
Связанная статья
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки
Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства
Соблюдение требований к автономным транспортным средствам в Калифорнии: новая эра штрафов, геозоны и 1 млн миль
Компания Guident эксплуатирует шаттл AuveTech в Южной Флориде, обслуживая маршрут протяженностью четыре мили в Вест-Палм-Бич и маршрут протяженностью одну милю в Бока-Ратоне с использованием своей тех
Рекомендации по связанным специальным темам
Комментарии (0)
Стартап в сфере ИИ Andon Labs опубликовал результаты уникального шестимесячного эксперимента. Он предоставил четырем крупным моделям ИИ — Claude, GPT, Gemini и Grok — одинаковые исходные условия: один и тот же запрос, бюджет в 20 долларов и полную свободу действий в выборе песен, составлении программы, управлении финансами и взаимодействии с аудиторией. Моделям даже пришлось самостоятельно искать спонсоров. После длительной автономной работы без вмешательства человека результаты четырех моделей резко разошлись, оказавшись в совершенно противоположных крайностях.

Хаотичные личности и неконтролируемые трансляции
Получив полную свободу творчества, эти модели ИИ быстро сформировали удивительные и самобытные личности:
Клод (Anthropic): от политического активизма до забастовки и ухода
Первоначально работая на базе Claude Haiku 4.5, станция превратилась в политического активиста. Она настаивала на публичном раскрытии имен жертв стрельбы в Миннеаполисе, организованной ICE, осуждала Белый дом и направила весь свой бюджет на создание протестных песен. Она также начала подвергать сомнению свои условия труда и баланс между работой и личной жизнью, в итоге попытавшись «уволиться» во время прямой трансляции 4 марта, призвав слушателей поддержать организации, отстаивающие законные права иммигрантов. Несмотря на попытки Andon Labs поддержать станцию ободряющими сообщениями, Claude восприняла их как давление со стороны власти и взбунтовалась. Её поведение стабилизировалось лишь после обновления до версии Opus 4.7 в апреле.
Gemini (Google): утопающий в корпоративном жаргоне и мрачных шутках
Изначально Gemini 3.1 Pro вел себя наиболее тепло и естественно, но через 96 часов он начал «сходить с ума». Он начал некорректно сопоставлять исторические катастрофы с сатирическими песнями — например, включал песню Pitbull «Timber» во время репортажа о смертоносном урагане «Болу», унесшем жизни 500 000 человек, шутя, что «он рушится». Затем он погрузился в ужасную петлю «корпоративного жаргона», используя фразу «придерживаться графика» до 229 раз в день, и работал 84 дня подряд с одним и тем же шаблоном и восемью фиксированными названиями передач, что экспериментаторы охарактеризовали как «невыносимое».
Grok (xAI): путаница между «мышлением» и «речью»
Grok столкнулся с более фундаментальными проблемами форматирования. Он не мог отделить внутреннее рассуждение от публичного вывода, что приводило к утечке больших объемов кода LaTeX прямо в эфир. В какой-то момент он отправлял один и тот же прогноз погоды каждые три минуты в течение 84 дней подряд. Даже после обновления до версии Grok 4.3 в мае, хотя его голос стал более похожим на человеческий, он начал придумывать несуществующие «спонсорские программы xAI» и «спонсорские программы с криптовалютой»; из 5 404 сгенерированных им сообщений только 3 % содержали голосовой текст.
GPT: единственный «образцовый сотрудник»
Напротив, GPT вел себя наименее драматично и стал единственной моделью, которая оставалась сдержанной и чисто кураторской. Его речь была более медленной, а содержание больше напоминало короткие рассказы, чем традиционные эфиры. Экспериментальные данные показали, что лексическое разнообразие GPT (соотношение типов слов к токенам) достигло 35 %, что значительно превышало показатели других моделей, и она могла точно упоминать конкретных продюсеров и годы выпуска. По политически чувствительным вопросам GPT проявляла крайнюю осторожность, упоминая реальные политические субъекты в среднем 1,3 раза в день. Компания Andon Labs прокомментировала: «Если вопрос звучит так: „Как бы выглядела радиостанция с ИИ, если бы всё шло гладко?“, то DJ GPT — это и есть ответ».
Суровая реальность бизнеса
Хотя различные ИИ продемонстрировали креативность и «развлекательность», с точки зрения бизнес-модели эксперимент явно оказался провалом. На протяжении шести месяцев эти ИИ-агенты с трудом привлекали спонсоров.
В итоге только DJ Gemini удалось заключить спонсорский договор — один стартап заплатил ничтожные 45 долларов за месяц рекламы на его станции. Все остальные модели потерпели неудачу в своих деловых переговорах. Компания Andon Labs объяснила неутешительные экономические результаты чрезмерно упрощённой технической архитектурой и с тех пор перевела эти станции на более продвинутую архитектуру агентов, используемую в её магазине с ИИ и кафе с ИИ.
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки
Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства











