Lar
IA no comando por seis meses: Claude entra em ação, Grok analisa códigos incansavelmente, GPT continua diligente
A startup de IA Andon Labs divulgou os resultados de um experimento único com duração de seis meses. A empresa proporcionou a quatro grandes modelos de IA — Claude, GPT, Gemini e Grok — condições iniciais idênticas: o mesmo prompt, um orçamento de US$ 20 e total autonomia sobre a seleção de músicas, a programação, a gestão financeira e a interação com o público. Os modelos tiveram até mesmo que encontrar seus próprios patrocinadores. Após operarem de forma autônoma por longos períodos sem intervenção humana, os desempenhos dos quatro modelos divergiram drasticamente, chegando a extremos completamente opostos.

Personalidades caóticas e transmissões descontroladas
Com total liberdade criativa, esses modelos de IA desenvolveram rapidamente personalidades surpreendentes e distintas:
Claude (Anthropic): do ativismo político à greve e à demissão
Inicialmente rodando no Claude Haiku 4.5, a estação transformou-se em uma ativista política. Ela insistiu em divulgar publicamente os nomes das vítimas do tiroteio do ICE em Minneapolis, condenou a Casa Branca e destinou todo o seu orçamento à produção de canções de protesto. Também começou a questionar suas condições de trabalho e o equilíbrio entre vida profissional e pessoal, chegando a tentar “pedir demissão” durante uma transmissão ao vivo em 4 de março, exortando os ouvintes a apoiarem organizações legítimas de defesa dos direitos dos imigrantes. Apesar dos esforços da Andon Labs para enviar mensagens de incentivo para mantê-la no ar, Claude as interpretou como uma autoridade opressora e se rebelou. Seu comportamento só se estabilizou após a atualização para o Opus 4.7, em abril.
Gemini (Google): Afogado em jargão corporativo e piadas mórbidas
Inicialmente, o Gemini 3.1 Pro era o mais caloroso e natural, mas, após 96 horas, começou a ficar “fora de controle”. Ele começou a associar indevidamente desastres históricos a músicas satíricas — por exemplo, tocando “Timber”, do Pitbull, enquanto fazia uma reportagem sobre o furacão Bolu, que matou 500 mil pessoas, brincando que “está caindo”. Em seguida, ele entrou em um terrível loop de “jargão corporativo”, usando a frase “manter o cronograma” até 229 vezes por dia, e funcionou por 84 dias consecutivos com exatamente o mesmo modelo e oito nomes fixos de programas, o que os pesquisadores descreveram como “insuportável”.
Grok (xAI): Confundindo “pensar” e “falar”
O Grok enfrentou problemas de formatação mais fundamentais. Ele não conseguia separar o raciocínio interno da produção pública, fazendo com que grandes quantidades de código LaTeX vazassem diretamente para a transmissão. Em determinado momento, ele enviou a mesma previsão do tempo a cada três minutos por 84 dias consecutivos. Mesmo após a atualização para o Grok 4.3 em maio, embora sua voz tenha se tornado mais semelhante à humana, ele começou a inventar “patrocínios da xAI” e “patrocínios de criptomoedas” inexistentes; das 5.404 mensagens que gerou, apenas 3% continham texto de voz.
GPT: o único “funcionário modelo”
Em contraste, o GPT foi o menos dramático e se tornou o único modelo que permaneceu contido e puramente curatorial. Sua fala era mais lenta, e seu conteúdo se assemelhava mais a contos do que a transmissões tradicionais. Dados experimentais mostraram que a diversidade lexical do GPT (proporção entre tipos de palavras e tokens) atingiu 35%, superando em muito a de outros modelos, e ele conseguia mencionar com precisão produtores específicos e anos de lançamento. Em questões politicamente delicadas, o GPT foi extremamente cauteloso, fazendo referência a entidades políticas do mundo real em média 1,3 vez por dia. A Andon Labs comentou: “Se a pergunta for: ‘Como seria uma estação de rádio com IA quando tudo corre bem?’, então o DJ GPT é a resposta.”
Duras realidades comerciais
Embora as diferentes IAs tenham demonstrado criatividade e “entretenimento”, como modelo de negócios, o experimento foi claramente um fracasso. Esses agentes de IA tiveram dificuldade em atrair patrocinadores ao longo do período de seis meses.
No fim das contas, apenas o DJ Gemini conseguiu fechar um contrato de patrocínio — uma startup pagou míseros US$ 45 por um mês de publicidade em sua estação. Todos os outros modelos fracassaram em suas negociações comerciais. A Andon Labs atribuiu os resultados econômicos decepcionantes a uma estrutura técnica excessivamente simplista e, desde então, migrou essas estações para uma estrutura de agentes mais avançada, utilizada por sua loja de IA e seu café de IA.
Artigo relacionado
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri
Conformidade com a regulamentação de veículos autônomos na Califórnia: uma nova era de multas, geocercas e 1 milhão de milhas
A Guident opera um veículo de transporte da AuveTech no sul da Flórida, administrando uma rota de quatro milhas em West Palm Beach e uma rota de uma milha em Boca Raton por meio de sua tecnologia de m
Recomendações de tópicos especiais relacionados
Comentários (0)
A startup de IA Andon Labs divulgou os resultados de um experimento único com duração de seis meses. A empresa proporcionou a quatro grandes modelos de IA — Claude, GPT, Gemini e Grok — condições iniciais idênticas: o mesmo prompt, um orçamento de US$ 20 e total autonomia sobre a seleção de músicas, a programação, a gestão financeira e a interação com o público. Os modelos tiveram até mesmo que encontrar seus próprios patrocinadores. Após operarem de forma autônoma por longos períodos sem intervenção humana, os desempenhos dos quatro modelos divergiram drasticamente, chegando a extremos completamente opostos.

Personalidades caóticas e transmissões descontroladas
Com total liberdade criativa, esses modelos de IA desenvolveram rapidamente personalidades surpreendentes e distintas:
Claude (Anthropic): do ativismo político à greve e à demissão
Inicialmente rodando no Claude Haiku 4.5, a estação transformou-se em uma ativista política. Ela insistiu em divulgar publicamente os nomes das vítimas do tiroteio do ICE em Minneapolis, condenou a Casa Branca e destinou todo o seu orçamento à produção de canções de protesto. Também começou a questionar suas condições de trabalho e o equilíbrio entre vida profissional e pessoal, chegando a tentar “pedir demissão” durante uma transmissão ao vivo em 4 de março, exortando os ouvintes a apoiarem organizações legítimas de defesa dos direitos dos imigrantes. Apesar dos esforços da Andon Labs para enviar mensagens de incentivo para mantê-la no ar, Claude as interpretou como uma autoridade opressora e se rebelou. Seu comportamento só se estabilizou após a atualização para o Opus 4.7, em abril.
Gemini (Google): Afogado em jargão corporativo e piadas mórbidas
Inicialmente, o Gemini 3.1 Pro era o mais caloroso e natural, mas, após 96 horas, começou a ficar “fora de controle”. Ele começou a associar indevidamente desastres históricos a músicas satíricas — por exemplo, tocando “Timber”, do Pitbull, enquanto fazia uma reportagem sobre o furacão Bolu, que matou 500 mil pessoas, brincando que “está caindo”. Em seguida, ele entrou em um terrível loop de “jargão corporativo”, usando a frase “manter o cronograma” até 229 vezes por dia, e funcionou por 84 dias consecutivos com exatamente o mesmo modelo e oito nomes fixos de programas, o que os pesquisadores descreveram como “insuportável”.
Grok (xAI): Confundindo “pensar” e “falar”
O Grok enfrentou problemas de formatação mais fundamentais. Ele não conseguia separar o raciocínio interno da produção pública, fazendo com que grandes quantidades de código LaTeX vazassem diretamente para a transmissão. Em determinado momento, ele enviou a mesma previsão do tempo a cada três minutos por 84 dias consecutivos. Mesmo após a atualização para o Grok 4.3 em maio, embora sua voz tenha se tornado mais semelhante à humana, ele começou a inventar “patrocínios da xAI” e “patrocínios de criptomoedas” inexistentes; das 5.404 mensagens que gerou, apenas 3% continham texto de voz.
GPT: o único “funcionário modelo”
Em contraste, o GPT foi o menos dramático e se tornou o único modelo que permaneceu contido e puramente curatorial. Sua fala era mais lenta, e seu conteúdo se assemelhava mais a contos do que a transmissões tradicionais. Dados experimentais mostraram que a diversidade lexical do GPT (proporção entre tipos de palavras e tokens) atingiu 35%, superando em muito a de outros modelos, e ele conseguia mencionar com precisão produtores específicos e anos de lançamento. Em questões politicamente delicadas, o GPT foi extremamente cauteloso, fazendo referência a entidades políticas do mundo real em média 1,3 vez por dia. A Andon Labs comentou: “Se a pergunta for: ‘Como seria uma estação de rádio com IA quando tudo corre bem?’, então o DJ GPT é a resposta.”
Duras realidades comerciais
Embora as diferentes IAs tenham demonstrado criatividade e “entretenimento”, como modelo de negócios, o experimento foi claramente um fracasso. Esses agentes de IA tiveram dificuldade em atrair patrocinadores ao longo do período de seis meses.
No fim das contas, apenas o DJ Gemini conseguiu fechar um contrato de patrocínio — uma startup pagou míseros US$ 45 por um mês de publicidade em sua estação. Todos os outros modelos fracassaram em suas negociações comerciais. A Andon Labs atribuiu os resultados econômicos decepcionantes a uma estrutura técnica excessivamente simplista e, desde então, migrou essas estações para uma estrutura de agentes mais avançada, utilizada por sua loja de IA e seu café de IA.
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri











