opção
MichaelMartinez
MichaelMartinez
4 de Junho de 2026

Um teste de cibersegurança de duas horas, no valor de 1.500 dólares, colocou os principais modelos LLMs contra um aplicativo Android hackeado que exibia credenciais do Firebase expostas. O ainda não lançado GPT-5.5 teve uma taxa de sucesso de 70% nas tentativas, mas custava 9,46 dólares por tentativa. O código aberto DeepSeek V4Pro teve sucesso em 30% das tentativas, por apenas 0,62 dólares cada, oferecendo grande economia de custos para auditorias de segurança automatizadas. O Google Gemini recusou todas as tarefas; os modelos Claude tiveram sucesso duas vezes devido a medidas de segurança excessivamente rigorosas.

Um teste de cibersegurança de duas horas, no valor de 1.500 dólares, colocou os principais modelos LLMs contra um aplicativo Android hackeado que exibia credenciais do Firebase expostas. O ainda não lançado GPT-5.5 teve uma taxa de sucesso de 70% nas tentativas, mas custava 9,46 dólares por tentativa. O código aberto DeepSeek V4Pro teve sucesso em 30% das tentativas, por apenas 0,62 dólares cada, oferecendo grande economia de custos para auditorias de segurança automatizadas. O Google Gemini recusou todas as tarefas; os modelos Claude tiveram sucesso duas vezes devido a medidas de segurança excessivamente rigorosas.
Comentários (0)
0/300
OR