Deep Cogito revela modelos híbridos de IA com recursos avançados de raciocínio
A Deep Cogito, uma nova empresa inovadora em IA, lançou uma série de modelos de IA de acesso aberto que alternam perfeitamente entre os modos de raciocínio e não raciocínio.
Os modelos de raciocínio, como o o1 da OpenAI, são excelentes em campos como matemática e física, verificando metodicamente as soluções passo a passo. No entanto, essa precisão exige mais recursos computacionais e tempo. Para resolver isso, empresas como a Anthropic estão desenvolvendo arquiteturas híbridas que combinam raciocínio com componentes padrão, permitindo respostas rápidas a consultas simples e análises mais profundas para consultas complexas.
Os modelos da Deep Cogito, denominados Cogito 1, são todos projetos híbridos. A empresa afirma que eles superam os principais modelos abertos de tamanho semelhante, incluindo os da Meta e da DeepSeek.
"Cada modelo pode responder instantaneamente ou refletir antes de responder, imitando modelos de raciocínio", afirmou a Deep Cogito em um post de blog. "Eles foram criados por uma equipe compacta em apenas 75 dias."
Os modelos do Cogito 1 variam de 3 bilhões a 70 bilhões de parâmetros, com planos para modelos de até 671 bilhões de parâmetros em um futuro próximo. Normalmente, mais parâmetros aumentam a capacidade de resolução de problemas de um modelo.
O Cogito 1 baseia-se nos modelos Llama da Meta e Qwen da Alibaba, com o Deep Cogito aplicando técnicas de treinamento inovadoras para melhorar o desempenho e permitir o raciocínio alternável.
Os benchmarks internos mostram que o maior modelo, o Cogito 70B, com o raciocínio ativado, supera o R1 do DeepSeek em tarefas selecionadas de matemática e linguagem. Sem raciocínio, ele também supera o Llama 4 Scout da Meta no LiveBench, uma ampla avaliação de IA.
Todos os modelos do Cogito 1 estão disponíveis para download ou acessíveis por meio de APIs nas plataformas de nuvem Fireworks AI e Together AI.

Desempenho do Cogito 1 em comparação com outros modelos populares de IA disponíveis abertamenteCrédito da imagem: Deep Cogito "Ainda estamos no início de nossa jornada de escalonamento, usando apenas uma fração da computação normalmente alocada para treinamento de modelos de linguagem grandes", observou a Deep Cogito em seu blog. "Estamos explorando novos métodos pós-treinamento para autoaperfeiçoamento."
Fundada em junho de 2024 em São Francisco, de acordo com os registros da Califórnia, a Deep Cogito foi criada por Drishan Arora, ex-engenheiro de software sênior do Google, e Dhruv Malhotra, anteriormente gerente de produtos da DeepMind do Google, onde se concentrou na pesquisa generativa.
Com o apoio da South Park Commons, de acordo com o PitchBook, a Deep Cogito tem como objetivo ser pioneira na "superinteligência geral" - uma IA que supera a maioria dos seres humanos e libera recursos sem precedentes.
Artigo relacionado
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri
Conformidade com a regulamentação de veículos autônomos na Califórnia: uma nova era de multas, geocercas e 1 milhão de milhas
A Guident opera um veículo de transporte da AuveTech no sul da Flórida, administrando uma rota de quatro milhas em West Palm Beach e uma rota de uma milha em Boca Raton por meio de sua tecnologia de m
Recomendações de tópicos especiais relacionados
Comentários (0)
A Deep Cogito, uma nova empresa inovadora em IA, lançou uma série de modelos de IA de acesso aberto que alternam perfeitamente entre os modos de raciocínio e não raciocínio.
Os modelos de raciocínio, como o o1 da OpenAI, são excelentes em campos como matemática e física, verificando metodicamente as soluções passo a passo. No entanto, essa precisão exige mais recursos computacionais e tempo. Para resolver isso, empresas como a Anthropic estão desenvolvendo arquiteturas híbridas que combinam raciocínio com componentes padrão, permitindo respostas rápidas a consultas simples e análises mais profundas para consultas complexas.
Os modelos da Deep Cogito, denominados Cogito 1, são todos projetos híbridos. A empresa afirma que eles superam os principais modelos abertos de tamanho semelhante, incluindo os da Meta e da DeepSeek.
"Cada modelo pode responder instantaneamente ou refletir antes de responder, imitando modelos de raciocínio", afirmou a Deep Cogito em um post de blog. "Eles foram criados por uma equipe compacta em apenas 75 dias."
Os modelos do Cogito 1 variam de 3 bilhões a 70 bilhões de parâmetros, com planos para modelos de até 671 bilhões de parâmetros em um futuro próximo. Normalmente, mais parâmetros aumentam a capacidade de resolução de problemas de um modelo.
O Cogito 1 baseia-se nos modelos Llama da Meta e Qwen da Alibaba, com o Deep Cogito aplicando técnicas de treinamento inovadoras para melhorar o desempenho e permitir o raciocínio alternável.
Os benchmarks internos mostram que o maior modelo, o Cogito 70B, com o raciocínio ativado, supera o R1 do DeepSeek em tarefas selecionadas de matemática e linguagem. Sem raciocínio, ele também supera o Llama 4 Scout da Meta no LiveBench, uma ampla avaliação de IA.
Todos os modelos do Cogito 1 estão disponíveis para download ou acessíveis por meio de APIs nas plataformas de nuvem Fireworks AI e Together AI.

"Ainda estamos no início de nossa jornada de escalonamento, usando apenas uma fração da computação normalmente alocada para treinamento de modelos de linguagem grandes", observou a Deep Cogito em seu blog. "Estamos explorando novos métodos pós-treinamento para autoaperfeiçoamento."
Fundada em junho de 2024 em São Francisco, de acordo com os registros da Califórnia, a Deep Cogito foi criada por Drishan Arora, ex-engenheiro de software sênior do Google, e Dhruv Malhotra, anteriormente gerente de produtos da DeepMind do Google, onde se concentrou na pesquisa generativa.
Com o apoio da South Park Commons, de acordo com o PitchBook, a Deep Cogito tem como objetivo ser pioneira na "superinteligência geral" - uma IA que supera a maioria dos seres humanos e libera recursos sem precedentes.
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri





Lar






