opção
Lar
Lista de modelos AL
DBRX-Instruct
Modelo Parâmetro Quantidade
132B
Modelo Parâmetro Quantidade
Organização afiliada
DataBricks
Organização afiliada
Código aberto
Tipo de licença
Tempo de liberação
26 de Março de 2024
Tempo de liberação
Introdução ao modelo
DBRX-Instruct é um modelo MoE treinado do zero pela DataBricks, utilizando um esquema de seleção de 16 especialistas escolhendo 4, com um número de parâmetros ativos de 36B. Ele foi pré-treinado em 12T tokens, suportando um contexto de 32K.
Deslize para a esquerda e para a direita para ver mais
Capacidade de compreensão de idiomas Capacidade de compreensão de idiomas
Capacidade de compreensão de idiomas
Muitas vezes, faz mal julgamentos semânticos, levando a óbvias desconexões lógicas nas respostas.
2.5
Escopo de cobertura do conhecimento Escopo de cobertura do conhecimento
Escopo de cobertura do conhecimento
Possui pontos cegos significativos, geralmente mostrando erros factuais e repetindo informações desatualizadas.
6.6
Capacidade de raciocínio Capacidade de raciocínio
Capacidade de raciocínio
Incapaz de manter cadeias de raciocínio coerentes, geralmente causando causalidade invertida ou erros de cálculo.
2.0
Modelo relacionado
DBRX-Instruct DBRX-Instruct é um modelo MoE treinado do zero pela DataBricks, utilizando um esquema de seleção de 16 especialistas escolhendo 4, com um número de parâmetros ativos de 36B. Ele foi pré-treinado em 12T tokens, suportando um contexto de 32K.
Doubao-Seed-1.6-251015 (Thinking) O modelo de raciocínio profundo lançado pela ByteDance, que suporta a troca manual de raciocínio profundo, e seu desempenho foi significativamente aprimorado em comparação com o doubao-1.5.
Doubao-Seed-1.6-thinking-250715 A versão mais recente do modelo da série Seed lançado pela ByteDance, que suporta o modo de pensamento.
ERNIE 5.0 O novo modelo ERNIE da Baidu, versão 5.0.
Spark-X1 O modelo de inferência Spark X1 lançado pela iFlytek, além de liderar tarefas matemáticas domésticas, avalia o desempenho de tarefas gerais como inferência, geração de texto e compreensão linguística contra o OpenAI o1 e o DeepSeek R1.
Documentos relevantes
Alibaba Super Cup: Qwen3.8-Max estreia com aprimoramento nas ferramentas de programação e escritório A Alibaba revelou oficialmente o Qwen3.8-Max, um modelo de base de próxima geração com 2,4 trilhão de parâmetros. Este avanço significativo em IA oferece ganhos substanciais de desempenho em áreas principais, como programação e tarefas profissionais
Magnata da Tecnologia da Índia Investe US$ 30 Milhões em Concorrente de IA ao Microsoft Office O empreendedor serial Bhavin Turakhia está investindo US$ 30 milhões de seu próprio capital, apostando que o setor de IA empresarial ainda tem espaço para novos jogadores. Sua mais recente startup, a Neo, opera com uma crença central: o software lega
Ex-Cientista-Chefe da OpenAI, Ilya, apresenta seu primeiro modelo de SSI A inteligência artificial alcançou mais um grande marco. Após sua saída da OpenAI, o ex-chefe de ciência Ilya Sutskever estabeleceu a Safe Superintelligence Inc. (SSI), que recentemente revelou detalhes sobre seu modelo inaugural. Relatórios de redes
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field Em 14 de maio de 2026, a plataforma de desenvolvimento de aplicações de IA Lovable anunciou sua participação na rodada de investimento inicial (seed) de US$ 800.000 para a startup dinamarquesa de hardware Atech. Liderada pela Lovable, a rodada atraiu
A Anthropic amplia as ferramentas de codificação do Claude AI para o Japão em busca de crescimento no exterior A Anthropic, uma proeminente empresa de inteligência artificial dos Estados Unidos, está intensificando seu alcance global. Na quarta-feira, a empresa realizou um grande encontro de desenvolvedores, “Code with Claude”, em Tóquio, reunindo cerca de 50
Comparação de modelos
Inicie a comparação
OR