opção
Lar
Lista de modelos AL
Qwen1.5-14B-Chat
Modelo Parâmetro Quantidade
14B
Modelo Parâmetro Quantidade
Organização afiliada
Alibaba
Organização afiliada
Código aberto
Tipo de licença
Tempo de liberação
4 de Fevereiro de 2024
Tempo de liberação

Introdução ao modelo
Qwen1.5 é a versão beta do Qwen2, mantendo sua arquitetura como um modelo transformador de apenas decodificador com ativação SwiGLU, RoPE e mecanismos de atenção de múltiplas cabeças. Ele oferece nove tamanhos de modelo e possui capacidades multilíngues e de chat aprimoradas, suportando uma extensão de contexto de 32.768 tokens. Todos os modelos possuem prompts de sistema habilitados para atuação de papéis e o código suporta implementação nativa em transformers.
Deslize para a esquerda e para a direita para ver mais
Capacidade de compreensão de idiomas Capacidade de compreensão de idiomas
Capacidade de compreensão de idiomas
Muitas vezes, faz mal julgamentos semânticos, levando a óbvias desconexões lógicas nas respostas.
5.7
Escopo de cobertura do conhecimento Escopo de cobertura do conhecimento
Escopo de cobertura do conhecimento
Possui pontos cegos significativos, geralmente mostrando erros factuais e repetindo informações desatualizadas.
5.8
Capacidade de raciocínio Capacidade de raciocínio
Capacidade de raciocínio
Incapaz de manter cadeias de raciocínio coerentes, geralmente causando causalidade invertida ou erros de cálculo.
3.8
Modelo relacionado
Qwen3.6-27B O Qwen3.6 é o modelo de código aberto de última geração da família Qwen e uma versão aprimorada da série Qwen3.5.
Qwen3.5-397B-A17B O Qwen3.5 é um importante modelo de base lançado recentemente pela Alibaba, que apresenta atualizações abrangentes nas áreas de fusão multimodal, arquitetura híbrida eficiente, aprendizado por reforço escalável, cobertura multilíngue e infraestrutura de treinamento, com desempenho e praticidade significativamente aprimorados.
Qwen3.6-Max-Preview O Qwen3.6-Max-Preview é o principal modelo proprietário do Qwen, com foco em um raciocínio mais robusto, no tratamento de tarefas complexas e em um desempenho conversacional de alta qualidade.
Qwen3-Next-80B-A3B-Thinking A mais recente série Qwen3-Next lançada nos modelos Qwen, melhorando a eficiência de escalabilidade por meio de uma arquitetura de modelo inovadora.
Qwen3-235B-A22B-Thinking-2507 Qwen3 é a última geração de modelos de linguagem de grande porte da série Qwen, oferecendo um conjunto abrangente de modelos densos e de mistura de especialistas (MoE).
Documentos relevantes
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri
Conformidade com a regulamentação de veículos autônomos na Califórnia: uma nova era de multas, geocercas e 1 milhão de milhas A Guident opera um veículo de transporte da AuveTech no sul da Flórida, administrando uma rota de quatro milhas em West Palm Beach e uma rota de uma milha em Boca Raton por meio de sua tecnologia de m
Óculos Inteligentes da Apple Podem Estrear na WWDC27, Destacando a Proteção de Privacidade O repórter da Bloomberg, Mark Gurman, informa que os óculos inteligentes da Apple, com o codinome N50, estão previstos para estrear na WWDC27 em junho de 2027, com um lançamento no varejo esperado para o outono de 2027. Originalmente direcionados par
Dentro dos Detalhes Revelados Sobre o Gemini de Próxima Geração: Poder de Cálculo Sobrecarregado, Equipes Internas Discordaram Sobre Prioridades de Desenvolvimento e Alocação de Recursos Os relatórios indicam que o lançamento do tão aguardado modelo Gemini de próxima geração do Google foi adiado. Desentendimentos internos sobre prioridades de desenvolvimento e alocação de recursos, combinados com capacidade computacional limitada e p
Comparação de modelos
Inicie a comparação
OR