option
Maison
Liste des modèles Al
Qwen1.5-7B-Chat
Quantité de paramètre de modèle
7B
Quantité de paramètre de modèle
Organisation affiliée
Alibaba
Organisation affiliée
Source ouverte
Type de licence
Temps de libération
4 février 2024
Temps de libération

Introduction du modèle
Qwen1.5 est la version bêta de Qwen2, conservant une architecture de modèle de transformation uniquement décodeur avec l'activation SwiGLU, RoPE et des mécanismes d'attention multi-têtes. Elle propose neuf tailles de modèles et possède des capacités améliorées pour les modèles multilingues et de conversation, prenant en charge une longueur de contexte de 32,768 tokens. Tous les modèles incluent des invites système pour le jeu de rôle, et le code prend en charge une implémentation native dans transformers.
Faites glisser vers la gauche et la droite pour voir plus
Capacité de compréhension du langage Capacité de compréhension du langage
Capacité de compréhension du langage
Fait souvent des erreurs de jugement sémantique, conduisant à des déconnexions logiques évidentes dans les réponses.
4.5
Portée de la couverture des connaissances Portée de la couverture des connaissances
Portée de la couverture des connaissances
A des angles morts de connaissances importantes, montrant souvent des erreurs factuelles et répétant des informations obsolètes.
5.1
Capacité de raisonnement Capacité de raisonnement
Capacité de raisonnement
Incapable de maintenir des chaînes de raisonnement cohérentes, provoquant souvent une causalité inversée ou des erreurs de calcul.
2.2
Modèle connexe
Qwen3.6-27B Qwen3.6 est le modèle open source de nouvelle génération de la gamme Qwen et une version améliorée de la série Qwen3.5.
Qwen3.5-397B-A17B Qwen 3.5 est un modèle de base majeur récemment lancé par Alibaba, qui se distingue par des améliorations significatives en matière de fusion multimodale, d'architecture hybride efficace, d'apprentissage par renforcement évolutif, de couverture multilingue et d'infrastructure d'entraînement, et qui offre des performances et une utilité pratique nettement améliorées.
Qwen3.6-Max-Preview Qwen3.6-Max-Preview est le modèle phare développé en interne par Qwen, axé sur un raisonnement plus solide, la gestion de tâches complexes et des performances conversationnelles de haute qualité.
Qwen3-Next-80B-A3B-Thinking La dernière série Qwen3-Next des modèles Qwen, qui améliore l'efficacité de la mise à l'échelle grâce à une architecture de modèle innovante.
Qwen3-235B-A22B-Thinking-2507 Qwen3 est la dernière génération de grands modèles linguistiques de la série Qwen, offrant une suite complète de modèles denses et de modèles mixtes d'experts (MoE).
Documents pertinents
Les lunettes intelligentes d’Apple pourraient être présentées lors de la WWDC27, mettant en avant la protection de la vie privée Mark Gurman de Bloomberg rapporte que les lunettes intelligentes d’Apple, codifiées N50, sont prévues pour une présentation lors de la WWDC27 en juin 2027, avec un lancement commercial attendu à l’automne 2027. Initialement destinées à la fin de cett
À l’intérieur des détails révélés sur le prochain Gemini : une puissance de calcul mise à rude épreuve, des équipes internes en désaccord sur les priorités de développement et l’allocation des ressources Les rapports indiquent que le lancement du modèle Gemini de nouvelle génération, tant attendu par Google, a été repoussé. Des désaccords internes concernant les priorités de développement et l'allocation des ressources, combinés à une capacité de cal
OpenAI rejette les inquiétudes concernant un ralentissement de la croissance, affirmant que plusieurs unités commerciales accélèrent En réponse aux critiques externes concernant la décélération de la croissance des ventes et le non-respect des objectifs internes, le leader de l'IA, OpenAI, a publié une déclaration rassurante le mardi 28 avril. L'entreprise a précisé que ses produi
Coupe Super d'Alibaba : Qwen3.8-Max fait ses débuts avec des outils de codage et de bureautique améliorés Alibaba a officiellement dévoilé Qwen3.8-Max, un modèle fondamental de nouvelle génération disposant de 2,4 billions de paramètres. Cette avancée majeure en intelligence artificielle offre des gains de performance substantiels dans des domaines clés
Un magnat indien de la technologie investit 30 millions de dollars dans un concurrent d'IA à Microsoft Office L’entrepreneur en série Bhavin Turakhia investit 30 millions de dollars de ses propres fonds, pariant sur le fait que le secteur de l’IA d’entreprise dispose encore de place pour de nouveaux acteurs. Sa dernière startup, Neo, repose sur une convictio
Comparaison du modèle
Démarrer la comparaison
OR