Llama 3
Description
Llama3 est un grand modèle de langage développé par Meta AI. Il succède au modèle de langage Llama2 de Meta.<br>Adresse de test en ligne :<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
Outils similaires
DeepSeek-R1
Les modèles de raisonnement de première génération de DeepSeek, DeepSeek-R1-Zero et DeepSeek-R1. DeepSeek-R1-Zero, un modèle entraîné par apprentissage par renforcement (RL) à grande échelle sans fine-tuning supervisé (SFT) en étape préliminaire, a démontré des performances remarquables en matière de raisonnement.
DeepSeek-V3
Un puissant modèle de langage Mixture-of-Experts (MoE) avec 671B paramètres au total, dont 37B activés pour chaque jeton.
grok-1
Un grand modèle de langage open source réalisé par xAI
Phi-3
Phi-3 est une famille de modèles d'IA ouverts développés par Microsoft. Les modèles Phi-3 sont les petits modèles de langage (SLM) les plus performants et les plus rentables disponibles, surpassant les modèles de même taille et de taille supérieure dans divers benchmarks de langage, de raisonnement, de codage et de mathématiques.
Gemma 4
Gemma 4 est la dernière série de modèles de langage open source de Google, basée sur l'architecture Gemini, offrant des performances améliorées, des fenêtres de contexte plus longues et une meilleure prise en charge multilingue.
Qwen3
Qwen3 est la série de grands modèles de langage développée par l'équipe Qwen d'Alibaba Cloud. Qwen3-2507 comprend des variantes Instruct et Thinking avec des tailles de 235B-A22B, 30B-A3B et 4B, un contexte long de 256K et une prise en charge d'entrée de 1 million de jetons dans certains scénarios.