grok-1
Beskrivning
En stor språkmodell med öppen källkod från xAI
Relaterade verktyg
DeepSeek-R1
DeepSeeks första generationens resonemangsmodeller, DeepSeek-R1-Zero och DeepSeek-R1. DeepSeek-R1-Zero, en modell som tränats genom storskalig förstärkningsinlärning (RL) utan övervakad finjustering (SFT) som ett inledande steg, uppvisade anmärkningsvärd prestanda i resonemang.
DeepSeek-V3
En stark Mixture-of-Experts (MoE)-språkmodell med totalt 671B parametrar, med 37B aktiverade för varje token.
Llama 3
Llama3 är en stor språkmodell utvecklad av Meta AI. Det är efterträdaren till Metas Llama2-språkmodell.<br>Online testadress:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
Phi-3
Phi-3 är en familj av öppna AI-modeller utvecklade av Microsoft. Phi-3-modellerna är de mest kapabla och kostnadseffektiva små språkmodellerna (SLM) som finns, och överträffar modeller av samma storlek och nästa storlek i en rad benchmarks inom språk, resonemang, kodning och matematik.
Gemma 4
Gemma 4 är Googles senaste serie med stora språkmodeller med öppen källkod, byggd på Gemini-arkitekturen, som erbjuder förbättrad prestanda, längre kontextfönster och bättre flerspråkigt stöd.
Qwen3
Qwen3 är serien av stora språkmodeller utvecklad av Qwen-teamet på Alibaba Cloud. Qwen3-2507 inkluderar Instruct- och Thinking-varianter med storlekarna 235B-A22B, 30B-A3B och 4B, 256K lång kontext och stöd för 1 miljon tokens inmatning i vissa scenarier.