DeepSeek-V4
Beskrivning
DeepSeeks flaggskeppsmodell av fjärde generationen. V4-Pro (1.6T MoE) och V4-Flash (284B MoE) har 1M kontext, inbyggd multimodalitet och Hybrid Attention för extrem effektivitet.
Relaterade verktyg
DeepSeek-R1
DeepSeeks första generationens resonemangsmodeller, DeepSeek-R1-Zero och DeepSeek-R1. DeepSeek-R1-Zero, en modell som tränats genom storskalig förstärkningsinlärning (RL) utan övervakad finjustering (SFT) som ett inledande steg, uppvisade anmärkningsvärd prestanda i resonemang.
DeepSeek-V3
En stark Mixture-of-Experts (MoE)-språkmodell med totalt 671B parametrar, med 37B aktiverade för varje token.
Llama 3
Llama3 är en stor språkmodell utvecklad av Meta AI. Det är efterträdaren till Metas Llama2-språkmodell.<br>Online testadress:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
grok-1
En stor språkmodell med öppen källkod från xAI
Phi-3
Phi-3 är en familj av öppna AI-modeller utvecklade av Microsoft. Phi-3-modellerna är de mest kapabla och kostnadseffektiva små språkmodellerna (SLM) som finns, och överträffar modeller av samma storlek och nästa storlek i en rad benchmarks inom språk, resonemang, kodning och matematik.
Gemma 4
Gemma 4 är Googles senaste serie med stora språkmodeller med öppen källkod, byggd på Gemini-arkitekturen, som erbjuder förbättrad prestanda, längre kontextfönster och bättre flerspråkigt stöd.