grok-1
Beschrijving
Een groot taalmodel met open source, uitgebracht door xAI
Gerelateerde tools
DeepSeek-R1
De eerste generatie redeneermodellen van DeepSeek, DeepSeek-R1-Zero en DeepSeek-R1. DeepSeek-R1-Zero, een model dat is getraind via grootschalig reinforcement learning (RL) zonder supervised fine-tuning (SFT) als voorbereidende stap, toonde opmerkelijke prestaties op het gebied van redeneren.
DeepSeek-V3
Een krachtig Mixture-of-Experts (MoE)-taalmodel met in totaal 671B parameters, waarvan er 37B worden geactiveerd voor elk token.
Llama 3
Llama3 is een groot taalmodel ontwikkeld door Meta AI. Het is de opvolger van Meta's Llama2-taalmodel.<br>Online testadres:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
Phi-3
Phi-3 is een familie van open AI-modellen ontwikkeld door Microsoft. Phi-3-modellen zijn de meest capabele en kosteneffectieve kleine taalmodellen (SLM's) die beschikbaar zijn, en overtreffen modellen van dezelfde grootte en de volgende grootte in een verscheidenheid aan benchmarks voor taal, redeneren, coderen en wiskunde.
Gemma 4
Gemma 4 is de nieuwste open source-serie grote taalmodellen van Google, gebouwd op de Gemini-architectuur, met verbeterde prestaties, langere contextvensters en betere meertalige ondersteuning.
Qwen3
Qwen3 is de serie grote taalmodellen ontwikkeld door het Qwen-team bij Alibaba Cloud. Qwen3-2507 omvat Instruct- en Thinking-varianten met formaten 235B-A22B, 30B-A3B en 4B, 256K lange context en ondersteuning voor 1 miljoen token-invoer in sommige scenario's.