Gemma 4
Beschreibung
Gemma 4 ist die neueste Open-Source-Serie großer Sprachmodelle von Google, die auf der Gemini-Architektur basiert und verbesserte Leistung, längere Kontextfenster und bessere Mehrsprachigkeit bietet.
Verwandte Tools
DeepSeek-R1
DeepSeeks erste Generation von Reasoning-Modellen, DeepSeek-R1-Zero und DeepSeek-R1. DeepSeek-R1-Zero, ein Modell, das durch groß angelegtes Reinforcement Learning (RL) ohne überwachtes Feintuning (SFT) als vorbereitenden Schritt trainiert wurde, zeigte bemerkenswerte Leistungen beim Reasoning.
DeepSeek-V3
Ein starkes Mixture-of-Experts (MoE)-Sprachmodell mit insgesamt 671B Parametern, von denen bei jedem Token 37B aktiviert werden.
Llama 3
Llama3 ist ein großes Sprachmodell, das von Meta AI entwickelt wurde. Es ist der Nachfolger von Metas Llama2-Sprachmodell.<br>Online-Testadresse:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
grok-1
Ein von xAI als Open Source veröffentlichtes großes Sprachmodell
Phi-3
Phi-3 ist eine Familie offener KI-Modelle, die von Microsoft entwickelt wurde. Phi-3-Modelle sind die leistungsfähigsten und kostengünstigsten kleinen Sprachmodelle (SLMs), die derzeit verfügbar sind, und übertreffen Modelle gleicher Größe und der nächstgrößeren Größe in verschiedenen Benchmarks für Sprache, Denken, Programmierung und Mathematik.
Qwen3
Qwen3 ist die Large-Language-Model-Serie von Qwen-Team bei Alibaba Cloud. Qwen3-2507 umfasst Instruct- und Thinking-Varianten mit den Größen 235B-A22B, 30B-A3B und 4B, 256K langem Kontext und Unterstützung für 1-Million-Token-Eingaben in einigen Szenarien.