DeepSeek-R1
Opis
Modele rozumowania pierwszej generacji DeepSeek: DeepSeek-R1-Zero i DeepSeek-R1. DeepSeek-R1-Zero, model trenowany za pomocą uczenia przez wzmacnianie (RL) na dużą skalę bez nadzorowanego dostrajania (SFT) jako wstępnego kroku, wykazał się niezwykłą wydajnością w rozumowaniu.
Powiązane narzędzia
DeepSeek-V3
Potężny model językowy Mixture-of-Experts (MoE) z łącznie 671B parametrami, z których 37B jest aktywowanych dla każdego tokena.
Llama 3
Llama3 to duży model językowy opracowany przez Meta AI. Jest następcą modelu językowego Llama2 firmy Meta.<br>Adres testu online:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
grok-1
Duży model językowy open source stworzony przez xAI
Phi-3
Phi-3 to rodzina otwartych modeli AI opracowanych przez Microsoft. Modele Phi-3 to najbardziej wydajne i opłacalne małe modele językowe (SLM) dostępne na rynku, przewyższające modele tej samej wielkości i następnej wielkości w różnych benchmarkach językowych, rozumowania, kodowania i matematyki.
Gemma 4
Gemma 4 to najnowsza seria wielkoskalowych modeli językowych Google o otwartym kodzie źródłowym, zbudowana na architekturze Gemini, oferująca ulepszone osiągi, dłuższe okna kontekstowe i lepsze wsparcie wielojęzyczne.
Qwen3
Qwen3 to seria dużych modeli językowych opracowana przez zespół Qwen w Alibaba Cloud. Qwen3-2507 obejmuje warianty Instruct i Thinking o rozmiarach 235B-A22B, 30B-A3B i 4B, długi kontekst 256K oraz obsługę wejścia 1 miliona tokenów w niektórych scenariuszach.