DeepSeek-R1

Kategoria:Open Source LLMsCennik: Darmowe

Opis

Modele rozumowania pierwszej generacji DeepSeek: DeepSeek-R1-Zero i DeepSeek-R1. DeepSeek-R1-Zero, model trenowany za pomocą uczenia przez wzmacnianie (RL) na dużą skalę bez nadzorowanego dostrajania (SFT) jako wstępnego kroku, wykazał się niezwykłą wydajnością w rozumowaniu.