DeepSeek-R1

Kategori:Open Source LLMsFiyatlandırma: Ücretsiz

Açıklama

DeepSeek'in ilk nesil akıl yürütme modelleri, DeepSeek-R1-Zero ve DeepSeek-R1. DeepSeek-R1-Zero, ön adım olarak denetimli ince ayar (SFT) yapılmadan büyük ölçekli pekiştirmeli öğrenme (RL) ile eğitilmiş bir model, akıl yürütmede dikkat çekici bir performans sergiledi.