DeepSeek-R1

Categoria:Open Source LLMsPreços: Grátis

Descrição

Os modelos de raciocínio de primeira geração da DeepSeek, DeepSeek-R1-Zero e DeepSeek-R1. DeepSeek-R1-Zero, um modelo treinado por meio de aprendizado por reforço (RL) em larga escala sem ajuste fino supervisionado (SFT) como etapa preliminar, demonstrou desempenho notável em raciocínio.