DeepSeek-R1

دسته:Open Source LLMsقیمت‌گذاری: رایگان

توضیحات

مدل‌های استدلال نسل اول DeepSeek، DeepSeek-R1-Zero و DeepSeek-R1. DeepSeek-R1-Zero، مدلی که از طریق یادگیری تقویتی (RL) در مقیاس بزرگ بدون تنظیم دقیق نظارت‌شده (SFT) به عنوان مرحله مقدماتی آموزش دیده است، عملکرد قابل توجهی در استدلال نشان داد.

ابزارهای مرتبط

DeepSeek-V3

یک مدل زبانی قوی Mixture-of-Experts (MoE) با مجموع 671B پارامتر که برای هر توکن 37B فعال می‌شود.

رایگان

Llama 3

Llama3 یک مدل زبانی بزرگ است که توسط Meta AI توسعه یافته است. این جانشین مدل زبانی Llama2 متا است.<br>آدرس تست آنلاین:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)

رایگان

grok-1

مدل زبانی بزرگ متن‌باز ساخته‌شده توسط xAI

رایگان

Phi-3

Phi-3 خانواده‌ای از مدل‌های هوش مصنوعی باز است که توسط مایکروسافت توسعه یافته است. مدل‌های Phi-3 توانمندترین و مقرون‌به‌صرفه‌ترین مدل‌های زبانی کوچک (SLM) موجود هستند و در معیارهای مختلف زبان، استدلال، کدنویسی و ریاضیات از مدل‌های هم‌اندازه و اندازه بعدی بهتر عمل می‌کنند.

رایگان

Gemma 4

Gemma 4 جدیدترین سری مدل‌های زبانی بزرگ متن‌باز گوگل است که بر روی معماری Gemini ساخته شده و عملکرد بهبود یافته، پنجره‌های زمینه طولانی‌تر و پشتیبانی چندزبانه بهتری را ارائه می‌دهد.

رایگان

Qwen3

Qwen3 مجموعه مدل‌های زبانی بزرگ است که توسط تیم Qwen در Alibaba Cloud توسعه یافته است. Qwen3-2507 شامل انواع Instruct و Thinking با اندازه‌های 235B-A22B، 30B-A3B و 4B، زمینه بلند 256K و پشتیبانی از ورودی 1 میلیون توکن در برخی سناریوها است.

رایگان