DeepSeek-R1

قسم:Open Source LLMsقیمت: مفت

وضاحت

DeepSeek کی پہلی نسل کے استدلال ماڈل، DeepSeek-R1-Zero اور DeepSeek-R1۔ DeepSeek-R1-Zero، ایک ماڈل جو بڑے پیمانے پر کمک سیکھنے (RL) کے ذریعے زیر نگرانی فائن ٹیوننگ (SFT) کے بغیر ابتدائی مرحلے کے طور پر تربیت یافتہ ہے، نے استدلال میں قابل ذکر کارکردگی دکھائی۔

متعلقہ ٹولز

DeepSeek-V3

ایک مضبوط Mixture-of-Experts (MoE) لینگویج ماڈل جس میں کل 671B پیرامیٹرز ہیں، ہر ٹوکن کے لیے 37B فعال ہوتے ہیں۔

مفت

Llama 3

Llama3 میٹا AI کی تیار کردہ ایک بڑی زبان کا ماڈل ہے۔ یہ میٹا کے Llama2 زبان کے ماڈل کا جانشین ہے۔<br>آن لائن ٹیسٹ ایڈریس:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)

مفت

grok-1

xAI کے ذریعہ اوپن سورس کیا گیا ایک بڑا لینگویج ماڈل

مفت

Phi-3

Phi-3 مائیکروسافٹ کے تیار کردہ کھلے AI ماڈلز کا ایک خاندان ہے۔ Phi-3 ماڈل دستیاب سب سے زیادہ قابل اور لاگت مؤثر چھوٹے زبان کے ماڈل (SLM) ہیں، جو مختلف زبان، استدلال، کوڈنگ اور ریاضی کے معیارات میں ایک ہی سائز اور اگلے سائز کے ماڈلز سے بہتر کارکردگی کا مظاہرہ کرتے ہیں۔

مفت

Gemma 4

Gemma 4 Google کی تازہ ترین اوپن سورس بڑی زبان کے ماڈل سیریز ہے، جو Gemini آرکیٹیکچر پر بنائی گئی ہے، جو بہتر کارکردگی، طویل سیاق و سباق کی ونڈوز اور بہتر کثیر لسانی معاونت فراہم کرتی ہے۔

مفت

Qwen3

Qwen3 Alibaba Cloud کی Qwen ٹیم کے تیار کردہ بڑے لینگویج ماڈل سیریز ہے۔ Qwen3-2507 میں Instruct اور Thinking مختلف اقسام شامل ہیں جن کے سائز 235B-A22B، 30B-A3B اور 4B ہیں، 256K طویل سیاق و سباق، اور بعض منظرناموں میں 1M ٹوکن ان پٹ سپورٹ۔

مفت