DeepSeek-V4
وضاحت
DeepSeek کی چوتھی نسل کا فلیگ شپ ماڈل۔ V4-Pro (1.6T MoE) اور V4-Flash (284B MoE) میں 1M سیاق و سباق، مقامی ملٹی موڈلٹی، اور انتہائی کارکردگی کے لیے Hybrid Attention شامل ہے۔
متعلقہ ٹولز
DeepSeek-R1
DeepSeek کی پہلی نسل کے استدلال ماڈل، DeepSeek-R1-Zero اور DeepSeek-R1۔ DeepSeek-R1-Zero، ایک ماڈل جو بڑے پیمانے پر کمک سیکھنے (RL) کے ذریعے زیر نگرانی فائن ٹیوننگ (SFT) کے بغیر ابتدائی مرحلے کے طور پر تربیت یافتہ ہے، نے استدلال میں قابل ذکر کارکردگی دکھائی۔
DeepSeek-V3
ایک مضبوط Mixture-of-Experts (MoE) لینگویج ماڈل جس میں کل 671B پیرامیٹرز ہیں، ہر ٹوکن کے لیے 37B فعال ہوتے ہیں۔
Llama 3
Llama3 میٹا AI کی تیار کردہ ایک بڑی زبان کا ماڈل ہے۔ یہ میٹا کے Llama2 زبان کے ماڈل کا جانشین ہے۔<br>آن لائن ٹیسٹ ایڈریس:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
grok-1
xAI کے ذریعہ اوپن سورس کیا گیا ایک بڑا لینگویج ماڈل
Phi-3
Phi-3 مائیکروسافٹ کے تیار کردہ کھلے AI ماڈلز کا ایک خاندان ہے۔ Phi-3 ماڈل دستیاب سب سے زیادہ قابل اور لاگت مؤثر چھوٹے زبان کے ماڈل (SLM) ہیں، جو مختلف زبان، استدلال، کوڈنگ اور ریاضی کے معیارات میں ایک ہی سائز اور اگلے سائز کے ماڈلز سے بہتر کارکردگی کا مظاہرہ کرتے ہیں۔
Gemma 4
Gemma 4 Google کی تازہ ترین اوپن سورس بڑی زبان کے ماڈل سیریز ہے، جو Gemini آرکیٹیکچر پر بنائی گئی ہے، جو بہتر کارکردگی، طویل سیاق و سباق کی ونڈوز اور بہتر کثیر لسانی معاونت فراہم کرتی ہے۔