Mixtral

قسم:Open Source LLMsقیمت: مفت

وضاحت

Mixtral 8x7B، ایک اعلیٰ معیار کا اسپارس مکسچر آف ایکسپرٹس ماڈل (SMoE) جس کے وزن کھلے ہیں۔ Mixtral زیادہ تر بینچ مارکس میں Llama 2 70B کو پیچھے چھوڑ دیتا ہے، جس میں انفرنس 6 گنا تیز ہے۔ یہ زیادہ تر معیاری بینچ مارکس میں GPT3.5 کے برابر یا اس سے بہتر ہے۔<br>پیپر: https://arxiv.org/pdf/2401.04088.pdf<br>خبریں: https://mistral.ai/news/mixtral-of-experts/

متعلقہ ٹولز

DeepSeek-R1

DeepSeek کی پہلی نسل کے استدلال ماڈل، DeepSeek-R1-Zero اور DeepSeek-R1۔ DeepSeek-R1-Zero، ایک ماڈل جو بڑے پیمانے پر کمک سیکھنے (RL) کے ذریعے زیر نگرانی فائن ٹیوننگ (SFT) کے بغیر ابتدائی مرحلے کے طور پر تربیت یافتہ ہے، نے استدلال میں قابل ذکر کارکردگی دکھائی۔

مفت

DeepSeek-V3

ایک مضبوط Mixture-of-Experts (MoE) لینگویج ماڈل جس میں کل 671B پیرامیٹرز ہیں، ہر ٹوکن کے لیے 37B فعال ہوتے ہیں۔

مفت

Llama 3

Llama3 میٹا AI کی تیار کردہ ایک بڑی زبان کا ماڈل ہے۔ یہ میٹا کے Llama2 زبان کے ماڈل کا جانشین ہے۔<br>آن لائن ٹیسٹ ایڈریس:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)

مفت

grok-1

xAI کے ذریعہ اوپن سورس کیا گیا ایک بڑا لینگویج ماڈل

مفت

Phi-3

Phi-3 مائیکروسافٹ کے تیار کردہ کھلے AI ماڈلز کا ایک خاندان ہے۔ Phi-3 ماڈل دستیاب سب سے زیادہ قابل اور لاگت مؤثر چھوٹے زبان کے ماڈل (SLM) ہیں، جو مختلف زبان، استدلال، کوڈنگ اور ریاضی کے معیارات میں ایک ہی سائز اور اگلے سائز کے ماڈلز سے بہتر کارکردگی کا مظاہرہ کرتے ہیں۔

مفت

Gemma 4

Gemma 4 Google کی تازہ ترین اوپن سورس بڑی زبان کے ماڈل سیریز ہے، جو Gemini آرکیٹیکچر پر بنائی گئی ہے، جو بہتر کارکردگی، طویل سیاق و سباق کی ونڈوز اور بہتر کثیر لسانی معاونت فراہم کرتی ہے۔

مفت