DeepSeek-V3
الوصف
نموذج لغوي قوي من نوع Mixture-of-Experts (MoE) بإجمالي 671B معلمة، مع تنشيط 37B لكل رمز.
أدوات ذات صلة
DeepSeek-R1
نماذج الاستدلال من الجيل الأول لـ DeepSeek، وهما DeepSeek-R1-Zero و DeepSeek-R1. أظهر DeepSeek-R1-Zero، وهو نموذج تم تدريبه عبر التعلم المعزز (RL) على نطاق واسع دون ضبط دقيق خاضع للإشراف (SFT) كخطوة أولية، أداءً ملحوظًا في الاستدلال.
Llama 3
Llama3 هو نموذج لغوي كبير طورته Meta AI. وهو خليفة نموذج اللغة Llama2 من Meta.<br>عنوان الاختبار عبر الإنترنت:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
grok-1
نموذج لغوي كبير مفتوح المصدر من xAI
Phi-3
Phi-3 هي عائلة من نماذج الذكاء الاصطناعي المفتوحة التي طورتها مايكروسوفت. نماذج Phi-3 هي نماذج اللغة الصغيرة (SLM) الأكثر قدرة وفعالية من حيث التكلفة المتاحة، حيث تتفوق على نماذج من نفس الحجم والحجم التالي في مجموعة متنوعة من معايير اللغة والاستدلال والبرمجة والرياضيات.
Gemma 4
Gemma 4 هي أحدث سلسلة نماذج لغوية كبيرة مفتوحة المصدر من Google، مبنية على بنية Gemini، وتقدم أداءً محسنًا ونوافذ سياق أطول ودعمًا متعدد اللغات أفضل.
Qwen3
Qwen3 هي سلسلة نماذج اللغة الكبيرة التي طورها فريق Qwen في Alibaba Cloud. تتضمن Qwen3-2507 إصدارات Instruct و Thinking بأحجام 235B-A22B و 30B-A3B و 4B، وسياق طويل يبلغ 256K، ودعم إدخال مليون رمز في بعض السيناريوهات.