DeepSeek-V4
الوصف
نموذج DeepSeek الرائد من الجيل الرابع. يوفر V4-Pro (1.6T MoE) وV4-Flash (284B MoE) سياق 1M، وتعدد الوسائط الأصلي، وHybrid Attention لكفاءة فائقة.
أدوات ذات صلة
DeepSeek-R1
نماذج الاستدلال من الجيل الأول لـ DeepSeek، وهما DeepSeek-R1-Zero و DeepSeek-R1. أظهر DeepSeek-R1-Zero، وهو نموذج تم تدريبه عبر التعلم المعزز (RL) على نطاق واسع دون ضبط دقيق خاضع للإشراف (SFT) كخطوة أولية، أداءً ملحوظًا في الاستدلال.
DeepSeek-V3
نموذج لغوي قوي من نوع Mixture-of-Experts (MoE) بإجمالي 671B معلمة، مع تنشيط 37B لكل رمز.
Llama 3
Llama3 هو نموذج لغوي كبير طورته Meta AI. وهو خليفة نموذج اللغة Llama2 من Meta.<br>عنوان الاختبار عبر الإنترنت:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
grok-1
نموذج لغوي كبير مفتوح المصدر من xAI
Phi-3
Phi-3 هي عائلة من نماذج الذكاء الاصطناعي المفتوحة التي طورتها مايكروسوفت. نماذج Phi-3 هي نماذج اللغة الصغيرة (SLM) الأكثر قدرة وفعالية من حيث التكلفة المتاحة، حيث تتفوق على نماذج من نفس الحجم والحجم التالي في مجموعة متنوعة من معايير اللغة والاستدلال والبرمجة والرياضيات.
Gemma 4
Gemma 4 هي أحدث سلسلة نماذج لغوية كبيرة مفتوحة المصدر من Google، مبنية على بنية Gemini، وتقدم أداءً محسنًا ونوافذ سياق أطول ودعمًا متعدد اللغات أفضل.