Phi-3
توضیحات
Phi-3 خانوادهای از مدلهای هوش مصنوعی باز است که توسط مایکروسافت توسعه یافته است. مدلهای Phi-3 توانمندترین و مقرونبهصرفهترین مدلهای زبانی کوچک (SLM) موجود هستند و در معیارهای مختلف زبان، استدلال، کدنویسی و ریاضیات از مدلهای هماندازه و اندازه بعدی بهتر عمل میکنند.
ابزارهای مرتبط
DeepSeek-R1
مدلهای استدلال نسل اول DeepSeek، DeepSeek-R1-Zero و DeepSeek-R1. DeepSeek-R1-Zero، مدلی که از طریق یادگیری تقویتی (RL) در مقیاس بزرگ بدون تنظیم دقیق نظارتشده (SFT) به عنوان مرحله مقدماتی آموزش دیده است، عملکرد قابل توجهی در استدلال نشان داد.
DeepSeek-V3
یک مدل زبانی قوی Mixture-of-Experts (MoE) با مجموع 671B پارامتر که برای هر توکن 37B فعال میشود.
Llama 3
Llama3 یک مدل زبانی بزرگ است که توسط Meta AI توسعه یافته است. این جانشین مدل زبانی Llama2 متا است.<br>آدرس تست آنلاین:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
grok-1
مدل زبانی بزرگ متنباز ساختهشده توسط xAI
Gemma 4
Gemma 4 جدیدترین سری مدلهای زبانی بزرگ متنباز گوگل است که بر روی معماری Gemini ساخته شده و عملکرد بهبود یافته، پنجرههای زمینه طولانیتر و پشتیبانی چندزبانه بهتری را ارائه میدهد.
Qwen3
Qwen3 مجموعه مدلهای زبانی بزرگ است که توسط تیم Qwen در Alibaba Cloud توسعه یافته است. Qwen3-2507 شامل انواع Instruct و Thinking با اندازههای 235B-A22B، 30B-A3B و 4B، زمینه بلند 256K و پشتیبانی از ورودی 1 میلیون توکن در برخی سناریوها است.