Llama 3
Penerangan
Llama3 ialah model bahasa besar yang dibangunkan oleh Meta AI. Ia adalah pengganti kepada model bahasa Llama2 Meta.<br>Alamat ujian dalam talian:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
Alat Berkaitan
DeepSeek-R1
Model penaakulan generasi pertama DeepSeek, DeepSeek-R1-Zero dan DeepSeek-R1. DeepSeek-R1-Zero, model yang dilatih melalui pembelajaran pengukuhan (RL) berskala besar tanpa penalaan halus terselia (SFT) sebagai langkah awal, menunjukkan prestasi yang luar biasa dalam penaakulan.
DeepSeek-V3
Model bahasa Mixture-of-Experts (MoE) yang kukuh dengan jumlah parameter 671B, dengan 37B diaktifkan untuk setiap token.
grok-1
Model bahasa besar sumber terbuka yang dikeluarkan oleh xAI
Phi-3
Phi-3 ialah keluarga model AI terbuka yang dibangunkan oleh Microsoft. Model Phi-3 ialah model bahasa kecil (SLM) yang paling berkebolehan dan kos efektif yang tersedia, mengatasi model bersaiz sama dan saiz seterusnya dalam pelbagai penanda aras bahasa, penaakulan, pengekodan dan matematik.
Gemma 4
Gemma 4 ialah siri model bahasa besar sumber terbuka terkini Google, dibina di atas seni bina Gemini, menawarkan prestasi yang lebih baik, tetingkap konteks yang lebih panjang, dan sokongan pelbagai bahasa yang lebih baik.
Qwen3
Qwen3 ialah siri model bahasa besar yang dibangunkan oleh pasukan Qwen di Alibaba Cloud. Qwen3-2507 merangkumi varian Instruct dan Thinking dengan saiz 235B-A22B, 30B-A3B, dan 4B, konteks panjang 256K, dan sokongan input 1 juta token dalam beberapa senario.