DeepSeek-V3
விளக்கம்
ஒரு வலுவான Mixture-of-Experts (MoE) மொழி மாதிரி, மொத்தம் 671B அளவுருக்கள், ஒவ்வொரு டோக்கனுக்கும் 37B செயல்படுத்தப்படுகிறது.
தொடர்புடைய கருவிகள்
DeepSeek-R1
DeepSeek-ன் முதல் தலைமுறை பகுத்தறிவு மாதிரிகள், DeepSeek-R1-Zero மற்றும் DeepSeek-R1. DeepSeek-R1-Zero, மேற்பார்வையிடப்பட்ட நுண்ணிய சரிசெய்தல் (SFT) இல்லாமல் ஆரம்ப படியாக பெரிய அளவிலான வலுவூட்டல் கற்றல் (RL) மூலம் பயிற்றுவிக்கப்பட்ட மாதிரி, பகுத்தறிவில் குறிப்பிடத்தக்க செயல்திறனை நிரூபித்தது.
Llama 3
Llama3 என்பது Meta AI ஆல் உருவாக்கப்பட்ட ஒரு பெரிய மொழி மாதிரியாகும். இது Meta இன் Llama2 மொழி மாதிரியின் வாரிசு ஆகும்.<br>ஆன்லைன் சோதனை முகவரி:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
grok-1
xAI ஆல் திறந்த மூலமாக வெளியிடப்பட்ட பெரிய மொழி மாதிரி
Phi-3
Phi-3 என்பது Microsoft ஆல் உருவாக்கப்பட்ட திறந்த AI மாதிரிகளின் குடும்பமாகும். Phi-3 மாதிரிகள் கிடைக்கக்கூடிய மிகவும் திறன்மிக்க மற்றும் செலவு குறைந்த சிறிய மொழி மாதிரிகள் (SLM) ஆகும், இவை பல்வேறு மொழி, பகுத்தறிவு, குறியீடு மற்றும் கணித அளவுகோல்களில் ஒரே அளவு மற்றும் அடுத்த அளவு மாதிரிகளை விட சிறப்பாக செயல்படுகின்றன.
Gemma 4
Gemma 4 என்பது Google இன் சமீபத்திய திறந்த மூல பெரிய மொழி மாதிரி தொடர் ஆகும், இது Gemini கட்டமைப்பின் அடிப்படையில் கட்டமைக்கப்பட்டுள்ளது, மேம்பட்ட செயல்திறன், நீண்ட சூழல் சாளரங்கள் மற்றும் சிறந்த பன்மொழி ஆதரவை வழங்குகிறது.
Qwen3
Qwen3 என்பது Alibaba Cloud இன் Qwen குழுவால் உருவாக்கப்பட்ட பெரிய மொழி மாதிரி தொடர் ஆகும். Qwen3-2507 ஆனது Instruct மற்றும் Thinking மாறுபாடுகளை உள்ளடக்கியது, 235B-A22B, 30B-A3B மற்றும் 4B அளவுகள், 256K நீண்ட சூழல், மற்றும் சில சூழ்நிலைகளில் 1M-டோக்கன் உள்ளீட்டு ஆதரவு.