Mixtral
விளக்கம்
Mixtral 8x7B, உயர்தர ஸ்பார்ஸ் மிக்ஸ்ச்சர் ஆஃப் எக்ஸ்பர்ட்ஸ் மாடல் (SMoE) திறந்த எடைகளுடன். Mixtral பெரும்பாலான அளவுகோல்களில் Llama 2 70B ஐ மிஞ்சுகிறது, 6 மடங்கு வேகமான inference உடன். இது பெரும்பாலான நிலையான அளவுகோல்களில் GPT3.5 உடன் பொருந்துகிறது அல்லது மிஞ்சுகிறது.<br>காகிதம்: https://arxiv.org/pdf/2401.04088.pdf<br>செய்திகள்: https://mistral.ai/news/mixtral-of-experts/
தொடர்புடைய கருவிகள்
DeepSeek-R1
DeepSeek-ன் முதல் தலைமுறை பகுத்தறிவு மாதிரிகள், DeepSeek-R1-Zero மற்றும் DeepSeek-R1. DeepSeek-R1-Zero, மேற்பார்வையிடப்பட்ட நுண்ணிய சரிசெய்தல் (SFT) இல்லாமல் ஆரம்ப படியாக பெரிய அளவிலான வலுவூட்டல் கற்றல் (RL) மூலம் பயிற்றுவிக்கப்பட்ட மாதிரி, பகுத்தறிவில் குறிப்பிடத்தக்க செயல்திறனை நிரூபித்தது.
DeepSeek-V3
ஒரு வலுவான Mixture-of-Experts (MoE) மொழி மாதிரி, மொத்தம் 671B அளவுருக்கள், ஒவ்வொரு டோக்கனுக்கும் 37B செயல்படுத்தப்படுகிறது.
Llama 3
Llama3 என்பது Meta AI ஆல் உருவாக்கப்பட்ட ஒரு பெரிய மொழி மாதிரியாகும். இது Meta இன் Llama2 மொழி மாதிரியின் வாரிசு ஆகும்.<br>ஆன்லைன் சோதனை முகவரி:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
grok-1
xAI ஆல் திறந்த மூலமாக வெளியிடப்பட்ட பெரிய மொழி மாதிரி
Phi-3
Phi-3 என்பது Microsoft ஆல் உருவாக்கப்பட்ட திறந்த AI மாதிரிகளின் குடும்பமாகும். Phi-3 மாதிரிகள் கிடைக்கக்கூடிய மிகவும் திறன்மிக்க மற்றும் செலவு குறைந்த சிறிய மொழி மாதிரிகள் (SLM) ஆகும், இவை பல்வேறு மொழி, பகுத்தறிவு, குறியீடு மற்றும் கணித அளவுகோல்களில் ஒரே அளவு மற்றும் அடுத்த அளவு மாதிரிகளை விட சிறப்பாக செயல்படுகின்றன.
Gemma 4
Gemma 4 என்பது Google இன் சமீபத்திய திறந்த மூல பெரிய மொழி மாதிரி தொடர் ஆகும், இது Gemini கட்டமைப்பின் அடிப்படையில் கட்டமைக்கப்பட்டுள்ளது, மேம்பட்ட செயல்திறன், நீண்ட சூழல் சாளரங்கள் மற்றும் சிறந்த பன்மொழி ஆதரவை வழங்குகிறது.