Mixtral

カテゴリー:Open Source LLMs料金: 無料

説明

Mixtral 8x7B、オープンウェイトの高品質スパース混合エキスパートモデル(SMoE)。MixtralはほとんどのベンチマークでLlama 2 70Bを上回り、推論速度は6倍高速です。ほとんどの標準ベンチマークでGPT3.5に匹敵するか、それを上回ります。<br>論文:https://arxiv.org/pdf/2401.04088.pdf<br>ニュース:https://mistral.ai/news/mixtral-of-experts/

関連ツール

DeepSeek-R1

DeepSeekの第一世代推論モデル、DeepSeek-R1-ZeroとDeepSeek-R1。DeepSeek-R1-Zeroは、教師あり微調整(SFT)を事前に行わずに大規模強化学習(RL)で訓練されたモデルであり、推論において顕著な性能を示しました。

無料

DeepSeek-V3

強力なMixture-of-Experts(MoE)言語モデル。総パラメータ671B、各トークンで37Bが活性化されます。

無料

Llama 3

Llama3はMeta AIが開発した大規模言語モデルです。MetaのLlama2言語モデルの後継です。<br>オンラインテストアドレス:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)

無料

grok-1

xAIがオープンソース化した大規模言語モデル

無料

Phi-3

Phi-3は、マイクロソフトが開発したオープンAIモデルのファミリーです。Phi-3モデルは、現在利用可能な最も高性能で費用対効果の高い小規模言語モデル(SLM)であり、言語、推論、コーディング、数学のさまざまなベンチマークにおいて、同じサイズおよび次のサイズのモデルを上回ります。

無料

Gemma 4

Gemma 4は、Googleの最新のオープンソース大規模言語モデルシリーズであり、Geminiアーキテクチャに基づいて構築され、改善されたパフォーマンス、より長いコンテキストウィンドウ、およびより良い多言語サポートを提供します。

無料