DeepSeek-V4
説明
DeepSeekの第4世代フラッグシップモデル。V4-Pro(1.6T MoE)とV4-Flash(284B MoE)は、1Mコンテキスト、ネイティブなマルチモーダル対応、そしてHybrid Attentionによる極めて高い効率性を備えています。
関連ツール
DeepSeek-R1
DeepSeekの第一世代推論モデル、DeepSeek-R1-ZeroとDeepSeek-R1。DeepSeek-R1-Zeroは、教師あり微調整(SFT)を事前に行わずに大規模強化学習(RL)で訓練されたモデルであり、推論において顕著な性能を示しました。
DeepSeek-V3
強力なMixture-of-Experts(MoE)言語モデル。総パラメータ671B、各トークンで37Bが活性化されます。
Llama 3
Llama3はMeta AIが開発した大規模言語モデルです。MetaのLlama2言語モデルの後継です。<br>オンラインテストアドレス:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
grok-1
xAIがオープンソース化した大規模言語モデル
Phi-3
Phi-3は、マイクロソフトが開発したオープンAIモデルのファミリーです。Phi-3モデルは、現在利用可能な最も高性能で費用対効果の高い小規模言語モデル(SLM)であり、言語、推論、コーディング、数学のさまざまなベンチマークにおいて、同じサイズおよび次のサイズのモデルを上回ります。
Gemma 4
Gemma 4は、Googleの最新のオープンソース大規模言語モデルシリーズであり、Geminiアーキテクチャに基づいて構築され、改善されたパフォーマンス、より長いコンテキストウィンドウ、およびより良い多言語サポートを提供します。