関連ツール
DeepSeek-R1
DeepSeekの第一世代推論モデル、DeepSeek-R1-ZeroとDeepSeek-R1。DeepSeek-R1-Zeroは、教師あり微調整(SFT)を事前に行わずに大規模強化学習(RL)で訓練されたモデルであり、推論において顕著な性能を示しました。
DeepSeek-V3
強力なMixture-of-Experts(MoE)言語モデル。総パラメータ671B、各トークンで37Bが活性化されます。
Llama 3
Llama3はMeta AIが開発した大規模言語モデルです。MetaのLlama2言語モデルの後継です。<br>オンラインテストアドレス:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
Phi-3
Phi-3は、マイクロソフトが開発したオープンAIモデルのファミリーです。Phi-3モデルは、現在利用可能な最も高性能で費用対効果の高い小規模言語モデル(SLM)であり、言語、推論、コーディング、数学のさまざまなベンチマークにおいて、同じサイズおよび次のサイズのモデルを上回ります。
Gemma 4
Gemma 4は、Googleの最新のオープンソース大規模言語モデルシリーズであり、Geminiアーキテクチャに基づいて構築され、改善されたパフォーマンス、より長いコンテキストウィンドウ、およびより良い多言語サポートを提供します。
Qwen3
Qwen3は、Alibaba CloudのQwenチームによって開発された大規模言語モデルシリーズです。Qwen3-2507には、InstructおよびThinkingバリアントが含まれ、235B-A22B、30B-A3B、4Bのサイズ、256Kの長いコンテキスト、および一部のシナリオでの100万トークン入力サポートを備えています。