DeepSeek-V4
分類:Open Source LLMs價格: 免費
描述
DeepSeek的第四代旗艦模型。V4-Pro(1.6T MoE)和V4-Flash(284B MoE),配備1M上下文、原生多模態與Hybrid Attention,實現極致效率。
相關工具
DeepSeek-R1
DeepSeek 的第一代推理模型,包括 DeepSeek-R1-Zero 和 DeepSeek-R1。DeepSeek-R1-Zero 是一種透過大規模強化學習(RL)訓練、無需監督式微調(SFT)作為初步步驟的模型,在推理方面表現出色。
免費
DeepSeek-V3
一個強大的混合專家(MoE)語言模型,總參數671B,每個token激活37B參數。
免費
Llama 3
Llama3 是 Meta AI 開發的大型語言模型。它是 Meta 的 Llama2 語言模型的繼任者。<br>在線測試地址:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)
免費
grok-1
一個由xAI開源的大型語言模型
免費
Phi-3
Phi-3 是微軟開發的一系列開放AI模型。Phi-3 模型是目前最強大且最具成本效益的小型語言模型(SLM),在語言、推理、編碼和數學等多個基準測試中均優於同尺寸及更大尺寸的模型。
免費
Gemma 4
Gemma 4 是 Google 最新的開源大型語言模型系列,基於 Gemini 架構,提供更佳的效能、更長的上下文視窗和更好的多語言支援。
免費