Mixtral

Danh mục:Open Source LLMsGiá: Miễn phí

Mô tả

Mixtral 8x7B, một mô hình hỗn hợp chuyên gia thưa thớt (SMoE) chất lượng cao với trọng số mở. Mixtral vượt trội hơn Llama 2 70B trong hầu hết các điểm chuẩn với tốc độ suy luận nhanh hơn 6 lần. Nó ngang bằng hoặc vượt trội hơn GPT3.5 trong hầu hết các điểm chuẩn tiêu chuẩn.<br>Bài báo: https://arxiv.org/pdf/2401.04088.pdf<br>Tin tức: https://mistral.ai/news/mixtral-of-experts/

Công cụ liên quan

DeepSeek-R1

Các mô hình suy luận thế hệ đầu tiên của DeepSeek, DeepSeek-R1-Zero và DeepSeek-R1. DeepSeek-R1-Zero, một mô hình được huấn luyện thông qua học tăng cường (RL) quy mô lớn mà không cần tinh chỉnh có giám sát (SFT) như bước sơ bộ, đã thể hiện hiệu suất vượt trội trong suy luận.

Miễn phí

DeepSeek-V3

Mô hình ngôn ngữ Mixture-of-Experts (MoE) mạnh mẽ với tổng 671B tham số, trong đó 37B được kích hoạt cho mỗi token.

Miễn phí

Llama 3

Llama3 là mô hình ngôn ngữ lớn do Meta AI phát triển. Đây là phiên bản kế nhiệm của mô hình ngôn ngữ Llama2 của Meta.<br>Địa chỉ kiểm tra trực tuyến:<br>[huggingface.co/Meta-Llama-3-70B-Instruct](https://huggingface.co/chat/models/meta-llama/Meta-Llama-3-70B-Instruct)

Miễn phí

grok-1

Mô hình ngôn ngữ lớn mã nguồn mở do xAI phát hành

Miễn phí

Phi-3

Phi-3 là một gia đình các mô hình AI mở do Microsoft phát triển. Các mô hình Phi-3 là các mô hình ngôn ngữ nhỏ (SLM) có khả năng và tiết kiệm chi phí nhất hiện có, vượt trội so với các mô hình cùng kích thước và kích thước tiếp theo trong nhiều chuẩn đánh giá về ngôn ngữ, lập luận, mã hóa và toán học.

Miễn phí

Gemma 4

Gemma 4 là dòng mô hình ngôn ngữ lớn mã nguồn mở mới nhất của Google, được xây dựng trên kiến trúc Gemini, mang lại hiệu suất được cải thiện, cửa sổ ngữ cảnh dài hơn và hỗ trợ đa ngôn ngữ tốt hơn.

Miễn phí