LLM Stats
คำอธิบาย
LLM Stats เป็นกระดานผู้นำ LLM ที่ครอบคลุมที่สุด โดยทำการวัดและเปรียบเทียบโมเดล API โดยใช้ข้อมูลชุมชนโอเพนซอร์สที่อัปเดตทุกวันเกี่ยวกับความสามารถ ราคา ความเร็ว และความยาวบริบท
เครื่องมือที่เกี่ยวข้อง
ราคาต่อโทเคน
เปรียบเทียบราคา LLM API สำหรับ 200+ โมเดลจาก OpenAI, Anthropic, Google และอื่นๆ รวมถึงตัวนับโทเคน เครื่องคำนวณต้นทุน และการเปรียบเทียบเกณฑ์มาตรฐาน
LMSYS Chatbot Arena Leaderboard
LMSYS Chatbot Arena เป็นแพลตฟอร์มเปิดแบบ crowdsourced สำหรับการประเมิน LLM เก็บรวบรวมการเปรียบเทียบแบบคู่จากมนุษย์มากกว่า 1,000,000 ครั้งเพื่อจัดอันดับ LLM ด้วยโมเดล Bradley-Terry และแสดงคะแนนของโมเดลในระดับ Elo
LiveCodeBench
LiveCodeBench เป็นเกณฑ์มาตรฐานการประเมิน LLM สำหรับโค้ดที่ครอบคลุมและปราศจากการปนเปื้อน ซึ่งรวบรวมปัญหาใหม่ ๆ อย่างต่อเนื่องเมื่อเวลาผ่านไป โดยเฉพาะอย่างยิ่ง LiveCodeBench ยังให้ความสำคัญกับความสามารถที่เกี่ยวข้องกับโค้ดในวงกว้างมากขึ้น เช่น การซ่อมแซมตัวเอง การเรียกใช้โค้ด และการคาดเดาผลลัพธ์การทดสอบ นอกเหนือจากการสร้างโค้ดเพียงอย่างเดียว
Artificial Analysis
Artificial Analysis เป็นแพลตฟอร์มที่ให้การเปรียบเทียบและเกณฑ์มาตรฐานของโมเดล AI และผู้ให้บริการ เพื่อช่วยให้ผู้ใช้ตัดสินใจอย่างมีข้อมูลเมื่อเลือกโมเดล AI และผู้ให้บริการ แพลตฟอร์มนี้ให้ข้อมูลเปรียบเทียบสำหรับโมเดล AI ยอดนิยมที่หลากหลาย รวมถึง GPT-4 ของ OpenAI, Llama 3 ของ Meta และซีรีส์ Claude ของ Anthropic ครอบคลุมตัวชี้วัดประสิทธิภาพ เช่น เวลาตอบสนอง ความหน่วง และต้นทุน
BenchGecko
เลเยอร์ข้อมูลของเศรษฐกิจ AI กระดานผู้นำเกณฑ์มาตรฐานโมเดล AI พร้อมการเปรียบเทียบราคาระหว่างผู้ให้บริการหลายร้อยราย ติดตามโมเดลหลายพันรายการจากเกณฑ์มาตรฐาน 128 รายการ ตัวชี้วัดเศรษฐกิจ AI กระดานผู้นำเอเจนต์ และไดเรกทอรีเซิร์ฟเวอร์ MCP API ฟรี