BenchGecko
বিবরণ
AI অর্থনীতির ডেটা স্তর। AI মডেল বেঞ্চমার্ক লিডারবোর্ড যা শতাধিক প্রদানকারীর মধ্যে ক্রস-প্রোভাইডার মূল্য তুলনা করে। 128টি বেঞ্চমার্কে হাজার হাজার মডেল ট্র্যাক করে, AI অর্থনীতি সূচক, এজেন্ট লিডারবোর্ড এবং MCP সার্ভার ডিরেক্টরি। ফ্রি API।
সম্পর্কিত টুল
LLM Stats
LLM Stats হল সবচেয়ে ব্যাপক LLM লিডারবোর্ড, যা প্রতিদিন আপডেট হওয়া ওপেন-সোর্স কমিউনিটি ডেটা ব্যবহার করে ক্ষমতা, মূল্য, গতি এবং কনটেক্সট দৈর্ঘ্যের উপর API মডেলগুলির বেঞ্চমার্ক এবং তুলনা করে।
প্রতি টোকেন মূল্য
OpenAI, Anthropic, Google এবং আরও অনেকের 200+ মডেলের LLM API মূল্য তুলনা করুন। টোকেন কাউন্টার, খরচ ক্যালকুলেটর এবং বেঞ্চমার্ক তুলনা অন্তর্ভুক্ত।
LMSYS Chatbot Arena Leaderboard
LMSYS Chatbot Arena হল LLM মূল্যায়নের জন্য একটি ক্রাউডসোর্সড ওপেন প্ল্যাটফর্ম। এটি 1,000,000-এরও বেশি মানব জোড়াভিত্তিক তুলনা সংগ্রহ করেছে Bradley-Terry মডেল দিয়ে LLM-দের র্যাঙ্ক করতে এবং Elo-স্কেলে মডেল রেটিং প্রদর্শন করতে।
LiveCodeBench
LiveCodeBench হল কোডের জন্য LLM-এর একটি সামগ্রিক এবং দূষণমুক্ত মূল্যায়ন বেঞ্চমার্ক যা সময়ের সাথে সাথে নতুন সমস্যা সংগ্রহ করতে থাকে। বিশেষত, LiveCodeBench কেবল কোড তৈরি ছাড়াও স্ব-মেরামত, কোড এক্সিকিউশন এবং পরীক্ষার আউটপুট পূর্বাভাসের মতো বিস্তৃত কোড-সম্পর্কিত ক্ষমতার উপরও দৃষ্টি নিবদ্ধ করে।
Artificial Analysis
Artificial Analysis এমন একটি প্ল্যাটফর্ম যা AI মডেল এবং পরিষেবা প্রদানকারীদের তুলনা এবং বেঞ্চমার্ক প্রদান করে, ব্যবহারকারীদের AI মডেল এবং পরিষেবা প্রদানকারী বেছে নেওয়ার সময় সচেতন সিদ্ধান্ত নিতে সহায়তা করে। প্ল্যাটফর্মটি OpenAI-এর GPT-4, Meta-এর Llama 3 এবং Anthropic-এর Claude সিরিজ সহ জনপ্রিয় AI মডেলগুলির বিস্তৃত পরিসরে তুলনামূলক ডেটা সরবরাহ করে, যা প্রতিক্রিয়া সময়, বিলম্ব এবং খরচের মতো কর্মক্ষমতা মেট্রিক্স কভার করে।