LLM Stats
Kuvaus
LLM Stats on kattavin LLM-tuloslista, joka vertaa ja benchmarkkaa API-malleja päivittäin päivitettävän avoimen lähdekoodin yhteisödataa käyttäen koskien kapasiteettia, hintaa, nopeutta ja kontekstin pituutta.
Samankaltaiset työkalut
Hinta per token
Vertaile LLM API -hinnoittelua yli 200 mallille OpenAI:lta, Anthropicilta, Googlelta ja muilta. Sisältää token-laskurit, kustannuslaskurit ja vertailuanalyysit.
LMSYS Chatbot Arena Leaderboard
LMSYS Chatbot Arena on joukkoistettu avoin alusta LLM-arviointeja varten. Se on kerännyt yli 1 000 000 ihmisen parivertailua luokitellakseen LLM:t Bradley-Terry-mallilla ja näyttääkseen mallien arviot Elo-asteikolla.
LiveCodeBench
LiveCodeBench on kokonaisvaltainen ja saastumaton arviointikriteeri LLM:ille koodille, joka kerää jatkuvasti uusia ongelmia ajan myötä. Erityisesti LiveCodeBench keskittyy myös laajempiin koodiin liittyviin kykyihin, kuten itsekorjaukseen, koodin suorittamiseen ja testitulosten ennustamiseen pelkän koodin tuottamisen lisäksi.
Artificial Analysis
Artificial Analysis on alusta, joka tarjoaa tekoälymallien ja palveluntarjoajien vertailuja ja vertailuarvoja auttaakseen käyttäjiä tekemään tietoisia päätöksiä valitessaan tekoälymalleja ja palveluntarjoajia. Alusta tarjoaa vertailutietoja laajasta valikoimasta suosittuja tekoälymalleja, mukaan lukien OpenAI:n GPT-4, Meta:n Llama 3 ja Anthropicin Claude-sarja, jotka kattavat suorituskykymittareita, kuten vasteaika, viive ja kustannukset.
BenchGecko
Tekoälytalouden datakerros. AI-mallien benchmark-tulostaulukko, jossa on hintavertailu satojen palveluntarjoajien välillä. Seuraa tuhansia malleja 128 benchmarkissa, tekoälytalouden indikaattoreita, agenttien tulostaulukkoa ja MCP-palvelinluetteloa. Ilmainen API.