awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descoperă cele mai bune repository-uri open source cu căutare AI.

ExploreazăCăutări recomandateAlternative open-sourceSoftware self-hostedBlogHartă site
ProiectServer MCPDespreCum realizăm clasamentulPresă
LegalConfidențialitateTermeni
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
ruixiangcui avatar

ruixiangcui/AGIEval

0
View on GitHub↗
775 stele·54 fork-uri·Python·MIT·8 vizualizări

AGIEval

This repository contains information about AGIEval, data, code and output of baseline systems for the benchmark.

Features

  • Benchmark Datasets - Benchmark for evaluating foundation models on human-centric tasks.
  • Model Evaluation - Benchmark testing models against standardized human-level academic and professional exams.
  • Evaluation Benchmarks - Benchmark for human-level cognitive and qualification exams.

Istoric stele

Graficul istoricului de stele pentru ruixiangcui/agievalGraficul istoricului de stele pentru ruixiangcui/agieval

Căutare AI

Explorează mai multe repository-uri excelente

Descrie ce ai nevoie în limbaj simplu — AI-ul sortează mii de proiecte open source selectate în funcție de relevanță.

Start searching with AI

Întrebări frecvente

Ce face ruixiangcui/agieval?

This repository contains information about AGIEval, data, code and output of baseline systems for the benchmark.

Care sunt principalele funcționalități ale ruixiangcui/agieval?

Principalele funcționalități ale ruixiangcui/agieval sunt: Benchmark Datasets, Model Evaluation, Evaluation Benchmarks.

Care sunt câteva alternative open-source pentru ruixiangcui/agieval?

Alternativele open-source pentru ruixiangcui/agieval includ: sjtu-lit/ceval — Official github repo for C-Eval, a Chinese evaluation suite for foundation models [NeurIPS 2023]. mikegu721/xiezhibenchmark — Xiezhi (獬豸) is a comprehensive evaluation suite for Language Models (LMs). It consists of 249587 multi-choice… michael-wzhu/promptcblue — PromptCBLUE: a large-scale instruction-tuning dataset for multi-task and few-shot learning in the medical domain in… haonan-li/cmmlu — CMMLU: Measuring massive multitask language understanding in Chinese. nvidia/isaac-gr00t. sjwhitworth/golearn — GoLearn is a machine learning library for the Go programming language. It provides a supervised learning framework and…

Alternative open-source pentru AGIEval

Proiecte open-source similare, clasificate după numărul de funcționalități comune cu AGIEval.
  • mikegu721/xiezhibenchmarkAvatar MikeGu721

    MikeGu721/XiezhiBenchmark

    98Vezi pe GitHub↗

    Xiezhi (獬豸) is a comprehensive evaluation suite for Language Models (LMs). It consists of 249587 multi-choice questions spanning 516 diverse disciplines and four difficulty levels, as shown below. Please check our paper for more details, and our website will be open later on.

    Python
    Vezi pe GitHub↗98
  • michael-wzhu/promptcblueAvatar michael-wzhu

    michael-wzhu/PromptCBLUE

    394Vezi pe GitHub↗

    PromptCBLUE: a large-scale instruction-tuning dataset for multi-task and few-shot learning in the medical domain in Chinese

    Python
    Vezi pe GitHub↗394
  • haonan-li/cmmluAvatar haonan-li

    haonan-li/CMMLU

    821Vezi pe GitHub↗

    CMMLU: Measuring massive multitask language understanding in Chinese

    Python
    Vezi pe GitHub↗821
  • sjtu-lit/cevalAvatar SJTU-LIT

    SJTU-LIT/ceval

    1,854Vezi pe GitHub↗

    Official github repo for C-Eval, a Chinese evaluation suite for foundation models NeurIPS 2023

    Python
    Vezi pe GitHub↗1,854
Vezi toate cele 30 alternative pentru AGIEval→