awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descoperă cele mai bune repository-uri open source cu căutare AI.

ExploreazăCăutări recomandateAlternative open-sourceSoftware self-hostedBlogHartă site
ProiectServer MCPDespreCum realizăm clasamentulPresă
LegalConfidențialitateTermeni
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
VT-NLP avatar

VT-NLP/MultiInstruct

0
View on GitHub↗
135 stele·4 fork-uri·Python·Apache-2.0·8 vizualizări

MultiInstruct

MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning

Features

  • Pre-training Datasets - Benchmark dataset for multimodal zero-shot learning.

Istoric stele

Graficul istoricului de stele pentru vt-nlp/multiinstructGraficul istoricului de stele pentru vt-nlp/multiinstruct

Căutare AI

Explorează mai multe repository-uri excelente

Descrie ce ai nevoie în limbaj simplu — AI-ul sortează mii de proiecte open source selectate în funcție de relevanță.

Start searching with AI

Alternative open-source pentru MultiInstruct

Proiecte open-source similare, clasificate după numărul de funcționalități comune cu MultiInstruct.
  • plexpt/chatgpt-corpusAvatar PlexPt

    PlexPt/chatgpt-corpus

    964Vezi pe GitHub↗

    This project provides a comprehensive Chinese language corpus designed to support the training and fine-tuning of large language models. It serves as a structured natural language processing resource, offering a collection of text data that includes dialogue, customer service interactions, and creative writing. The dataset is organized into distinct thematic categories, allowing for targeted model development across specific conversational and narrative contexts. By providing information in standardized, schema-agnostic text formats, the collection ensures portability across various machine l

    awesomecorpuscorpus-data
    Vezi pe GitHub↗964
  • fuxiaoliu/lrv-instructionAvatar FuxiaoLiu

    FuxiaoLiu/LRV-Instruction

    297Vezi pe GitHub↗

    ICLR'24 Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning

    Pythonchatgptevaluationevaluation-metrics
    Vezi pe GitHub↗297
  • guoyang9/unk-vqaAvatar guoyang9

    guoyang9/UNK-VQA

    7Vezi pe GitHub↗

    A VQA dataset that includes unanswerable questions TPAMI 2024.

    Vezi pe GitHub↗7
  • esbatmop/mnbvcAvatar esbatmop

    esbatmop/MNBVC

    4,123Vezi pe GitHub↗

    MNBVC is a dataset pipeline and toolkit designed for the collection, cleaning, and normalization of massive text and code corpora used to train large language models. It provides specialized tools for harvesting source code, commit histories, and repository metadata from version control platforms, alongside a multilingual text corpus collector for gathering parallel text and academic papers. The project distinguishes itself through comprehensive capabilities for processing diverse document types, including a PDF-to-text converter that transforms complex layouts and formulas into structured JS

    chinesechinese-languagechinese-nlp
    Vezi pe GitHub↗4,123
Vezi toate cele 27 alternative pentru MultiInstruct→

Întrebări frecvente

Ce face vt-nlp/multiinstruct?

MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning

Care sunt principalele funcționalități ale vt-nlp/multiinstruct?

Principalele funcționalități ale vt-nlp/multiinstruct sunt: Pre-training Datasets.

Care sunt câteva alternative open-source pentru vt-nlp/multiinstruct?

Alternativele open-source pentru vt-nlp/multiinstruct includ: plexpt/chatgpt-corpus — This project provides a comprehensive Chinese language corpus designed to support the training and fine-tuning of… fuxiaoliu/lrv-instruction — [ICLR'24] Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning. guoyang9/unk-vqa — A VQA dataset that includes unanswerable questions [TPAMI 2024]. hypjudy/sparkles — Sparkles: Unlocking Chats Across Multiple Images for Multimodal Instruction-Following Models. icoz69/stablellava — Official repo for StableLLAVA. esbatmop/mnbvc — MNBVC is a dataset pipeline and toolkit designed for the collection, cleaning, and normalization of massive text and…