awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descubre los mejores repositorios open-source con nuestra búsqueda potenciada por IA.

ExplorarBúsquedas curadasAlternativas open-sourceSoftware autohospedableBlogMapa del sitio
ProyectoServidor MCPAcerca deCómo clasificamosPrensa
Aviso legalPrivacidadTérminos
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
microsoft avatar

microsoft/MM-REACT

0
View on GitHub↗
multimodal-react.github.io↗

MM REACT

Official repo for MM-REACT

Features

  • In Context Learning - Prompting language models for multimodal reasoning and action.

Búsqueda con IA

Explora más repositorios increíbles

Describe lo que necesitas en lenguaje sencillo: la IA clasifica miles de proyectos open-source curados por relevancia.

Start searching with AI
  • Multimodal Agents - Prompting models for multimodal reasoning and action execution.
  • Perception Models - Prompting language models for multimodal reasoning and action.
  • Chatbots and Assistants - Multimodal ReAct design implementation.
  • 966 estrellas·68 forks·Python·MIT·8 vistas

    Historial de estrellas

    Gráfico del historial de estrellas de microsoft/mm-reactGráfico del historial de estrellas de microsoft/mm-react

    Alternativas open-source a MM REACT

    Proyectos open-source similares, clasificados según cuántas características comparten con MM REACT.
    • baaivision/emuAvatar de baaivision

      baaivision/Emu

      1,775Ver en GitHub↗

      Emu Series: Generative Multimodal Models from BAAI

      Python
      Ver en GitHub↗1,775
    • cvlab-columbia/viperAvatar de cvlab-columbia

      cvlab-columbia/viper

      1,717Ver en GitHub↗

      Code for the paper "ViperGPT: Visual Inference via Python Execution for Reasoning"

      Jupyter Notebook
      Ver en GitHub↗1,717
    • aigc-audio/audiogptAvatar de AIGC-Audio

      AIGC-Audio/AudioGPT

      10,174Ver en GitHub↗

      AudioGPT is an LLM-driven audio framework and processing suite that uses large language models to orchestrate neural audio pipelines. It functions as a multimodal audio generator and processing system, integrating a collection of pretrained models to handle speech synthesis, sound generation, and audio manipulation. The system is distinguished by its ability to generate audio from diverse inputs, including text and images, and its capacity to produce synchronized talking head videos. It also operates as a neural speech translator, converting spoken language between different tongues while pre

      Pythonaudiogptmusic
      Ver en GitHub↗10,174
    • microsoft/jarvisAvatar de microsoft

      microsoft/JARVIS

      24,854Ver en GitHub↗

      JARVIS is a system for large language model task orchestration, deployment management, and automation benchmarking. It utilizes a task orchestrator to decompose complex requests into actionable steps and coordinates various expert models to synthesize final responses. The project includes an AI model deployment manager to handle the local deployment of expert models across different hardware scales. It further provides an AI workflow API consisting of web endpoints used to trigger automated task workflows and retrieve results from model selection stages. The framework incorporates an automat

      Python
      Ver en GitHub↗24,854
    Ver las 30 alternativas a MM REACT→

    Preguntas frecuentes

    ¿Qué hace microsoft/mm-react?

    Official repo for MM-REACT

    ¿Cuáles son las características principales de microsoft/mm-react?

    Las características principales de microsoft/mm-react son: In Context Learning, Multimodal Agents, Perception Models, Chatbots and Assistants.

    ¿Qué alternativas de código abierto existen para microsoft/mm-react?

    Las alternativas de código abierto para microsoft/mm-react incluyen: cvlab-columbia/viper — Code for the paper "ViperGPT: Visual Inference via Python Execution for Reasoning". microsoft/jarvis — JARVIS is a system for large language model task orchestration, deployment management, and automation benchmarking. It… baaivision/emu — Emu Series: Generative Multimodal Models from BAAI. aigc-audio/audiogpt — AudioGPT is an LLM-driven audio framework and processing suite that uses large language models to orchestrate neural… 11cafe/jaaz — Jaaz is a self-hosted AI design suite and multimodal workspace used for generating and editing images and videos. It… baptistearno/typebot.io — Typebot is a visual chatbot builder and conversational platform designed for lead generation and data collection. It…