awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descubre los mejores repositorios open-source con nuestra búsqueda potenciada por IA.

ExplorarBúsquedas curadasAlternativas open-sourceSoftware autohospedableBlogMapa del sitio
ProyectoServidor MCPAcerca deCómo clasificamosPrensa
Aviso legalPrivacidadTérminos
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
Alpha-VLLM avatar

Alpha-VLLM/Lumina-DiMOO

0
View on GitHub↗
1,001 estrellas·61 forks·Python·Apache-2.0·6 vistassynbol.github.io/Lumina-DiMOO↗

Lumina DiMOO

Lumina-DiMOO: An Omni Diffusion Large Language Model for Multi-Modal Generation and Understanding

Features

  • Multimodal Diffusion Models - Omni-diffusion model for multimodal generation and understanding.
  • Unified Models - Unified multimodal generation model.
  • Unified Multimodal Models - Multimodal model for vision and language.

Historial de estrellas

Gráfico del historial de estrellas de alpha-vllm/lumina-dimooGráfico del historial de estrellas de alpha-vllm/lumina-dimoo

Búsqueda con IA

Explora más repositorios increíbles

Describe lo que necesitas en lenguaje sencillo: la IA clasifica miles de proyectos open-source curados por relevancia.

Start searching with AI

Preguntas frecuentes

¿Qué hace alpha-vllm/lumina-dimoo?

Lumina-DiMOO: An Omni Diffusion Large Language Model for Multi-Modal Generation and Understanding

¿Cuáles son las características principales de alpha-vllm/lumina-dimoo?

Las características principales de alpha-vllm/lumina-dimoo son: Multimodal Diffusion Models, Unified Models, Unified Multimodal Models.

¿Qué alternativas de código abierto existen para alpha-vllm/lumina-dimoo?

Las alternativas de código abierto para alpha-vllm/lumina-dimoo incluyen: lehduong/onediffusion. bytedance/lance — A 3B-active-parameter native unified multimodal model for image and video understanding, generation, and editing. facebookresearch/tuna-2 — Official implementation of Tuna-2: Pixel Embeddings Beat Vision Encoders for Unified Understanding and Generation. byteflow-ai/tokenflow — [CVPR 2025] 🔥 Official impl. of "TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation". deepseek-ai/janus — Janus is a multimodal large language model and unified framework that integrates visual understanding and image… meituan-longcat/longcat-next.

Alternativas open-source a Lumina DiMOO

Proyectos open-source similares, clasificados según cuántas características comparten con Lumina DiMOO.
  • deepseek-ai/janusAvatar de deepseek-ai

    deepseek-ai/Janus

    17,746Ver en GitHub↗

    Janus is a multimodal large language model and unified framework that integrates visual understanding and image generation within a single neural network. It functions as both a visual understanding model for analyzing images and a text-to-image generator. The system uses a unified transformer backbone and a multimodal latent space to bridge the gap between text and visual data. This architecture employs decoupled visual encoding and cross-modal tokenization to separate the paths for discriminative understanding and generative tasks, representing images as grids of discrete codes. The projec

    Pythonany-to-anyfoundation-modelsllm
    Ver en GitHub↗17,746
  • bytedance/lanceAvatar de bytedance

    bytedance/Lance

    1,250Ver en GitHub↗

    A 3B-active-parameter native unified multimodal model for image and video understanding, generation, and editing.

    Python
    Ver en GitHub↗1,250
  • byteflow-ai/tokenflowAvatar de ByteFlow-AI

    ByteFlow-AI/TokenFlow

    465Ver en GitHub↗

    CVPR 2025 🔥 Official impl. of "TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation".

    Python
    Ver en GitHub↗465
  • facebookresearch/tuna-2Avatar de facebookresearch

    facebookresearch/tuna-2

    725Ver en GitHub↗

    Official implementation of Tuna-2: Pixel Embeddings Beat Vision Encoders for Unified Understanding and Generation

    Python
    Ver en GitHub↗725
Ver las 29 alternativas a Lumina DiMOO→