awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descubre los mejores repositorios open-source con nuestra búsqueda potenciada por IA.

ExplorarBúsquedas curadasAlternativas open-sourceSoftware autohospedableBlogMapa del sitio
ProyectoServidor MCPAcerca deCómo clasificamosPrensa
Aviso legalPrivacidadTérminos
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
leondz avatar

leondz/garak

0
View on GitHub↗
8,227 estrellas·1,044 forks·Python·Apache-2.0·21 vistasdiscord.gg/uVch4puUCs↗

Garak

Garak es un conjunto de herramientas para medir la fiabilidad de la IA, escanear vulnerabilidades y automatizar evaluaciones de seguridad mediante sondeos adaptativos. Funciona como un escáner de vulnerabilidades de IA generativa y herramienta de evaluación diseñada para identificar brechas de seguridad, alucinaciones y modos de falla en modelos de lenguaje.

El framework proporciona un kit de herramientas para red-teaming y evaluaciones de seguridad, utilizando un sistema estructurado de sondas y detectores para calcular las tasas de falla. Escanea específicamente riesgos como la fuga de datos y la inyección de prompts registrando las respuestas del modelo a entradas adversarias.

El proyecto incluye un sistema de plugins para crear generadores y detectores personalizados para ampliar el conjunto de pruebas. Además, admite la integración con varios proveedores de modelos de IA a través de APIs en la nube, archivos locales y puntos finales web, con resultados mantenidos a través de registros de evaluación de seguridad.

Features

  • Model Red-Teaming - Implements automated adversarial testing and vulnerability scanning to identify safety failures in generative AI models.
  • AI Risk Assessments - Automates the evaluation of security postures and risk profiles for language models using structured probes.
  • LLM Security - Identifies and documents security vulnerabilities such as prompt injection through adversarial probing and response logging.
  • Generative Model Scanners - Scans generative AI models for critical vulnerabilities like data leakage and prompt injection.
  • LLM Security Scanning - Employs adaptive probes to scan generative models for hallucinations, data leakage, and injection vectors.
  • LLM Evaluation - Measures model reliability and quality by running standardized probes and calculating failure rates.
  • Model Provider Integrations - Provides connectors to interface with large language models hosted via cloud APIs and local endpoints.
  • Test Suite Extensions - Includes a plugin system for expanding the suite with custom adversarial probes and detectors.
  • Model Failure Analyzers - Analyzes model responses against specific detectors to identify and quantify undesirable failure modes.
  • AI Safety Testing Frameworks - Offers a plugin-based framework for creating custom generators and detectors to evaluate model safety.
  • AI Application Security - Comprehensive vulnerability scanner for LLM weaknesses and jailbreaks.
  • AI Security - Vulnerability scanner for probing LLM weaknesses.
  • AI Security and Red Teaming - LLM vulnerability scanner for probing language models.
  • Guardrails and AI Safety - Listed in the “Guardrails and AI Safety” section of the The Incredible Pytorch awesome list.
  • Safety and Security - LLM vulnerability scanner.

Historial de estrellas

Gráfico del historial de estrellas de leondz/garakGráfico del historial de estrellas de leondz/garak

Búsqueda con IA

Explora más repositorios increíbles

Describe lo que necesitas en lenguaje sencillo: la IA clasifica miles de proyectos open-source curados por relevancia.

Start searching with AI

Alternativas open-source a Garak

Proyectos open-source similares, clasificados según cuántas características comparten con Garak.
  • nvidia/nemo-guardrailsAvatar de NVIDIA

    NVIDIA/NeMo-Guardrails

    6,453Ver en GitHub↗

    NeMo-Guardrails is a toolkit for adding programmable safety constraints and dialogue boundaries to large language model conversational systems. It functions as security middleware that intercepts inputs and outputs to block prompt injections, jailbreaks, and sensitive data leaks, while providing a conversational dialogue manager to define structured interaction flows through configuration files. The framework includes a hallucination filter to screen model outputs for factual accuracy and a specialized modeling language for defining conversational flows and constraints. It provides capabiliti

    Python
    Ver en GitHub↗6,453
  • azure/pyritAvatar de Azure

    Azure/PyRIT

    3,444Ver en GitHub↗

    PyRIT is an AI vulnerability assessment tool and security scanner designed to detect risks in large language model applications. It functions as a generative AI red teaming framework used to simulate adversarial attacks and identify weaknesses in system guardrails. The tool automates AI risk assessment by scanning generative AI components for security vulnerabilities. It utilizes automated testing and analysis to identify security gaps and prevent potential exploits through a consistent, repeatable process. The system incorporates asynchronous model orchestration to compare security postures

    Pythonai-red-teamgenerative-aired-team-tools
    Ver en GitHub↗3,444
  • nvidia/garakAvatar de NVIDIA

    NVIDIA/garak

    8,114Ver en GitHub↗

    Garak is an AI model evaluation tool and vulnerability scanner designed for red teaming large language models and auditing the security of retrieval-augmented generation pipelines. It identifies behavioral weaknesses, such as jailbreaks, hallucinations, and data leakage, by simulating adversarial attacks and executing automated testing vectors. The framework utilizes an adaptive probing loop where prompts can react to previous model behavior and be modified in flight via middleware. To ensure consistent analysis, it employs a provider-agnostic interface to interact with various model APIs and

    Pythonaillm-evaluationllm-security
    Ver en GitHub↗8,114
  • tencent/ai-infra-guardAvatar de Tencent

    Tencent/AI-Infra-Guard

    2,971Ver en GitHub↗

    AI-Infra-Guard is a security scanning platform designed to detect vulnerabilities across large language model deployments, AI agent skills, and the underlying infrastructure. It functions as a security toolset for auditing source code, evaluating model robustness, and identifying insecure network configurations. The project provides a red teaming framework that uses curated attack datasets to test for jailbreak vulnerabilities and prompt injections. It also includes an infrastructure auditor that employs network fingerprinting and asset discovery to match running components against known comm

    Pythonagentagent-scanagentskills
    Ver en GitHub↗2,971
Ver las 30 alternativas a Garak→

Preguntas frecuentes

¿Qué hace leondz/garak?

Garak es un conjunto de herramientas para medir la fiabilidad de la IA, escanear vulnerabilidades y automatizar evaluaciones de seguridad mediante sondeos adaptativos. Funciona como un escáner de vulnerabilidades de IA generativa y herramienta de evaluación diseñada para identificar brechas de seguridad, alucinaciones y modos de falla en modelos de lenguaje.

¿Cuáles son las características principales de leondz/garak?

Las características principales de leondz/garak son: Model Red-Teaming, AI Risk Assessments, LLM Security, Generative Model Scanners, LLM Security Scanning, LLM Evaluation, Model Provider Integrations, Test Suite Extensions.

¿Qué alternativas de código abierto existen para leondz/garak?

Las alternativas de código abierto para leondz/garak incluyen: nvidia/nemo-guardrails — NeMo-Guardrails is a toolkit for adding programmable safety constraints and dialogue boundaries to large language… azure/pyrit — PyRIT is an AI vulnerability assessment tool and security scanner designed to detect risks in large language model… nvidia/garak — Garak is an AI model evaluation tool and vulnerability scanner designed for red teaming large language models and… tencent/ai-infra-guard — AI-Infra-Guard is a security scanning platform designed to detect vulnerabilities across large language model… promptfoo/promptfoo — Promptfoo is an evaluation framework designed for testing, benchmarking, and red-teaming language models and agentic… protectai/llm-guard — LLM Guard is a security firewall and guardrail framework designed to scan and sanitize inputs and outputs for large…