# Evaluar respuestas de un LLM (/ai--llm-eval)

/ai--llm-eval es una skill de Claude Code de la sección IA y Agentes. Monta un conjunto de evaluación para una función de IA: casos, rúbricas, comprobaciones por código, jueces LLM con control de sesgos y puerta en CI.

- Versión web: https://skills.sgomez.dev/es/s/ai--llm-eval
- Sección: [IA y Agentes](https://skills.sgomez.dev/es/ai.md)
- Autor: Santiago Gómez de la Torre
- Licencia: MIT
- Código: https://github.com/sgomez-dev/claude-skills/blob/main/skills/ai/llm-eval.md
- Actualizada el 10 jul 2026

## Cómo pedírselo

- `/ai--llm-eval crea una rúbrica para evaluar las respuestas de mi asistente`
- `/ai--llm-eval monta un LLM-as-judge que controle el sesgo`
- `/ai--llm-eval integra las evaluaciones del modelo en el pipeline de CI`

## Instalar

macOS · Linux:

```
curl -fsSL https://raw.githubusercontent.com/sgomez-dev/claude-skills/main/install.sh | bash
```

Windows:

```
irm https://raw.githubusercontent.com/sgomez-dev/claude-skills/main/install.ps1 | iex
```

Plugin de Claude Code:

```
/plugin marketplace add sgomez-dev/claude-skills
/plugin install ai-skills@claude-skills-collection
```

## Permisos

- Lee: `**/*`
- Escribe: `**/*`
- Ejecuta: `project test/eval runners`, `CI config`
- Red: No
- Destructiva: No

## Descripción del autor (traducida)

Evaluación de salidas de LLM: rúbricas, LLM como juez con controles de sesgo, e integración en CI

- [Cómo revisamos esto](https://skills.sgomez.dev/es/methodology.md)
