# Preparar un dataset para ML (/ml--dataset-prep)

/ml--dataset-prep es una skill de Claude Code de la sección IA y Agentes. Convierte un conjunto de datos en bruto en una base limpia, bien dividida y sin fuga de información: perfilado, limpieza, divisiones y balance.

- Versión web: https://skills.sgomez.dev/es/s/ml--dataset-prep
- Sección: [IA y Agentes](https://skills.sgomez.dev/es/ai.md)
- Autor: Santiago Gómez de la Torre
- Licencia: MIT
- Código: https://github.com/sgomez-dev/claude-skills/blob/main/skills/ml/dataset-prep.md
- Actualizada el 10 jul 2026

## Cómo pedírselo

- `/ml--dataset-prep prepara mi dataset de clientes para entrenar el modelo`
- `/ml--dataset-prep comprueba si hay fugas de datos entre train y test`
- `/ml--dataset-prep balancea las clases de este dataset desequilibrado`

## Instalar

macOS · Linux:

```
curl -fsSL https://raw.githubusercontent.com/sgomez-dev/claude-skills/main/install.sh | bash
```

Windows:

```
irm https://raw.githubusercontent.com/sgomez-dev/claude-skills/main/install.ps1 | iex
```

Plugin de Claude Code:

```
/plugin marketplace add sgomez-dev/claude-skills
/plugin install ml-skills@claude-skills-collection
```

## Permisos

- Lee: `**/*.py`, `**/*.ipynb`, `**/*.csv`, `**/*.parquet`, `**/*.json`, `**/*.yaml`, `requirements.txt`, `pyproject.toml`
- Escribe: `**/*.py`, `data/**`, `**/*.md`, `**/*.yaml`
- Ejecuta: `python`, `pip`
- Red: No
- Destructiva: No

## Descripción del autor (traducida)

Prepara un dataset para ML: limpieza, particiones, comprobaciones de fugas de datos, balanceo, versionado

- [Cómo revisamos esto](https://skills.sgomez.dev/es/methodology.md)
