Skip to main content
Ejecuta cualquier Skill en Manus
con un clic
Repositorio de GitHub

data-science-plugin

data-science-plugin contiene 19 skills recopiladas de andikarachman, con cobertura ocupacional por repositorio y páginas de detalle dentro del sitio.

skills recopiladas
19
Stars
15
actualizado
2026-02-25
Forks
2
Cobertura ocupacional
1 categorías ocupacionales · 100% clasificado
explorador de repositorios

Skills en este repositorio

scikit-learn
Científicos de datos

Scikit-learn API patterns for preprocessing, pipelines, model selection, and evaluation. Use when /ds:experiment needs to build sklearn pipelines, tune hyperparameters, or evaluate models.

2026-02-25
setup
Científicos de datos

Check Python environment for required DS/ML libraries and report versions or missing packages. Use when setting up a new project or debugging import errors.

2026-02-25
tuning-hyperparameters
Científicos de datos

Hyperparameter tuning workflow reference -- strategy selection, Bayesian optimization with Optuna, search space design, and result analysis. Use when /ds:experiment needs to choose a tuning strategy, design search spaces, or analyze tuning runs.

2026-02-25
data-preprocessing
Científicos de datos

Pre-model data preparation pipelines for cleaning, validation, transformation, and ETL orchestration. Use when raw data needs deduplication, schema validation, format conversion, or quality assurance before EDA or modeling.

2026-02-25
pandas-pro
Científicos de datos

Pandas API patterns for DataFrame operations, data cleaning, aggregation, merging, and performance optimization. Use when generating pandas code for data loading, manipulation, or profiling in /ds:eda, /ds:preprocess, or /ds:experiment.

2026-02-25
polars
Científicos de datos

Polars expression API for high-performance DataFrame operations, lazy evaluation, joins, aggregations, and I/O. Use as a parallel alternative to pandas-pro when working with large datasets or generating Polars code for data loading, manipulation, or profiling in /ds:eda, /ds:preprocess, or /ds:experiment.

2026-02-25
data-quality-frameworks
Científicos de datos

Data quality validation with Great Expectations, dbt tests, and data contracts. Use when building formal validation rules, expectation suites, or data contracts for repeatable quality gates.

2026-02-25
exploratory-data-analysis
Científicos de datos

Detect file types and perform format-specific EDA across 200+ scientific data formats. Use when /ds:eda encounters non-tabular or unfamiliar data files, or when format-specific analysis guidance is needed.

2026-02-24
shap
Científicos de datos

SHAP API patterns for model interpretability -- explainer selection, feature attribution, and visualization. Use when /ds:experiment needs per-prediction explanations, global feature importance, or interaction analysis. For built-in tree importance and permutation importance use scikit-learn; for coefficient-based interpretation use statsmodels.

2026-02-24
statistical-analysis
Científicos de datos

Guided statistical analysis with test selection, assumption checking, power analysis, and APA reporting. Use when /ds:experiment needs to design comparison protocols, validate assumptions, or report results.

2026-02-24
eda-checklist
Científicos de datos

Systematic exploratory data analysis checklist covering structure, quality, distributions, relationships, and target analysis. Use when starting EDA on any dataset.

2026-02-24
model-card
Científicos de datos

Generate standardized model documentation following HuggingFace Model Card and NVIDIA Model Card++ formats. Use when preparing a model for deployment or handoff.

2026-02-24
reproducibility-checklist
Científicos de datos

Verify that an ML experiment meets reproducibility requirements: random seeds, library versions, data hashes, environment capture. Use when reviewing experiments before shipping.

2026-02-24
aeon
Científicos de datos

Aeon API patterns for time series machine learning -- classification, regression, clustering, anomaly detection, segmentation, and similarity search. Use when /ds:experiment needs time-series-specific ML algorithms (ROCKET, InceptionTime, DTW classifiers), or /ds:eda needs temporal feature extraction (Catch22, ROCKET features) or change point detection. For classical statistical forecasting (ARIMA/SARIMAX) use statsmodels; for tabular ML pipelines use scikit-learn; for visualization use matplotlib.

2026-02-24
statsmodels
Científicos de datos

Statsmodels API patterns for OLS, GLM, discrete choice, time series (ARIMA/SARIMAX), and diagnostics. Use when /ds:experiment needs statsmodels model fitting, diagnostics, or time-series forecasting, or /ds:eda needs VIF and stationarity checks. For guided test selection and APA reporting use statistical-analysis.

2026-02-24
matplotlib
Científicos de datos

Matplotlib API patterns for creating publication-quality visualizations. Use when /ds:eda needs distribution plots, correlation heatmaps, or relationship visualizations, or when /ds:experiment needs result plots (learning curves, confusion matrices, forecast visualizations). For standard ML diagnostic plots use scikit-learn display utilities; for statsmodels diagnostic plots use statsmodels built-in plotting; for quick statistical plots prefer seaborn.

2026-02-24
experiment-tracking
Científicos de datos

Standard format for logging ML experiments including hypothesis, config, results, and learnings. Use when running experiments to maintain a consistent record.

2026-02-24
split-strategy
Científicos de datos

Select and implement appropriate train/validation/test split strategies based on data characteristics. Use when designing the evaluation framework for a model.

2026-02-24
target-leakage-detection
Científicos de datos

Detect target leakage in feature sets by checking temporal validity, feature-target correlation, and information flow. Use before training any model.

2026-02-24