Skip to main content
Run any Skill in Manus
with one click
GitHub repository

data-science-plugin

data-science-plugin contains 19 collected skills from andikarachman, with repository-level occupation coverage and site-owned skill detail pages.

skills collected
19
Stars
15
updated
2026-02-25
Forks
2
Occupation coverage
1 occupation categories · 100% classified
repository explorer

Skills in this repository

scikit-learn
data-scientists-152051

Scikit-learn API patterns for preprocessing, pipelines, model selection, and evaluation. Use when /ds:experiment needs to build sklearn pipelines, tune hyperparameters, or evaluate models.

2026-02-25
setup
data-scientists-152051

Check Python environment for required DS/ML libraries and report versions or missing packages. Use when setting up a new project or debugging import errors.

2026-02-25
tuning-hyperparameters
data-scientists-152051

Hyperparameter tuning workflow reference -- strategy selection, Bayesian optimization with Optuna, search space design, and result analysis. Use when /ds:experiment needs to choose a tuning strategy, design search spaces, or analyze tuning runs.

2026-02-25
data-preprocessing
data-scientists-152051

Pre-model data preparation pipelines for cleaning, validation, transformation, and ETL orchestration. Use when raw data needs deduplication, schema validation, format conversion, or quality assurance before EDA or modeling.

2026-02-25
pandas-pro
data-scientists-152051

Pandas API patterns for DataFrame operations, data cleaning, aggregation, merging, and performance optimization. Use when generating pandas code for data loading, manipulation, or profiling in /ds:eda, /ds:preprocess, or /ds:experiment.

2026-02-25
polars
data-scientists-152051

Polars expression API for high-performance DataFrame operations, lazy evaluation, joins, aggregations, and I/O. Use as a parallel alternative to pandas-pro when working with large datasets or generating Polars code for data loading, manipulation, or profiling in /ds:eda, /ds:preprocess, or /ds:experiment.

2026-02-25
data-quality-frameworks
data-scientists-152051

Data quality validation with Great Expectations, dbt tests, and data contracts. Use when building formal validation rules, expectation suites, or data contracts for repeatable quality gates.

2026-02-25
exploratory-data-analysis
data-scientists-152051

Detect file types and perform format-specific EDA across 200+ scientific data formats. Use when /ds:eda encounters non-tabular or unfamiliar data files, or when format-specific analysis guidance is needed.

2026-02-24
shap
data-scientists-152051

SHAP API patterns for model interpretability -- explainer selection, feature attribution, and visualization. Use when /ds:experiment needs per-prediction explanations, global feature importance, or interaction analysis. For built-in tree importance and permutation importance use scikit-learn; for coefficient-based interpretation use statsmodels.

2026-02-24
statistical-analysis
data-scientists-152051

Guided statistical analysis with test selection, assumption checking, power analysis, and APA reporting. Use when /ds:experiment needs to design comparison protocols, validate assumptions, or report results.

2026-02-24
eda-checklist
data-scientists-152051

Systematic exploratory data analysis checklist covering structure, quality, distributions, relationships, and target analysis. Use when starting EDA on any dataset.

2026-02-24
model-card
data-scientists-152051

Generate standardized model documentation following HuggingFace Model Card and NVIDIA Model Card++ formats. Use when preparing a model for deployment or handoff.

2026-02-24
reproducibility-checklist
data-scientists-152051

Verify that an ML experiment meets reproducibility requirements: random seeds, library versions, data hashes, environment capture. Use when reviewing experiments before shipping.

2026-02-24
aeon
data-scientists-152051

Aeon API patterns for time series machine learning -- classification, regression, clustering, anomaly detection, segmentation, and similarity search. Use when /ds:experiment needs time-series-specific ML algorithms (ROCKET, InceptionTime, DTW classifiers), or /ds:eda needs temporal feature extraction (Catch22, ROCKET features) or change point detection. For classical statistical forecasting (ARIMA/SARIMAX) use statsmodels; for tabular ML pipelines use scikit-learn; for visualization use matplotlib.

2026-02-24
statsmodels
data-scientists-152051

Statsmodels API patterns for OLS, GLM, discrete choice, time series (ARIMA/SARIMAX), and diagnostics. Use when /ds:experiment needs statsmodels model fitting, diagnostics, or time-series forecasting, or /ds:eda needs VIF and stationarity checks. For guided test selection and APA reporting use statistical-analysis.

2026-02-24
matplotlib
data-scientists-152051

Matplotlib API patterns for creating publication-quality visualizations. Use when /ds:eda needs distribution plots, correlation heatmaps, or relationship visualizations, or when /ds:experiment needs result plots (learning curves, confusion matrices, forecast visualizations). For standard ML diagnostic plots use scikit-learn display utilities; for statsmodels diagnostic plots use statsmodels built-in plotting; for quick statistical plots prefer seaborn.

2026-02-24
experiment-tracking
data-scientists-152051

Standard format for logging ML experiments including hypothesis, config, results, and learnings. Use when running experiments to maintain a consistent record.

2026-02-24
split-strategy
data-scientists-152051

Select and implement appropriate train/validation/test split strategies based on data characteristics. Use when designing the evaluation framework for a model.

2026-02-24
target-leakage-detection
data-scientists-152051

Detect target leakage in feature sets by checking temporal validity, feature-target correlation, and information flow. Use before training any model.

2026-02-24
data-science-plugin Agent Skills on GitHub | SkillsMP