Skip to main content

Skills en este repositorio

synthetic-sciences/openscience - Página 4

SkillsMP ha recopilado 313 skills de synthetic-sciences/openscience. Abre una skill para revisar su origen y sus detalles.

synthetic-sciences/openscience

Mostrando 40 de 313 skills recopiladas.

ocupación
Desarrolladores de software
descripción

Calculates training costs for Tinker fine-tuning jobs. Use when estimating costs for Tinker LLM training, counting tokens in datasets, or comparing Tinker model training prices. Tokenizes datasets using the correct model tokenizer and provides accurate cost…

Idioma del texto original: inglés

actualizado
ocupación
Científicos de datos
descripción

Infer gene regulatory networks (GRNs) from gene expression data using scalable algorithms (GRNBoost2, GENIE3). Use when analyzing transcriptomics data (bulk RNA-seq, single-cell RNA-seq) to identify transcription factor-target gene relationships and…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

PyTorch library for audio generation including text-to-music (MusicGen) and text-to-sound (AudioGen). Use when you need to generate music from text descriptions, create sound effects, or perform melody-conditioned music generation.

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Multiagent AI system for scientific research assistance that automates research workflows from data analysis to publication. This skill should be used when generating research ideas from datasets, developing research methodologies, executing computational…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

High-performance toolkit for genomic interval analysis in Rust with Python bindings. Use when working with genomic regions, BED files, coverage tracks, overlap detection, tokenization for ML models, or fragment analysis in computational genomics and machine…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

MATLAB and GNU Octave numerical computing for matrix operations, data analysis, visualization, and scientific computing. Use when writing MATLAB/Octave scripts for linear algebra, signal processing, image processing, differential equations, optimization,…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Pareto-aware molecular design balancing multiple ADMET properties simultaneously. Based on MultiMol (Yu 2025) and MOLLM (Ran 2025).

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Comprehensive toolkit for creating, analyzing, and visualizing complex networks and graphs in Python. Use when working with network/graph data structures, analyzing relationships between entities, computing graph algorithms (shortest paths, centrality,…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Bayesian modeling with PyMC. Build hierarchical models, MCMC (NUTS), variational inference, LOO/WAIC comparison, posterior checks, for probabilistic programming and inference.

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Multi-objective optimization framework. NSGA-II, NSGA-III, MOEA/D, Pareto fronts, constraint handling, benchmarks (ZDT, DTLZ), for engineering design and optimization problems.

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Cloud-based quantum chemistry platform with Python API. Preferred for computational chemistry workflows including pKa prediction, geometry optimization, conformer searching, molecular property calculations, protein-ligand docking (AutoDock Vina), and AI…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Machine learning in Python with scikit-learn. Use when working with supervised learning (classification, regression), unsupervised learning (clustering, dimensionality reduction), model evaluation, hyperparameter tuning, preprocessing, or building ML…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Model interpretability and explainability using SHAP (SHapley Additive exPlanations). Use this skill when explaining machine learning model predictions, computing feature importance, generating SHAP plots (waterfall, beeswarm, bar, scatter, force, heatmap),…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Process-based discrete-event simulation framework in Python. Use this skill when building simulations of systems with processes, queues, resources, and time-based events such as manufacturing systems, service operations, network traffic, logistics, or any…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Provides guidance for LLM post-training with RL using slime, a Megatron+SGLang framework. Use when training GLM models, implementing custom data generation workflows, or needing tight Megatron-LM integration for RL scaling.

Idioma del texto original: inglés

actualizado
ocupación
Científicos de datos
descripción

Guided statistical analysis with test selection and reporting. Use when you need help choosing appropriate tests for your data, assumption checking, power analysis, and APA-formatted results. Best for academic research reporting, test selection guidance. For…

Idioma del texto original: inglés

actualizado
ocupación
Científicos de datos
descripción

Statistical models library for Python. Use when you need specific model classes (OLS, GLM, mixed models, ARIMA) with detailed diagnostics, residuals, and inference. Best for econometrics, time series, rigorous inference with coefficient tables. For guided…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Use this skill when working with symbolic mathematics in Python. This skill should be used for symbolic computation tasks including solving equations algebraically, performing calculus operations (derivatives, integrals, limits), manipulating algebraic…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Graph Neural Networks (PyG). Node/graph classification, link prediction, GCN, GAT, GraphSAGE, heterogeneous graphs, molecular property prediction, for geometric deep learning.

Idioma del texto original: inglés

actualizado
ocupación
Científicos de datos
descripción

UMAP dimensionality reduction. Fast nonlinear manifold learning for 2D/3D visualization, clustering preprocessing (HDBSCAN), supervised/parametric UMAP, for high-dimensional data.

Idioma del texto original: inglés

actualizado
ocupación
Científicos de datos
descripción

This skill should be used for time series machine learning tasks including classification, regression, clustering, forecasting, anomaly detection, segmentation, and similarity search. Use when working with temporal data, sequential patterns, or time-indexed…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Distributed computing for larger-than-RAM pandas/NumPy workflows. Use when you need to scale existing pandas/NumPy code beyond memory or across clusters. Best for parallel file processing, distributed ML, integration with existing pandas code. For out-of-core…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Python library for working with geospatial vector data including shapefiles, GeoJSON, and GeoPackage files. Use when working with geographic data for spatial analysis, geometric operations, coordinate transformations, spatial joins, overlay operations,…

Idioma del texto original: inglés

actualizado
ocupación
Científicos de datos
descripción

Patterns for loading PDE simulation datasets (PDEBench, PhiFlow, JAX-CFD) from HDF5 files. Handles layout detection (single tensor vs separate variables), spatial/temporal downsampling, multi-variable systems, HuggingFace and DaRUS data sources, and efficient…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Convert files and office documents to Markdown. Supports PDF, DOCX, PPTX, XLSX, images (with OCR), audio (with transcription), HTML, CSV, JSON, XML, ZIP, YouTube URLs, EPubs and more.

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Fast in-memory DataFrame library for datasets that fit in RAM. Use when pandas is too slow but data still fits in memory. Lazy evaluation, parallel execution, Apache Arrow backend. Best for 1-100GB datasets, ETL pipelines, faster pandas replacement. For…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Use this skill for processing and analyzing large tabular datasets (billions of rows) that exceed available RAM. Vaex excels at out-of-core DataFrame operations, lazy evaluation, fast aggregations, efficient visualization of big data, and machine learning on…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Chunked N-D arrays for cloud storage. Compressed arrays, parallel I/O, S3/GCS integration, NumPy/Dask/Xarray compatible, for large-scale scientific computing pipelines.

Idioma del texto original: inglés

actualizado
ocupación
Científicos biológicos, todos los demás
descripción

Access AlphaFold 200M+ AI-predicted protein structures. Retrieve structures by UniProt ID, download PDB/mmCIF files, analyze confidence metrics (pLDDT, PAE), for drug discovery and structural biology.

Idioma del texto original: inglés

actualizado
ocupación
Científicos biológicos, todos los demás
descripción

Efficient database search tool for bioRxiv preprint server. Use this skill when searching for life sciences preprints by keywords, authors, date ranges, or categories, retrieving paper metadata, downloading PDFs, or conducting literature reviews.

Idioma del texto original: inglés

actualizado
ocupación
Científicos biológicos, todos los demás
descripción

Access BRENDA enzyme database via SOAP API. Retrieve kinetic parameters (Km, kcat), reaction equations, organism data, and substrate-specific enzyme information for biochemical research and metabolic pathway analysis.

Idioma del texto original: inglés

actualizado
ocupación
Científicos biológicos, todos los demás
descripción

Query the CELLxGENE Census (61M+ cells) programmatically. Use when you need expression data across tissues, diseases, or cell types from the largest curated single-cell atlas. Best for population-scale queries, reference atlas comparisons. For analyzing your…

Idioma del texto original: inglés

actualizado
ocupación
Científicos biológicos, todos los demás
descripción

Query ChEMBL bioactive molecules and drug discovery data. Search compounds by structure/properties, retrieve bioactivity data (IC50, Ki), find inhibitors, perform SAR studies, for medicinal chemistry.

Idioma del texto original: inglés

actualizado
ocupación
Epidemiólogos
descripción

Query ClinicalTrials.gov via API v2. Search trials by condition, drug, location, status, or phase. Retrieve trial details by NCT ID, export data, for clinical research and patient matching.

Idioma del texto original: inglés

actualizado
ocupación
Científicos biológicos, todos los demás
descripción

Access ClinPGx pharmacogenomics data (successor to PharmGKB). Query gene-drug interactions, CPIC guidelines, allele functions, for precision medicine and genotype-guided dosing decisions.

Idioma del texto original: inglés

actualizado
ocupación
Científicos biológicos, todos los demás
descripción

Query NCBI ClinVar for variant clinical significance. Search by gene/position, interpret pathogenicity classifications, access via E-utilities API or FTP, annotate VCFs, for genomic medicine.

Idioma del texto original: inglés

actualizado
ocupación
Científicos biológicos, todos los demás
descripción

Access COSMIC cancer mutation database. Query somatic mutations, Cancer Gene Census, mutational signatures, gene fusions, for cancer research and precision oncology. Requires authentication.

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Work with Data Commons, a platform providing programmatic access to public statistical data from global sources. Use this skill when working with demographic data, economic indicators, health statistics, environmental data, or any public datasets available…

Idioma del texto original: inglés

actualizado
ocupación
Científicos biológicos, todos los demás
descripción

Access and analyze comprehensive drug information from the DrugBank database including drug properties, interactions, targets, pathways, chemical structures, and pharmacology data. This skill should be used when working with pharmaceutical data, drug…

Idioma del texto original: inglés

actualizado
ocupación
Científicos biológicos, todos los demás
descripción

Access European Nucleotide Archive via API/FTP. Retrieve DNA/RNA sequences, raw reads (FASTQ), genome assemblies by accession, for genomics and bioinformatics pipelines. Supports multiple formats.

Idioma del texto original: inglés

actualizado
Mostrando 40 de 313 skills recopiladas.