Skip to main content

jmagly/aiwg-training

SkillsMP 已收集 jmagly/aiwg-training 中的 15 个 Skill。打开任一 Skill 可查看来源和详情。

最近记录的来源活动
SkillsMP 收录数据更新
已收集 skills
15
GitHub 星标
1
GitHub Forks
1

这个仓库中的 skills

2 个职业分类 · 已分类 100%

已展示 15 / 15 个已收集 Skill。

职业分类
数据科学家
描述

Generate Datasheet, Model Card, and Data Statement from a dataset manifest

原文语言:英语

更新
职业分类
数据科学家
描述

Deterministically rebuild a dataset from its manifest and verify fixity equivalence

原文语言:英语

更新
职业分类
数据科学家
描述

Create a versioned training dataset with manifest, fixity, provenance, and archive snapshot

原文语言:英语

更新
职业分类
数据科学家
描述

End-to-end training dataset pipeline — acquire sources through publication

原文语言:英语

更新
职业分类
数据科学家
描述

Detect training-eval overlap against benchmark sets before dataset publication

原文语言:英语

更新
职业分类
数据科学家
描述

Generate SFT training examples from raw sources using Self-Instruct / Evol-Instruct / SQuAD / STaR patterns

原文语言:英语

更新
职业分类
数据科学家
描述

Convert canonical training examples to Alpaca format for training frameworks

原文语言:英语

更新
职业分类
数据科学家
描述

Convert canonical training examples to ChatML format for training frameworks

原文语言:英语

更新
职业分类
数据科学家
描述

Convert canonical training examples to JSONL format for training frameworks

原文语言:英语

更新
职业分类
数据科学家
描述

Convert canonical training examples to Parquet format for training frameworks

原文语言:英语

更新
职业分类
软件开发工程师
描述

Convert canonical training examples to ShareGPT format for training frameworks

原文语言:英语

更新
职业分类
数据科学家
描述

Generate preference pairs (chosen/rejected) for DPO/KTO/ORPO/SimPO training

原文语言:英语

更新
职业分类
数据科学家
描述

Large-scale synthetic training data generation with Model Collapse recursion guard

原文语言:英语

更新
职业分类
数据科学家
描述

Acquire a training data source with license validation and delegate ingest to the semantic memory kernel

原文语言:英语

更新
职业分类
数据科学家
描述

GRADE quality assessment adapted for individual training examples

原文语言:英语

更新
已展示 15 / 15 个已收集 Skill。