Generate Datasheet, Model Card, and Data Statement from a dataset manifest
原文の言語: 英語
メニュー
SkillsMP は jmagly/aiwg-training から 15 件の skill を収集しています。skill を開くとソースと詳細を確認できます。
収集済み skill 15 件中 15 件を表示しています。
Generate Datasheet, Model Card, and Data Statement from a dataset manifest
原文の言語: 英語
Deterministically rebuild a dataset from its manifest and verify fixity equivalence
原文の言語: 英語
Create a versioned training dataset with manifest, fixity, provenance, and archive snapshot
原文の言語: 英語
End-to-end training dataset pipeline — acquire sources through publication
原文の言語: 英語
Detect training-eval overlap against benchmark sets before dataset publication
原文の言語: 英語
Generate SFT training examples from raw sources using Self-Instruct / Evol-Instruct / SQuAD / STaR patterns
原文の言語: 英語
Convert canonical training examples to Alpaca format for training frameworks
原文の言語: 英語
Convert canonical training examples to ChatML format for training frameworks
原文の言語: 英語
Convert canonical training examples to JSONL format for training frameworks
原文の言語: 英語
Convert canonical training examples to Parquet format for training frameworks
原文の言語: 英語
Convert canonical training examples to ShareGPT format for training frameworks
原文の言語: 英語
Generate preference pairs (chosen/rejected) for DPO/KTO/ORPO/SimPO training
原文の言語: 英語
Large-scale synthetic training data generation with Model Collapse recursion guard
原文の言語: 英語
Acquire a training data source with license validation and delegate ingest to the semantic memory kernel
原文の言語: 英語
GRADE quality assessment adapted for individual training examples
原文の言語: 英語