Skip to main content

sentencepiece

Language-independent tokenizer treating text as raw Unicode. Supports BPE and Unigram algorithms. Fast (50k sentences/sec), lightweight (6MB memory), deterministic vocabulary. Used by T5, ALBERT, XLNet, mBART. Train on raw text without pre-tokenization. Use when you need multilingual support, CJK languages, or reproducible tokenization.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
davila7/claude-code-templates
آخر نشاط في المصدر
٨ يناير ٢٠٢٦ في ١٤:٢٤
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٣٠٬٢٢٩
التفرعات
٣٬٣٩٤

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.