用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/cas-bigdatalab/piflow --skill abbrev-expander命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
Dataspace 文件输入源算子。用于根据 Dataspace 数据源实例 ID 和空间内文件路径下载单个文件,并将该文件作为工作流输入提供给下游算子。该算子没有上游输入,必须作为 DAG 的起始节点使用。
Dataspace 文件输出终止算子。用于接收上游算子的单个文件输出,按指定相对目录上传到 Dataspace 空间目录中,实际文件名自动沿用输入文件名。该算子必须作为 DAG 的终止节点使用。
用于编辑或创建 Gaussian 输入文件(.gjf),支持添加 Link 0 指令(%chk、%oldchk、%nprocshared、%mem)、Route 行关键词、电荷和多重度。可对已有 gjf 文件进行参数填充,也可从零创建新的 gjf 文件。
基于 SOC 职业分类
正在显示 SKILL.md
| name | abbrev_expander |
| description | 领域缩略语展开 Skill:按内置或外部词典将独立缩略语替换为全称,可选在全称后保留原缩写。 适用于技术文本、论文摘要和业务记录中的缩写清洗;不负责模糊缩写消歧或大小写无关替换。 |
| name_zh | 缩略语展开 |
| tag | 数据清洗 |
| input_params | [{"name":"input_path","type":"string","required":true,"description":"输入结构化文件路径"},{"name":"output_path","type":"string","required":true,"description":"输出结构化文件路径"},{"name":"text_columns","type":"string","required":false,"description":"处理的文本列,逗号分隔;默认全部字符串列"},{"name":"dict_path","type":"string","required":false,"description":"外部缩略语词典路径,支持 json/csv/tsv"},{"name":"keep_abbr","type":"string","required":false,"description":"是否在全称后保留原缩写"}] |
| output_params | [{"name":"output_path","type":"string","description":"缩略语展开后的结构化文件"}] |
| publisher | COMMUNITY |
本 skill 按词典将文本列中的独立缩略语替换为全称。默认内置 AI、NLP、CPU、GPU、ML 等通用技术缩略语;也支持通过 JSON/CSV/TSV 外部词典提供 abbrev -> full 映射。匹配按缩略语长度优先,并使用词边界避免替换单词内部子串。
当用户请求以下任务时,应使用此 skill:
AIM、AIGC 这类完整词被 AI 误替换| 参数 | 说明 |
|---|---|
--input_path | 输入 CSV/TSV/Excel 等结构化文件路径 |
--output_path | 输出结构化文件路径 |
| 参数 | 说明 | 默认值 |
|---|---|---|
--text_columns | 处理的文本列,逗号分隔;不填则处理全部字符串列 | 全部字符串列 |
--dict_path | 外部词典路径,支持 JSON 对象或含 abbrev,full 列的 CSV/TSV | 内置词典 |
--keep_abbr | 在全称后保留原缩写,如 artificial intelligence (AI) | False |
id,text
1,"AI and NLP models used GPU acceleration."
2,"AIGC should remain a single token."
外部 CSV/TSV 词典格式:
abbrev,full
LLM,large language model
RAG,retrieval augmented generation
python scripts/abbrev_expander.py \
--input_path input.csv \
--output_path output.csv \
--text_columns text
python scripts/abbrev_expander.py \
--input_path input.csv \
--output_path output.csv \
--text_columns text \
--dict_path custom_dict.csv \
--keep_abbr
| 输入文本 | 输出文本 |
|---|---|
AI and NLP models used GPU acceleration. | artificial intelligence and natural language processing models used graphics processing unit acceleration. |
AI and NLP models used GPU acceleration. with --keep_abbr | artificial intelligence (AI) and natural language processing (NLP) models used graphics processing unit (GPU) acceleration. |
AIGC should remain a single token. | AIGC should remain a single token. |
id,text
1,"artificial intelligence and natural language processing models used graphics processing unit acceleration."
2,"AIGC should remain a single token."
依赖 Python、pandas,以及本仓库 DC 公用 data_io 读写工具。
ai 不会被内置 AI 规则替换。