Skip to main content

lecture-voice

按讲义一节一节「正式开讲」并把现场语音存成课程录音(lecture-video 的输入)。用讲师口吻在语音通道里讲一节 → 等对方认可 → 把飞书「重播」那段原声存成 mp3、写文字稿、嵌进课件该节开头 → 讲下一节。触发:「开始第二轮讲解」「正式讲课录音」「一节一节讲给我听并录下来」「把音频放到小节前面」「录课」「lecture voice」。

Quellinformationen

Repository
yangwhale/CloseCrab
Letzte Quellaktivität
27. September 2026 um 14:12
Erkannte Sprache von SKILL.md
Chinesisch
Sterne
4
Forks
0

Installationsoptionen

Standardmäßig ist der Prompt ausgewählt, der zuerst die Quelle prüft. Sie können zu einem direkten Befehl wechseln oder eine lokale Kopie herunterladen.

Quelldateien prüfen

Lesen Sie SKILL.md und alle von SkillsMP angezeigten Begleitdateien, bevor Sie sich für eine Installation entscheiden.

Datei-Explorer
6 Dateien

SKILL.md wird angezeigt

SKILL.md
Quellanweisungen · Schreibgeschützte Vorschau
name
lecture-voice
description
按讲义一节一节「正式开讲」并把现场语音存成课程录音(lecture-video 的输入)。用讲师口吻在语音通道里讲一节 → 等对方认可 → 把飞书「重播」那段原声存成 mp3、写文字稿、嵌进课件该节开头 → 讲下一节。触发:「开始第二轮讲解」「正式讲课录音」「一节一节讲给我听并录下来」「把音频放到小节前面」「录课」「lecture voice」。
# 讲课录音(一节一节讲 → 现场原声 → 课程录音) **这一步产出的录音是主资产**,后面的讲课视频(`lecture-video` skill)只给它配画面。 ## 一节的循环 1. **讲**:读讲义这一节的台词和课件,在语音通道里用讲师口吻完整讲一遍。 2. **等**:结尾问「这一节就到这里,大家有问题吗?」,然后**结束这一轮**,等对方反馈。 3. **改**:对方指出讲浅了、讲错了、没讲清 → 先改课件/讲义(该画图就画图),再**整节重讲**,不要只补一段。 4. **存**:对方说没问题、放音频 → 马上存(`/tmp` 重启即丢): ```bash ~/.claude/skills/lecture-voice/scripts/save_take.sh WebPages/media/<课>-lecture-s<N>.mp3 [剪掉秒数] ``` 看它打印的开头、结尾:开头必须是这一节的第一句,结尾是「……大家有问题吗」。 开头多了一句交代 → 找静音点,带「剪掉秒数」重跑。 文字稿写进 `tools/<课>-audio/s<N>.txt`(就是刚才那轮的回复原文,保留情绪标签)。 5. **挂**:重建课件和讲义(每节开头的录音条自动出现)→ 提交并推送 → 用**文字通知**报「第 N 节录音已放好」→ 讲下一节。 ## 讲的规矩(这些都被纠正过) - **正式上课,一点后台信息都不露**:不说「我改了」「已经 push」「这张图的代号」「这里我会问台下」。 要问台下就直接问:「大家先想一想……」。看图就说「请看这张图」。 - **状态交代一律走文字通知**(`feishu-notify.py`),**不进语音回复** —— 它会被录进课程音频。 第二节就因为开头一句「第一节录音已放好」被迫剪头。 - **不许浅**:推导、数字的来历、两种方案的区别要讲透;「随便一提就过去」会被要求重讲。 讲一对相近的概念,先分清是**并列**还是**递进**(PCP→DCP 是递进)。 - 比方要能对上机制里流动的**每样东西**;够用就停,别升级。 - 讲义里没有、现场多讲的内容,讲完**回填讲义**,让讲义和录音一致。 - 时长超计划只报告,不为了时长删内容。 ## 批量模式:不经过语音通道直接录(2026-09-27 起可用) 对方说「不用听了,直接录」时用这条:讲稿写成文件,离线合成。**走的是现场语音同一条合成路径** (`discord_voice_sidecar._gemini_tts_stream`:同模型、同声音、同分批),所以音色和节奏跟现场讲的一样。 ```bash SK=~/.claude/skills/lecture-voice/scripts $SK/synth_all.sh tools/<课>-audio WebPages/media <课> s1 s2 s3 # 并行合成,一段 ~0.21 秒/字,约 2.5 倍实时 ``` - 讲稿格式照现场:每段开头情绪标签、短句、数字写中文读法、**代码名里不要下划线**(会被念出来)、结尾固定「这一节就到这里,大家有问题吗?」 - 验:时长 ÷ 字数应在 0.20–0.24 秒/字;明显偏低就是丢了批次 - **整句漏念**(srt.py 报「录音里像是没念」):不重录整段,只补那一句 `$SK/splice_missing.py 录音.mp3 字幕.srt "上一句原文" "[标签] 漏掉的那句"`,然后对这段重跑时间戳和 srt - 讲稿别让写手把「可能被问到」全塞进去:第一版专题一写出了四个多小时(计划一小时)。 标准是「主线讲透」:推导、数字来历、方案区别保留,题外话和折叠展开一句带过或删掉,约「计划分钟 × 330 字」 ## 衔接 录音、文字稿齐了 → 用 `lecture-video` skill 给这一节配画面出视频(它会先给录音打逐字时间戳)。
Auf GitHub ansehen