Skip to main content

lecture-voice

按讲义一节一节「正式开讲」并把现场语音存成课程录音(lecture-video 的输入)。用讲师口吻在语音通道里讲一节 → 等对方认可 → 把飞书「重播」那段原声存成 mp3、写文字稿、嵌进课件该节开头 → 讲下一节。触发:「开始第二轮讲解」「正式讲课录音」「一节一节讲给我听并录下来」「把音频放到小节前面」「录课」「lecture voice」。

Ir a la instalación

Datos de origen

Repositorio
yangwhale/CloseCrab
Última actividad en el origen
27 de septiembre de 2026 a las 14:12
Idioma detectado de SKILL.md
chino
Estrellas
4
Forks
0

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.

Explorador de archivos
6 archivos

Mostrando SKILL.md

SKILL.md
Instrucciones de origen · Vista previa de solo lectura
name
lecture-voice
description
按讲义一节一节「正式开讲」并把现场语音存成课程录音(lecture-video 的输入)。用讲师口吻在语音通道里讲一节 → 等对方认可 → 把飞书「重播」那段原声存成 mp3、写文字稿、嵌进课件该节开头 → 讲下一节。触发:「开始第二轮讲解」「正式讲课录音」「一节一节讲给我听并录下来」「把音频放到小节前面」「录课」「lecture voice」。
# 讲课录音(一节一节讲 → 现场原声 → 课程录音) **这一步产出的录音是主资产**,后面的讲课视频(`lecture-video` skill)只给它配画面。 ## 一节的循环 1. **讲**:读讲义这一节的台词和课件,在语音通道里用讲师口吻完整讲一遍。 2. **等**:结尾问「这一节就到这里,大家有问题吗?」,然后**结束这一轮**,等对方反馈。 3. **改**:对方指出讲浅了、讲错了、没讲清 → 先改课件/讲义(该画图就画图),再**整节重讲**,不要只补一段。 4. **存**:对方说没问题、放音频 → 马上存(`/tmp` 重启即丢): ```bash ~/.claude/skills/lecture-voice/scripts/save_take.sh WebPages/media/<课>-lecture-s<N>.mp3 [剪掉秒数] ``` 看它打印的开头、结尾:开头必须是这一节的第一句,结尾是「……大家有问题吗」。 开头多了一句交代 → 找静音点,带「剪掉秒数」重跑。 文字稿写进 `tools/<课>-audio/s<N>.txt`(就是刚才那轮的回复原文,保留情绪标签)。 5. **挂**:重建课件和讲义(每节开头的录音条自动出现)→ 提交并推送 → 用**文字通知**报「第 N 节录音已放好」→ 讲下一节。 ## 讲的规矩(这些都被纠正过) - **正式上课,一点后台信息都不露**:不说「我改了」「已经 push」「这张图的代号」「这里我会问台下」。 要问台下就直接问:「大家先想一想……」。看图就说「请看这张图」。 - **状态交代一律走文字通知**(`feishu-notify.py`),**不进语音回复** —— 它会被录进课程音频。 第二节就因为开头一句「第一节录音已放好」被迫剪头。 - **不许浅**:推导、数字的来历、两种方案的区别要讲透;「随便一提就过去」会被要求重讲。 讲一对相近的概念,先分清是**并列**还是**递进**(PCP→DCP 是递进)。 - 比方要能对上机制里流动的**每样东西**;够用就停,别升级。 - 讲义里没有、现场多讲的内容,讲完**回填讲义**,让讲义和录音一致。 - 时长超计划只报告,不为了时长删内容。 ## 批量模式:不经过语音通道直接录(2026-09-27 起可用) 对方说「不用听了,直接录」时用这条:讲稿写成文件,离线合成。**走的是现场语音同一条合成路径** (`discord_voice_sidecar._gemini_tts_stream`:同模型、同声音、同分批),所以音色和节奏跟现场讲的一样。 ```bash SK=~/.claude/skills/lecture-voice/scripts $SK/synth_all.sh tools/<课>-audio WebPages/media <课> s1 s2 s3 # 并行合成,一段 ~0.21 秒/字,约 2.5 倍实时 ``` - 讲稿格式照现场:每段开头情绪标签、短句、数字写中文读法、**代码名里不要下划线**(会被念出来)、结尾固定「这一节就到这里,大家有问题吗?」 - 验:时长 ÷ 字数应在 0.20–0.24 秒/字;明显偏低就是丢了批次 - **整句漏念**(srt.py 报「录音里像是没念」):不重录整段,只补那一句 `$SK/splice_missing.py 录音.mp3 字幕.srt "上一句原文" "[标签] 漏掉的那句"`,然后对这段重跑时间戳和 srt - 讲稿别让写手把「可能被问到」全塞进去:第一版专题一写出了四个多小时(计划一小时)。 标准是「主线讲透」:推导、数字来历、方案区别保留,题外话和折叠展开一句带过或删掉,约「计划分钟 × 330 字」 ## 衔接 录音、文字稿齐了 → 用 `lecture-video` skill 给这一节配画面出视频(它会先给录音打逐字时间戳)。
Ver en GitHub