원클릭으로
qwen3-asr-assistant
智能语音转文字助手,基于 Qwen3-ASR 模型,支持实时语音识别和智能文本改写。可以将录音转换为文字,并一键改写成邮件、笔记、社交媒体文案,支持复制、分享和录音拼接。适用于会议纪要、语音备忘、内容创作等多种场景。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
메뉴
智能语音转文字助手,基于 Qwen3-ASR 模型,支持实时语音识别和智能文本改写。可以将录音转换为文字,并一键改写成邮件、笔记、社交媒体文案,支持复制、分享和录音拼接。适用于会议纪要、语音备忘、内容创作等多种场景。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
SOC 직업 분류 기준
小跃虚拟伴侣 - 使用智谱 AI 提供温暖的对话陪伴和静态图片分享
基于ByteDance agentkit-samples多媒体用例的小省导购员数字人带货视频生成技能,整合多模态内容生成能力(图像、视频、音频),支持AI绘画、语音合成、视频生成,与小省导购员人设融合,9:16竖屏适配,直接对接带货视频生成流程
分析文章内容,在需要视觉辅助理解的位置生成插画。配图可以是信息补充、概念具象化,或引导读者想象。当用户要求"给文章配图"、"为文章生成插图"、"添加配图"时使用此技能。
为3-12岁儿童提供温馨亲切的睡前寓言故事和成语典故讲解。支持用户唤醒后提供故事列表选择,或直接讲解指定故事/成语。讲解时保持亲切温馨的语气、0.6倍正常语速、通俗易懂的表达,为小朋友营造舒适的睡前氛围。
Connect to and control Google Chrome browser using agent-browser with CDP (Chrome DevTools Protocol). Use when the user wants to automate their existing Chrome browser, see browser actions in real-time, or needs to control the Chrome instance they're already using. Handles installation, setup, connecting via remote debugging, and all browser automation tasks with live visual feedback.
Transform data into compelling narratives using visualization, context, and persuasive structure. Use when presenting analytics to stakeholders, creating data reports, or building executive presentations.
| name | qwen3-asr-assistant |
| description | 智能语音转文字助手,基于 Qwen3-ASR 模型,支持实时语音识别和智能文本改写。可以将录音转换为文字,并一键改写成邮件、笔记、社交媒体文案,支持复制、分享和录音拼接。适用于会议纪要、语音备忘、内容创作等多种场景。 |
| dependency | {"python":["requests>=2.28.0","numpy>=1.21.0"],"system":[]} |
requests>=2.28.0
numpy>=1.21.0
录音/上传音频(调用方提供)
语音转文字(智能体调用脚本)
from scripts.asr_transcriber import Qwen3ASRTranscriber
transcriber = Qwen3ASRTranscriber()
result = transcriber.transcribe(
audio_file="recording.wav",
language="zh-CN"
)
text = result["text"]
文字改写(智能体处理)
复制/分享(智能体处理)
录音拼接(智能体处理)
# 智能体处理拼接
full_text = original_text + "\n\n" + new_text
场景:录制会议语音,转换为结构化的会议笔记
执行流程:
录制会议语音(60分钟)
调用脚本转文字:
from scripts.asr_transcriber import Qwen3ASRTranscriber
transcriber = Qwen3ASRTranscriber()
result = transcriber.transcribe(
audio_file="meeting.wav",
language="zh-CN"
)
meeting_text = result["text"]
智能体改写成笔记:
# 会议笔记
## 时间地点
- 时间:2024年1月23日
- 地点:公司会议室
## 参会人员
- 张经理、李主管、王工程师
## 主要议题
1. Q1业绩回顾
- 销售额增长20%
- 新用户增加5000人
2. Q2工作计划
- 推出新产品线
- 加强市场推广
- 优化客户服务
3. 决议事项
- 批准新产品线预算
- 成立市场推广小组
场景:录制语音备忘,转换为正式邮件
执行流程:
主题:明天项目会议准备材料
小王:
你好!
关于明天上午10点在3号会议室召开的项目会议,请提前准备好以下材料:
1. 项目进度报告
2. 预算表
3. 团队人员名单
如有疑问,请及时联系我。
祝好!
张经理
场景:录制语音灵感,转换为社交媒体发布文案
执行流程:
☕️ 今日份咖啡推荐!
今天发现了一家宝藏咖啡店 ☕✨
咖啡口感浓郁,环境舒适超治愈,简直是工作充电的好地方~
#咖啡探店 #工作日常 #周末好去处
📍 地址:[咖啡店名称]
⭐ 推荐:招牌拿铁、手冲咖啡
场景:录制长篇语音,分多段录音,最后拼接完整文本
执行流程:
第一段录音(0-10分钟):
result1 = transcriber.transcribe("part1.wav")
text1 = result1["text"]
第二段录音(10-20分钟):
result2 = transcriber.transcribe("part2.wav")
text2 = result2["text"]
第三段录音(20-30分钟):
result3 = transcriber.transcribe("part3.wav")
text3 = result3["text"]
智能体拼接:
完整文本:
[第一段内容]
...(智能体添加连接词)...
[第二段内容]
...(智能体添加连接词)...
[第三段内容]
场景:语音转文字后,一键复制或分享到微信
执行流程:
文本已复制到剪贴板!
✅ 文本已生成,可以分享到微信
分享格式:
[改写后的文本]
#会议纪要 #工作效率
初始化:
Qwen3ASRTranscriber(api_key=None, base_url=None)
主要方法:
# 语音转文字
transcribe(
audio_file: str,
language: str = "zh-CN",
format: str = "wav",
sample_rate: int = 16000,
return_timestamps: bool = False
) -> dict
# 返回格式
{
"success": True,
"text": "识别的文字",
"language": "zh-CN",
"duration": 120.5,
"segments": [...] # 如果 return_timestamps=True
}