1. 会议录音转文字稿
项目经理背景
项目经理录制了一段中文项目会议,需要在会后快速整理讨论内容。
问题
手动听写整段录音耗时较长,难以快速提取会议文字。
如何使用
上传 `project_meeting.mp3`,输出格式选择“纯文本”,语言提示选择“中文”。
结果
工具将会议语音转换为可复制和编辑的中文文字稿。
Elysia Tools
导航
AI Tools
用 grok-stt AI 模型将语音(wav/mp3/m4a/flac/ogg/webm/aac)转录为文本、SRT、VTT 或 JSON。最长 10 分钟。
详情
上传包含语音的音频或视频文件,工具通过 OpenRouter 的 x-ai/grok-stt-1.0 模型完成转录。长音频会在静音附近切分成有界 FLAC 片段。字幕优先使用服务商返回的词级或分段时间戳;若不可用,则使用明确标注的静音对齐近似时间。支持 WAV、MP3、M4A、FLAC、OGG、WebM 和 AAC。音频时长遵循套餐限制(免费版:10 分钟,由平台强制)。可自动检测或指定语言提示。
执行
填写表单、运行工具,并在同一页面查看结果。
等待运行
案例
相关内容
工具使用指南
音频转文字转录器使用 grok-stt AI 模型,将包含语音的 WAV、MP3、M4A、FLAC、OGG、WebM、AAC 音频或支持的视频文件转换为纯文本、SRT、VTT 或 JSON,单个文件最长支持 10 分钟。
背景
项目经理录制了一段中文项目会议,需要在会后快速整理讨论内容。
问题
手动听写整段录音耗时较长,难以快速提取会议文字。
如何使用
上传 `project_meeting.mp3`,输出格式选择“纯文本”,语言提示选择“中文”。
结果
工具将会议语音转换为可复制和编辑的中文文字稿。
背景
内容创作者有一段包含英语访谈的 MP4 视频,需要制作字幕文件。
问题
需要将访谈语音转换为带时间轴的字幕,而不是仅获取普通文本。
如何使用
上传包含英语语音的支持视频文件,输出格式选择“SRT”,语言提示选择“英语”。
输出格式:SRT;语言提示:英语;最大分块时长:45 秒。结果
工具生成带时间信息的 SRT 转录结果,可用于后续字幕整理。
背景
研究人员需要保存一段录音的转录片段,并保留结果中的时间信息。
支持 WAV、MP3、M4A、FLAC、OGG、WebM 和 AAC,也可上传支持的 WebM 或 MP4 视频文件。
免费版最长为 10 分钟,实际时长受平台套餐限制。
可以,输出格式支持 SRT 和 VTT,也支持纯文本与 JSON。
不需要。可以使用自动检测,也可以指定中文、英语、法语等语言提示。
优先使用服务商返回的词级或分段时间戳;如果没有,则使用明确标注的静音对齐近似时间。
问题
纯文本不便于按片段查看和后续结构化整理。
如何使用
上传 `interview.m4a`,输出格式选择“JSON”,语言提示选择“自动检测”。
结果
工具返回 JSON 格式的转录结果,便于保存和进一步处理。