上传音视频转文字

上传你拥有权利的本地音视频文件,配置语言、格式、时间轴和断句选项。ASR 转写能力准备中,当前不会上传或处理文件。

UP
拖拽音视频文件到这里

支持 MP3、M4A、WAV、MP4、MOV,单个文件不超过 200MB

选择音视频文件,按分钟消耗 AI 额度

套餐限制

单个文件大小最大 200MB最大 2GB最大 5GB
单个文件时长最长 30 分钟最长 3 小时最长 6 小时
每月转写时长30 分钟600 分钟2000 分钟
生成时间轴×
导出格式TXTTXT / SRTTXT / SRT / VTT

转写结果预览(示例)

00:00:00大家好,欢迎使用 Mozihao 音视频转文字工具。

00:00:03我们支持上传多种音频和视频格式,快速将语音转换为文字。

00:00:09工具支持多语言识别,并且可以自动断句,生成时间轴。

00:00:20无论是会议记录、课堂笔记,还是视频字幕制作,都能高效完成。

常见问题

合规与版权提醒

请确保上传的音视频内容已获得合法授权,或属于您拥有合法使用权的内容。严禁上传、转写和传播任何侵权、违法或敏感内容。

支持的上传转写能力

音视频转文字

上传自有音频或视频文件,生成可复制的文字内容。

字幕格式导出

支持 TXT、SRT、VTT 等转写结果格式规划。

时间轴与断句

可选择生成时间轴、自动断句和标点,便于后续整理。

三步完成上传转写

  1. 选择自有文件

    上传你拥有合法使用权的音频或视频文件。

  2. 设置语言和格式

    选择识别语言、导出格式、时间轴和断句选项。

  3. 创建任务并导出

    任务完成后预览文本,并导出 TXT/SRT/VTT。

适用素材示例

  • 会议录音、课程录音
  • 自制视频、访谈素材
  • 公开视频授权素材的本地文件

常见失败原因

  • 文件过大、格式异常或音轨不可读取。
  • AI 额度不足,无法创建新的转写任务。
  • 音频噪声过大或多人重叠说话,可能影响识别质量。

上传转写常见问题

可以上传别人的视频吗?

请只上传本人内容、已获授权素材或符合使用规则的文件。

转写结果一定准确吗?

准确度会受音质、口音、背景噪声和说话重叠影响,建议转写后人工校对。

为什么需要消耗 AI 额度?

上传转写需要调用语音识别能力,会按任务预估时长消耗额度。