今观「AI语音」· 共 48 种
视频转文字,支持 CSV、TXT、SRT、VTT 四种导出格式,可以附带时间戳和说话人标签,支持 99 种语言,除上传文件外也支持 YouTube、TikTok、Instagram 等社交媒体平台视频链接
AI 字幕生成与校对工具,自动标出不确定的词并显示剩余检查数,在同一浏览器工作流里完成生成、校对、整轨翻译、字幕样式和视频导出;无需注册可免费处理最长 10 分钟视频
Meet妙记 ✦
运行中可随身携带的 AI 语音助手,记会议、记灵感、记待办,记录你的每一天;专注工作/生活/学习/闲谈/灵感等场景的语音记录,支持实时语音转写、说话人区分、AI 智能摘要一键生成,历史会议可按主题回看,iOS、Android、Mac、Windows 四端覆盖,单次录音最长 4 小时,内置 19 种行业纪要模板
语音输入、转写与 AI 润色,任意应用内快捷键唤起;支持 BYOK、本地词典与多种语音/大模型服务商 — 跨平台,MIT 开源
中文 AI 语音输入工具,按快捷键说话,在 Windows 任意应用把口述整理成去口头语、可分段和结构化的文字并插入当前光标;支持用户词典、中文转英文和自选云端 ASR/LLM
将 ElevenLabs 网页版语音转文字流程封装为 Python CLI,复用自有账号免费额度,支持批量转录、长音频静音切分和 SRT/VTT/TXT 等格式导出
无需注册的 YouTube 转录工具,可搜索 transcript、跳转时间戳,并导出 TXT、SRT、VTT
Speakoala ✦
运行中集“全格式兼容、超自然人声、沉浸式听感”于一体的智能语音助手,能将网页、邮件及 PDF/Word 等本地文档一键转化为媲美真人的多国语言朗读,配合词级高亮同步、背景白噪音及最高 4 倍速调节,解放用户双眼,让深度阅读在通勤、家务或健身的碎片化场景中焕发新生
Sonicker ✦
运行中AI 语音克隆平台,3 秒克隆任何声音,完美保留情感和口音。支持中英日韩等 10 种语言的语音合成,提供 50+ 预设声音库和 AI 声音设计功能,免费开始使用。
FastScribe ✦
运行中Convert MP3, MP4, WAV to text online. Audio transcription and video to text converter with 240 minutes free credit.
用户只需录制或上传一段音频,系统便能在几秒内生成一个属于用户自己的声音模型。支持任意文本的语音生成,听起来自然流畅,几乎接近真人语音。整个流程无需复杂设备,也不需要技术背景,真正实现“用几句话训练出自己的声音”
在会议中,Tovo 是一款注重隐私的 AI 助手,完全在您的设备上运行,为会议和对话提供实时转录和智能协助,无需向外部服务器发送任何数据。
SAM TTS ✦
运行中复刻 Microsoft SAM 的文本转语音工具,支持文字输入并生成极具复古感的电子语音。用户可自定义音高、语速、嘴型、喉咙共鸣等参数,还可下载生成的语音(WAV 格式),无需登录,适合内容创作、游戏配音、搞笑语音等多种场景。