
ScribeToAny — Free Audio & Video to Text Transcription
ScribeToAny 可转录音视频为文本,支持 98 种语言和多种导出格式。
ScribeToAny — AI 音视频转录与字幕生成工具,支持说话人识别(区分发言人)、多语言翻译与字级高精度时间戳,长音频高速转文字,一键导出 SRT/VTT/TXT 格式 — 免费试用
完整作品展
技术栈
60 projects

ScribeToAny 可转录音视频为文本,支持 98 种语言和多种导出格式。
ScribeToAny — AI 音视频转录与字幕生成工具,支持说话人识别(区分发言人)、多语言翻译与字级高精度时间戳,长音频高速转文字,一键导出 SRT/VTT/TXT 格式 — 免费试用

快速、精准的 AI 音频转录工具,无需注册,支持多种格式和语言。
音频转文字工具 — AI 音频转文字,快速、精准、安全的转写服务

上传漫画页面,AI自动翻译并完成排版。
eunhye1999 · Product Hunt
KomaLume AI-translate full manga chapters — cleaned and typeset

用100多个AI语音将文本转换为语音,支持27种语言,可下载MP3。
dheeraj_vishwakarma · Product Hunt
Free Text to Speech Online Free For everyone Text to Speech Online

将文本转为自然音质AI语音,支持18种语言,无需注册即可下载MP3。
littlepp · HN
Speech Generation – Free text-to-speech in 18 languages

浏览器插件,为日语视频字幕添加平假名注音、翻译和AI语法解析。
@yurilifelab · X
从 0 到 1,我用 AI 做了一个真正上线的产品! 这期视频分享mimikatsu 从一个想法到开发、测试、修改,再到正式上线的整个过程。 如果你也想用 AI 做自己的产品,但不知道该从哪里开始,希望这个视频能给你一些参考。 已在Chrome web store上线,它一定是你学日语的好帮手

Learn Japanese Hiragana and Katakana beautifully, one flashcard at a time.
@RuyumeLearning · X

上传音频或视频,SayScribe 自动转成带说话者标签和时间戳的文字稿。
zxhywork · V2EX
SayScribe AI - 音频转文字的在线工具 花了几周搞了一个基于 OpenAI Whisper 的 AI 转录工具 **[SayScribe]( https://sayscribe.org)**,目前 5 个工具全部免费,每天 3 次无需注册。上线前请 SEO 专家做了一轮诊断,踩了不少坑,分享出来给同样在做工具站的 V 友参考。 --- ## 做了什么 核心工具是 **[Audio to Text Converter]( https://sayscribe.org)**(主页),上传音频/视频文件,AI 自动转成带 speaker labels 和时间戳的文字稿。选这个词的原因是:Google 第一页有个 DR 只有 10 的小站排第三,KD 才 20.2 ,链接预算只要 15-35 个引用域就能进前十——典型的弱盘面蓝海。 然后在主页基础上拆了 4 个子工具,每个打一个独立搜索词: - **[MP3 to Text]( https://sayscribe.org/mp3-to-text)** — 只转 MP3 。KD 41.7 比主页难一些,但

在浏览器本地离线转录音视频文件,无需上传数据,无需注册账户。
mikicat · V2EX
[分享创造] 做了一个纯本地离线运行的语音转文字工具: Free Local Transcription 大家好, 平时经常有一些包含敏感信息或者不想上传到第三方服务器的音频(如会议记录、采访、个人备忘等)需要转文字。市面上很多工具本质上都是套壳调用云端 API ,既有数据泄露风险,长期用也有不小的 API 成本。 结合自己的模型优化经验,我做了一个完全基于本地算力运行的音频转文字工具:Free Local Transcription 🔗 体验地址: https://freelocaltranscription.com/ 主要特点 100% 本地运行 / 零数据外传:推理完全在设备本地完成,音频文件不会上传到任何服务器,断网状态下也能保证隐私与安全。 无需 API Key / 完全免费:依靠本地算力运行,不需要填 API Key ,也没有按分钟计费的困扰。 即开即用:界面保持极简,拖入音频即可直接进行本地转写。 目前的权衡与折衷 相比直接走云端高性能 GPU 集群,本地推理的速度会直接取决于用户的设备配置与硬件性能,老旧设备上可能存在内存占

从文本生成带情感的AI语音,支持59种语言。
@prosodyai · X
ProsodyAI — AI text-to-speech that performs, not just pronounces. Tell it how to sound ("warm, slow, like a bedtime story") and it does. Three engines in one app: ours, OpenAI and Gemini. 100,000 characters free every month, voice cloning included.

将录音或视频转录为带时间戳和说话人识别的可编辑文本。
lavande · V2EX
做了一个语音转文字的工具,另加 AI 总结、翻译、提问等(附踩坑记录) 先上链接:[Echoryte]( https://echoryte.com/) 感觉这个网站 vibe coding 的话,感觉手熟的同学可能半天就能搓出来…… 但是我用了一个多月才上线,主要是被 GPT5.6 坑了,当时 5.6 和 fable 前后发布,然后试了试用 fable 5 做的 plan ,然后 5.6 sol 推理开到最大去执行。结果愣是给我干了 33 个小时没停,写了将近 2 万行代码。 但是坑就坑在这,推理开太高,就过度思考了,给我整了很多虚头巴脑的东西出来,什么“门禁”我也不懂,什么合规,一大堆,然后我就不停地删,删了一个月,最后我就跟 GPT 说,我特么是个人小项目,不是大公司,再这么高下去永远上不了线了。然后终于看删的差不多了,上线了! 欢迎大家试用,轻拍,谢谢!

上传书籍进行翻译,生成13种语言的有声书。
u/SonikaAI · Reddit
I built SonikaAI to translate books/documents and turn them into audiobooks in one upload The problem I kept running into was pretty simple: I had a document or book in a language I wasn't comfortable reading, and turning it into something I could actually use took multiple steps. Translate it somewhere. Download or copy the result. Then, if I wanted to listen instead of read, move it into another tool for text-to-speech. For longer documents, that also meant dealing with formatting, splitt