
Maina Voice — Speech to Text & Model Benchmarking
比较多个语音转文字引擎的速度和准确度,支持本地隐私保护。
@alvaisy · X
finished voice to text small web app for my own itch. it's opensource. use openrotuer key. and use it with 4 models.
完整作品展
技术栈
21 projects

比较多个语音转文字引擎的速度和准确度,支持本地隐私保护。
@alvaisy · X
finished voice to text small web app for my own itch. it's opensource. use openrotuer key. and use it with 4 models.

将 MP3 和 MP4 文件转换为带有时间戳和说话人识别的可编辑文字稿。
digiplanp · V2EX
做了一个音视频转文字工具,支持 MP3/MP4、说话人识别和字幕导出 大家好,最近做了一个在线音视频转文字工具 ToText ,想发出来请大家体验一下,也听听 V 友的意见。 最开始做这个工具,是因为我自己在处理会议录音、访谈和视频内容时,发现单纯生成一大段文字并不太实用。转录完成后,通常还需要反复对照原始录音、修改错误、区分说话人,再整理摘要或字幕。 所以现在做成了一个相对完整的工作流: * 上传 MP3 、MP4 、M4A 、MOV 、WAV 、WebM 等音视频文件 * 自动识别语言并生成带时间戳的文字稿 * 支持说话人识别和说话人名称修改 * 点击文字片段可以跳转到对应的音视频位置 * 可以搜索、编辑和校对转录内容 * 自动生成摘要、会议纪要、章节和行动事项 * 支持导出 TXT 、DOCX 、PDF 、SRT 、VTT 、CSV 和 JSON 音频文件可以直接使用 [MP3 to Transcript]( https://totext.app/) 功能,比较适合播客、访谈、课程录音、会议和语音备忘录。 视频文件也使用同一个编辑器,通过

在浏览器中将文本转换为自然语音,支持调整速度和变化。
g58892881 · HN
Inflect TTS v2+ONNX, 9M/4M text-to-speech models running in the browser

快速、精准的 AI 音频转录工具,无需注册,支持多种格式和语言。
音频转文字工具 — AI 音频转文字,快速、精准、安全的转写服务

上传音频或视频,SayScribe 自动转成带说话者标签和时间戳的文字稿。
zxhywork · V2EX
SayScribe AI - 音频转文字的在线工具 花了几周搞了一个基于 OpenAI Whisper 的 AI 转录工具 **[SayScribe]( https://sayscribe.org)**,目前 5 个工具全部免费,每天 3 次无需注册。上线前请 SEO 专家做了一轮诊断,踩了不少坑,分享出来给同样在做工具站的 V 友参考。 --- ## 做了什么 核心工具是 **[Audio to Text Converter]( https://sayscribe.org)**(主页),上传音频/视频文件,AI 自动转成带 speaker labels 和时间戳的文字稿。选这个词的原因是:Google 第一页有个 DR 只有 10 的小站排第三,KD 才 20.2 ,链接预算只要 15-35 个引用域就能进前十——典型的弱盘面蓝海。 然后在主页基础上拆了 4 个子工具,每个打一个独立搜索词: - **[MP3 to Text]( https://sayscribe.org/mp3-to-text)** — 只转 MP3 。KD 41.7 比主页难一些,但

将文本转为自然音质AI语音,支持18种语言,无需注册即可下载MP3。
littlepp · HN
Speech Generation – Free text-to-speech in 18 languages

在浏览器本地离线转录音视频文件,无需上传数据,无需注册账户。
mikicat · V2EX
[分享创造] 做了一个纯本地离线运行的语音转文字工具: Free Local Transcription 大家好, 平时经常有一些包含敏感信息或者不想上传到第三方服务器的音频(如会议记录、采访、个人备忘等)需要转文字。市面上很多工具本质上都是套壳调用云端 API ,既有数据泄露风险,长期用也有不小的 API 成本。 结合自己的模型优化经验,我做了一个完全基于本地算力运行的音频转文字工具:Free Local Transcription 🔗 体验地址: https://freelocaltranscription.com/ 主要特点 100% 本地运行 / 零数据外传:推理完全在设备本地完成,音频文件不会上传到任何服务器,断网状态下也能保证隐私与安全。 无需 API Key / 完全免费:依靠本地算力运行,不需要填 API Key ,也没有按分钟计费的困扰。 即开即用:界面保持极简,拖入音频即可直接进行本地转写。 目前的权衡与折衷 相比直接走云端高性能 GPU 集群,本地推理的速度会直接取决于用户的设备配置与硬件性能,老旧设备上可能存在内存占

用AI转录音频和视频为文本和摘要
@Mahima_Akkina · X
Yes, you can check - It's a tool used to convert both and video into text and summaries

使用 AI 生成的语音将文本转换为播客剧集。
@motyar · X
🎙️ Idea → Audio

将中文文本转换为粤语、四川话等多种方言的语音。
ldbmcs · V2EX
做了一个无需注册就能试的方言配音工具「乡音阁」,想请 V 友帮忙体验 大家好,我之前一直主要做开发,产品做出来后不太擅长推广。这次想把自己长期维护的一个项目发出来,请大家体验一下。 项目叫「乡音阁」,是一个中文方言文字转语音工具。 做它的原因比较简单:普通话配音工具已经很多,但粤语、四川话、东北话、闽南语等方言的选择相对有限。 目前已经支持: - 10+ 种中文方言和多种音色 - 输入文字生成方言语音 - 在线试听和下载音频 - 声音复刻、声音设计和 API - 中英文页面 体验地址: https://xiangyinge.com/zh 无需注册可以直接试用 100 个字符;超过免费额度后需要购买资源包。 如果愿意体验,我比较希望了解: - 使用了什么方言和音色 - 哪些字词发音不准确或不自然 - 操作过程中是否有不清楚的地方 - 你希望用它解决什么问题 产品目前主要由我自己开发和维护,前端使用 Next.js ,部署在 Cloudflare 。技术实现、产品设计或者推广方面的问题也欢迎交流。 感谢大家体验

收集客户推荐,自动生成案例研究、社交内容和证明页面。
@rafaelaraujo_pt · X
CasePruve turns one happy client’s real answers into a full case study, tweet, thread and proof page. No invented numbers. No complicated process. Just one link → 4 short questions → ready-to-use proof. Free to try →

通过AI聊天界面一站式创建视频,自动生成脚本、配音和编辑。
u/Real-Estate-Agentx44 · Reddit
Built an AI video tool where one chat writes, voices, generates, and edits the whole video - is all-in-one actually useful or do you prefer separate tools? I've been building ViewPress AI , an AI video generator, and I'm at the point where I want honest feedback before I keep pushing in one direction. Instead of jumping between a script tool, a voice tool, an image/video generator, and an editor, you describe what you want in one chat and the agent handles the whole thing. It