
Free TTS Audio — AI Text-to-Speech & PDF to MP3 | tts.audio
将文本和PDF转换为AI自然语音并下载为MP3。
@caschiblu · X
完整作品展
技术栈
60 projects

将文本和PDF转换为AI自然语音并下载为MP3。
@caschiblu · X

AI 电话助手,在浏览器中录制、转录业务通话并提取洞见。
u/carlosmarcialt · Reddit
I spent months building my SaaS and completely forgot the marketing part I just realized Voxandra has had exactly zero marketing. Not bad marketing. Literally none. So this Reddit post is now the entire marketing department. Voxandra is an AI phone copilot for people and teams who still get real work done over phone calls. Supplier calls, payment follow ups, claims, banks, government offices, universities, and all the other places that somehow still behave like email was never invented.

使用 AI 语音将文本和 PDF 转换为自然发音的音频
@caschiblu · X

Sonara turns text into natural, expressive speech. Studio-grade voices for narration, assistants, and storytelling.
@Dev_NexaLabs · X
NOTE: we're still in the early phase something is not yet finish.

能处理收入电话的双工AI语音模型,自然应对中断和重叠语音。
vatsalaggarwal · HN
Production duplex speech model for revenue calls

比较多个语音转文字引擎的速度和准确度,支持本地隐私保护。
@alvaisy · X
finished voice to text small web app for my own itch. it's opensource. use openrotuer key. and use it with 4 models.

在浏览器本地离线转录音视频文件,无需上传数据,无需注册账户。
mikicat · V2EX
[分享创造] 做了一个纯本地离线运行的语音转文字工具: Free Local Transcription 大家好, 平时经常有一些包含敏感信息或者不想上传到第三方服务器的音频(如会议记录、采访、个人备忘等)需要转文字。市面上很多工具本质上都是套壳调用云端 API ,既有数据泄露风险,长期用也有不小的 API 成本。 结合自己的模型优化经验,我做了一个完全基于本地算力运行的音频转文字工具:Free Local Transcription 🔗 体验地址: https://freelocaltranscription.com/ 主要特点 100% 本地运行 / 零数据外传:推理完全在设备本地完成,音频文件不会上传到任何服务器,断网状态下也能保证隐私与安全。 无需 API Key / 完全免费:依靠本地算力运行,不需要填 API Key ,也没有按分钟计费的困扰。 即开即用:界面保持极简,拖入音频即可直接进行本地转写。 目前的权衡与折衷 相比直接走云端高性能 GPU 集群,本地推理的速度会直接取决于用户的设备配置与硬件性能,老旧设备上可能存在内存占

将录音或视频转录为带时间戳和说话人识别的可编辑文本。
lavande · V2EX
做了一个语音转文字的工具,另加 AI 总结、翻译、提问等(附踩坑记录) 先上链接:[Echoryte]( https://echoryte.com/) 感觉这个网站 vibe coding 的话,感觉手熟的同学可能半天就能搓出来…… 但是我用了一个多月才上线,主要是被 GPT5.6 坑了,当时 5.6 和 fable 前后发布,然后试了试用 fable 5 做的 plan ,然后 5.6 sol 推理开到最大去执行。结果愣是给我干了 33 个小时没停,写了将近 2 万行代码。 但是坑就坑在这,推理开太高,就过度思考了,给我整了很多虚头巴脑的东西出来,什么“门禁”我也不懂,什么合规,一大堆,然后我就不停地删,删了一个月,最后我就跟 GPT 说,我特么是个人小项目,不是大公司,再这么高下去永远上不了线了。然后终于看删的差不多了,上线了! 欢迎大家试用,轻拍,谢谢!

将 MP4 视频转录为文本,支持时间戳和说话人标签。
yongkunchen · V2EX
做了一个 MP4 转文字的小工具 最近自己做了一个 MP4 转文字的 AI 小工具,主要用于把视频快速转换成文本。 项目地址: https://mp4totext.ai/ 开发过程中发现,真正麻烦的并不是调用语音识别模型,而是视频格式兼容、音频提取、长视频处理以及异步任务这些细节。 目前还在持续优化,如果大家平时有视频转文字的需求,欢迎试试看。 也想听听大家对视频转写类工具还有哪些实际需求。

将播客转录为文本,带讲者标签和 AI 摘要。
u/vadeconry · Reddit
I built a tool that turns Podcast URLs into transcripts and summaries Hi everyone, I am a software developer by profession, and over the past few months I've been working on a side project called PodTyper. You can access it at https://www.podtyper.com Instead of downloading audio files or uploading episodes manually, you just paste a podcast URL (Spotify, YouTube or Apple Podcasts) and it generates a transcript along with AI-powered summaries. I originally built it becau

将语音转换为AI润色的文本,支持自定义改写风格。
@louispereira · X
End of an era for me. I just moved web app out of Bubble, to a version i custom built with Claude. No Code gave me wings back in 2023, but it cannot compete with Claude in 2026 imo. Forever grateful to @bubble though. It changed my life.

将 MP3 和 MP4 文件转换为带有时间戳和说话人识别的可编辑文字稿。
digiplanp · V2EX
做了一个音视频转文字工具,支持 MP3/MP4、说话人识别和字幕导出 大家好,最近做了一个在线音视频转文字工具 ToText ,想发出来请大家体验一下,也听听 V 友的意见。 最开始做这个工具,是因为我自己在处理会议录音、访谈和视频内容时,发现单纯生成一大段文字并不太实用。转录完成后,通常还需要反复对照原始录音、修改错误、区分说话人,再整理摘要或字幕。 所以现在做成了一个相对完整的工作流: * 上传 MP3 、MP4 、M4A 、MOV 、WAV 、WebM 等音视频文件 * 自动识别语言并生成带时间戳的文字稿 * 支持说话人识别和说话人名称修改 * 点击文字片段可以跳转到对应的音视频位置 * 可以搜索、编辑和校对转录内容 * 自动生成摘要、会议纪要、章节和行动事项 * 支持导出 TXT 、DOCX 、PDF 、SRT 、VTT 、CSV 和 JSON 音频文件可以直接使用 [MP3 to Transcript]( https://totext.app/) 功能,比较适合播客、访谈、课程录音、会议和语音备忘录。 视频文件也使用同一个编辑器,通过