
The full gallery
Tech stack
26 projects


A shared music room for friends. Everyone hears the same track at the same second, one person holds the aux, and anyone can take it off them.
@theeasyway6 · X

Convert audio and video files to text with speaker labels and timestamps, no signup required.
zxhywork · V2EX
SayScribe AI - 音频转文字的在线工具 花了几周搞了一个基于 OpenAI Whisper 的 AI 转录工具 **[SayScribe]( https://sayscribe.org)**,目前 5 个工具全部免费,每天 3 次无需注册。上线前请 SEO 专家做了一轮诊断,踩了不少坑,分享出来给同样在做工具站的 V 友参考。 --- ## 做了什么 核心工具是 **[Audio to Text Converter]( https://sayscribe.org)**(主页),上传音频/视频文件,AI 自动转成带 speaker labels 和时间戳的文字稿。选这个词的原因是:Google 第一页有个 DR 只有 10 的小站排第三,KD 才 20.2 ,链接预算只要 15-35 个引用域就能进前十——典型的弱盘面蓝海。 然后在主页基础上拆了 4 个子工具,每个打一个独立搜索词: - **[MP3 to Text]( https://sayscribe.org/mp3-to-text)** — 只转 MP3 。KD 41.7 比主页难一些,但

Segment Anything for Audio — made simple. Separate audio with a text prompt. Isolate vocals, remove background music, extract speech from noise. Privacy-first stem splitter powered
@sambamdamnn · X

Convert MP3 and MP4 files to editable transcripts with timestamps and speaker identification.
digiplanp · V2EX
做了一个音视频转文字工具,支持 MP3/MP4、说话人识别和字幕导出 大家好,最近做了一个在线音视频转文字工具 ToText ,想发出来请大家体验一下,也听听 V 友的意见。 最开始做这个工具,是因为我自己在处理会议录音、访谈和视频内容时,发现单纯生成一大段文字并不太实用。转录完成后,通常还需要反复对照原始录音、修改错误、区分说话人,再整理摘要或字幕。 所以现在做成了一个相对完整的工作流: * 上传 MP3 、MP4 、M4A 、MOV 、WAV 、WebM 等音视频文件 * 自动识别语言并生成带时间戳的文字稿 * 支持说话人识别和说话人名称修改 * 点击文字片段可以跳转到对应的音视频位置 * 可以搜索、编辑和校对转录内容 * 自动生成摘要、会议纪要、章节和行动事项 * 支持导出 TXT 、DOCX 、PDF 、SRT 、VTT 、CSV 和 JSON 音频文件可以直接使用 [MP3 to Transcript]( https://totext.app/) 功能,比较适合播客、访谈、课程录音、会议和语音备忘录。 视频文件也使用同一个编辑器,通过

Transcribe audio files to text instantly with AI, no signup required.
音频转文字工具 — AI 音频转文字,快速、精准、安全的转写服务

Convert audio and video to searchable transcripts with AI.
giang_taira · Product Hunt
GPT Transcribe Turn recorded speech into reviewable text

Transcribe audio and video recordings into searchable, editable text.
lavande · V2EX
做了一个语音转文字的工具,另加 AI 总结、翻译、提问等(附踩坑记录) 先上链接:[Echoryte]( https://echoryte.com/) 感觉这个网站 vibe coding 的话,感觉手熟的同学可能半天就能搓出来…… 但是我用了一个多月才上线,主要是被 GPT5.6 坑了,当时 5.6 和 fable 前后发布,然后试了试用 fable 5 做的 plan ,然后 5.6 sol 推理开到最大去执行。结果愣是给我干了 33 个小时没停,写了将近 2 万行代码。 但是坑就坑在这,推理开太高,就过度思考了,给我整了很多虚头巴脑的东西出来,什么“门禁”我也不懂,什么合规,一大堆,然后我就不停地删,删了一个月,最后我就跟 GPT 说,我特么是个人小项目,不是大公司,再这么高下去永远上不了线了。然后终于看删的差不多了,上线了! 欢迎大家试用,轻拍,谢谢!

Generate AI lip-sync talking head videos by uploading photos and audio.
vtoolpro · HN
Lip Sync AI – Create Your Talking Videos Instantly

Listen to music together in shared rooms with chat, skip voting, and AI-powered song requests.
vodmaker · V2EX
做了个在线听音乐的另一种可能 平时听歌,不管是工作还是休息,习惯基本都是:打开 App ,进入歌单,然后开始播放。 我最近在想,听歌是不是还能有另一种方式? 参考 KTV 的点歌模式,我做了一个多人在线听歌的小产品——听歌 Next 。 大家可以进入同一个房间,一起听同一首歌,也可以各自点歌,把想听的歌曲加入播放队列。播放进度会在房间内同步,还支持聊天和投票切歌。 另外做了一个自然语言点歌功能,不需要准确输入歌名,可以直接说: - 来几首适合下班路上听的歌 - 想听一些周杰伦早期的慢歌 - 放几首适合写代码的轻音乐 系统会根据描述推荐歌曲,再批量加入播放队列。 目前还是早期版本,欢迎大家来试用,也欢迎反馈问题和建议: 试用地址: https://tingge-production.up.railway.app/

Turn newsletters and reports into personalized private audio shows.
BSOhealth · HN
Audioreality.ai – email to private daily podcast summary show

Transcribe MP4 videos to text with timestamps, speaker labels, and summaries.
yongkunchen · V2EX
做了一个 MP4 转文字的小工具 最近自己做了一个 MP4 转文字的 AI 小工具,主要用于把视频快速转换成文本。 项目地址: https://mp4totext.ai/ 开发过程中发现,真正麻烦的并不是调用语音识别模型,而是视频格式兼容、音频提取、长视频处理以及异步任务这些细节。 目前还在持续优化,如果大家平时有视频转文字的需求,欢迎试试看。 也想听听大家对视频转写类工具还有哪些实际需求。