
SUB/WAVE
由AI DJ精选和播报音乐的互联网电台。
@pinku1 · X
Personal internet radio: Agentic AI DJ - Open Source
完整作品展
技术栈
28 projects

由AI DJ精选和播报音乐的互联网电台。
@pinku1 · X
Personal internet radio: Agentic AI DJ - Open Source

将 MP3 和 MP4 文件转换为带有时间戳和说话人识别的可编辑文字稿。
digiplanp · V2EX
做了一个音视频转文字工具,支持 MP3/MP4、说话人识别和字幕导出 大家好,最近做了一个在线音视频转文字工具 ToText ,想发出来请大家体验一下,也听听 V 友的意见。 最开始做这个工具,是因为我自己在处理会议录音、访谈和视频内容时,发现单纯生成一大段文字并不太实用。转录完成后,通常还需要反复对照原始录音、修改错误、区分说话人,再整理摘要或字幕。 所以现在做成了一个相对完整的工作流: * 上传 MP3 、MP4 、M4A 、MOV 、WAV 、WebM 等音视频文件 * 自动识别语言并生成带时间戳的文字稿 * 支持说话人识别和说话人名称修改 * 点击文字片段可以跳转到对应的音视频位置 * 可以搜索、编辑和校对转录内容 * 自动生成摘要、会议纪要、章节和行动事项 * 支持导出 TXT 、DOCX 、PDF 、SRT 、VTT 、CSV 和 JSON 音频文件可以直接使用 [MP3 to Transcript]( https://totext.app/) 功能,比较适合播客、访谈、课程录音、会议和语音备忘录。 视频文件也使用同一个编辑器,通过

用语音记录支出,识别消费漏洞,管理订阅。
@aeltyif · X
Small expenses add up fast. FloosYo helps you spot them, see the yearly damage, and stop the leaks before your money disappears.

录制你的声音,获得关于清晰度、语速、稳定性和听感的AI反馈。
MRNiu · V2EX
做了一个免费的声音表达分析工具,录 5–15 秒就能看到反馈 最近做了一个小工具:Voice Impression Checker 。 它想解决的问题很简单:我们经常知道自己“说了什么”,却不太清楚这段话听起来是什么感觉。 打开网站后,只需要录制 5–15 秒自然说话的声音,工具会从这一次录音中分析: - 清晰度、语速、稳定性、能量和声音变化 - 听感上的温暖、自信、亲和力和参与感 - 这次表达做得比较好的地方 - 下一次录音可以尝试改进的一件事 网站还提供了 Rate My Voice 模式,可以针对面试回答、演讲开场、自我介绍和日常交流等场景进行练习。 需要特别说明的是,它不是声音好坏评判,也不会通过声音判断性格或身份。所有结果只描述当前这一次录音的表达效果,更适合用来反复练习和比较不同说法。 目前网站免费使用,不需要注册账号,录音仅用于生成当前报告,不会保存。 网站地址: https://voiceimpressionchecker.com/ 这是一个刚完成的早期版本。如果你愿意体验,欢迎告诉我结果是否容易理解,以及你最希望

用 AI 创作原创免版税的歌曲和音乐
DeepSong AI — AI 生成音乐和歌曲,原创且免版税

根据文本描述生成BeMusic AI音乐和人声。
BeMusic AI — AI 音乐生成器

在浏览器中创作和协作音乐记谱,实时预览效果。
@erikdao · X

在无限画布上组合AI生成的图像、视频和音频。
ZOOOP — AI 原生创作平台,支持在浏览器端无限画布上生成图像、视频和音频,提供去背景、高清化等专项工具及即用型 AI 模板,支持发布模板赚取积分,并具备团队共享积分模式。

将汽车视频和音乐上传至Machcut,自动生成节拍同步的竖屏编辑。
u/Jonathanproductions · Reddit
We built a tool that automatically edits car videos to phonk beats... here's what it makes We've been building MACHCUT for the past few months. Drop in raw car footage and a phonk track and it produces a beat-synchronized vertical edit automatically. Python engine, not generative AI. Your real footage, automated cutting. The engine runs on A100 GPUs, uses YOLO to pick the best clips from your footage, locks cuts to the beat drop, and outputs vertical 1080p or 4K in about 6 min

将PDF转换为AI配音的培训视频,自动生成幻灯片。
u/No-Tap6993 · Reddit
I built a slide deck video builder Most AI generated visual can look like slop. I built a slide deck video builder for training content. It generates beautiful slide decks from 18 templates, adds voice over, allows post editing, and finally export to mp4. Check it out at https://inkbolt.ai and let me know what you think! I have to give a shout out to this repo for inspiring how to do design properly with AI. https://github.com/zarazhangrui/frontend-slides submitted b

Riffly — 从音频片段、哼唱旋律或语音输入播放音乐。
@HappyMonkeyAI · X
Been building so many cool things recently, like Riffly 🎸Hear something cool? Play it in seconds. 📷Drop in a clip, hum a melody, or use your mic. 📷

将 Shopify 商店、博文和文档转换为多语言 AI 音频指南。
@Alexhible · X
I wanted to share a quick "How It Works" overview of Exhible, a platform I built entirely using Claude Code. What Exhible does: It transforms content sources (Shopify stores, Google Docs, urls, PDFs) into interactive, multilingual audio-visual guides