
Lip Sync AI Video Generator Free Online | LipsyncX
从照片或语音用AI生成对口型视频。
AI LipSync — 对口型视频生成工具,支持长视频翻译
完整作品展
技术栈
27 projects

从照片或语音用AI生成对口型视频。
AI LipSync — 对口型视频生成工具,支持长视频翻译

克隆你的声音创作和讲述原创故事。
u/Aware_Web9715 · Reddit
Create stories in your voice Built using open source models (Qwen 3.6 and TTS). Clone your voice and create an original story for free. Just a fun weekend project that runs on my spark. Feedback gets reviewed daily and the coding agents attempts to create a PR. https://app.getzoro.com submitted by /u/Aware_Web9715 to r/SideProject [link] [comments]

录制你的声音,获得关于清晰度、语速、稳定性和听感的AI反馈。
MRNiu · V2EX
做了一个免费的声音表达分析工具,录 5–15 秒就能看到反馈 最近做了一个小工具:Voice Impression Checker 。 它想解决的问题很简单:我们经常知道自己“说了什么”,却不太清楚这段话听起来是什么感觉。 打开网站后,只需要录制 5–15 秒自然说话的声音,工具会从这一次录音中分析: - 清晰度、语速、稳定性、能量和声音变化 - 听感上的温暖、自信、亲和力和参与感 - 这次表达做得比较好的地方 - 下一次录音可以尝试改进的一件事 网站还提供了 Rate My Voice 模式,可以针对面试回答、演讲开场、自我介绍和日常交流等场景进行练习。 需要特别说明的是,它不是声音好坏评判,也不会通过声音判断性格或身份。所有结果只描述当前这一次录音的表达效果,更适合用来反复练习和比较不同说法。 目前网站免费使用,不需要注册账号,录音仅用于生成当前报告,不会保存。 网站地址: https://voiceimpressionchecker.com/ 这是一个刚完成的早期版本。如果你愿意体验,欢迎告诉我结果是否容易理解,以及你最希望

Voice infrastructure for web applications — the #1 voicebot and Voice OS for websites in 2026. Embeddable voice agent + TTS/STT APIs, agentic DOM actions, 50+ languages, 487ms P50.
@adarshknt1 · X
I’m building

上传音频或视频,SayScribe 自动转成带说话者标签和时间戳的文字稿。
zxhywork · V2EX
SayScribe AI - 音频转文字的在线工具 花了几周搞了一个基于 OpenAI Whisper 的 AI 转录工具 **[SayScribe]( https://sayscribe.org)**,目前 5 个工具全部免费,每天 3 次无需注册。上线前请 SEO 专家做了一轮诊断,踩了不少坑,分享出来给同样在做工具站的 V 友参考。 --- ## 做了什么 核心工具是 **[Audio to Text Converter]( https://sayscribe.org)**(主页),上传音频/视频文件,AI 自动转成带 speaker labels 和时间戳的文字稿。选这个词的原因是:Google 第一页有个 DR 只有 10 的小站排第三,KD 才 20.2 ,链接预算只要 15-35 个引用域就能进前十——典型的弱盘面蓝海。 然后在主页基础上拆了 4 个子工具,每个打一个独立搜索词: - **[MP3 to Text]( https://sayscribe.org/mp3-to-text)** — 只转 MP3 。KD 41.7 比主页难一些,但

将 MP3 和 MP4 文件转换为带有时间戳和说话人识别的可编辑文字稿。
digiplanp · V2EX
做了一个音视频转文字工具,支持 MP3/MP4、说话人识别和字幕导出 大家好,最近做了一个在线音视频转文字工具 ToText ,想发出来请大家体验一下,也听听 V 友的意见。 最开始做这个工具,是因为我自己在处理会议录音、访谈和视频内容时,发现单纯生成一大段文字并不太实用。转录完成后,通常还需要反复对照原始录音、修改错误、区分说话人,再整理摘要或字幕。 所以现在做成了一个相对完整的工作流: * 上传 MP3 、MP4 、M4A 、MOV 、WAV 、WebM 等音视频文件 * 自动识别语言并生成带时间戳的文字稿 * 支持说话人识别和说话人名称修改 * 点击文字片段可以跳转到对应的音视频位置 * 可以搜索、编辑和校对转录内容 * 自动生成摘要、会议纪要、章节和行动事项 * 支持导出 TXT 、DOCX 、PDF 、SRT 、VTT 、CSV 和 JSON 音频文件可以直接使用 [MP3 to Transcript]( https://totext.app/) 功能,比较适合播客、访谈、课程录音、会议和语音备忘录。 视频文件也使用同一个编辑器,通过

将语音转录为整洁清单,可复制到笔记和应用。
emadda · HN
list55.com: Transcribe a list into plain text

在浏览器本地离线转录音视频文件,无需上传数据,无需注册账户。
mikicat · V2EX
[分享创造] 做了一个纯本地离线运行的语音转文字工具: Free Local Transcription 大家好, 平时经常有一些包含敏感信息或者不想上传到第三方服务器的音频(如会议记录、采访、个人备忘等)需要转文字。市面上很多工具本质上都是套壳调用云端 API ,既有数据泄露风险,长期用也有不小的 API 成本。 结合自己的模型优化经验,我做了一个完全基于本地算力运行的音频转文字工具:Free Local Transcription 🔗 体验地址: https://freelocaltranscription.com/ 主要特点 100% 本地运行 / 零数据外传:推理完全在设备本地完成,音频文件不会上传到任何服务器,断网状态下也能保证隐私与安全。 无需 API Key / 完全免费:依靠本地算力运行,不需要填 API Key ,也没有按分钟计费的困扰。 即开即用:界面保持极简,拖入音频即可直接进行本地转写。 目前的权衡与折衷 相比直接走云端高性能 GPU 集群,本地推理的速度会直接取决于用户的设备配置与硬件性能,老旧设备上可能存在内存占

上传音频样本克隆声音,生成具有可调节情感、语速和音调的语音。
ccx001 · V2EX
做了个 AI 声音克隆 VoiceCloner,有免费额度,留邮箱送积分 做了一个网站:[**VoiceCloner**]( https://voicecloner.org/zh),上传一小段音频,AI 就能用这个声音读出任意文字。 **可调节的参数:** - 语言(自动检测) - 情绪 - 插入停顿 - 语气词 - 语速 - 音调 **免费额度:** | 场景 | 积分 | |------|------| | 匿名打开 | 500 | | 登录 | 1000 | | 每天签到 | +200 | 1 积分 ≈ 1 字符,免费额度用完了签到还能继续攒。 --- **🎁 本帖福利:** > - **前 20 名**回复邮箱 → 手动充 **1000 积分**(约 1000 字符) > - 20 名之后 → **500 积分** 叠加登录自带的 1000 ,前 20 名到手 2000 起步。 立即体验:[中文站]( https://voicecloner.org/zh) | [英文站]( https://voic

Tovo - 本地AI应用,提供转录和会议协助,完全在设备上运行。
Tovo - AI 会议/面试助手 — 在会议中,Tovo 是一款注重隐私的 AI 助手,完全在您的设备上运行,为会议和对话提供实时转录和智能协助,无需向外部服务器发送任何数据。

VoicePost AI 将语音、视频或文档转换为社交媒体帖子和视频脚本。
@VoicePost_AI · X

用AI快速转录视频和音频,配有40多个工具生成字幕、摘要、翻译和图像放大。
@indrapurnomos · X
Check out what I just built with Lovable!