
Veo3.1 视频生成器|原生音频与镜头级控制
用 Veo 3.1 制作 1080p 视频,原生音频与镜头级控制。
Veo 3.1 AI — 使用 Veo3.1 创作电影级视频,配备 1080p 原生音频、首尾帧控制及免费试用额度
完整作品展
技术栈
9 projects

用 Veo 3.1 制作 1080p 视频,原生音频与镜头级控制。
Veo 3.1 AI — 使用 Veo3.1 创作电影级视频,配备 1080p 原生音频、首尾帧控制及免费试用额度

从文字或参考图快速生成 768p AI 短视频,支持原生音频。
plutozc · V2EX
做了两个 MiniMax H3 AI 视频生成入口 最近在用 MiniMax H3 做一些 AI 视频的快速试验,发现自己常在文字、图片参考、画幅和时长之间来回切,所以顺手做了两个偏不同工作流的入口,想听听大家会不会觉得这种拆分有用。 一个是偏快速迭代的版本: [H3 Max]( https://h3-max.org) 主打从文字或参考图生成短视频,重点放在快速生成 768p 片段和提示词里的画面、镜头、音频描述。 另一个是功能更完整的工作台: [MiniMax H3 Max]( https://minimaxh3max.org) 同样支持 text-to-video 和 image-to-video ,可以按需要选 768p 、2K 或 4K ,也能调时长和横竖画幅。 目前都还是刚上线的个人项目: - 文字或图片作为起点生成视频 - 一个提示词里写画面、动作、镜头和声音方向 - 方便先快速出一个版本,再回头改提示词 两站都不是官方站,生成结果和速度会受模型设置及队列影响。现在页面和体验还在继续补,尤其想听听大家更在意“快点出第一版”,

从文本和图像生成 4K+ 电影级视频,支持多镜头序列和人物持久化。
kling — AI 生成视频,支持多种 kling 模型

将 MP3 和 MP4 文件转换为带有时间戳和说话人识别的可编辑文字稿。
digiplanp · V2EX
做了一个音视频转文字工具,支持 MP3/MP4、说话人识别和字幕导出 大家好,最近做了一个在线音视频转文字工具 ToText ,想发出来请大家体验一下,也听听 V 友的意见。 最开始做这个工具,是因为我自己在处理会议录音、访谈和视频内容时,发现单纯生成一大段文字并不太实用。转录完成后,通常还需要反复对照原始录音、修改错误、区分说话人,再整理摘要或字幕。 所以现在做成了一个相对完整的工作流: * 上传 MP3 、MP4 、M4A 、MOV 、WAV 、WebM 等音视频文件 * 自动识别语言并生成带时间戳的文字稿 * 支持说话人识别和说话人名称修改 * 点击文字片段可以跳转到对应的音视频位置 * 可以搜索、编辑和校对转录内容 * 自动生成摘要、会议纪要、章节和行动事项 * 支持导出 TXT 、DOCX 、PDF 、SRT 、VTT 、CSV 和 JSON 音频文件可以直接使用 [MP3 to Transcript]( https://totext.app/) 功能,比较适合播客、访谈、课程录音、会议和语音备忘录。 视频文件也使用同一个编辑器,通过

在浏览器中用可视化节点构建模块化音频合成器
Synthesizer Flow — 浏览器端模块化合成器,通过可视化节点和连线搭建音频工作流,支持实时声音合成、MIDI 音序及 AI Agent 辅助修改工程

用AI编辑音频、生成音乐、创建无缝循环和音轨分离。
audjust.ai — 智能音频编辑与 AI 音乐生成工具,帮助处理音频文件(智能缩短歌曲、延长音频、寻找完美无缝循环)并从文字描述、歌词或图片生成完整音乐轨道。支持多种风格,内置 MIDI 编辑器、音轨分离、Lo-fi 转换等专业工具。

将您的人声转换为钢琴、吉他、小提琴等100+种乐器演奏。
Voice to Instrument — AI 工具,将人声录音转换为器乐曲目。上传歌声或录音,AI 自动生成钢琴、吉他、鼓等器乐伴奏。

匹配音乐EQ与参考歌曲的浏览器AI工具。
@pcclubb · X
Check out "SONICSYNC EQ "match engine · v1.0 I just built with Lovable!

Type a sentence, get a royalty-free WAV loop or sample. Set BPM and key, download for your DAW. 25 free Sounds generations a day.
sigvef · HN
Text to Sample