
SHRP — Speech to Text, Transcription, YouTube Transcripts & TTS
Transcribe audio and video to text, create summaries and captions, and generate speech.
@bydigiwares · X
The full gallery
Tech stack
32 projects

Transcribe audio and video to text, create summaries and captions, and generate speech.
@bydigiwares · X

Turn text into illustrated and video stories using AI image and video generation tools.
aniv — 一站式 AI 创作工具站,浏览器打开即用:AI 文生图、AI 文生视频、视频画质增强、字幕合成

Transform video into clips, captions, articles, newsletters, and social posts.
@SpiceP0dcast · X
Create, distribute and monetize your video content - one chat.

Transcribe MP4 videos to text with timestamps, speaker labels, and summaries.
yongkunchen · V2EX
做了一个 MP4 转文字的小工具 最近自己做了一个 MP4 转文字的 AI 小工具,主要用于把视频快速转换成文本。 项目地址: https://mp4totext.ai/ 开发过程中发现,真正麻烦的并不是调用语音识别模型,而是视频格式兼容、音频提取、长视频处理以及异步任务这些细节。 目前还在持续优化,如果大家平时有视频转文字的需求,欢迎试试看。 也想听听大家对视频转写类工具还有哪些实际需求。

Create AI videos from image, video, and audio references with control over style and composition.
luya · V2EX
独立开发又折腾了个 AI 视频小站, V 友登录送一次生成 最近又折腾了个小站: https://referencetovideo.net 主要是做 reference to video 。 起因是我自己最近一直在玩 AI 视频,发现现在不少模型已经不只是文生视频、图生视频了,开始可以塞参考图、参考视频、音频进去。 但每家支持的东西又不太一样,用起来挺乱的。 所以就想干脆做个站,把这些东西放到一个地方。 现在大概就是: 上传图片 / 视频 / 音频 写 prompt 选模型 生成视频 目前还比较早期,边做边改。 我自己比较常用的场景是: * 拿人物图继续生成视频 * 产品图做广告 * 拿一段视频参考动作或者镜头 * 几种素材混着用 技术栈还是比较常规: Next.js PostgreSQL Stripe Vercel 再接一些视频模型 API 这次也给 V 友留了点福利。 **注册登录送一次免费生成次数**,不用付费,可以直接试一下。 地址: https://refere

Create high-quality AI videos from text or images in up to 4K using multiple models.
coter · V2EX
做了一个 AI 视频生成网站 AI 视频模型越来越强了,可玩性越来越好,我做了这个 AI 视频生成网站,接入主流 AI 视频生成模型,欢迎体验! 网址: https://tovideo.io/

Generate cinematic videos from images and text with AI-controlled motion effects.
Vibe Video — 面向普通用户的 AI 视频生成网站,支持文生视频、图生视频、参考图生视频和电影化镜头控制,适合创作者和营销团队快速产出视频

Generate 2K videos from text, images, or reference materials using AI.
wendy29 · Product Hunt
MiniMax H3 AI image-to-video clips for launch demos

Generate cinematic videos from still images with AI motion and voiceovers.
Image to Video AI — 将静态图片生成视频的 AI 工具

Convert MP3 and MP4 files to editable transcripts with timestamps and speaker identification.
digiplanp · V2EX
做了一个音视频转文字工具,支持 MP3/MP4、说话人识别和字幕导出 大家好,最近做了一个在线音视频转文字工具 ToText ,想发出来请大家体验一下,也听听 V 友的意见。 最开始做这个工具,是因为我自己在处理会议录音、访谈和视频内容时,发现单纯生成一大段文字并不太实用。转录完成后,通常还需要反复对照原始录音、修改错误、区分说话人,再整理摘要或字幕。 所以现在做成了一个相对完整的工作流: * 上传 MP3 、MP4 、M4A 、MOV 、WAV 、WebM 等音视频文件 * 自动识别语言并生成带时间戳的文字稿 * 支持说话人识别和说话人名称修改 * 点击文字片段可以跳转到对应的音视频位置 * 可以搜索、编辑和校对转录内容 * 自动生成摘要、会议纪要、章节和行动事项 * 支持导出 TXT 、DOCX 、PDF 、SRT 、VTT 、CSV 和 JSON 音频文件可以直接使用 [MP3 to Transcript]( https://totext.app/) 功能,比较适合播客、访谈、课程录音、会议和语音备忘录。 视频文件也使用同一个编辑器,通过

Create videos from text or images with AI motion control, audio generation, and lip-sync.
Veo3 AI Video Generator — 支持文本转视频和图像转视频,配备原生音频生成和精准唇形同步,2-5秒完成专业级视频创作。

Apply motion from reference videos to turn static images into animated videos.
Kling Motion Control — AI Motion Transfer with Kling 3.0