
完整作品展
技术栈
20 projects


一键下载微软文字转语音合成音频,支持所有官方语音和SSML语法。
微软 TTS (Text-to-Speech) 文字转语音下载器 — 一键播放或下载 微软 TTS 文字转语音 合成的音频。支持所有官方提供的语音和声音选项。支持SSML语法。每月享免费用量。量大者可升级Pro Plan,固定便宜费用无限使用。摒弃按量收费。支持支付宝


文本驱动的AI图像编辑工具,支持照片修复、去水印和头像生成。
Qwen Image Edit — AI 图像编辑工具,支持文本指令编辑、照片修复、去水印、专业头像生成和多图像处理

在浏览器中用可视化节点构建模块化音频合成器
Synthesizer Flow — 浏览器端模块化合成器,通过可视化节点和连线搭建音频工作流,支持实时声音合成、MIDI 音序及 AI Agent 辅助修改工程

用 Veo 3.1 制作 1080p 视频,原生音频与镜头级控制。
Veo 3.1 AI — 使用 Veo3.1 创作电影级视频,配备 1080p 原生音频、首尾帧控制及免费试用额度

用AI生成和编辑图像,完美支持中英文文本渲染。
Free Qwen Image Edit AI — Qwen Image Edit 网站。高级 AI 图像编辑与完美文本渲染,完美支持中英文文本渲染。

上传音频或视频,SayScribe 自动转成带说话者标签和时间戳的文字稿。
zxhywork · V2EX
SayScribe AI - 音频转文字的在线工具 花了几周搞了一个基于 OpenAI Whisper 的 AI 转录工具 **[SayScribe]( https://sayscribe.org)**,目前 5 个工具全部免费,每天 3 次无需注册。上线前请 SEO 专家做了一轮诊断,踩了不少坑,分享出来给同样在做工具站的 V 友参考。 --- ## 做了什么 核心工具是 **[Audio to Text Converter]( https://sayscribe.org)**(主页),上传音频/视频文件,AI 自动转成带 speaker labels 和时间戳的文字稿。选这个词的原因是:Google 第一页有个 DR 只有 10 的小站排第三,KD 才 20.2 ,链接预算只要 15-35 个引用域就能进前十——典型的弱盘面蓝海。 然后在主页基础上拆了 4 个子工具,每个打一个独立搜索词: - **[MP3 to Text]( https://sayscribe.org/mp3-to-text)** — 只转 MP3 。KD 41.7 比主页难一些,但

上传音频或视频文件,自动生成文本转录、摘要、字幕和语音。
@bydigiwares · X

用 Qwen AI 模型将文本描述转换为逼真照片。
Qwen Image — AI 图像生成

用于语音、聊天和视频面试的 AI 平台,提供自动转录和分析。
Aural — 开源 AI 面试平台,支持语音、聊天和视频面试,提供自适应追问、结构化评分、面试练习与自托管 - [查看仓库](https://github.com/1146345502/aural-oss)

快速、精准的 AI 音频转录工具,无需注册,支持多种格式和语言。
音频转文字工具 — AI 音频转文字,快速、精准、安全的转写服务