• English
  • Deutsch
  • Español
  • 中文简体
  • 中文繁體
  • 日本語
  • 한국어
  • ไทย
  • Tiếng Việt
ArtPlayer logoArtplayer
ArtPlayer logoArtplayer
ArtPlayer 编辑器字幕编辑器免费视频工具

热门

视频增强
图片高清放大
AI 扩图
X 视频下载器
Facebook 视频下载器

视频

倒放视频
视频截图
移除视频水印
调整音量
HLS 转 MP4
视频转 HLS
M3U8 下载器
剪辑视频
编辑元数据
视频马赛克
压缩视频
视频防抖
翻转视频
调整视频大小
调整视频
视频淡入淡出
图片转视频
视频模糊
循环视频
拆分视频
视频转换
裁剪视频
旋转视频
视频静音
视频转 GIF
视频滤镜
合并视频
添加字幕
添加文字
添加水印
添加照片
画中画
视频转文字
人脸模糊
背景模糊
绿幕编辑
马赛克遮脸
生成缩略图
提取缩略图
检查元数据
提取轨道
删除元数据
标准化视频
重新封装视频
定格动画
动态视频
纯色视频
PDF 转视频
倒计时视频
回旋视频
分屏视频
视频变速
视频补帧
智能重构图
添加开场图片
按场景切割视频

音频

循环音频
音频变速
分割音频
添加封面图
剪辑音频
去除静音
提取音频
标准化音频
转换音频
合并音频
调整音量
添加音频
语音转文字
文本转语音
人声分离
压缩音频
均衡音频
音频滤波
淡入淡出
调整音高
倒放音频
添加混响
检测 BPM
检测响度
音频降噪
音频可视化

图片

GIF 高清增强
图片去水印
深度图
老照片修复
移除背景
图片盲水印
擦除物体

录制

录音机
屏幕录制
摄像头录制
首页/文本转语音/
Q群: 320881312 GitHub 反馈文档关于

浏览器 AI 音频工具

文本转语音

本地 TTSWebGPU 支持WAV 输出

用本地 WebGPU Kitten TTS 把短英文文本生成 WAV 语音片段。文本不会上传。

文本输入
已就绪
仅支持英文 · 91/500 字符

模型越大,质量越高,加载越久。

  • Nano - 最快 · 26 MB
  • Micro - 平衡 · 45 MB
  • Mini - 更高质量 · 82 MB
No data

选择内置声音。

  • Bella (女声)
  • Luna (女声)
  • Rosie (女声)
  • Kiki (女声)
  • Jasper (男声)
  • Bruno (男声)
  • Hugo (男声)
  • Leo (男声)
No data

调整朗读速度。

0.5x1.00x2.0x
工作方式

ArtPlayer 下载 Kitten TTS 模型文件并缓存在本地,然后在浏览器中运行 WebGPU 推理并导出 WAV 文件。

本地文本处理
模型文件加载后,你的文本会在当前浏览器中转换成语音。
WebGPU 运行时
引擎使用浏览器 WebGPU compute shaders,因此需要兼容的现代浏览器。
英文声音
当前 Kitten TTS 模型面向英文提示和短段落。
模型缓存
Nano、Micro、Mini 权重可从 R2 加载,首次运行后会缓存在 Cache Storage。

工作流程

三步完成浏览器工作流。

  1. 1

    上传文件

    从设备选择要用于 文本转语音 的源文件。

  2. 2

    调整设置

    查看预览,并按需要调整选项。

  3. 3

    预览并下载

    确认处理结果,然后下载导出的文件。

你需要了解的要点

开始前了解隐私、浏览器支持、导出结果和实际限制。

本地文本处理

模型文件加载后,你的文本会在当前浏览器中转换成语音。

WebGPU 运行时

引擎使用浏览器 WebGPU compute shaders,因此需要兼容的现代浏览器。

英文声音

当前 Kitten TTS 模型面向英文提示和短段落。

常见问题

了解隐私、浏览器支持、导出结果以及大文件处理的常见问题。

这个工具会上传文件吗?

这个浏览器工具会在当前设备本地处理所选媒体。此流程不会把文件上传到 ArtPlayer 服务器。

导出的文件会有水印吗?

不会。ArtPlayer 浏览器工具不会给导出的文件添加水印。

为什么处理需要时间?

处理在你的浏览器里运行,速度取决于设备性能、浏览器、内存、源文件大小和导出结果所需的设置。

哪些浏览器效果最好?

较新的 Chrome、Edge 和其他现代 Chromium 浏览器通常最适合较重的浏览器媒体处理。

大文件处理失败时应该怎么办?

可以先尝试更小的源文件,关闭其他占用资源的标签页,先降低分辨率或时长,并在导出完成前保持页面打开。

生成语音时会上传我的文本吗?

不会。模型文件下载完成后,输入文本会在当前浏览器中转换成语音。

这个 TTS 模型支持什么语言?

Kitten TTS 目前只支持英文,因此短英文文本效果最好。

为什么第一次运行要下载模型?

页面需要下载 Kitten TTS 的模型权重和声音数据,并会缓存在 Cache Storage 中,方便之后再次使用。

Text to Speech 适合哪些浏览器?

建议使用较新的 WebGPU 浏览器,例如 Chrome、Edge 或 Safari。这个运行时没有 wasm fallback。

相关工具

继续使用相近的 ArtPlayer 工具,沿用本地优先的浏览器工作流。

语音转文字
语音转文字
用云端 ASR 将音频或视频中的语音转成 TXT、SRT、VTT 和 JSON。
转换音频
转换音频
将音频文件或视频音轨转换为 MP3、WAV 或 AAC。
添加音频
添加音频
为视频添加音乐或配音,并在本地导出新的 MP4。
查看全部工具
ArtPlayer logoArtplayer

免费的浏览器媒体工具,可用于编辑、转换、录制和准备视频、音频、字幕与 AI 辅助结果。

联系我们: support@artplayer.org Buy Me a Coffee

视频工具

剪辑视频压缩视频调整视频大小视频转换裁剪视频合并视频按场景切割视频X 视频下载器Facebook 视频下载器

音频工具

剪辑音频提取音频转换音频合并音频添加音频

字幕与 AI

视频增强语音转文字人声分离添加字幕视频转文字字幕编辑器

图片

图片高清放大GIF 高清增强AI 扩图图片去水印老照片修复移除背景图片高清放大

站点

免费视频工具ArtPlayer 编辑器字幕编辑器博客关于常见问题文档
© 2026 ArtPlayer。保留所有权利。
隐私条款Cookie可接受使用版权

Cookie choices

ArtPlayer uses necessary cookies for app security and preferences. Optional analytics and advertising cookies only run when you allow them.

Cookie Policy