OPEN-SOURCE TOOLS

真正有实用价值的 GitHub 开源工具

按股票分析、量化交易、数字货币、视频增强和图片增强等方向筛选实用开源项目。

正在查看标签 #音频处理清除筛选
GitHub - neuphonic/neutts: On-device TTS model by Neuphonic 阅览图
开源项目 · AI 音频与语音类
开源
开源项目·AI 音频与语音类·新手

GitHub - neuphonic/neutts: On-device TTS model by Neuphonic

NeuTTS HuggingFace 🤗: - NeuTTS-Air (English): Model , Q8 GGUF , Q4 GGUF , Space - NeuTTS-Nano Multilingual Collection: - NeuTTS-Nano (English): Model , Q8 GGUF , Q4 GGUF - NeuTTS-Nano-French: Model , Q8 GGUF , Q4 GGUF - NeuTTS-Nano-German: Model , Q8 GGUF ,

GitHub 开源项目

0 阅读2026/09/10
查看指南
GitHub - buxuku/SmartSub: 视频转字幕、字幕翻译、AI 配音与声音克隆、字幕烧录——免费开源的一站式桌面工具。基于 Whisper / FunASR 等本地模型离线语音转文字,批量处理 + 全平台 GPU 加速,跨 Windows / macOS / Li 阅览图
开源项目 · AI 音频与语音类
开源
开源项目·AI 音频与语音类·新手

GitHub - buxuku/SmartSub: 视频转字幕、字幕翻译、AI 配音与声音克隆、字幕烧录——免费开源的一站式桌面工具。基于 Whisper / FunASR 等本地模型离线语音转文字,批量处理 + 全平台 GPU 加速,跨 Windows / macOS / Li

妙幕 / SmartSub 视频转字幕、字幕翻译、AI 配音与声音克隆、字幕烧录——一站式开源桌面工具 让每一帧画面都能美妙地表达 中文 | English | 日本語 下载安装 · 功能特性 · 免费方案 · 常见问题 · 更新日志 妙幕是什么 妙幕(SmartSub)是一款开源的字幕与配音工具,把「语音转文字 → 字幕翻译 → 校对润色 → TTS 配音 → 烧录合成」整条流水线装进一个桌面应用,还内置在线视频下载,粘贴 B 站 / YouTube 等平台链接即可直接取材。转写基于

GitHub 开源项目

4 阅读2026/09/03
查看指南
Audiblez - 从电子书生成有声书 阅览图
开源项目 · AI 音频与语音类
开源
开源项目·AI 音频与语音类·新手

Audiblez - 从电子书生成有声书

Audiblez 是一个将 EPUB 电子书转换为 M4B 有声书的开源工具,基于 Kokoro-82M 高质量文本转语音模型,支持多种语言、图形界面和 CUDA 加速。

GitHub 开源项目

1 阅读2026/08/11
查看指南
GitHub - OpenBMB/VoxCPM: VoxCPM2: Tokenizer-Free TTS for Multilingual Speech Generation, Creative Voice Design, and True-to-Life Cloning 阅览图
开源项目 · AI 音频与语音类
开源
开源项目·AI 音频与语音类·新手

GitHub - OpenBMB/VoxCPM: VoxCPM2: Tokenizer-Free TTS for Multilingual Speech Generation, Creative Voice Design, and True-to-Life Cloning

VoxCPM2: Tokenizer-Free TTS for Multilingual Speech Generation, Creative Voice Design, and True-to-Life Cloning English | 中文 👋 Join our community for discussion and support! Feishu | Discord VoxCPM is a tokenizer-free Text-to-Speech system that directly

GitHub 开源项目

1 阅读2026/08/10
查看指南
MiniMax H3 Audio T8 - ComfyUI 原生 H3 音频节点扩展 阅览图
开源项目 · AI 音频与语音类
开源
开源项目·AI 音频与语音类·新手

MiniMax H3 Audio T8 - ComfyUI 原生 H3 音频节点扩展

面向 ComfyUI 原生 MiniMax H3 的扩展节点包,当前 1.12.0 注册 54 个节点,覆盖音画条件、对白分析、长视频续写、语音链、来源视频音画重绘等实验与稳定功能。代码采用 GPL-3.0-or-later,不包含模型权重,需配合 ComfyUI 及 MiniMax H3 模型使用。

GitHub 开源项目

33 阅读2026/08/10
查看指南