OPEN-SOURCE TOOLS
真正有实用价值的 GitHub 开源工具 按股票分析、量化交易、数字货币、视频增强和图片增强等方向筛选实用开源项目。
开源工具 Skills 开源模型 游戏模型 3D
开源项目 · AI 音频与语音类 开源项目 · AI 音频与语音类 · 新手
HAPI:远程控制 Claude Code / Codex 等 AI 编程代理会话的本地优先应用 HAPI 是一个用于运行官方 Claude Code、Codex、Cursor Agent、Grok Build、OpenCode、Kimi、Copilot、Antigravity、Pi、DeepSeek Harness 会话,并通过 Web / PWA / Telegram Mini App 远程控制的 App,定位为 Happy 的本地优先替代方案,支持本地与远程无缝交接、手机扫码配对、语音控制和端到端加密中继。
GitHub 开源项目
查看指南
开源项目 · AI 音频与语音类 开源项目 · AI 音频与语音类 · 新手
GitHub - neuphonic/neutts: On-device TTS model by Neuphonic NeuTTS HuggingFace 🤗: - NeuTTS-Air (English): Model , Q8 GGUF , Q4 GGUF , Space - NeuTTS-Nano Multilingual Collection: - NeuTTS-Nano (English): Model , Q8 GGUF , Q4 GGUF - NeuTTS-Nano-French: Model , Q8 GGUF , Q4 GGUF - NeuTTS-Nano-German: Model , Q8 GGUF ,
GitHub 开源项目
查看指南
开源项目 · AI 音频与语音类 开源项目 · AI 音频与语音类 · 新手
GitHub - buxuku/SmartSub: 视频转字幕、字幕翻译、AI 配音与声音克隆、字幕烧录——免费开源的一站式桌面工具。基于 Whisper / FunASR 等本地模型离线语音转文字,批量处理 + 全平台 GPU 加速,跨 Windows / macOS / Li 妙幕 / SmartSub 视频转字幕、字幕翻译、AI 配音与声音克隆、字幕烧录——一站式开源桌面工具 让每一帧画面都能美妙地表达 中文 | English | 日本語 下载安装 · 功能特性 · 免费方案 · 常见问题 · 更新日志 妙幕是什么 妙幕(SmartSub)是一款开源的字幕与配音工具,把「语音转文字 → 字幕翻译 → 校对润色 → TTS 配音 → 烧录合成」整条流水线装进一个桌面应用,还内置在线视频下载,粘贴 B 站 / YouTube 等平台链接即可直接取材。转写基于
GitHub 开源项目
查看指南
开源项目 · AI 音频与语音类 开源项目 · AI 音频与语音类 · 新手
Audiblez - 从电子书生成有声书 Audiblez 是一个将 EPUB 电子书转换为 M4B 有声书的开源工具,基于 Kokoro-82M 高质量文本转语音模型,支持多种语言、图形界面和 CUDA 加速。
GitHub 开源项目
查看指南
开源项目 · AI 音频与语音类 开源项目 · AI 音频与语音类 · 新手
Voicebox - 开源 AI 语音工作室 Voicebox 是一个本地优先的开源 AI 语音工作室,支持克隆任意声音、在 7 个 TTS 引擎和 23 种语言中生成语音、使用全局热键向任意应用听写,并可为 MCP 智能体提供语音输出,是 ElevenLabs 和 WisprFlow 的开源替代品。
GitHub 开源项目
查看指南
开源项目 · AI 音频与语音类 开源项目 · AI 音频与语音类 · 新手
GitHub - OpenBMB/VoxCPM: VoxCPM2: Tokenizer-Free TTS for Multilingual Speech Generation, Creative Voice Design, and True-to-Life Cloning VoxCPM2: Tokenizer-Free TTS for Multilingual Speech Generation, Creative Voice Design, and True-to-Life Cloning English | 中文 👋 Join our community for discussion and support! Feishu | Discord VoxCPM is a tokenizer-free Text-to-Speech system that directly
GitHub 开源项目
查看指南
开源项目 · AI 音频与语音类 开源项目 · AI 音频与语音类 · 新手
MiniMax H3 Audio T8 - ComfyUI 原生 H3 音频节点扩展 面向 ComfyUI 原生 MiniMax H3 的扩展节点包,当前 1.12.0 注册 54 个节点,覆盖音画条件、对白分析、长视频续写、语音链、来源视频音画重绘等实验与稳定功能。代码采用 GPL-3.0-or-later,不包含模型权重,需配合 ComfyUI 及 MiniMax H3 模型使用。
GitHub 开源项目
查看指南 第 2 / 3 页 · 共 26 条