华南理工大学在读,关注音频生成与语音大模型的实验、流式处理和评测工具。
| 项目 | 用途 |
|---|---|
| SonoForge | 音频生成基线、可复现实验和结果分析 |
| VoxWeave | 音频流、对话轮次、批处理与语音模型接口 |
| AuralBench | 音频与文本评测、统计比较和报告 |
主要使用 Python、NumPy 和 Docker。各项目提供无需 GPU 的本地示例和测试; 外部预训练模型的依赖与验证范围见对应项目文档。
项目中的 2025–2026 提交时间线为重建的演示数据,不代表实际开发日期。
华南理工大学在读,关注音频生成与语音大模型的实验、流式处理和评测工具。
| 项目 | 用途 |
|---|---|
| SonoForge | 音频生成基线、可复现实验和结果分析 |
| VoxWeave | 音频流、对话轮次、批处理与语音模型接口 |
| AuralBench | 音频与文本评测、统计比较和报告 |
主要使用 Python、NumPy 和 Docker。各项目提供无需 GPU 的本地示例和测试; 外部预训练模型的依赖与验证范围见对应项目文档。
项目中的 2025–2026 提交时间线为重建的演示数据,不代表实际开发日期。
Auditable evaluation for generated audio and speech models, with manifests, metrics, statistics, and reports.
Python 1
The SQLite of agent sandboxes — self-hosted, E2B-compatible. One machine, sandboxes that live forever, idle costs nothing.
A collection of open-source Agent Skills for content creation — images, audio, and video.
Cross-platform terminal grid for running Codex, Claude, Gemini, and other CLI agents side by side.