Document local AI music across languages (#47)

This commit is contained in:
Martin Delophy
2026-07-25 16:11:56 +08:00
committed by GitHub
parent e7b7743f0f
commit ea25abc514
11 changed files with 11 additions and 0 deletions
+1
View File
@@ -13,6 +13,7 @@ Timeline Studio ist ein lokaler KI-Videoeditor für den Browser. Er verbindet ei
## Hauptfunktionen
- Mehrsprachige Sprachausgabe mit Piper/VITS ONNX und Kokoro 82M.
- Lokale KI-Musik mit Stable Audio 3 Small Q4 ONNX über WebGPU, übersetzten freien Prompts, 30/60/90/120-Sekunden-Optionen, wellenformbasierten langen Loops, persistentem Modellcache und automatischer Ablage in „Meine Assets“.
- Automatische Untertitel mit Whisper small q8 ONNX.
- Intelligenter Bildausschnitt mit YOLOS tiny und MODNet.
- Gesangs-/Musiktrennung und Avatare mit JoyVASA und LivePortrait.
+1
View File
@@ -13,6 +13,7 @@ Timeline Studio es un editor de vídeo con IA, local y ejecutado en el navegador
## Funciones principales
- Locución multilingüe con Piper/VITS ONNX y Kokoro 82M.
- Música de IA local con Stable Audio 3 Small Q4 ONNX mediante WebGPU, traducción de indicaciones libres, opciones de 30/60/90/120 segundos, bucles largos guiados por la forma de onda, caché persistente del modelo e incorporación automática a Mis recursos.
- Subtítulos automáticos con Whisper small q8 ONNX.
- Encuadre inteligente con YOLOS tiny y MODNet.
- Separación de voz y música, y creación de avatares con JoyVASA y LivePortrait.
+1
View File
@@ -13,6 +13,7 @@ Timeline Studio est un éditeur vidéo IA local qui fonctionne dans le navigateu
## Fonctionnalités principales
- Voix multilingues avec Piper/VITS ONNX et Kokoro 82M.
- Musique IA locale avec Stable Audio 3 Small Q4 ONNX via WebGPU, traduction des descriptions libres, durées de 30/60/90/120 secondes, boucles longues guidées par la forme donde, cache persistant du modèle et ajout automatique à Mes ressources.
- Sous-titres automatiques avec Whisper small q8 ONNX.
- Cadrage intelligent avec YOLOS tiny et MODNet.
- Séparation voix/musique et avatars via JoyVASA et LivePortrait.
+1
View File
@@ -13,6 +13,7 @@ Timeline Studio はブラウザで動作するローカルファーストの AI
## 主な機能
- Piper/VITS ONNX と Kokoro 82M による多言語音声。
- Stable Audio 3 Small Q4 ONNX と WebGPU によるローカル AI 音楽生成。自由入力プロンプトの翻訳、30/60/90/120 秒、波形解析による長尺ループ、モデルの永続キャッシュ、マイ素材への自動追加に対応。
- Whisper small q8 ONNX による字幕自動生成。
- YOLOS tiny と MODNet によるスマートフレーミング。
- ボーカル分離、JoyVASA と LivePortrait によるアバター生成。
+1
View File
@@ -13,6 +13,7 @@ Timeline Studio는 브라우저에서 실행되는 로컬 우선 AI 동영상
## 주요 기능
- Piper/VITS ONNX와 Kokoro 82M을 이용한 다국어 음성.
- Stable Audio 3 Small Q4 ONNX와 WebGPU를 이용한 로컬 AI 음악 생성. 자유 형식 프롬프트 번역, 30/60/90/120초 옵션, 파형 기반 장시간 루프, 영구 모델 캐시, 내 에셋 자동 추가를 지원합니다.
- Whisper small q8 ONNX 자동 자막.
- YOLOS tiny와 MODNet 스마트 프레이밍.
- 보컬 분리 및 JoyVASA/LivePortrait 아바타 생성.
+1
View File
@@ -20,6 +20,7 @@ https://github.com/user-attachments/assets/e8327caa-429e-40ff-a7fe-a59e6cf7a464
## AI capabilities
- **Multilingual voiceover:** Chinese Piper/VITS ONNX voices, English Kokoro 82M, and browser Piper voices for German, Spanish, French, Italian, and Brazilian Portuguese.
- **Local AI music:** Stable Audio 3 Small Q4 ONNX runs through WebGPU with translated free-form prompts, 30/60/90/120-second choices, waveform-aware long-track looping, persistent model caching, and automatic insertion into My Assets.
- **Automatic captions:** Whisper small q8 ONNX with waveform-aware timing and conservative Chinese recognition cleanup.
- **Smart framing:** YOLOS tiny subject detection and MODNet portrait matting for smart crop, caption avoidance, and background removal across images and complete videos.
- **AI vocal separation:** isolate vocals and place the instrumental stem on the music track without leaving the browser workflow.
+1
View File
@@ -13,6 +13,7 @@ O Timeline Studio é um editor de vídeo com IA, local e executado no navegador.
## Principais recursos
- Narração multilíngue com Piper/VITS ONNX e Kokoro 82M.
- Música local por IA com Stable Audio 3 Small Q4 ONNX via WebGPU, tradução de prompts livres, opções de 30/60/90/120 segundos, loops longos orientados pela forma de onda, cache persistente do modelo e inclusão automática em Meus recursos.
- Legendas automáticas com Whisper small q8 ONNX.
- Enquadramento inteligente com YOLOS tiny e MODNet.
- Separação de voz e música e avatares com JoyVASA e LivePortrait.
+1
View File
@@ -13,6 +13,7 @@ Timeline Studio — локальный ИИ-видеоредактор, рабо
## Основные возможности
- Многоязычная озвучка с Piper/VITS ONNX и Kokoro 82M.
- Локальная генерация ИИ-музыки на Stable Audio 3 Small Q4 ONNX через WebGPU: перевод свободных промптов, варианты 30/60/90/120 секунд, длинные циклы с анализом волны, постоянный кэш модели и автоматическое добавление в «Мои ресурсы».
- Автоматические субтитры на базе Whisper small q8 ONNX.
- Умное кадрирование с YOLOS tiny и MODNet.
- Разделение вокала и музыки, аватары JoyVASA и LivePortrait.
+1
View File
@@ -13,6 +13,7 @@ Timeline Studio คือโปรแกรมตัดต่อวิดีโ
## ความสามารถหลัก
- เสียงพากย์หลายภาษาด้วย Piper/VITS ONNX และ Kokoro 82M
- สร้างเพลง AI ในเครื่องด้วย Stable Audio 3 Small Q4 ONNX ผ่าน WebGPU รองรับการแปลพรอมต์อิสระ ระยะเวลา 30/60/90/120 วินาที การวนเพลงยาวโดยวิเคราะห์รูปคลื่น แคชโมเดลแบบถาวร และเพิ่มลงในสินทรัพย์ของฉันโดยอัตโนมัติ
- คำบรรยายอัตโนมัติด้วย Whisper small q8 ONNX
- การจัดเฟรมอัจฉริยะด้วย YOLOS tiny และ MODNet
- แยกเสียงร้องและดนตรี พร้อมอวตาร JoyVASA และ LivePortrait
+1
View File
@@ -13,6 +13,7 @@ Timeline Studio là trình chỉnh sửa video AI ưu tiên xử lý cục bộ
## Tính năng chính
- Lồng tiếng đa ngôn ngữ với Piper/VITS ONNX và Kokoro 82M.
- Tạo nhạc AI cục bộ bằng Stable Audio 3 Small Q4 ONNX qua WebGPU, hỗ trợ dịch lời nhắc tự do, các lựa chọn 30/60/90/120 giây, lặp nhạc dài theo phân tích dạng sóng, bộ nhớ đệm mô hình bền vững và tự động thêm vào Tài nguyên của tôi.
- Phụ đề tự động bằng Whisper small q8 ONNX.
- Căn khung thông minh với YOLOS tiny và MODNet.
- Tách giọng hát/nhạc và tạo avatar bằng JoyVASA cùng LivePortrait.
+1
View File
@@ -16,6 +16,7 @@ Timeline Studio 是一个本地优先、直接运行在浏览器中的 AI 视频
## AI 能力
- **多语言 AI 配音:** 中文 Piper/VITS ONNX、英文 Kokoro 82M,以及德语、西班牙语、法语、意大利语和巴西葡萄牙语的浏览器 Piper 声音。
- **本地 AI 音乐:** Stable Audio 3 Small Q4 ONNX 通过 WebGPU 在浏览器运行,支持自由提示词自动翻译、30/60/90/120 秒选项、长音乐波形感知循环、模型持久缓存,并在完成后自动加入“我的素材”。
- **自动字幕:** Whisper small q8 ONNX,结合音频能量修正时间戳,并对中文识别结果做克制的高置信纠错。
- **智能画面:** YOLOS tiny 主体检测与 MODNet 人像抠图,用于图片和完整视频的智能裁切、字幕避让与背景移除。
- **AI 人声分离:** 在浏览器工作流中提取人声,并把伴奏放入音乐轨。