mirror of
https://github.com/RVC-Project/Retrieval-based-Voice-Conversion-WebUI.git
synced 2026-09-01 19:48:26 +02:00
Translate the latest changelog update
This commit is contained in:
@@ -1,3 +1,16 @@
|
||||
### 2026-07-18
|
||||
- 降低网页使用难度(推理输入音频无需输入路径,前端实时日志优化,保存推理用小模型后自动刷新模型列表,推理首页选择模型后自动检测匹配的index路径等)
|
||||
- 数据特征提取、训练模型、索引阶段可中途掐断,重启继续进度
|
||||
- GPU自动识别判断推理模式和精度
|
||||
- 修复依赖问题(例如pyworld,fairseq,matplotlib,pyav,onnxruntime-gpu环境修复等)
|
||||
- 解决编码问题
|
||||
- 网页启动自动探寻可用端口
|
||||
- 单卡训练不用DDP
|
||||
- 基础模型不变,若干影响效果的修复,使用现有微调模型更新整合包/代码包版本重新推理,或者使用新版本重新训练再推理,均有可能效果会有提升。
|
||||
- 支持FCPE音高提取算法
|
||||
- 实时变声模式gui支持cuda graph推理加速,算法推理延时指标4.7最高加速倍(4090D测试结果),同时显卡占用相对20~30%左右
|
||||
- 移除了已明显无用或过时的功能
|
||||
|
||||
### 20231006更新
|
||||
|
||||
我们制作了一个用于实时变声的界面go-realtime_gui.bat/realtime_gui.py(事实上早就存在了),本次更新重点也优化了实时变声的性能。对比0813版:
|
||||
|
||||
@@ -1,3 +1,16 @@
|
||||
### 2026-07-18
|
||||
- Utilisation simplifiée de l’interface Web (il n’est plus nécessaire de saisir un chemin pour l’audio d’entrée de l’inférence, amélioration des journaux en temps réel dans l’interface, actualisation automatique de la liste des modèles après l’enregistrement d’un petit modèle d’inférence, détection automatique du chemin d’index correspondant après la sélection d’un modèle sur la page d’accueil de l’inférence, etc.).
|
||||
- L’extraction des caractéristiques des données, l’entraînement des modèles et la création des index peuvent désormais être interrompus en cours d’exécution, puis repris après un redémarrage.
|
||||
- Détection automatique du GPU afin de déterminer le mode d’inférence et la précision.
|
||||
- Correction de problèmes de dépendances (notamment ceux concernant pyworld, fairseq, matplotlib, PyAV et les environnements GPU d’ONNX Runtime).
|
||||
- Résolution des problèmes d’encodage.
|
||||
- L’interface Web recherche désormais automatiquement un port disponible au démarrage.
|
||||
- L’entraînement sur un seul GPU n’utilise plus DDP.
|
||||
- Le modèle de base reste inchangé. Plusieurs problèmes affectant la qualité des résultats ont été corrigés. La mise à jour du package intégré/du code, puis la relance de l’inférence avec un modèle affiné existant, ou le réentraînement avec la nouvelle version avant de relancer l’inférence, peuvent améliorer les résultats.
|
||||
- Ajout de la prise en charge de l’algorithme d’extraction de hauteur FCPE.
|
||||
- L’interface graphique de conversion vocale en temps réel prend en charge l’accélération de l’inférence par CUDA Graph, avec une accélération maximale de 4.7× de la latence d’inférence de l’algorithme (résultat mesuré sur une RTX 4090D), tandis que l’utilisation du GPU reste d’environ 20–30%.
|
||||
- Suppression des fonctionnalités manifestement obsolètes ou devenues inutiles.
|
||||
|
||||
### 2023-08-13
|
||||
1-Corrections régulières de bugs
|
||||
- Modification du nombre total d'époques minimum à 1 et changement du nombre total d'époques minimum à 2
|
||||
|
||||
@@ -1,3 +1,17 @@
|
||||
### 2026 年 7 月 18 日更新
|
||||
|
||||
- Web UI の操作性を向上(推論用の入力音声でパス入力が不要、フロントエンドのリアルタイムログを改善、推論用の小型モデル保存後にモデル一覧を自動更新、推論ホーム画面でモデル選択後に対応する index パスを自動検出するなど)。
|
||||
- データの特徴抽出、モデル学習、インデックス構築を途中で中断し、再起動後に続きから再開できるようにしました。
|
||||
- GPU を自動検出し、推論モードと精度を決定するようにしました。
|
||||
- 依存関係の問題を修正(pyworld、fairseq、matplotlib、PyAV、ONNX Runtime GPU 環境の問題など)。
|
||||
- エンコーディングに関する問題を解決しました。
|
||||
- Web UI 起動時に利用可能なポートを自動的に検索するようにしました。
|
||||
- 単一 GPU での学習では DDP を使用しないようにしました。
|
||||
- ベースモデルに変更はありません。出力品質に影響する複数の問題を修正しました。既存のファインチューニング済みモデルで統合パッケージ/コードを更新して再度推論する場合も、新バージョンで再学習してから推論する場合も、品質が向上する可能性があります。
|
||||
- FCPE ピッチ抽出アルゴリズムに対応しました。
|
||||
- リアルタイム声変換 GUI が CUDA Graph による推論高速化に対応し、アルゴリズムの推論レイテンシーで最大 4.7× の高速化を達成しました(RTX 4090D でのテスト結果)。GPU 使用率は約 20–30% に抑えられています。
|
||||
- 明らかに不要または旧式となった機能を削除しました。
|
||||
|
||||
### 2023 年 10 月 6 日更新
|
||||
|
||||
リアルタイム声変換のためのインターフェース go-realtime_gui.bat/realtime_gui.py を作成しました(実際には既に存在していました)。今回のアップデートでは、リアルタイム声変換のパフォーマンスを重点的に最適化しました。0813 版との比較:
|
||||
|
||||
@@ -1,3 +1,17 @@
|
||||
### 2026년 7월 18일 업데이트
|
||||
|
||||
- 웹 UI 사용 편의성을 개선했습니다(추론 입력 오디오의 경로를 입력할 필요가 없으며, 프런트엔드 실시간 로그 개선, 추론용 소형 모델 저장 후 모델 목록 자동 새로 고침, 추론 홈 화면에서 모델 선택 후 일치하는 index 경로 자동 감지 등).
|
||||
- 데이터 특징 추출, 모델 학습, 인덱스 구축을 도중에 중단하고 재시작 후 이어서 진행할 수 있습니다.
|
||||
- GPU를 자동으로 감지하여 추론 모드와 정밀도를 결정합니다.
|
||||
- 의존성 문제를 수정했습니다(pyworld, fairseq, matplotlib, PyAV, ONNX Runtime GPU 환경 문제 등).
|
||||
- 인코딩 문제를 해결했습니다.
|
||||
- 웹 UI 시작 시 사용 가능한 포트를 자동으로 검색합니다.
|
||||
- 단일 GPU 학습에서는 더 이상 DDP를 사용하지 않습니다.
|
||||
- 베이스 모델은 변경되지 않았습니다. 출력 품질에 영향을 주는 여러 문제를 수정했습니다. 기존 파인튜닝 모델로 통합 패키지/코드를 업데이트한 뒤 다시 추론하거나, 새 버전으로 다시 학습한 뒤 추론하면 품질이 향상될 수 있습니다.
|
||||
- FCPE 피치 추출 알고리즘을 지원합니다.
|
||||
- 실시간 음성 변환 GUI가 CUDA Graph 추론 가속을 지원하며, 알고리즘 추론 지연 시간에서 최대 4.7×의 가속을 달성했습니다(RTX 4090D 테스트 결과). GPU 사용률은 약 20–30%로 유지됩니다.
|
||||
- 명백히 불필요하거나 오래된 기능을 제거했습니다.
|
||||
|
||||
### 2023년 10월 6일 업데이트
|
||||
|
||||
실시간 음성 변환을 위한 인터페이스인 go-realtime_gui.bat/realtime_gui.py를 제작했습니다(사실 이는 이미 존재했었습니다). 이번 업데이트는 주로 실시간 음성 변환 성능을 최적화하는 데 중점을 두었습니다. 0813 버전과 비교하여:
|
||||
|
||||
@@ -1,3 +1,16 @@
|
||||
### 2026-07-18
|
||||
- Uso simplificado da interface web (não é mais necessário inserir um caminho para o áudio de entrada da inferência, melhoria dos logs em tempo real na interface, atualização automática da lista de modelos após salvar um modelo pequeno de inferência, detecção automática do caminho de índice correspondente após selecionar um modelo na página inicial de inferência etc.).
|
||||
- A extração de características dos dados, o treinamento de modelos e a criação de índices agora podem ser interrompidos durante a execução e retomados após a reinicialização.
|
||||
- Detecção automática da GPU para determinar o modo e a precisão da inferência.
|
||||
- Correção de problemas de dependências (incluindo aqueles relacionados a pyworld, fairseq, matplotlib, PyAV e ambientes GPU do ONNX Runtime).
|
||||
- Resolução de problemas de codificação.
|
||||
- A interface web agora procura automaticamente uma porta disponível durante a inicialização.
|
||||
- O treinamento com uma única GPU não usa mais DDP.
|
||||
- O modelo-base permanece inalterado. Diversos problemas que afetavam a qualidade dos resultados foram corrigidos. Atualizar o pacote integrado/o código e executar novamente a inferência com um modelo já ajustado, ou treinar novamente com a nova versão antes de executar a inferência, pode melhorar os resultados.
|
||||
- Adição de suporte ao algoritmo de extração de pitch FCPE.
|
||||
- A GUI de conversão de voz em tempo real oferece aceleração de inferência com CUDA Graph, alcançando uma aceleração máxima de 4.7× na latência de inferência do algoritmo (resultado medido em uma RTX 4090D), enquanto a utilização da GPU permanece em torno de 20–30%.
|
||||
- Remoção de recursos claramente obsoletos ou que não eram mais úteis.
|
||||
|
||||
### 2023-10-06
|
||||
- Criamos uma GUI para alteração de voz em tempo real: go-realtime_gui.bat/realtime_gui.py (observe que você deve escolher o mesmo tipo de dispositivo de entrada e saída, por exemplo, MME e MME).
|
||||
- Treinamos um modelo RMVPE de extração de pitch melhor.
|
||||
|
||||
@@ -1,3 +1,15 @@
|
||||
### 2026-07-18
|
||||
- Web arayüzünün kullanım karmaşıklığı azaltıldı (ses çıkarımı girişi için artık dosya yolu gerekmiyor, ön uçtaki gerçek zamanlı günlükler iyileştirildi, çıkarım için küçük model kaydedildikten sonra model listesi otomatik olarak yenileniyor, çıkarım ana sayfasında model seçildikten sonra eşleşen index yolu otomatik olarak algılanıyor vb.).
|
||||
- Veri özelliği çıkarımı, model eğitimi ve indeks oluşturma aşamaları artık yarıda durdurulabilir ve yeniden başlatmanın ardından kaldığı yerden sürdürülebilir.
|
||||
- Çıkarım modu ve hassasiyeti belirlemek için GPU otomatik olarak algılanır.
|
||||
- Bağımlılık sorunları giderildi (pyworld, fairseq, matplotlib, PyAV ve ONNX Runtime GPU ortamlarıyla ilgili sorunlar dahil).
|
||||
- Kodlama sorunları çözüldü.
|
||||
- Web arayüzü artık başlangıçta kullanılabilir bir bağlantı noktasını otomatik olarak arar.
|
||||
- Tek GPU ile eğitim artık DDP kullanmıyor.
|
||||
- Temel model değişmedi. Çıktı kalitesini etkileyen çeşitli sorunlar giderildi. Paketlenmiş paketi/kodu güncelleyip mevcut ince ayarlı modelle çıkarımı yeniden çalıştırmak veya yeni sürümle yeniden eğitim yapıp ardından çıkarım çalıştırmak sonuçları iyileştirebilir.
|
||||
- FCPE perde çıkarma algoritması desteği eklendi.
|
||||
- Gerçek zamanlı ses dönüştürme GUI'si CUDA Graph çıkarım hızlandırmasını destekler; algoritma çıkarım gecikmesinde 4.7×'e kadar hızlanma sağlar (RTX 4090D üzerinde test edilmiştir), GPU kullanımı ise yaklaşık 20–30% düzeyinde kalır.
|
||||
- Açıkça eski veya artık yararlı olmayan özellikler kaldırıldı.
|
||||
|
||||
### 2023-08-13
|
||||
1- Düzenli hata düzeltmeleri
|
||||
|
||||
Reference in New Issue
Block a user