Abogen publie la v1.3.1 : nouvelle interface utilisateur Web, pipeline EPUB 3 et moteur Supertonic TTS

Abogen v1.3.1 apporte une interface utilisateur Web basée sur Flask, un pipeline d'empaquetage de superposition multimédia EPUB 3, un moteur Supertonic TTS, une attribution de rôles multitimbrale et une intégration Caliber/Audiobookshelf.

Abogen v1.3.1 : D'un outil bureautique à une double forme bureau + Web

Abogen Version v1.3.1. Cette version n'est pas légère : elle n'ajoute pas seulement des fonctions, mais utilise une reconstruction architecturale pour étendre Abogen d'une simple application de bureau PyQt6 à un outil double forme qui partage le même noyau pour le bureau et le Web, et ajoute des fonctionnalités clés telles que EPUB 3, Supertonic TTS et multi-timbral.

Faits en bref

Itinéraire Mises à jour
Formulaire Ajout de l'interface utilisateur Web basée sur Flask (abogen-web)
Architecture Base de code refactorisée, interface graphique PyQt6 et interface utilisateur Web partagent le même noyau
Sortie Pipeline d'empaquetage de superposition de médias EPUB 3
Voix Ajout du moteur Supertonic TTS (accélération GPU)
Performances Attribution de rôle multi-timbrale + analyse d'entité/couverture d'articulation
Écologie Calibre OPDS, intégration de bibliothèque audio

Reconstruction architecturale : un ensemble de noyaux, deux entrées

abogen-web convient au déploiement de Docker et de serveurs sans tête, et lui et l'interface graphique du bureau partagent désormais la même logique de base. Cela signifie que que vous cliquiez dessus depuis le bureau ou que vous l'exécutiez par lots sur le serveur, le comportement sera cohérent - c'est également la prémisse pour laquelle Abogen s'oriente vers la génération par lots de livres audio côté serveur.

Qualité du contenu : Livre audio EPUB 3 « joué » par les participants

Le pipeline EPUB 3 peut créer un livre électronique avec une superposition multimédia basée sur l'audio généré et les métadonnées fragmentées. Les métadonnées temporelles fragmentées sont conservées dans le produit de tâche et équipées de tests automatisés. Avec l'attribution de rôles à plusieurs voix, différentes voix peuvent être attribuées au narrateur et à différents personnages pour créer un livre audio « dramatique » ; le système d'analyse d'entité et de couverture de prononciation nouvellement ajouté s'occupe spécifiquement de la prononciation des noms propres. Le moteur Supertonic TTS apporte en outre des options de composition accélérées par GPU.

Mise à niveau et mise en œuvre

  1. Mettez à niveau vers la v1.3.1 via « uv tool update abogen ».
  2. Évaluez abogen-web dans le scénario de serveur et connectez-le à Caliber/Audiobookshelf pour former un pipeline.
  3. Le déploiement Web doit prêter attention au contrôle d'accès et à l'occupation des ressources ; les modifications complètes sont soumises aux instructions de publication officielles.
Copyright : Contenu source Sorties d'Abogen GitHub . Cette plateforme a compilé et organisé ce contenu à des fins d'information et d'échange éducatif. Pour tout problème de droit d'auteur, veuillez nous contacter.

Avis

  • Chargement des avis...