Fixie
Gratuit
Fixie est une plateforme d'agents d'IA conversationnelle d'entreprise qui fournit des fonctionnalités complètes pour créer, héberger et déployer des agents d'IA, prenant en charge l'interaction en langage naturel et l'intégration des systèmes d'entreprise.
Fixie(Ultravox)
Paramètres et statistiques de base de Fixie
| Paramètres | Données |
|---|---|
| Positionnement du produit | Couche d'infrastructure d'IA vocale en temps réel + grand modèle multimodal vocal natif |
| Feuille de route technologique de base | LLM multimodal vocal natif (compréhension audio de bout en bout, pas d'étape ASR indépendante) |
| Dernière version du modèle | Ultravox v0.7 (2025-12) |
| Base LLM | Llama 3.3 70B / 8B, peut être adapté à n'importe quel modèle de poids open source |
| Licence open source | MIT (GitHub), Apache-2.0 et personnalisé (partie SDK) |
| Hébergement de poids de modèle | Hugging Face (organisation fixie-ai, 24 modèles, 37 ensembles de données) |
| Étoiles GitHub | 4 500+ (dépôt principal ultravox) |
| Fourches GitHub | 381 |
| Prise en charge des langues du SDK | JavaScript / Python / Android (Kotlin) |
| Formulaire de produit | API hébergée (Ultravox Realtime Platform) + poids du modèle open source |
| Limite de simultanéité pour les appels | Concurrence à 5 voies avec paiement à l'utilisation, sans limite stricte pour Pro |
| Modèle de prix | 0,05 $/minute (TTS inclus), 30 premières minutes gratuites |
| Certification de conformité | SOC 2 (via la plateforme Delve Trust) |
Fixie a d'abord été une « plateforme d'agents d'IA conversationnelle » et a ensuite subi une transformation stratégique majeure. Elle a complètement réorienté son orientation produit vers l'IA vocale en temps réel et a lancé le grand modèle multimodal vocal natif Ultravox et prend en charge la plate-forme d'agent vocal en temps réel. Le domaine fixie.ai d'origine est désormais redirigé vers ultravox.ai. L'entité juridique de la société reste Fixie.AI et sa marque de produits est unifiée sous le nom d'Ultravox.
Utilisateurs de Fixie et reconnaissance du marché
Sensibilisez progressivement les utilisateurs sur le terrain et les capacités du produit sont utilisées par les créateurs de contenu et les équipes pour améliorer l'efficacité du travail. Les données spécifiques sur l’échelle des utilisateurs et l’adoption par l’industrie sont soumises à la page officielle en temps réel.
L'avantage de coût de Fixie
La structure de coûts de Fixie (Ultravox) couvre un modèle d'utilisateur à trois niveaux, et la stratégie de tarification est considérablement rentable dans le domaine de l'IA vocale en temps réel.
Couche client C/développeur individuel :
- Forfait à l'utilisation : 0 $/mois, y compris 30 minutes de quota d'appels gratuits, excédent de 0,05 $/minute (y compris les frais TTS), limite stricte simultanée à 5 voies, appels illimités sur le terrain de jeu.
- Il s'agit de l'une des barrières d'entrée gratuites les plus basses pour les API d'IA vocale en temps réel sur le marché aujourd'hui. Par rapport à l'API OpenAI Realtime (0,06 $/minute d'entrée audio + 0,24 $/minute de sortie audio), le prix tout compris d'Ultravox de 0,05 $/minute présente un net avantage en termes de coût.
Couche d'appel d'API :
- Tarification des threads (appel texte/outil) : 2,00 $/million de jetons d'entrée (non mis en cache), 15,00 $/million de jetons de sortie, les jetons d'entrée mis en cache sont gratuits.
- Jonction SIP : 0,5 ¢/minute (Pay-as-you-go), 0,48 ¢/minute (Pro).
- Le forfait Pro coûte 100 $/mois, lève la limite de simultanéité stricte et comprend 5 sons personnalisés, 20 corpus RAG et un planificateur de numérotation sortante.
Niveau de déploiement entreprise/privé :
- La version entreprise peut être personnalisée à la demande, y compris le SLA prioritaire, le support de gestion organisationnelle et la personnalisation de toutes les fonctions. Le prix n'est pas divulgué, veuillez contacter l'équipe commerciale pour confirmation.
- Les poids des modèles sont open source (licence MIT). Les entreprises peuvent déployer elles-mêmes l'inférence sans avoir à payer de frais d'API, mais elles doivent gérer leur propre infrastructure GPU. La formation de l'adaptateur peut être effectuée en 2 à 3 heures sur le 8xH100, avec un seuil matériel modéré.
Considérations de coûts implicites : le coût réel de l'IA vocale n'est pas seulement le prix unitaire de l'API, mais inclut également la qualité de la conversation (taux de retouche/de transfert de main d'œuvre), les délais (impactant l'expérience utilisateur) et l'investissement de développement personnalisé. L'architecture vocale native de bout en bout d'Ultravox a une latence 30 à 50 % inférieure à celle de la solution de pipeline « ASR + LLM + TTS », ce qui réduit indirectement le coût de désabonnement des utilisateurs dû à la latence.
Principales fonctions de Fixie
-
Inférence vocale native : le modèle Ultravox effectue une compréhension sémantique directement dans l'espace audio sans passer par une étape ASR (parole en texte) distincte. L'audio est directement mappé sur l'espace sémantique de grande dimension du LLM via le projecteur multimodal, et le modèle comprend simultanément le contenu sémantique et les signaux paralinguistiques (intonation, rythme, émotion), ce qui constitue une différence essentielle par rapport à l'architecture traditionnelle en cascade.
-
Gestion des conversations en temps réel : fournit des capacités de dialogue vocal en temps réel via deux méthodes d'accès : WebSocket et API REST. La plateforme gère le cycle de vie des appels (établissement, maintenance, terminaison), le suivi de l'état des conversations VAD (Voice Activity Detection) et la détection des points de terminaison (Endpointing), et les développeurs n'ont pas besoin de gérer la signalisation sous-jacente.
-
Détection d'activité vocale UltraVAD : modèle VAD neuronal auto-développé (UltraVAD v0.1), basé sur la distinction entre la probabilité d'achèvement de la parole, le mode pause, la pause réflexive et la fin du tour, permettant un contrôle plus naturel du rythme du dialogue, réduisant les interruptions et les silences gênants.
-
SDK multiplateforme et intégration de téléphonie : fournit un SDK à trois terminaux JavaScript, Python et Android, des capacités d'intégration intégrées avec les principaux opérateurs de télécommunications (Twilio, etc.) et prend en charge les liaisons SIP pour passer et recevoir des appels PSTN.
-
Accès à la base de connaissances RAG : le plan Pro prend en charge jusqu'à 20 corpus, et l'agent vocal peut récupérer le contenu de la base de connaissances de l'entreprise pendant la conversation pour prendre en charge des scénarios de questions et réponses commerciales complexes.
-
Planificateur d'appels sortants : les forfaits Pro et supérieurs offrent une gestion automatique des appels sortants, adaptée aux nouvelles visites des clients, aux rappels de rendez-vous, aux notifications par lots et à d'autres scénarios.
-
Playground Sandbox Testing : fournit un Playground en ligne gratuit, permettant aux développeurs de tester les effets de dialogue des agents vocaux sans écrire de code, réduisant ainsi les coûts de débogage.
[Vue d'expert] : La synergie principale d'Ultravox réside dans la trinité « modèle natif vocal + plateforme d'inférence gérée + intégration télécom ». Contrairement aux solutions traditionnelles qui nécessitent une sélection indépendante de chaque nœud (modèle STT → LLM → moteur TTS → fournisseur de télécommunications), Ultravox fournit un lien entièrement géré de l'entrée audio à la sortie audio, réduisant ainsi les points de défaillance de l'intégration du système et permettant d'optimiser la latence sur l'ensemble de la pile plutôt que de se limiter à un seul composant.
Evolution du modèle et de la version de Fixie
L'évolution du modèle Fixie a une trajectoire claire, tous publiés sous la marque Ultravox, et chaque version fournit des poids open source.
Version principale
| Version | Dates | Modèle de base | Changements clés |
|---|---|---|---|
| Ultravox v0.3 | 2024-08 | Version initiale | Aperçu public de la première version, prenant en charge le raisonnement en streaming audio vers texte |
| Ultravox v0.4 | 2024-08 | Lama 3 | Première version prête pour la production, formation de 14 000 étapes en 2-3 heures sur 8xH100 |
| Ultravox v0.4.1 | 2024-11 | Lama 3 | Améliorations de la stabilité et des performances |
| Ultravox v0.5 | 2025-02 | Lama 3.2 1B | Variante légère, HF télécharge 1,18 million |
| Ultravox v0.6 | 2025-06 | Lama 3.3 70B / Gemma 3 27B / Qwen 3 32B | Variantes multi-bases pour prendre en charge des capacités d'inférence à plus grande échelle |
| Ultravox v0.7 | 2025-12 | GLM-4 6B | Big Bench Audio SOTA (91,8 % / 97 % avec réflexion) |
Évolution de la plateforme produit
- 2023-2024 : Fixie fonctionne comme une plate-forme universelle d'agents d'IA conversationnelle, offrant des capacités de construction d'agents au niveau de l'entreprise, d'intégration d'outils et de déploiement multicanal. Le positionnement du produit à ce stade est similaire à celui des plateformes telles que Dify et Coze actuellement sur le marché.
- 2024-08 : Passage à la piste d'IA vocale, sortie de la version préliminaire d'Ultravox v0.3 et ouverture d'applications de test internes pour l'API Ultravox Realtime.
- 2025 à aujourd'hui : L'accent produit s'est complètement déplacé vers la marque Ultravox. Le nom de domaine fixie.ai d'origine a été redirigé vers ultravox.ai et les fonctions associées de la plate-forme d'agent de dialogue d'origine ont été progressivement effacées. La société utilise actuellement la plateforme Ultravox Realtime comme principal mode de livraison de ses produits.
Les avantages techniques de Fixie
Conception d'architecture : LLM multimodal vocal natif
Le choix technologique principal d'Ultravox est d'utiliser l'audio comme première modalité d'entrée plutôt que comme composant secondaire. L'architecture du modèle est : encodeur audio → projecteur multimodal (adaptateur) → LLM pré-entraîné (gelé) → sortie de jeton texte. Cette conception apporte trois effets clés :
- Éliminer les retards en cascade : les systèmes d'IA vocale traditionnels doivent passer par un pipeline en quatre étapes : "Détection d'activité vocale → Reconnaissance ASR → Inférence LLM → Synthèse TTS", chaque étape introduisant des centaines de millisecondes de retard. L'architecture de bout en bout d'Ultravox mappe l'audio directement dans l'espace sémantique avec une latence jusqu'au premier mot (TTFT) nettement inférieure à celle des solutions en cascade.
- Préserver les informations paralinguistiques : les signaux paralinguistiques tels que l'intonation, l'accentuation, la vitesse de parole, les pauses, etc. sont perdus dans le processus de conversion de texte, et Ultravox traite directement ces informations dans la représentation audio, permettant au modèle de percevoir les émotions et les implications de l'utilisateur.
- Adaptation de base flexible : L'architecture Adater permet à Ultravox d'accéder à n'importe quel LLM pondéré open source (Llama, Mistral, Gemma, Qwen, GLM) sans être lié à un seul écosystème de modèles. 6 variantes de base ont été publiées, couvrant des tailles de paramètres de 1B à 70B.
Efficacité de la formation : Seule la couche Adaptateur est mise à jour pendant la formation, le LLM et l'encodeur audio restent figés. La v0.4 ne prend que 2 à 3 heures pour s'entraîner sur 14 000 pas sur 8xH100. Ce faible coût de formation signifie que les entreprises peuvent utiliser leurs propres données pour affiner les modèles vocaux avec un budget abordable.
Infrastructure d'inférence : Ultravox crée sa propre pile d'inférence et ne s'appuie pas sur des fournisseurs LLM externes ou des pools d'inférence partagés, garantissant une latence contrôlable et aucune gigue de file d'attente. La plate-forme prend en charge de 5 à un nombre illimité d'appels simultanés, et l'architecture entièrement gérée élimine la charge d'exploitation et de maintenance.
Principaux avantages de l'évaluation : Big Bench Audio est la référence d'évaluation de l'IA vocale reconnue par l'industrie, et les 91,8 % (sans inférence) et 97 % (avec inférence) d'Ultravox v0.7 sont tous deux les meilleurs du secteur. Par rapport à GPT-4 Realtime (la solution vocale de bout en bout d'OpenAI), Ultravox atteint une précision de compréhension plus élevée avec une latence identique ou inférieure.
Comment utiliser Fixie
Fixie (Ultravox) propose quatre niveaux d'accès, couvrant le chemin complet de l'expérimentation à la production.
| Entrée | Personnes concernées | Principales utilisations | Coût |
|---|---|---|---|
| API temps réel Ultravox | Développeur / ISV | Intégration d'agent vocal de qualité production | À partir de 0,05 $/minute |
| Aire de jeux (app.ultravox.ai) | Personnel non technique / évaluation des produits | Tests conversationnels et expérience | Gratuit (illimité) |
| Poids du modèle Open Source (visage câlin) | Ingénieur/Chercheur ML | Inférence auto-hébergée, mise au point, recherche universitaire | Gratuit (Licence MIT) |
| SDK (JS/Python/Android) | Développeur Front-end / Back-end / Mobile | Intégration client | Gratuit (Open Source) |
Processus d'accès typique :
- Enregistrez un compte : visitez app.ultravox.ai pour créer un compte et bénéficiez automatiquement de 30 minutes d'appels gratuits.
- Playground Test : configurez les invites du système, sélectionnez les sons, configurez le corpus RAG dans le Playground et testez l'effet de dialogue en temps réel.
- Obtenir la clé API : obtenez la clé API à partir de la console pour l'authentification de l'API REST ou de l'interface WebSocket.
- Intégration du SDK : sélectionnez le SDK correspondant en fonction de la plateforme d'application (JS pour le Web, Python pour le backend Kotlin pour Android) et reportez-vous à la documentation officielle pour y accéder.
- Configurer la téléphonie (facultatif) : si vous avez besoin de fonctionnalités d'appel PSTN, configurez une jonction SIP ou connectez-vous à des fournisseurs de télécommunications tels que Twilio.
- Déploiement en production : choisissez le forfait Pay-as-you-go (faible simultanéité) ou Pro (forte simultanéité) pour passer en ligne à la production.
Inférence auto-hébergée (avancée) : téléchargez les poids du modèle depuis Hugging Face et utilisez l'image Docker ou Poetry pour démarrer le service d'inférence. Officiellement, il fournit des options de déploiement gérées pour la plate-forme BaseTen et prend également en charge une infrastructure GPU personnalisée.
Prix des produits pour Fixie
Ultravox adopte un modèle de tarification hybride « utilisation + abonnement », et la page de tarification est ouverte et transparente.
| Dimensions de facturation | Paiement à l'utilisation | Pro (paiement annuel) | Entreprise |
|---|---|---|---|
| Frais mensuels | 0 $ | 100$/mois | Devis personnalisé |
| Coût de l'appel | 0,05 $/minute | 0,05 $/minute | Personnalisé |
| Liaison SIP | 0,5 ¢/minute | 0,48 ¢/minute | Personnalisé |
| Jeton d’entrée Threads | 2,00 $/million (non mis en cache) | 2,00 $/million (non mis en cache) | Personnalisation |
| Jeton de sortie des threads | 15,00 $/million | 15,00 $/million | Personnalisation |
| Jeton d'entrée de cache | Gratuit | Gratuit | Gratuit |
| Durée libre | 30 minutes | 30 minutes | Personnalisé |
| Appels sur le terrain de jeu | Illimité | Illimité | Illimité |
| Plafond de concurrence | 5 voies | Pas de plafond rigide | Personnalisation |
| Sons personnalisés | 1 | 5 | Personnalisé |
| Corpus RAG | 2 | 20 | Personnalisé |
| Planificateur d'appels sortants | ❌ | ✅ | ✅ |
| SLA prioritaire | ❌ | ❌ | ✅ |
| Gestion d'organisation | ❌ | ❌ | ✅ |
Stratégie de quota gratuit : les 30 premières minutes sont entièrement gratuites (y compris les frais TTS), il n'y a pas de limite sur le nombre d'appels sur le terrain de jeu et elle convient à la preuve de concept et aux opérations d'essai à faible trafic. Par rapport aux produits concurrents, l'API OpenAI Realtime ne fournit pas de quota gratuit et Gemini Live a un modèle de tarification similaire mais une écologie différente.
Déduction de la structure des coûts : en prenant comme exemple un scénario de service client avec 1 000 appels quotidiens et une durée moyenne d'appel de 3 minutes, le volume d'appels mensuel est d'environ 90 000 minutes et le coût est d'environ 4 500 $/mois (hors frais d'abonnement Pro). En utilisant la solution traditionnelle ASR + LLM + TTS à la même échelle, seul le coût ASR (Deepgram, etc. est d'environ 0,0059 $/minute) plus l'inférence LLM (environ 0,01 à 0,03 $/heure) plus TTS, le coût total est d'environ 5 000 à 8 000 $/mois. Le prix tout compris d'Ultravox de 0,05 $/minute est compétitif sur le marché actuel (basé sur les déductions des données publiques, engagement non officiel).
Scénarios d'application Fixie
-
Agent vocal du service client : les entreprises connectent Ultravox aux lignes d'assistance du service client pour remplacer ou assister les agents manuels dans le traitement des demandes courantes (état des commandes, retours et échanges, confirmations de rendez-vous). L'expérience interactive naturelle de l'architecture vocale native réduit la résistance des utilisateurs au « service client machine ». Une fois l'appel terminé, un résumé peut être automatiquement généré et écrit dans CRM. Points clés de vérification : taux de résolution au premier instant (FCR) et taux de transfert manuel des conversations monocanal.
-
Marketing sortant et visites de retour : utilisez le planificateur d'appels sortants pour effectuer des tâches d'appels sortants telles que les visites de retour des clients, les enquêtes de satisfaction et les rappels de renouvellement par lots. Les agents peuvent ajuster leurs propos en temps réel en fonction de la conversation et transférer en toute transparence les clients intéressés vers la vente manuelle. Points clés de vérification : Comparaison du taux de connexion, du taux de conversion et du taux de raccrochage avec les solutions d'appels sortants IA traditionnelles.
-
Rendez-vous médical et pré-consultation : Les cliniques ou les hôpitaux se connectent à Ultravox pour gérer l'enregistrement des rendez-vous, la reprogrammation, les rappels d'examens et d'autres questions. L'agent collecte des informations sur les symptômes du patient (pré-consultation) grâce à un dialogue naturel, réduisant ainsi la charge de travail transactionnelle du personnel médical. Clé de vérification : respectez les exigences de sécurité des données de niveau HIPAA.
-
Services internes aux employés : les grandes entreprises déploient des agents vocaux sur les lignes d'assistance téléphonique des employés pour gérer les affaires internes telles que l'assistance informatique, les consultations RH et les applications de voyage. Les employés peuvent décrire les problèmes naturellement par la parole, et les agents appellent les systèmes back-end (ServiceNow, Workday, etc.) pour effectuer des actions. Points clés à vérifier : Profondeur de l'intégration avec les systèmes SSO et d'entreprise existants.
-
Compagnon pédagogique d'IA piloté par la voix : Dans des scénarios tels que l'apprentissage des langues, les tests de connaissances et les simulations d'entretiens, les capacités de conversation en temps réel d'Ultravox peuvent offrir aux apprenants une expérience de pratique orale immersive, et la conservation des informations paralinguistiques permet de corriger la prononciation et l'intonation. Objectif de vérification : précision de la reconnaissance des langues autres que l'anglais.
Fixie convient aux personnes
-
Développeur d'applications Voice AI : développeurs indépendants ou équipes de startup qui ont besoin de créer rapidement des agents vocaux. L'API entièrement gérée d'Ultravox réduit le temps d'intégration de l'IA vocale de quelques semaines à quelques jours. Pas besoin de créer votre propre pipeline ASR/TTS, appelez simplement l'API et intégrez le SDK. Ne convient pas aux limites : dans les scénarios nécessitant une personnalisation approfondie des paramètres ASR ou TTS (comme une optimisation spéciale pour des accents et des dialectes spécifiques), la plate-forme d'hébergement basée sur Ultravox peut ne pas être aussi flexible qu'une solution auto-construite.
-
Équipes d'IA de moyennes et grandes entreprises : les entreprises dotées d'équipes d'infrastructure d'IA peuvent intégrer Ultravox en tant que couche d'IA vocale dans les systèmes de service client, de marketing et de ressources humaines existants. Le plan Pro n'a pas de limites de simultanéité ni de SLA au niveau de l'entreprise pour répondre aux besoins d'évolutivité. Ne convient pas à la frontière : les entreprises qui ont besoin d'atteindre une compréhension sémantique de haute précision dans des langues autres que l'anglais (en particulier le chinois, le japonais, l'arabe, etc.) devraient donner la priorité à tester les performances d'Ultravox dans la langue actuelle via Playground avant de prendre des décisions d'achat.
-
Institutions de recherche sur l'IA et utilisateurs universitaires : les pondérations open source et la licence MIT d'Ultravox, ainsi que le code de formation public (basé sur MosaicML / PyTorch), fournissent une base de référence reproductible pour la recherche multimodale vocale. 24 modèles et 37 ensembles de données constituent un écosystème de recherche complet. Unfit Boundary : scénarios de recherche nécessitant une génération vocale complète de bout en bout (sortie audio) - Ultravox ne génère actuellement que des jetons de texte et la synthèse vocale doit s'appuyer sur des composants TTS externes.
-
Chefs de produits et décideurs IA : équipe de sélection de technologies qui évalue la technologie d'IA vocale en temps réel. Ultravox propose des tests gratuits dans le Playground pour valider les concepts de produits sans frais de développement. Tarification transparente et par répartition pour une adoption progressive, du pilote à l'expansion. Limite inappropriée : pour les scénarios d'interaction en temps réel avec des exigences de latence extrêmement élevées (<200 ms de bout en bout), il est recommandé d'effectuer des tests de charge réels à des fins de vérification.
Résumé et Outlook
La principale compétitivité de Fixie (Ultravox) réside dans le double avantage de latence et de qualité apporté par l'architecture multimodale vocale native, ainsi que dans la complexité d'intégration réduite de la plateforme entièrement gérée. Sur le marché en croissance rapide de l'IA vocale en temps réel, Ultravox est actuellement l'une des rares solutions de bout en bout à fournir à la fois des pondérations de modèles open source et des API gérées de qualité production. Son score SOTA Big Bench Audio et son écosystème open source (4 500+ étoiles, 24 modèles, millions de téléchargements) vérifient la faisabilité de la voie technique.
Limites et incertitudes actuelles :
- Positionnement flou pendant la période de transformation du produit : Dans le processus de transformation d'une plateforme générale d'agents de dialogue en une plateforme spécifique à l'IA vocale, il existe une déconnexion entre les actifs d'origine de la marque Fixie (documents, cas, sensibilisation de la communauté) et la nouvelle marque Ultravox. Les visiteurs accèdent directement à ultravox.ai après être entrés depuis fixie.ai, et les nouveaux utilisateurs peuvent être confus quant à la relation entre les deux sociétés.
- Prend uniquement en charge la sortie de texte : la sortie du modèle actuel est un jeton de texte, la synthèse vocale doit s'appuyer sur un TTS externe et une véritable sortie vocale de bout en bout (c'est-à-dire jeton audio → décodage audio) n'a pas encore été implémentée. La feuille de route officielle mentionne « Speech Generation Coming Soon », mais il n'y a pas encore de calendrier précis.
- Maturité du support non anglais : les données d'évaluation (Big Bench Audio) et la formation des modèles sont basées sur l'anglais, et l'étendue de la prise en charge des langues non anglaises telles que le chinois et le japonais n'a pas été vérifiée publiquement. Les entreprises ciblant les marchés asiatiques nécessitent une évaluation supplémentaire.
- Durabilité commerciale de la stratégie open source : tout en conservant les deux lignes de poids du modèle open source et d'API d'hébergement commercial, vous pourriez être confronté à la pression de la différenciation fonctionnelle entre la version open source et la version commerciale à long terme.
Évaluation des risques d'approvisionnement/d'adoption : Pour les entreprises qui prévoient de lancer des fonctionnalités d'IA vocale en temps réel en 2026-2027, il est recommandé de vérifier d'abord les performances d'Ultravox dans des langages et des scénarios commerciaux spécifiques via Playground. Après avoir confirmé votre satisfaction, utilisez le forfait Pay-as-you-go pour un petit projet pilote de trafic (1 à 3 mois), puis décidez si vous souhaitez passer au forfait Pro ou Enterprise en fonction de la qualité réelle des appels, du délai et du taux de transfert de main-d'œuvre. Les conditions du SLA (en particulier les plafonds de simultanéité, les garanties de disponibilité) et les politiques d'utilisation de la formation aux données (si le modèle utilisera les données des appels d'entreprise pour la formation secondaire) doivent être clairement indiquées dans le contrat. Pour les scénarios nécessitant une sortie vocale de bout en bout (audio vers audio), il est recommandé de prêter attention aux progrès officiels d'Ultravox dans les fonctions de génération vocale, ou d'évaluer simultanément l'intégration complémentaire de solutions TTS pures telles que ElevenLabs et Cartesia.
Outils associés :
Comment utiliser Fixie
- Client Web : Vous pouvez l'utiliser en visitant le site officiel et en créant un compte. La plupart des fonctions ne nécessitent pas d'installation.
- Accès API : fournit une API RESTful, les développeurs peuvent obtenir la clé API et l'intégrer dans leurs propres applications.
Informations de version
- Écurie :Prend en charge les ensembles d'outils d'agent personnalisés et une intégration plus approfondie des systèmes tiers. Il n’y a pas encore de date officielle précise.
- Version initiale :La première version publique prend en charge la construction et le déploiement d'agents d'IA conversationnelle. Il n’y a pas encore de date officielle précise.
Avis des utilisateurs