Calme
Gratuit
Calmo est une plateforme SRE agent-native pour les
Calmo - Plateforme SRE agent-native
Paramètres et statistiques de base
| Paramètres | Détails |
|---|---|
| Positionnement du produit | Plateforme SRE agent-native |
| Tâches principales | Enquête sur les incidents, analyse des causes profondes, triage des alertes, remédiation |
| Objets connectés | Code, infrastructure, manuels d'observabilité, SOP, outils de collaboration en équipe |
| Intégrations typiques | Datadog, Sentry, GitHub, Grafana, Kubernetes, Slack, Notion |
| Fonctionnalités d'entreprise | Modèle européen de stockage BYO, sur site, centre de confiance |
| Comment commencer | Plateforme Web + commande d'installation CLI |
Un bref commentaire : L'argument de vente de Calmo n'est pas de "vous aider à lire les alarmes", mais d'aider l'équipe SRE à mener à bien la première série d'enquêtes sur les accidents, libérant ainsi les gens de "la recherche d'abord des indices" et de "la vérification et la prise de décision".
Reconnaissance des utilisateurs et du marché
Le site officiel s'adresse directement au produit aux équipes SRE, DevOps et d'ingénierie de production, et souligne qu'il peut réduire le bruit des alarmes, raccourcir le MTTR et générer des plans de remédiation et du code/PR. Ce qui a réellement valeur de référence pour l’équipe, ce ne sont pas ces slogans, mais trois types de vérification :
- Combien de temps s'écoule entre la première alarme et le jugement préliminaire.
- Quel est le coût d'accès à la production réelle ?
- Si les résultats des enquêtes automatiques peuvent être fiables et réutilisés par les ingénieurs.
Avantage de coût
Le site officiel ne divulgue pas le prix standard, mais propose un scénario d'essai et de calcul du retour sur investissement de 14 jours. Le véritable coût ne réside pas seulement dans l’abonnement, mais également dans les trois parties suivantes :
- Coût en temps d'ingénierie : réduisez les allers-retours des ingénieurs SRE/plateforme entre la journalisation, la surveillance et le code.
- Coût des temps d'arrêt en cas d'accident : raccourcissez le temps de positionnement et réduisez la fenêtre d'amplification des défauts.
- Coût de perte de connaissances : Consolidez l'expérience des incidents dans les SOP et les actifs d'enquête.
Déduction pour réduction des coûts et augmentation de l'efficacité (engagement non officiel) :
- Pour les équipes fréquemment interrompues par des alarmes à haute fréquence, le premier tour de positionnement peut être réduit de 30 à 90 minutes à quelques minutes de vérification des hypothèses des candidats.
- Pour les nouveaux SRE, les scénarios qui reposaient auparavant sur l'expérience verbale d'ingénieurs supérieurs peuvent être convertis en SOP et en connaissances d'enquête consultables, réduisant ainsi le temps nécessaire pour « trouver quelqu'un à qui demander ».
Fonctions principales
- Enquête autonome sur les incidents : effectuez une enquête automatique après l'arrivée de l'alarme.
- Validation d'hypothèses parallèles : validez plusieurs hypothèses de causes profondes en parallèle au lieu de deviner en série.
- Playbook & SOP Library : indexez l'expérience de gestion des erreurs de l'équipe en connaissances appelables.
- Plans de remédiation avec extraits de code et PR : générez des suggestions de remédiation et des pistes d'assistance au niveau du code.
- Intégrations d'infrastructure : connectez la surveillance, le référentiel de code, les outils de collaboration et de connaissances.
- CLI/Bridge IDE : introduisez des capacités d'investigation dans l'interface de travail réelle des ingénieurs.
Lien caché : la force de Calmo réside dans la chaîne "surveillance -> enquête -> preuves -> SOP -> suggestions de réparation" sur une seule ligne, réduisant ainsi la rupture de contexte causée par de multiples sauts de système dans la gestion traditionnelle des incidents.
Evolution du modèle et de la version
| Scène | Temps | Changement |
|---|---|---|
| Phase d'enquête automatique | ~2025-01 | Commencez par une enquête sur les accidents et une analyse des causes profondes |
| Étape d'accumulation des connaissances | ~2025-09 | Augmenter les capacités d'assetisation des Playbook et SOP |
| Étape de la plateforme Agent-Native | ~2026-01 | Renforcez les fonctionnalités d'entreprise telles que CLI, Bridge IDE, modèle BYO, sur site, etc. |
Avantages techniques
- Hypothèse de vérification parallèle : Plus cohérente avec le rythme réel des incidents de production complexes que le dépannage en série.
- Agrégation de contexte au niveau du système : lecture simultanée du code, de la surveillance, du déploiement et des actifs de connaissances.
- Les entreprises sont fortement conscientes de la mise en œuvre : insistez publiquement sur le modèle européen de stockage BYO, sur site et sur la formation sans utiliser les données des clients.
Si vous le regardez du point de vue de l'agent, les actions réelles de Calmo sont en gros : lire les alarmes et surveiller les signaux, interroger les journaux et les erreurs, corréler les référentiels de code et les modifications, appeler Playbook/SOP et générer des suggestions de réparation. Le schéma officiel de l'outil standardisé n'a pas été rendu public, mais la page publique suffit à montrer qu'il ne s'agit pas d'un « agent de questions et réponses à tour unique », mais d'un agent systématique qui organise des actions autour des liens d'enquête.
Les liens texte disponibles peuvent être résumés comme suit :
Alerte/Incident -> Agent Calmo -> Télémétrie + Code + Contexte Playbook -> Validation d'hypothèse -> Remédiation suggérée -> Approbation humaine
Cela signifie que l’avantage de Calmo n’est pas de deviner la cause première pour vous, mais de passer d’abord en revue l’agrégation de preuves la plus longue de l’ingénieur et les actions de dépannage préliminaires.
Limite de collaboration homme-machine :
- Peut être hautement automatisé : filtrage initial des alarmes, agrégation des signaux, génération d'hypothèses, collecte de preuves, appels SOP historiques.
- Une confirmation manuelle est requise : exécution des modifications du contexte de production, restauration, commutation du trafic, mise à niveau des autorisations, prise de décision d'influence du client externe.
- Ne convient pas aux limites : Si le système de surveillance de l'équipe est incomplet et que les journaux et les métadonnées sont chaotiques, Calmo ne peut qu'accélérer le chaos de lecture, mais ne peut pas compléter la base d'observabilité pour vous à partir de rien.
Les pièges de l’ingénierie se concentrent principalement sur trois points :
- Surcharge de contexte d'enquête : lorsqu'il y a trop de signaux de surveillance, de journaux et de code, il est facile pour l'agent de générer des conclusions d'enquête qui semblent complètes mais dont les priorités sont erronées.
- Faire confiance aux suggestions automatiques : les suggestions de correctifs et les brouillons de relations publiques ne peuvent être utilisés que comme points de départ et ne peuvent pas contourner l'approbation de la production.
- Pollution de la base de connaissances : si les SOP et le Playbook eux-mêmes sont obsolètes, Calmo rejouera l'ancien processus avec une plus grande efficacité.
Comment utiliser
| Entrée | Descriptif |
|---|---|
| Site officiel | https://getcalmo.com/ |
| Commande d'installation | curl -fsSL https://getcalmo.com/get | ch |
| Portail produit | Exécuter des enquêtes, des cas d'utilisation, CLI/Bridge IDE |
| Documents | https://docs.getcalmo.com/introduction |
La commande officielle d'installation rapide est la suivante :
curl -fsSL https://getcalmo.com/get | merde
Processus de mise en œuvre suggéré :
- Connectez-vous d'abord à des portails de grande valeur tels que Datadog, Sentry, Slack et GitHub.
- Importez ensuite le Playbook, le Runbook et le SOP de l'équipe pour former une base de connaissances.
- Utiliser des incidents pilotes pour vérifier la fiabilité des enquêtes automatisées plutôt que d'ordonner la garde totale.
- Laissez les suggestions de réparation dans la « couche de suggestions » et continuez à parcourir la chaîne d'approbation manuelle pour les modifications de production.
- Indiquez clairement dans le système de tâches quelles actions sont uniquement autorisées à être lues, quelles actions sont autorisées à générer des suggestions et quelles actions nécessitent toujours une approbation manuelle.
Prix des produits
Le modèle de tarification est soumis à la page officielle en temps réel. Habituellement, un système freemium ou d'abonnement est adopté, les fonctions de base peuvent être utilisées gratuitement et les fonctions avancées ou l'utilisation à haute fréquence nécessitent un paiement.
Scénarios d'application
- Enquête sur les accidents de production : rassemblez rapidement des preuves et des causes premières préliminaires après l'arrivée de l'alarme.
- Assistance SRE pour les débutants : facilitez l'utilisation des SOP et de l'expérience historique.
- Dépannage distribué multi-systèmes : journaux de liens, surveillance, code et connaissances dans le même lien d'enquête.
- Amélioration de l'efficacité de l'ingénierie de la plate-forme : raccourcissez le délai entre la découverte des problèmes et la proposition de plans de réparation.
Personnes concernées
- Équipe SRE/Platform Engineering : nécessité de raccourcir le MTTR et de réduire la charge cognitive d'astreinte.
- Équipes DevOps et Infra : nécessité de gérer uniformément les indices d'incident provenant de plusieurs sources de données.
- Chef de projet : Il est nécessaire d'accumuler les connaissances sur les accidents dans les actifs organisationnels.
- Non applicable au groupe : Équipes n'ayant quasiment aucun système de suivi de production, aucune SOP, et peu désireuses de transformer le processus.
Résumé et Outlook
Elle propose des solutions compétitives dans son domaine et sa valeur fondamentale réside dans l’abaissement du seuil d’utilisation de l’IA dans ce domaine.
Limites actuelles : Certaines fonctionnalités avancées nécessitent un abonnement payant et la version gratuite comporte des restrictions de fonction ou d'utilisation ; les détails techniques spécifiques et les critères de performance n’ont pas encore été entièrement divulgués.
Outils associés : crewai, langchain
Informations de version
- Plateforme SRE agent-native et étape IDE Calmo Bridge :Le site officiel souligne que Calmo est passé d'un simple assistant d'enquête à une plate-forme Agent-Native SRE, prenant en charge l'enquête automatique, la vérification parallèle des hypothèses, l'entrée d'installation CLI de la base de connaissances Playbook/SOP, ainsi que des fonctionnalités d'entreprise telles que le modèle BYO, le stockage sur site et européen.
- Étape de la plateforme d'enquête sur les accidents et d'analyse des causes profondes :La plate-forme s'articule autour de scénarios SRE avec pour base une enquête automatique sur les accidents et une analyse des causes profondes, et s'étend progressivement à la base de connaissances CLI, à l'intégration et à la génération de recommandations de réparation.
Avis des utilisateurs