갈릴레오 AI
무료
Galileo AI는
갈릴레오AI
핵심 매개변수 및 통계
Galileo AI의 제품 페이지에서는 오프라인 평가를 생산 가드레일로 전환하는 것을 목표로 플랫폼을 AI 관찰 가능성 및 평가 엔지니어링 플랫폼으로 정의합니다. 설명서 페이지에서는 Galileo가 엔지니어, 제품 관리자 및 도메인 전문가에게 서비스를 제공하는 GenAI 및 에이전트 애플리케이션용이며 에이전트 프레임워크 Python SDK, TypeScript SDK 또는 API(공식 문서)를 통해 액세스할 수 있음을 추가로 설명합니다.
| 프로젝트 | 공공정보 |
|---|---|
| 제품 포지셔닝 | GenAI 및 Agentic 애플리케이션을 위한 관찰, 평가 및 생산 가드레일 플랫폼 |
| 주요 개체 | 추적, 세션, 범위, 데이터 세트, 프롬프트, 지표, 가드레일 |
| 주요 시나리오 | RAG 평가, 에이전트 평가, 안전 평가, 보안 평가, 사용자 정의 평가 |
| 접근방법 | 웹 콘솔 Python SDK, TypeScript SDK, API, 공통 에이전트/LLM 프레임워크 통합 |
| 생산능력 | 오프라인 평가, 온라인 관찰, 지표 튜닝 Luna-2 저지연 평가, 실시간 가드레일 |
| 배포 양식 | SaaS, 가상 사설 클라우드, 온프레미스 |
| 최신 공개 업데이트 | 2026-06-05 기업 고객을 위한 에이전트 제어 |
| 가격 포털 | 무료, Pro 및 Enterprise 3계층 공개 가격 페이지 |
기능 경계: Galileo AI는 일반 챗봇도 아니고 단순한 로깅 플랫폼도 아닙니다. 이미 GenAI, RAG 또는 에이전트 애플리케이션을 보유하고 있고 품질을 측정하고 오류 모드를 찾고 생산 위험을 제어해야 하는 팀에 더 적합합니다. 팀이 아직 AI 애플리케이션 개발에 진입하지 않았거나 온라인 트래픽이 없는 경우, 즉각적인 비즈니스 이점보다는 플랫폼의 가치가 평가 방법 구축에 더 많이 반영될 것입니다.
사용자 및 시장 인지도
Galileo의 시장 신호는 주로 기업 고객, 금융 및 협력 생태계에서 나옵니다. 공식 시리즈 B 발표에 따르면 갈릴레오는 2024년 10월 15일 시리즈 B에서 4,500만 달러를 발표했으며 누적 자금 조달 규모는 6,800만 달러에 달했습니다. 같은 발표에서는 2024년 이후 매출이 834% 증가했고 기업 고객 수가 4배 증가했으며 Fortune 50대 기업 6개가 소개되었으며 Twilio, Comcast, HP, ServiceTitan이 상장되어 있다고 밝혔습니다. 고객 또는 파트너를 기다리고 있습니다(공식 공지).
기업 승인: Writer, Cisco Outshift, Ema, NVIDIA, Satisfi Labs, MongoDB, CrewAI, HP, Clearwater Analytics 등과 같은 고객 또는 파트너 리뷰가 제품 페이지 및 가격 페이지에 표시됩니다. 구매 판단에서 더 중요한 것은 이러한 평가가 "평가 도구 체인", "에이전트 관찰", "NVIDIA NeMo 통합" 및 "Luna-2 생산 평가"에 중점을 두고 있다는 점입니다. 이는 Galileo가 개인 효율성 도구보다는 기업 수준의 AI 품질 관리에 중점을 두고 있음을 나타냅니다.
생태학적 승인: 공식 Agent Reliability 릴리스 기사에서는 Graph Engine이 CrewAI, LangGraph, OpenAI Agents SDK, LlamaIndex 및 기타 프레임워크를 지원한다고 공개했습니다. 2026-05-08 릴리스 노트에는 A2A 다중 에이전트 분산 추적 및 OpenTelemetry 확장도 추가되었습니다. 이러한 유형의 생태적 적응은 액세스 비용을 줄여주지만 실제 가용성은 여전히 팀의 현재 프레임워크, 로깅 표준 및 데이터 보존 요구 사항에 따라 달라집니다.
비용 이점
Galileo AI의 비용 이점은 "가장 저렴한 SaaS 구독"이 아니라 비싸고 느린 판사로서의 범용 LLM 파이프라인을 Luna-2와 같은 특수 목적 검토 모델로 대체하는 것입니다. 제품 페이지에는 Luna가 트래픽의 100%를 모니터링하고 96% 더 낮은 비용으로 실행되는 모델로 최적화된 평가를 추출할 수 있다고 명시되어 있습니다. Agent Reliability 릴리스에는 Luna-2가 200ms 미만의 대기 시간을 실행하는 동안 20개 이상의 표시기를 지원하며 기존 LLM 기반 솔루션보다 97% 저렴하다고 명시되어 있습니다.
C 클라이언트/개인: 무료 플랜은 월 5,000개의 추적, 무제한 사용자 및 무제한 사용자 정의 평가를 포함하여 월 $0에 공개적으로 제공되며 이는 개발자와 소규모 팀이 아이디어를 확인하고 평가하는 데 적합합니다. 제한 사항은 무료 할당량이 주로 실험 및 소규모 애플리케이션을 다루며 엔터프라이즈 프로덕션 환경의 SSO, 전용 지원, 배포 격리 및 데이터 거버넌스 요구 사항을 대체할 수 없다는 것입니다.
개발자/API: Pro 플랜은 월 $100에 공개되며 연간 지불액을 33% 절약하고 월간 추적 50,000개, 표준 RBAC, 고급 분석 및 통찰력, Slack 지원을 포함합니다. 가격 책정 페이지에는 추적 수에 따라 가격이 조정된다는 내용이 나와 있습니다. 개발팀에서는 추적량, 평가 지표 개수, LLM-as-a-judge 호출, Luna 지표 호출 및 로그 보존을 함께 계산해야 합니다.
엔터프라이즈/프라이빗: 엔터프라이즈는 문의하기이며 무제한 추적, 사용자 지정 속도 제한, 호스팅/VPC/온프레미스 배포, 엔터프라이즈급 RBAC/SSO, 전용 CSM, 실시간 가드레일, 연중무휴 지원, 지연 시간이 짧은 전용 추론 서버 및 전방 배포 엔지니어링 지원을 포함합니다. VPC, 온프레미스, 전용 추론 및 보안 약관의 경우 실제 견적 및 계약 범위는 공식 실시간 페이지 및 비즈니스 확인에 따릅니다.
주요 기능
Galileo AI의 기능은 "실제 데이터 캡처, 평가 구성, 오류 발견 및 온라인 평가를 가드레일로 제공"을 중심으로 이루어집니다. AI 품질을 오프라인 테스트에서 온라인 거버넌스로 확장하는 데 적합합니다.
- 데이터 및 주석 자산: 합성, 개발 및 실제 생산 데이터에서 데이터 세트를 구축하고 도메인 전문가 주석을 통해 지속적으로 업데이트되는 실측 자산을 형성합니다.
- RAG/에이전트/안전/보안 지표: 공식 제품 페이지는 RAG, 에이전트, 안전, 보안을 다루는 20개 이상의 기본 평가판을 공개하고 사용자 정의 평가기를 지원합니다.
- 에이전트 그래프 및 추적 관찰: 에이전트 신뢰성 페이지 설명 그래프 보기는 각 분기, 결정 및 도구 호출을 표시하여 팀이 다단계 에이전트 경로에서 오프셋 지점을 찾는 데 도움을 줍니다.
- 인사이트 엔진: 에이전트 행동에 대한 실패 모드 분석을 수행하고, 근본 원인, 다중 에이전트 핸드오프, 도구 선택 패턴을 찾고, 연결된 증거와 실행 가능한 제안을 제공합니다.
- Luna-2 생산 평가: Luna-2 페이지는 저비용, 낮은 지연 생산 평가를 위해 $0.12/1M 토큰, 0.95 정확도, 152ms 평균 대기 시간, 128k 최대 토큰 등과 같은 지표를 공개합니다.
- 에이전트 제어 및 가드레일 관리: 2026-06-05 릴리스 노트에서는 Agent Control이 엔터프라이즈 에이전트 가드레일을 중앙에서 관리하여 유해 콘텐츠 프롬프트 삽입 및 PII 유출과 같은 위험을 차단할 수 있음을 보여줍니다.
모델 및 버전의 진화
관련 내용은 아직 공개되지 않았으니, 공식 실시간 페이지를 참고해주시기 바랍니다.
기술적인 장점
갈릴레오 AI의 기술적 장점은 단일점 모델 성능이 아닌 '평가 모델+관측 데이터+생산 가드레일'의 조합에서 나온다.
전용 평가 모델: Luna-2는 평가용으로 특별히 설계된 SLM을 사용하여 고주파수 품질 판단을 수행합니다. 기계적으로는 비용이 많이 드는 판사로서의 LLM 작업을 대기 시간이 짧은 모델로 추출합니다. 실제로 플랫폼은 높은 샘플링 속도로 프로덕션 트래픽을 지속적으로 평가할 수 있습니다. 적용 가능한 시나리오는 고객 서비스 상담원, RAG Q&A, 금융/의료 등 지속적인 위험 관리가 필요한 애플리케이션입니다.
에이전트 기본 관찰: 그래프 엔진은 에이전트의 분기, 도구 호출, 결정 경로 및 세션 컨텍스트를 통합된 방식으로 제공합니다. 기계적으로는 선형 로그에서 그래픽 경로로 범위/추적을 확장합니다. 실제로 엔지니어링 팀이 도구 선택, 전달 및 작업 완료와 같은 오류를 더 쉽게 찾을 수 있습니다. 적용 가능한 시나리오는 다단계, 다중 도구 및 다중 에이전트 비즈니스 흐름입니다.
평가에서 가드레일까지: 플랫폼은 오프라인 지표, 온라인 신호 및 실시간 차단을 연결합니다. 기계적으로 평가 점수는 작업, 도구 액세스 및 에스컬레이션 경로를 제어할 수 있습니다. 실제로 품질 판단은 보고서에만 국한되지 않고 생산 시 보호를 유발할 수 있습니다. 적용 가능한 시나리오는 PII 유출 프롬프트 삽입, 유해한 출력 또는 잘못된 도구 호출에 대한 강력한 제약이 있는 비즈니스입니다.
사용방법
Galileo AI의 입구는 제품 콘솔 SDK/API와 엔터프라이즈 배포의 세 가지 범주로 나뉩니다. 개발자는 공식 웹사이트에서 무료로 등록하여 시작할 수 있습니다. 엔터프라이즈 팀은 일반적으로 먼저 데이터 경계, 로그 보존 정책 SSO/RBAC 및 배포 양식을 명확히 해야 합니다.
| 사용 방법 | 모두에게 적합 | 주요활동 | 주의사항 |
|---|---|---|---|
| 웹 콘솔 | 제품 및 운영 AI 품질 관리자 | 추적, 세션, 측정항목, 실험, 통찰력 보기 | 먼저 애플리케이션 로그에 액세스하거나 실험 데이터를 가져와야 합니다 |
| Python/타입스크립트 SDK | 엔지니어링팀 에이전트 개발자 | 첫 번째 추적 기록, 실험 실행, 프레임워크 액세스 | API Key, 프로젝트 Key, 로그 필드, 샘플링 전략 관리 필요 |
| 에이전트/LLM 프레임워크 통합 | LangGraph, CrewAI, OpenAI Agents SDK 등을 사용하는 팀 | 에이전트 경로 도구 호출 및 추적을 자동으로 기록 | 통합 깊이는 현재 프레임워크 버전 및 Otel 지원에 따라 다릅니다. |
| 엔터프라이즈 배포 | 보안, 규정 준수 및 플랫폼 팀 | 호스팅, VPC 또는 온프레미스 시나리오 평가 | 비즈니스 검증 계약, 데이터 상주, 지원 SLA 및 전용 추론 필요 |
일반적인 구현 경로는 먼저 실제 추적을 기록한 다음 추적에 대한 평가 지표를 실행하고 안정적인 지표를 실험 및 가드레일로 확장하는 것입니다. RAG 시스템의 경우 검색 품질, 맥락 정확성 및 환각을 검증하는 데 우선순위가 부여됩니다. 에이전트 시스템의 경우 도구 선택 품질, 동작 진행, 동작 완료 및 대화 품질을 검증하는 것이 우선시됩니다.
제품 가격
Galileo AI 가격 페이지는 무료, Pro, Enterprise의 세 가지 계층으로 공개됩니다. 무료는 개발자와 소규모 팀을 위한 것이고, Pro는 더 자신감을 갖고 라이브를 시작하려는 팀을 위한 것이며, Enterprise는 확장성, 보안 및 고급 지원이 필요한 조직을 위한 것입니다.
| 계획 | 공개 가격 | 공개 할당량/용량 | 적용 범위 |
|---|---|---|---|
| 무료 | $0/월 | 월간 추적 5,000개, 사용자 무제한, 사용자 정의 평가 무제한 | 실험, 평가 개념, 초기 단계 소규모 팀 |
| 프로 | 월 $100부터 시작하며 매년 지불됩니다. 흔적이 있는 가격 규모 | 월간 추적 50,000개, 표준 RBAC, 고급 분석 및 통찰력, Slack 지원 | 소규모 생산 또는 성장하는 팀 |
| 기업 | 저희에게 연락하세요 | 무제한 추적, 사용자 정의 비율 제한, 호스팅/VPC/온프레미스, RBAC/SSO, 실시간 가드레일, 연중무휴 지원, 전용 추론 서버 | 엔터프라이즈 규모, 규정 준수, 개인 또는 전용 지원 |
청구 위험 포인트: AI 평가 비용에는 Galileo 구독뿐만 아니라 판사로서의 LLM 모델 호출, 데이터 보존, 평가 지표 수, 추적 샘플링 비율, 전용 추론 서버, 내부 운영 및 유지 관리도 포함됩니다. Luna-2는 고주파 평가 비용을 줄일 수 있지만 Luna 지표의 활성화 조건, 특정 지표 적용 범위 및 기업 계약 조건은 여전히 공식 실시간 페이지 및 비즈니스 확인을 거쳐야 합니다.
애플리케이션 시나리오
- RAG 품질 측정: 검색 품질, 문맥 관련성, 답변 환상 및 인용 일관성을 측정합니다. 수용의 초점은 단일 Q&A 데모를 보는 것이 아니라 검색 지표가 실제 비즈니스 근거와 일치하는지 여부입니다.
- AI 에이전트 생산 관찰: 다단계 에이전트의 도구 호출, 분기, 핸드오프, 작업 완료 및 대화 품질 모니터링에 사용됩니다. 수용의 초점은 실패한 범위를 신속하게 찾을 수 있는지 여부와 제안이 프롬프트, 도구 스키마 또는 프로세스 설계에 피드백될 수 있는지 여부입니다.
- 보안 및 규정 준수 가드레일: 신속한 삽입, PII 유출, 유해한 콘텐츠, 잘못된 도구 호출 등 고위험 시나리오에 사용됩니다. 수용의 초점은 지연 시간이 짧은 차단, 잘못된 차단 비율, 감사 로그 및 수동 롤백 메커니즘입니다.
- 평가 엔지니어링 플랫폼: 데이터세트, 실험, 사용자 정의 지표, 인적 피드백 및 릴리스 게이트를 연구 및 개발 프로세스에 통합하는 데 사용됩니다. 수용의 초점은 일회성 수동 검토에 의존하지 않고 CI/CD 또는 릴리스 액세스 제어를 안정적으로 재사용할 수 있는지 여부입니다.
- 엔터프라이즈 AI 운영 거버넌스: 부서 전체의 생산 추적, 비용, 예외 및 개선 제안을 집계하는 데 사용됩니다. 승인의 초점은 권한, 데이터 보존 VPC/온프레미스, SSO/RBAC 및 지원 SLA가 조직 요구 사항을 충족하는지 여부입니다.
해당자
- AI 응용 엔지니어링 팀: RAG, 에이전트, 고객 서비스 로봇, 검색 Q&A 또는 자동화된 워크플로를 구축하여 로그, 리뷰 및 온라인 이상 징후 진단을 하나의 플랫폼으로 통합하는 팀에 적합합니다.
- 제품 및 도메인 전문가: 주석에 참여하고 답변 품질을 평가하며 비즈니스 성공 기준을 정의해야 하는 제품 관리자 및 SME에 적합합니다. 주석과 사용자 정의 평가를 사용하여 주관적인 판단을 추적 가능한 지표로 변환합니다.
- 플랫폼 및 보안 팀: SSO/RBAC, 데이터 보존, 생산 가드레일 PII 및 프롬프트 주입 위험 제어가 필요한 엔터프라이즈 플랫폼 팀을 위한 것입니다.
- 고빈도 실험팀: 프롬프트, 모델, 데이터 세트 및 실험을 비교하고 현장 테스트를 체계적인 평가로 업그레이드해야 하는 AI 제품 팀에 적합합니다.
매우 적합하지 않은 상황은 일반 채팅만 필요하거나, 온라인 AI 애플리케이션이 없거나, 추적/데이터 세트를 제공할 수 없거나, 팀에 일시적으로 지표 거버넌스 리더가 없는 경우입니다. Galileo AI의 가치는 지속적인 측정과 지속적인 개선에서 나옵니다. 데이터 흐름과 조직 소유자가 없으면 플랫폼은 "하나 이상의 대시보드"가 됩니다.
요약 및 전망
Galileo AI의 핵심 역량은 GenAI 평가 에이전트 관찰 가능 Luna-2 짧은 지연 시간 평가 모델과 생산 가드레일을 동일한 워크플로에 배치하는 데 있습니다. POC에서 프로덕션까지 엔터프라이즈 AI의 가장 어려운 부분, 즉 모델과 에이전트가 신뢰할 수 있고 설명 가능하며 개선 가능하고 실제 트래픽에서 위험을 차단할 수 있음을 증명하는 방법을 해결합니다.
현재 제한 사항도 매우 명확합니다. 일부 기업 기능에는 비즈니스 확인이 필요하며 Luna 메트릭은 요청 시 활성화됩니다. 가격은 추적 및 기업 조건에 따라 변경됩니다. SDK/프레임워크 통합이 성공적으로 구현될 수 있는지 여부는 기존 아키텍처에 따라 다릅니다. 평가 지표에는 비즈니스 근거와 SME 피드백에 대한 지속적인 조정이 필요합니다. 고위험 산업의 경우 Galileo의 자동 평가 결과를 수동 감사, 규정 준수 프로세스 및 보안 테스트와 결합해야 합니다.
구현 제안은 먼저 파일럿을 위한 고가치의 측정 가능한 RAG 또는 에이전트 프로세스를 선택하고 추적 범위, 오류 위치 시간, 수동 검토 볼륨, 차단 허위 경보 비율 및 온라인 액세스 제어 통과 비율과 같은 지표를 설정하는 것입니다. 지표가 안정적이면 다중 팀, 다중 에이전트 또는 엔터프라이즈 배포로 확장합니다. 구매하기 전에 기업은 VPC/온프레미스 조건 SSO/RBAC, 데이터 보존 Luna-2 활성화 범위, 전용 추론 비용 및 연중무휴 지원 경계를 검토하는 데 집중해야 합니다.
갈릴레오 AI 버전 및 제품 진화
Galileo AI는 기존 데스크톱 소프트웨어처럼 고정된 버전 번호가 없는 지속적으로 반복되는 클라우드 플랫폼입니다. 보다 적절한 버전 컨텍스트는 평가 인텔리전스, 에이전트 신뢰성, Luna Studio 및 에이전트 제어와 같은 공식적인 공개 이정표에 따라 구분됩니다.
메인 라인 이정표
- 2024-10-15: 평가지능 플랫폼. 공식 시리즈 B 발표에서는 플랫폼을 AI 개발 워크플로를 다루는 평가 인텔리전스로 설명합니다. 제품 구성 요소에는 미세 조정, 평가, 관찰 및 보호가 포함되며 Luna 평가 제품군이 환각, 검색 효율성, 에이전트 품질 및 기타 요소를 평가할 수 있음을 강조합니다.
- 2025-07-16: 에이전트 신뢰성 플랫폼. 공식 블로그는 Graph Engine을 사용하여 에이전트 관찰을 해결하고 Insights Engine을 사용하여 오류 모드를 자동으로 분석하며 Luna-2를 사용하여 실시간 가드레일을 지원하는 무료 Agent Reliability Platform을 발표했습니다.
- 2026-05-22: 루나 스튜디오. 릴리스 노트에서는 대기 시간이 짧고 비용이 저렴한 SLM 지표를 훈련하는 데 사용되는 기업 고객을 위한 Luna Studio를 출시하고 평가 예산을 관찰하기 위해 통합 비용을 추가합니다.
- 2026-06-05: 에이전트 제어. 릴리스 노트에서는 중앙 집중식 제어 플레인을 사용하여 가드레일과 거버넌스 정책을 정의하고 에이전트 코드를 변경하지 않고도 유해 콘텐츠 즉각적인 삽입, PII 유출 및 기타 위험을 차단하는 엔터프라이즈 에이전트 제어를 출시합니다.
검증 핵심사항
프로덕션 환경에서는 2026-06-05 Agent Control을 최신 공개 기능 노드로 간주해야 하지만 실제 가용성은 기업 권한, 패키지, 배포 양식 및 판매 활성화에 의해 영향을 받을 수 있습니다. Luna 지표 페이지에는 Luna 지표가 요청 시 고객에게만 공개되므로 기본적으로 모든 Luna-2 지표를 모든 계정에 즉시 사용할 수 있는 것으로 간주할 수는 없다고 명시되어 있습니다.
버전 정보
- 기업 고객을 위한 에이전트 제어 :공식 릴리스 노트에서는 가드레일을 중앙에서 정의하고 기업 고객을 위한 에이전트 거버넌스를 관리하는 Agent Control을 출시했습니다. 에이전트 코드를 변경하지 않고도 유해 콘텐츠 프롬프트 삽입, PII 유출 및 기타 위험을 차단할 수 있습니다.
- Luna Studio 및 통합 비용 차트 :공식 릴리스 노트에서는 대기 시간이 짧고 비용이 저렴한 SLM 지표를 교육하기 위한 Luna Studio 엔터프라이즈 기능의 출시와 판사로서의 LLM 비용을 추적하기 위한 통합 비용 관리 페이지 추가를 발표했습니다.
- 에이전트 신뢰성 플랫폼 :공식 블로그는 Graph Engine, Insights Engine 및 Luna-2 실시간 가드레일을 중심으로 다중 에이전트 시스템 관찰, 오류 모드 분석 및 생산 보호를 지원하는 무료 에이전트 신뢰성 플랫폼을 발표했습니다.
- 평가 인텔리전스 플랫폼 :공식 블로그에서는 시리즈 B 자금 조달로 4,500만 달러를 발표했으며 주요 제품 라인을 Fine-Tune, Evaluate, Observe, Protect 등 AI 품질 수명 주기를 다루는 평가 인텔리전스 플랫폼으로 정의했습니다.
사용자 후기