

몇 분 만에 AI 에이전트 오류를 디버깅하고 모니터링하세요. 모든 실행을 추적하고, 기존 모니터링이 놓치는 환각 및 근거 없는 답변을 포착하며, 정확히 무엇이 잘못되었는지 확인할 수 있습니다. 토큰 낭비를 줄이고, 에이전트 품질을 개선하며, .NET, Python, JavaScript를 지원하여 더 빠르게 출시하세요.
Loading comments…
프로젝트 정보
제품 키워드
Progress AI Observability는 AI 에이전트, LLM 애플리케이션, RAG 시스템, 그리고 코파일럿을 위해 특별히 구축된 프로덕션급 모니터링 플랫폼입니다. AI 워크로드를 일반적인 요청-응답 API처럼 취급하는 대신, 프롬프트, 모델 호출, 도구 사용, 검색 단계, 재시도, 출력 등 전체 실행 경로를 캡처하여 팀이 동작을 추적하고, 실패를 디버깅하며, 비용을 통제하고, 실제 프로덕션 데이터에서 출력 품질을 평가할 수 있게 합니다. .NET, Python, JavaScript를 지원하며, SDK 설치와 몇 줄의 코드만으로 약 5분 안에 설정할 수 있습니다.
프롬프트, 모델, 도구 전반의 실행 경로를 캡처하고 지연 시간, 토큰 사용량, 출력을 포함합니다. 단일 요청-응답 쌍이 아닌, 다단계 및 다중 에이전트 워크플로우에서 결정이 어떻게 전개되는지 확인할 수 있습니다.
추적 수준의 컨텍스트(건너뛴 도구, 검색 문제, 잘못된 컨텍스트, 루프, 재시도, 오류)를 사용하여 실패를 진단합니다. 이 플랫폼은 일반적인 애플리케이션 로그가 놓치는 AI 특유의 실패 모드를 표면화합니다.
모델, 제공업체, 에이전트, 워크플로우 패턴별로 토큰 사용량과 예상 비용을 추적합니다. 비용을 유발하는 요인을 파악하여 사용량이 통제 불능으로 확대되기 전에 최적화할 수 있습니다.
캡처된 추적에 대해 LLM-as-a-judge 평가를 실행하여 품질, 유용성, 정책 준수 여부를 점수화합니다. 실제 실행 데이터를 사용하여 프롬프트, 모델 또는 워크플로우 변경 사항을 나란히 비교합니다.
기존 모니터링은 오류를 보지만, Progress AI Observability는 그 뒤에 있는 추론 과정을 봅니다.
이 차이는 AI 에이전트가 오류처럼 보이지 않는 방식으로 실패하기 때문에 중요합니다. 응답이 빠르고 완전하며 유효해 보여도 근거가 없거나, 안전하지 않거나, 관련성이 없을 수 있습니다. 이 플랫폼은 평가 점수를 프로덕션 추적에 직접 연결하므로, 진공 상태에서 품질을 판단하는 것이 아니라 출력을 생성한 정확한 실행 경로를 기준으로 판단합니다. 추적, 비용 분석, 품질 평가를 하나의 도구로 결합한 것이 일반적인 APM 솔루션과의 차별점입니다.
프로덕션에서 AI 에이전트나 LLM 앱을 실행 중이고, 로그가 동작을 설명하지 못하거나, 비용이 명확한 원인 없이 증가하거나, 출력이 보이는 것만큼 신뢰할 수 없다고 의심되는 상황에 부딪혔을 때 유용합니다. .NET, Python, JavaScript로 작업 중이고 추적, 디버깅, 비용 통제, 품질 평가를 위한 단일 창구를 원한다면 확인해 볼 가치가 있습니다. 신용카드가 필요 없는 무료 티어를 통해 커밋하기 전에 자체 워크로드로 쉽게 테스트할 수 있습니다.
고려해볼 만한 다른 도구
GitHits는 코딩 에이전트가 앱이 의존하는 오픈소스 코드에 접근할 수 있도록 지원합니다. 실제 구현 예제, 의존성 소스 탐색, 패키지 검사 및 문서를 제공합니다. 에이전트는 코드베이스를 검색(grep)하고 읽을 수 있지만, 앱이 의존하는 오픈소스 코드는 검색(grep)하거나 읽을 수 없습니다. 바로 그 지점에서 에이전트는 추측, 재시도, 반복을 시작합니다. GitHits는 요청 시 버전 인식 인덱스를 구축합니다. 에이전트는 의존성 뒤에 있는 코드를 검색, 탐색, 검사할 수 있습니다. CLI: npx githits@latest init
에이전트가 무언가를 배포해야 할 때, 인간을 위해 만들어진 벽에 정면으로 부딪힙니다. 오늘 저희는 Cloudflare Workers에서 임시 계정(Temporary Accounts)을 출시합니다. 이제 모든 에이전트가 wrangler deploy --temporary 를 실행하여 몇 초 만에 라이브 Worker를 얻을 수 있습니다.
AI 에이전트는 빠르게 출시될 수 있지만, 올바른 제품 맥락이 없으면 종종 맹목적으로 움직이게 됩니다. Brief는 제품 팀에게 의사결정을 포착하고, 제품 의도를 보존하며, 채팅, Slack, CLI, MCP를 통해 인간과 에이전트에게 관련 맥락을 제공하는 살아있는 진실의 원천을 제공합니다. 비전에서 영향까지 전략, 의사결정, 실행을 연결해 줍니다.
Conan은 Claude Code를 실시간 HUD로 감싸는 네이티브 macOS 앱입니다. 모든 프롬프트, 도구 호출, 스킬, 토큰이 발생하는 즉시 표시됩니다.
제작자
neon_dev
Loading comments…