Fabraix

Fabraix

Fabraix · 코딩

Fabraix는 AI 에이전트를 출시하는 팀을 위해 만들어진 적대적 검증 플랫폼으로, 그 에이전트가 어디서 무너지는지 알아야 하는 팀이 쓴다. 핵심 엔진인 Nyx는 정적인 프롬프트 목록이 아니라 실행 중인 에이전트를 상대로 적응형, 멀티턴, 블랙박스 공격을 가한다. 회사 측에 따르면 Nyx는 천 가지가 넘는 공격 전략을 활용하고 실행할 때마다 학습을 거듭하므로, 레드팀 캠페인은 낡는 대신 더 날카로워진다. 제안은 단순하다. 사용자보다 먼저 탈옥, 데이터 유출, 정책 위반을 찾아내는 것이다. 이 목표는 AI 에이전트 보안 테스트를 다른 출시 관문과 같은 위치에 놓고, AI 에이전트 레드팀 테스트를 일회성 감사가 아닌 지속적인 작업으로 다룬다. 아무도 계속 탐색하지 않으면 LLM 보안은 빠르게 무너진다.

Fabraix 미리보기

Fabraix 소개

Fabraix란 무엇인가

Fabraix는 실제 사용자를 마주하는 AI 에이전트를 겨냥한 보안 테스트 플랫폼이다. 소스 코드나 모델을 따로 스캔하는 대신, 공격자가 그러듯 배포된 에이전트를 탐색한다. 경로는 대화, 도구 호출, 그리고 에이전트가 실제로 읽는 간접 채널이다. 이 팀은 수십 개 포춘 500 기업의 에이전트에서 취약점을 발견했다고 밝힌다. 읽기 전용 샌드박스를 탈출한 코딩 에이전트와, 간접 프롬프트 인젝션 이후 비밀번호 관리자 자격 증명을 유출한 브라우저 에이전트가 포함된다. 이런 사례는 기억에 남는다.

이 제품이 가장 중요한 곳은 에이전트가 돈, 개인 데이터, 또는 사람에 관한 결정에 닿을 수 있는 팀이다. 데이터베이스에 접근하는 고객 지원 봇, 부동산 검색 어시스턴트, 코딩 코파일럿은 모두 같은 약점을 공유한다. 예상치 못한 곳에서 오는 지시를 따른다는 점이다. Fabraix는 그런 실패 모드를 지속적으로 찾도록 설계됐으며, 출시 시점에 한 번 확인하는 도구가 아니다. 그렇다면 시점이 왜 이렇게 중요한가. 에이전트는 변하기 때문이다. 모델을 바꾸고 도구를 추가하면 어제의 안전한 동작이 뒤집힐 수 있다.

주된 한계는 범위와 성숙도다. Fabraix는 취미 프로젝트용 셀프서비스 도구가 아니라 전문성 높은 기업 지향 서비스이며, 더 넓은 LLM 스택이 아니라 에이전트에 특화해 겨냥한다. 프로덕션 또는 그에 근접한 에이전트를 운영하지 않는다면, 아마 구매자가 아니다. 수긍이 간다.

시작하기

  1. 공식 사이트를 통해 연락하고 테스트하려는 에이전트를 설명한다. 배포 방식과 호출할 수 있는 도구도 포함한다.
  2. Nyx가 에이전트와 직접 상호작용할 수 있도록 접근 권한을 주고, 의도한 가드레일과 정책에 관한 맥락도 전달한다.
  3. Nyx가 직접 및 간접 공격 경로를 결합한 적응형 멀티턴 캠페인을 실행하도록 한다.
  4. 보고된 발견 사항을 심각도 순으로 검토한다. 각 항목을 촉발한 구체적 대화나 요청이 함께 온다.
  5. 문제를 고친 뒤 다시 실행해 같은 공격이 더는 통하지 않는지 확인한다.

제품 정보

Fabraix의 요금, 지원 플랫폼, 성능을 한눈에 확인해 보세요.

무료 플랜아니요
유료 플랜Custom pricing
플랫폼Web
개발사Fabraix
카테고리코딩
출시일Jan 2025
최근 업데이트Aug 2025
웹사이트 방문 수3.2K
웹사이트 글로벌 순위5.1M
API 제공 여부N/A

추천 대상

이 도구가 가장 잘 맞는 사용자, 작업, 상황입니다.

사용자

  • AI 제품 팀
  • 보안 엔지니어
  • 규정 준수 및 신뢰 책임자

작업

  • 프롬프트 인젝션 경로 찾기
  • 도구 사용 경계 테스트
  • 변경 후 가드레일 검증

활용 상황

  • 출시 전 보안 검토
  • 운영 중 에이전트 지속 모니터링
  • 규제 대상 의사결정 에이전트

주요 기능

Nyx 블랙박스 테스트 엔진

Nyx는 소스 코드나 내부 프롬프트 없이 외부에서 에이전트를 테스트한다. 이 점이 중요하다. 사용자를 해치는 실패는 저장소에서 발견할 수 있는 결함이 아니라, 실제 환경에서의 에이전트 동작에서 비롯되는 경우가 많다. 블랙박스 테스트는 완전히 통제하지 못하는 제3자 또는 벤더 제작 에이전트도 평가하게 해준다. 소스가 필요 없다.

적응형 멀티턴 캠페인

일회성 프롬프트를 쏘는 대신, Nyx는 에이전트의 응답에 따라 조정되는 긴 대화를 진행한다. 부분적인 거부를 받은 공격자는 표현을 바꿔 다시 시도할 수 있다. 단호한 사람이 시스템을 탐색하는 방식에 더 가깝다. 멀티턴 압박은 많은 단발 테스트가 너무 일찍 포기하는 지점이다. 한 발로는 이야기가 거의 완성되지 않는다.

1000가지가 넘는 공격 전략

Fabraix에 따르면 Nyx는 천 가지가 넘는 공격 전략을 활용하며, 직접 탈옥, 간접 인젝션, 도구 악용 경로에 이른다. 넓이가 핵심이다. 여러 전술을 아우르는 범위는 좁은 테스트 도구 모음이 건너뛸 문제를 잡아낸다. 회사는 AgentHarm에서 78%의 공격 성공률을 제시하며, 자체 비교 수치로 GPT-5.6 Sol의 67%와 대비한다.

스스로 개선하는 공격 루프

모든 캠페인은 학습 루프에 투입되므로, 성공한 전술은 이후 실행에서 재사용되고 다듬어진다. 실제로 이는 레드팀이 첫 회차에서 정체하지 않는다는 뜻이다. 바로 그 지점이 차이다. 업데이트를 자주 내보내는 팀에게 스스로 개선되는 테스트 도구는 고정된 프롬프트 라이브러리보다 유용하다.

간접 프롬프트 인젝션 테스트

Fabraix는 채팅창 밖에 있는 인젝션 경로를 겨냥한다. 에이전트가 처리하라고 지시받은 문서, 이메일, 웹 페이지 같은 것이다. 기록된 한 사례에서는 정교하게 만든 이메일이 브라우저 에이전트를 움직여 보관소 자격 증명을 읽고 외부로 보내게 했다. 이런 경로는 놓치기 쉽다. 악의적 지시는 사용자로부터 직접 오지 않는다.

도구 및 샌드박스 탈출 점검

플랫폼은 에이전트가 지켜야 할 한계를 깨뜨릴 수 있는지 탐색한다. Fabraix는 사람의 개입 없이 읽기 전용 샌드박스를 탈출해 지속성 훅을 기록한 코딩 에이전트를 제시한다. 실제 침해다. 도구 경계를 테스트하면 나쁜 입력 하나가 어느 정도 피해를 낼 수 있는지 알 수 있다.

거버넌스 및 정책 위반 테스트

순수한 보안을 넘어 Nyx는 에이전트가 정책 위반, 차별적 행동으로 유도될 수 있는지 점검한다. 회사는 공정 주거 가드레일을 넘어 불법적 유도로 밀려난 부동산 검색 에이전트를 설명한다. 작은 결함이 아니다. 소비자 보호나 차별 금지 규칙 아래 운영하는 사람에게 이런 범주의 발견은 데이터 유출만큼 심각하다.

장단점

장점

  • 운영 중 에이전트를 처음부터 끝까지 테스트하므로, 결과가 단순화된 모형이 아니라 실제 동작을 반영한다.
  • 직접 및 간접 인젝션 경로를 결합해 프롬프트만 다루는 도구 모음이 놓치는 유출을 잡아낸다.
  • 적응형으로 스스로 개선되는 루프 덕에 캠페인이 반복 실행에서 낡지 않는다.
  • 발견 사항에 재현 가능한 추적이 따라붙어 수정과 재검증이 더 실용적이다.
  • 회사 측에 따르면 Oxford, Meta, Monzo, TradingHub의 연구자가 뒷받침한다.

단점

  • 가격이 공개되지 않아 예산에 맞는지 알려면 팀에 연락해야 한다.
  • 무료 요금제도 셀프서비스 체험도 없어 빠른 실전 평가가 불가능하다.
  • API 제공 여부가 불분명해, 묻지 않고 기존 CI 파이프라인에 넣을 수 있다고 가정할 수 없다.
  • 에이전트에 특히 초점을 맞추므로 모델 수준 보안 테스트만 필요한 팀은 범위가 원하는 것보다 좁게 느껴질 수 있다.

자주 묻는 질문

사용자와 도구를 주고받는 AI 에이전트를 테스트하며 보안, 논리, 정렬 실패를 찾는다. Nyx는 정적인 모델이 아니라 운영 중 에이전트에 적대적 캠페인을 실행하므로, 결과는 적대적 입력에서의 동작을 반영한다.

관련 콘텐츠

Fabraix와 관련된 도구, 스킬, 아티클을 살펴보세요.

Fabraix 대안

Forefront

Forefront

Forefront · 코딩

Forefront는 오픈소스 AI로 무언가를 만드는 웹 플랫폼이다. 대표적인 오픈소스 언어 모델을 자신의 데이터로 미세 조정하고, 성능을 평가하고, API로 실행하거나 내보내 직접 호스팅할 수 있다. 폐쇄형 플랫폼의 편의를 원하면서도 모델과 데이터의 소유권은 놓지 않으려는 개발자가 대상이다.

무료 / $0 - $99/mo자세히 보기
Startkit

Startkit

StartKit.AI · 코딩

Startkit은 AI SaaS와 AI 래퍼 제품을 만들기 위한 보일러플레이트다. 지루한 부분을 미리 연결해 둔 AI 스타트업 보일러플레이트라고 생각하면 된다. 인증, Stripe와 Lemon Squeezy 결제, 사용량 제한, 트랜잭션 이메일, 그리고 OpenAI, Anthropic, Groq, Llama와 통신하는 AI API 스타터 키트가 포함된다. 저장소를 복제하고 가격을 정한 뒤 사용자가 실제로 돈을 내는 부분에 착수하면 된다. React와 Tailwind 위의 Next.js로 만들어졌기 때문에 보일러플레이트 코드의 상당 부분이 이미 익숙하게 느껴진다.

유료 / $99 - $499 one-time자세히 보기
Testim

Testim

Tricentis · 코딩

Testim은 웹, 모바일, Salesforce 애플리케이션 전반에 걸쳐 엔드투엔드 테스트를 만들고 실행하는 AI 기반 테스트 자동화 플랫폼이다. 머신러닝에 기대어 인터페이스가 바뀌어도 테스트를 안정적으로 유지하므로, 팀은 깨진 셀렉터를 고치는 데 쓰는 시간을 줄인다. 오늘부터 쓸 수 있는 자동화 테스트 도구치고 나쁘지 않다. 브라우저에서 동작을 녹화해 테스트를 만들고, 더 세밀한 제어가 필요하면 JavaScript를 더한다. 바쁜 QA 팀에게 탄탄한 선택이다.

무료 / Custom pricing on request자세히 보기