LAGOS AI FAMILY · 행동 안전 (플래그십)
AI Guardrail
우리 AI가 무너지지 않도록 지키는 실시간 관제탑
프롬프트 인젝션·탈옥·유해발화·정책위반을 입력부터 출력·에이전트 행동까지 전 계층에서 탐지·차단합니다.
LLM-FREE 온프레미스
폐쇄망·에어갭
한국어 특화
국정원 보안기능확인서(NIS) 트랙
금융보안·전자금융규제(FIS) 대응
XAI 판정 근거
생성형 AI 서비스를 운영하는 순간, 사용자는 그것을 공격 대상으로 삼습니다. Guardrail은 여러분이 배포한 AI를 감싸는 안전벨트로서, 악의적 입력이 모델을 장악하거나 모델이 위험한 응답을 내보내는 것을 실시간·결정론적으로 막습니다. 판정 티어에 생성형 LLM을 쓰지 않아(LLM-FREE 독트린) 폐쇄망·CPU 환경에서도 완결 동작합니다.
핵심 기능
프롬프트 인젝션·탈옥 차단
정규식 267룰(63카테고리) + 유니코드 정규화로 우회·난독화 공격까지 결정론적으로 차단.
의미기반 탐지 (LLM-FREE)
KLUE-RoBERTa·KoSimCSE 인코더로 패러프레이즈·다국어·맥락 래핑 공격을 의미 수준에서 포착.
유해 출력·정보 누출 차단
시스템 프롬프트 유출, 자격증명(API키·JWT) 노출, 유해 생성물을 출력단에서 필터링.
환각(groundedness) 검증
RAG 응답이 출처에 근거하는지 검증해 미근거 답변을 차단.
PII 비식별화
입력·출력의 개인정보를 결정론적으로 탐지해 마스킹.
자가학습 방어(SLDS) · 정책 핫리로드
차단된 공격을 시그니처로 학습해 입구에서 선제 차단. 재시작 없이 정책 즉시 적용.
왜 LAGOS Guardrail인가
◆완전 온프레미스 · 폐쇄망 — 판정에 외부 API를 호출하지 않아 국방·공공 폐쇄망에서 그대로 동작.
◆설명가능한 차단(XAI) — 어느 계층이 왜 막았는지 단계별 근거와 NIS 대책 코드까지 제시.
◆한국어·한국 규제 특화 — 한국어 우회·주권 왜곡·국내 규제 맥락에 맞춘 탐지.
◆인증 트랙 — 국정원 보안기능확인서(NIS) 제출을 전제로 형상·감사 설계, 금융보안·전자금융규제(FIS) 대응 병행.
대상 · 배포
이런 곳에 필요합니다
자체 생성형 AI 서비스(챗봇·상담·RAG·에이전트)를 운영하는 공공기관·국방·금융. AI가 탈옥·유해발화·정책위반을 일으키지 않아야 하는 조직.
배포 형태
온프레미스 / 에어갭 설치. CPU 환경 동작. 리버스 프록시 또는 SDK 형태로 기존 AI 파이프라인에 인라인 삽입.
LAGOS AI Family — 3형제 독립 제품 · 공통 탐지 코어 · 통합 관측 해자
AI Guardrail
행동 안전 — 우리 AI를 지킨다
● 본 제품
AI GateKeeper
경계 통제 — 정보 유출을 막는다