가드레일이란?
가드레일은 챗봇(Route A)이 사용자 요청을 처리하는 과정에서 입력 · 도구 호출 · 출력 각 단계를 검사하는 재사용 가능한 안전 규칙 세트입니다. 여러 챗봇에 연결할 수 있고, 연결한 순서대로 평가됩니다.
가드레일은 챗봇(Route A)에만 적용됩니다. 에이전트(Route B, 이너릿)에는 적용되지 않습니다.

적용 단계
각 가드레일은 어느 시점에 검사할지 단계를 선택합니다.
- 입력 검사(check_input) — 사용자 메시지가 LLM에 들어가기 전에 평가. 비용 절감에 효과적.
- 도구 검사(check_tool) — 챗봇이 외부 도구를 호출하기 전에 파라미터/대상을 검증. 파괴적 명령 차단 등.
- 출력 검사(check_output) — LLM 응답을 사용자에게 보내기 전에 사후 검사.
규칙 유형
규칙은 크게 두 종류로 나뉩니다.
규칙 기반(빠름, 결정적)
keyword_block— 금지어 차단. 태그 입력으로 키워드를 추가합니다.regex_block— 정규식 패턴. 주민번호·전화번호·이메일·카드번호·IP·URL 프리셋 중 선택하거나 직접 입력할 수 있습니다.pii_filter— 민감정보 마스킹. 정규식 엔진(주민번호·전화번호·이메일·카드번호·IP·URL·계좌번호) 또는 LLM 엔진(맥락 기반 감지 + 사용자 지정 마스킹 대상)을 선택할 수 있습니다.length_limit— 입력/출력 길이 제한 (글자 수 기준)language_filter— 허용 언어 제한
LLM 기반(분류 모델 호출)
prompt_injection— 프롬프트 인젝션/탈옥 감지topic_restriction— 주제 허용/금지content_moderation— 유해 콘텐츠 분류. 민감도(약함·보통·강함)로 차단 기준을 조절합니다.
LLM 기반 규칙이 하나라도 있으면 규칙마다 분류용 모델을 선택해야 합니다. 모델이 지정되지 않으면 저장할 수 없습니다.
세부 설정
규칙 유형별로 다음과 같은 세부 옵션도 제공합니다.
- 차단 메시지 직접 입력 — 규칙이 매치됐을 때 사용자에게 보여줄 메시지 커스터마이즈
keyword_block— 대소문자 무시 옵션topic_restriction— 허용 목록(allowlist) / 금지 목록(blocklist) 모드 선택language_filter— 최소 단어 길이 설정
테스트 채팅
가드레일 빌더 우측의 테스트 채팅 패널에서 실제 대화로 규칙 동작을 바로 검증할 수 있습니다. 모델을 선택하고 대화를 나눠 보며 차단·경고·마스킹이 의도대로 동작하는지 확인하세요.
액션
규칙이 매치되면 취할 행동을 고릅니다.
block— 요청/응답을 차단하고 메시지 노출warn— 경고와 함께 통과mask— 민감정보를 마스킹한 뒤 통과 (민감정보 마스킹 규칙에서만 선택 가능)
챗봇에 연결하기
챗봇 빌더의 가드레일 연결 다이얼로그에서 가드레일을 선택해 연결합니다. 한 가드레일을 여러 챗봇에 공유할 수 있습니다.
비활성화
가드레일을 끄려면 챗봇에서 연결을 해제하거나 가드레일 자체를 삭제하세요. 연결을 유지한 채 일시정지하는 별도의 on/off 토글은 제공하지 않습니다 — 필요하면 연결 해제 후 다시 연결하면 됩니다.