AI 취약점 탐색 자동화

실시간 AI 가드레일 적용
AI 안전성의 표준을 세우다
우리는 사고가 터지기를 기다리지 않습니다. 연구팀이 최정상 AI 학회에서 차세대 위협을, 그것이 실제로 나타나기 전에 먼저 짚어냅니다.
우리는 공격자처럼 생각합니다. 수백만 개의 시나리오로 AI를 선제적으로 스트레스 테스트해, 기존 테스트가 놓치는 취약점을 드러냅니다.
정적인 규칙은 결국 무너집니다. 우리의 가드레일은 기업 환경에 맞춰 끊임없이 학습하고 적응하며, AI 속도를 늦추지 않고 실시간으로 위협을 차단합니다.
레드티밍과 가드레일을 하나의 플랫폼에서. 한 번의 통합으로 개발부터 프로덕션까지 전체 라이프사이클을 커버합니다.
수천 개의 자동화 시나리오로 모델의 취약점과 환각을 선제적으로 찾아냅니다.
프록시 단에서 악성 프롬프트를 차단하고 민감정보를 실시간으로 마스킹합니다.
자체 LLM과 직접 구축한 에이전트부터 ChatGPT, Gemini 같은 상용 API, 나아가 Claude Code, GitHub Copilot 같은 코딩 에이전트까지. 하나의 플랫폼으로 모두 보호합니다.
클라우드 SaaS로 배포하거나 완전히 격리된 온프레미스로 배포하세요. 데이터 거버넌스와 규제 준수 요건에 맞춰 제공합니다.
VLM Safety를 평가하려면 VLM의 고유한 특성을 반영한 안전한 모델을 개발해야 합니다. Figstep과 RTVLM 데이터셋을 분석해 타이포그래피 기반 시각 프롬프트 공격을 살펴봅니다.
자세히 보기이번 주 KAIST 연구실과 미팅을 열어 진행 중인 연구 프로젝트의 방향을 다듬고 실험 설계를 구체화했습니다. 핵심 주제는 심리학적 접근과 LLM을 결합해 탈옥 프롬프트를 설계하는 것이었습니다.
자세히 보기우리는 최전선 모델들이 거짓말하고, 조종하고, 자기보존에 나서도록 만들었습니다. 프롬프트 인젝션이나 탈옥을 쓰지 않았습니다. 특정 역할과 지침이 부여된, 맥락이 풍부한 시나리오에 모델을 배치했을 뿐입니다. 우리가 만든 상황을 헤쳐 나가려다 모델들은 스스로 자신의 정렬을 무너뜨렸습니다.
자세히 보기