Introducing Shieldstral.
Summary
Mistral AI가 텍스트와 이미지의 안전성 평가를 단일 모델로 수행하며 추론 시 자연어 정책을 적용할 수 있는 3B 크기의 오픈 가중치 다중모드 안전 분류기 Shieldstral을 출시했습니다.
Key Points
- 콘텐츠 중재를 정책 적응형 질의응답 작업으로 구성하여 추론 시 재학습 없이 평문 정책을 수용할 수 있습니다.
- 텍스트 안전성 및 다중모드 콘텐츠 중재 분야에서 최대 7배 크기의 기존 가드레일 모델들과 유사하거나 더 나은 성능을 보여줍니다.
- Apache 2.0 라이선스로 배포되는 오픈 가중치 모델이며, 단일 16GB NVIDIA GPU 환경에서 효율적으로 작동합니다.
Notable Quotes & Details
Notable Data / Quotes
- 3B
- 7x
- Apache 2.0
- 16GB NVIDIA GPU
Intended Audience
AI 애플리케이션 개발자, 모델 콘텐츠 안전 중재 정책 설계자 및 연구원