Introducing Shieldstral.
Summary
Mistral AI가 미세조정(retraining) 없이 자연어 규칙 입력만으로 텍스트와 이미지 유해성을 동시에 평가할 수 있는 3B 크기의 오픈 가중치 다중모달 안전 분류 모델인 Shieldstral을 출시했습니다.
Key Points
- 콘텐츠 중재를 정책 적응형 질의응답(QA) 작업으로 재구성하여 최대 7배 크기의 모델과 대등하거나 더 뛰어난 성능을 보입니다.
- 추론 시점에 자연어로 된 평가 규칙(정책)을 프롬프트 형태로 입력받으므로, 배포 환경에 따라 매번 모델을 재학습시킬 필요가 없습니다.
- Apache 2.0 라이선스로 공개되어 무료로 다운로드할 수 있으며, 16GB NVIDIA GPU 단 한 장에서도 효율적으로 실행 가능합니다.
Notable Quotes & Details
Notable Data / Quotes
- 3B
- 7x
- Apache 2.0
- 16GB NVIDIA GPU
Intended Audience
AI 애플리케이션 개발자, 모델 배포 및 콘텐츠 모더레이션 시스템 설계자, 보안 연구원