Introducing Shieldstral.
Summary
Mistral AI가 콘텐츠 모더레이션을 정책 적응형 질의응답 작업으로 구성하여 최대 7배 크기의 모델을 능가하는 3B 오픈 가중치 멀티모달 안전 분류기인 Shieldstral을 출시했습니다.
Key Points
- 추론 시점에 자연어 정책을 입력받아 재학습 없이 텍스트와 이미지 안전성을 통합 평가합니다.
- 요청을 지시(Instruct), 질문(Query), 문서(Document)의 세 부분으로 구성하여 바이너리 질의응답으로 콘텐츠를 판별합니다.
- Apache 2.0 라이선스로 오픈 가중치가 공개되었으며, 16GB NVIDIA GPU 1대에서 효율적으로 작동합니다.
Notable Quotes & Details
Notable Data / Quotes
- 3B
- 7x
- Apache 2.0
- 16GB NVIDIA GPU
Intended Audience
AI 애플리케이션 개발자, 모델 배포 및 모더레이션 시스템 설계자, 보안 연구원