AREA 01

Trustworthy AI

모델이 언제, 왜 실패하는지를 먼저 규명하고, 그 결과를 방어 기법 설계로 연결합니다.

연구 과제

2025.03 ~ 2027.02진행 중
윤리적인 다국어 LLM 활용을 위한 문맥 기반 탈옥 가드레일 구축
한국연구재단 우수신진연구
2022.06 ~ 2025.02
인공지능 시스템의 실용화를 위한 딥러닝 안정성 알고리즘 개발
한국연구재단 기본연구
2022.07 ~ 2022.12
공정한 인공지능 면접 모델 알고리즘 개발
Genesis Lab

논문

Adversarial Robustness
Optimization Stability
Fairness
2024
2023