AI의 신뢰성을 높이기 위해 유해 콘텐츠와 딥페이크 방지, 개인정보 보호 기술을 강화하여, 안전하고 윤리적인 AI 사용을 보장
다중 부정 가이던스 간 충돌 문제 완화
픽셀 수준에서 작동하는 부정 가이던스에 의미론적인 요소를 반영하기 위한 외부 인코더 도입 시도가 실패하는 원인을 적대적 공격 관점에서 설명
2026년, 생성형 AI 보안 위협 대응 기술 개발,정보통신기획평가원

Diffusion 모델의 픽셀 수준 의미론적 부정 가이던스 실패 규명
픽셀 수준에서 작동하는 부정 가이던스에 의미론적인 요소를 반영하기 위한 외부 인코더 도입 시도가 실패하는 원인을 적대적 공격 관점에서 설명
2026년, 생성형 AI 보안 위협 대응 기술 개발,정보통신기획평가원

맞춤형 근거 영역 기반 의료 QA 추론
의료 QA에서 질문별 핵심 근거 영역만 선별해 단계적으로 추론함으로써, KG 기반 답변의 정확성과 일관성을 높이고 환각을 줄이는 프레임워크
2026년, 생성형 AI 보안 위협 대응 기술 개발,정보통신기획평가원

인과추론 기반 개인정보 유출 억제 연구
SAE 기반 개인정보 억제의 한계를 진단하고 인과적 검증 기반의 LLM 개인정보 누출 억제 방향을 제시하는 연구
2026, Foundation Model 운용 과정에서 민감정보 추론 방지 및 리스크 평가 기술 개발, 한국인터넷진흥원

LLM CoT Faithfulness 향상
모델 내부 공간을 식별하고 모델 학습 시 파라미터 업데이트를 해당 공간의 영공간으로 투영하여 추론 성능과 내부 추론 과정의 충실성을 동시에 보존
2026년, 엣지 AI 보안을 위한 Robust AI 및 분산 공격 탐지 기술 개발, 정보통신기획평가원

그래프 기반 임상 추론 멀티에이전트
임상 추론을 위해 멀티 에이전트의 근거와 가설을 그래프로 구조화하고 정량적으로 평가하여 편향을 보정하고 추론 경로를 추적
2026년, 생성형 AI 보안 위협 대응 기술 개발,정보통신기획평가원

제한된 자원 환경에서의 실시간 군집 UAV 제어
임베디드 제약 환경에서 군집 UAV의 충돌 회피와 편대 복귀를 실시간으로 수행하기 위한 멀티 에이전트 강화학습 기반 제어 기술
2025년, 생성형 AI 보안 위협 대응 기술 개발,정보통신기획평가원

복원 가능한 비식별화
형식 보존 암호화로 얼굴 이미지의 신원 정보를 안전하게 저장하고, 원본 얼굴 필요 시 이미지를 복원하는 프레임워크
2025년, 생성형 AI 보안 위협 대응 기술 개발,정보통신기획평가원

Diffusion 모델의 부적절 컨텐츠 생성 완화 기술
Text-to-Image 생성 모델의 부적절한 콘텐츠 문제 해결을 위한 유해개념별 특징 공간 생성 및 조정을 통한 완화된 이미지 생성 기술
2026년, 생성형 AI 보안 위협 대응 기술 개발, 정보통신기획평가원

프롬프트 엔지니어링 기반 이진 추론
변호사-검사-판사 구조를 활용한 이진 논리 추론 및 Real-world task에서 모델의 정확성과 신뢰성을 향상시키는 새로운 프롬프트 엔지니어링 기법
2024년, 생성형 AI 보안 위협 대응 기술 개발, 정보통신기획평가원

AI 프라이버시 비서
개인정보 문서 요약 및 해석을 통해 개인정보 유출 위험도 판단 후 맞춤형 개인정보 제공 및 PDS 연동과 On -Device 환경 구축에 맞춘 개인정보 AI 비서 개발
2024년, 생성형 AI 보안 위협 대응 기술 개발, 정보통신기획평가원

생체 인증 가능한 얼굴 비식별화
블랙박스 적대적 알고리즘과 StyleGAN을 활용하여, 사람은 식별할 수 없지만 인공지능은 동일인을 인증할 수 있는 인증 가능한 얼굴 비식별화에 대한 연구
2023년, 자기주권 신원 활용을 위한 사용자 신원 인증 및 관리 기술 개발, 정보통신기획평가원

음성 비식별화
방송 음성 변조의 보안 취약성 개선을 위한 Lightweight 음성 비식별화 모델의 다양한 변조 방식을 활용한 비식별화 기술
2023년, 엣지 AI 보안을 위한 Robust AI 및 분산 공격 탐지 기술 개발, 정보통신기획평가원
