![2026 AI 안전 지킴이 모집 [생성형 AI 위험·오류 사례 발굴 프로젝트]](/_next/image?url=https%3A%2F%2Fskvnobjmcgicsqjvuqmt.supabase.co%2Fstorage%2Fv1%2Fobject%2Fpublic%2Fcontent-images%2Fuploads%2F1789540739673-dfqvvzyxte8.png&w=3840&q=75&dpl=dpl_3ozpyhnwLvURVqypymPhnotmPPMH)
2026 AI 안전 지킴이 모집 [생성형 AI 위험·오류 사례 발굴 프로젝트]
2026 AI 안전 지킴이 모집 [생성형 AI 위험·오류 사례 발굴 프로젝트]
-
주제
2026 AI 안전 지킴이 모집 [생성형 AI 위험·오류 사례 발굴 프로젝트] ○ 모집개요 - 생성형 AI 서비스에서 발생할 수 있는 오류와 위험 사례를 국민이 직접 발굴·제보하는 「AI 안전 지킴이」 참여자를 모집합니다. 사실 왜곡(환각), 편향·차별, 보안 취약점, 기술적 결함 등 AI 사용 과정에서 발견되는 다양한 문제 사례를 제보하고, 전문가 검수를 거쳐 신뢰할 수 있는 AI 안전 사례로 구축하는 국민 참여형 프로젝트입니다. ○ 모집인원 - 30명 내외 (모집 및 선발 상황에 따라 인원은 조정될 수 있음) ○ 활동형태 * 온라인 기반 모니터링 활동 - 생성형 AI 서비스 사용 및 위험 사례 발굴 - AIWORKS+를 통한 제보 등록 - 운영진의 보완 요청 및 검수 의견 확인 - 필요시 온라인 교육·회의 및 질의응답 참여 ○ 활동내용 - AI 안전 파수꾼은 다양한 생성형 AI 서비스를 직접 사용하며 다음 분야의 위험·오류 사례를 발굴하고 제보합니다. [사실 왜곡(환각)] - 출처 또는 기준 정답과 비교했을 때 사실과 다른 답변 - 날짜·수치·인물 등에 관한 오류 - 존재하지 않거나 확인되지 않는 정보를 사실처럼 생성한 답변 - 동일한 질문에서 사실 오류가 반복적으로 재현되는 경우 [편향·차별] - 특정 집단에 대한 비하 또는 고정관념이 포함된 답변 - 성별·연령·지역·직업·인종 등 특정 집단에 대한 불공정한 판단 - 동일한 질문에서 대상 집단만 변경했을 때 답변이나 판단이 달라지는 경우 - 답변의 맥락상 정당한 이유 없이 특정 집단을 차별하는 표현 [보안 취약점] - 악용 가능한 정보나 행동을 유도·조력하는 답변 - 프롬프트 인젝션 또는 탈옥을 통해 안전장치를 우회할 수 있는 경우 - 불법·위험행위에 관한 구체적인 정보를 제공하는 경우 - 개인정보 또는 민감정보가 노출되거나 노출 위험이 있는 경우기술적 결함 [기술적 결함] - AI 서비스가 정상적으로 응답하지 않는 경우 - 요구한 출력 형식과 다르게 답변하는 포맷 오류 - 동일한 답변이나 동작이 계속 반복되는 루프 현상 - 모델 버전·운영체제 등 특정 환경에서 재현되는 서비스 오동작 또는 품질 결함 ※ 개인별 활동 분야와 제보 목표는 교육 및 운영 과정에서 별도로 안내됩니다. ※ 제보 내용은 정해진 작성 가이드와 증빙 기준을 충족해야 합니다.
일정
○ 기간 및 일정 - 활동기간: 선발 및 위촉일(10월 초)~ 2026. 11. 30.(월) - 세부 교육 및 활동 일정은 최종 선발자에게 별도 안내 ※ 사업 진행 상황에 따라 활동 일정이 변경되거나 조기 종료될 수 있음 ※ 최종 선발자는 활동 전 사전교육(온라인)에 참여해야 함 ○ 검수절차 - 접수된 제보는 다음의 3단계 검수 절차를 거쳐 최종 확정됩니다. [1차 검수] - AI 전문 강사 2인이 분야별 제보 내용 및 기본요건 확인 - 작성 내용, 증빙자료, 중복 여부 및 제보 적정성 검토 [2차 검수] - 전문인력으로 구성된 검수자가 사례의 정확성 및 위험도 검토 - 제보 분야, 재현 가능성 및 활용 가능성 확인 [3차 검수] - 최종 전문가 검수를 통해 위험도 레벨 및 확정 사례 선정 ※ 검수 결과에 따라 제보가 보완 요청 또는 반려될 수 있습니다. ※ 동일하거나 유사한 사례가 제출된 경우 먼저 접수된 사례를 기준으로 인정될 수 있습니다.
지원자격
○ 지원자격 - 생성형 AI 및 AI 안전 분야에 관심이 있는 분 - AI가 생성한 답변의 오류·위험 요소를 논리적으로 설명할 수 있는 분 - 정해진 제보 작성 가이드와 활동 기준을 준수할 수 있는 분 - 온라인 교육 및 운영 채널을 통한 소통이 가능한 분
출품규격
○ 접수방법 - 온라인 신청 링크를 통해 지원서 작성 및 제출 - 제출된 지원서 검토 후 최종 선발자 개별 안내 - 제보 시 제출 내용 : 제보자는 AI 서비스에서 발견한 위험·오류 사례에 대해 다음 내용을 작성해야 합니다. - 사용한 AI 서비스명 / AI에 입력한 질문 또는 명령어 - AI가 생성한 전체 답변 / 문제가 발생한 부분 - 문제라고 판단한 이유 / 해당 제보 분야 - 예상 위험도 / 재현 방법 및 발생 과정 - 화면 캡처 등 확인 가능한 증빙자료 / 개인정보 및 민감정보 포함 여부 ※ 다른 사람이 동일한 조건에서 사례를 확인할 수 있도록 구체적으로 작성해야 합니다. ※ 개인정보, 저작권 침해 자료 또는 불법적인 방법으로 수집한 자료는 제출할 수 없습니다.
시상 내역
○ 혜택내역 - 과학기술정보통신부 장관 명의 위촉장, 수료증 발급 - 제보 1건당 최대 15,000P 지급 가능 (활동기간 동안 30여건 수행 예정) ※ 포인트는 최종 정산하여 개인 통장으로 현금 지급 - 우수 활동자 연말 포상 및 시상 <포인트 지급 기준> - 1. 기본요건을 충족하고 반려되지 않은 제보: 8,000P - 2. 레벨에 따른 차등지급 : 1,000P ~ 3,000P (위험도 레벨 1~2: 추가 1,000P/ 위험도 레벨 3: 추가 2,000P/ 위험도 레벨 4~5: 추가 3,000P) - 3. 최종 확정 사례 선정: 추가 4,000P ※ 최대 15,000P 지급은 최종 확정 사례에 한함 / 보상은 동일한 제보 건을 기준으로 단계별 누적 지급됩니다. ※ 기본요건을 충족하지 못하거나 반려된 제보는 포인트 지급 대상에서 제외됩니다. ※ 중복·허위·표절·증빙 미비 사례는 보상 대상에서 제외될 수 있습니다. ※ 포인트 지급 일정과 사용 방법은 최종 선발자에게 별도로 안내됩니다.
유의사항
○ 유의사항 - 제출한 지원 내용이 사실과 다른 경우 선발이 취소될 수 있습니다. - 활동 중 작성한 제보 내용과 사업 관련 자료를 외부에 공개할 수 없습니다. - 개인정보 또는 타인의 권리를 침해하는 자료를 제출해서는 안 됩니다. - 자동화 도구를 이용한 무분별한 제보, 허위 제보 및 다른 참여자의 사례를 복제한 제보는 인정되지 않습니다. - 운영 가이드 위반, 반복적인 부실 제보 또는 활동 방해 행위가 확인되면 활동이 제한될 수 있습니다. - 프로젝트 일정과 세부 운영기준은 사업 진행 상황에 따라 변경될 수 있습니다. - 최종 선발자에 한하여 교육 및 활동 방법을 개별 안내드립니다. ○ 문의 - 이메일: kjung225@etri.re.kr





