| 회사개요 |
대기업 계열 |
| 모집제목 |
AI Security RL 환경 엔지니어 |
| 근무지역 |
경기도 |
| 제출서류 |
이력서, 경력기술서, 사진파일첨부(국문) |
| 전체경력 |
3년
이상 |
나이 |
제한없음
|
| 학력/전공 |
대학교(4년) 졸업 이상 |
| 모집내용 |
담당업무
1. 보안 과제 실행환경 설계 및 구축
• Offensive·Defensive 과제 명세 정의·난이도 계층화, Sandbox 설계 및 운영
• IaC기반 환경 프로비저닝·온보딩 및 패키징·버전 관리·재현성 확보
2. 실행 결과 기반 Verifier 개발
• 취약점 재현·패치 유효성·탐지 규칙 판정 관련 로직 구현
• 이진 판정 및 단계별 부분 점수의 분리 적용 등의 보상 설계
3. 대규모 실행 운영 및 우회 방지
• 다수 Sandbox의 동시 Rollout 처리량 관리 및 초기화·복원 안정성 확보
• Reward Hacking·Verifier 우회 사례 분석·차단 및 자체 침투 시험을 통한 격리 경계 검증
4. Trajectory 수집 및 컨소시엄 산출물 통합
• Trajectory 수집·관측 체계 구축 및 참여기관 산출물 통합·품질 판정
• 환경-Verifier 공통 인터페이스 규격 정의 및 오픈소스 공개용 패키징·재현 레시피 구성
5. 평가 인프라 지원 및 선행 연구
• 재현 가능한 자동 평가 환경 구성 및 공개 벤치마크(CyberGym, ExCyTIn-Bench 등) 이식
• 사이버 훈련 환경 자동 생성·변형 기법 연구 및 후속 국책 과제 요건 정의 참여
자격요건
• 보안 인프라 구축, 취약점 분석, 모의해킹, 보안 도구 개발 중 하나 이상의 보안 분야 실무 경력을 3년 이상 보유하신 분
• 다음 두 가지 경험 중 하나 이상을 보유하신 분
- 훈련·평가 환경 구축
: 사이버 레인지, 보안경진대회(CTF) 인프라 또는 채점 서버, Flag 검증, 실행 결과 대조 중 하나 이상의 보안 실습 환경 설계·운영 경험 (단, 환경 프로비저닝 및 과제의 성공 여부를 자동으로 판정하는 로직 구현 경험 필수 포함)
- 실행 기반 판정
: 취약점 재현, 패치 시험, 탐지 규칙 실행의 결과를 자동으로 판정하는 로직 구현 경험
(Sanitizer 출력 대조, 빌드·테스트 자동화, 룰 실행 결과 측정 중 하나 이상)
• Container, Virtual Machine, Sandbox 등 격리 실행환경의 구축 및 운영 경험을 보유하신 분
• Python 기반 프로덕션 코드 작성 역량을 갖추신 분
우대사항
• 보안경진대회(CTF) 출제 또는 사이버 훈련 시나리오 설계 경험을 보유하신 분
• 강화학습 환경·LLM 학습 파이프라인 구축 또는 강화학습 학습·서빙 스택(verl, TRL, Ray, vLLM, SGLang 등) 경험을 보유하신 분
• 대규모 Container Orchestration(Kubernetes 등) 운영 또는 IaC(Terraform, Ansible 등) 기반 환경 자동화 경험을 보유하신 분
• Fuzzing 인프라· OSS-Fuzz 계열 파이프라인 또는 Active Directory 기반 공격 실습 환경 구축 경험을 보유하신 분
• Digital Twin 또는 운영환경 복제 기반 검증 환경 구축 경험을 보유하신 분
• LLM as a Judge 설계 또는 Rubric 기반 자동 채점 경험을 보유하신 분
• 오픈소스 보안 도구 기여 이력 또는 관련 분야 학술 논문 게재·발표 이력을 보유하신 분 |
| 기타정보 |
|
|