연구진은 가상의 기업 'Nebulon'을 배경으로 한 합성 기업 피싱 이메일 데이터셋 NEST-Phish를 공개했다. 이 데이터셋은 다양한 업무 커뮤니케이션 주제를 아우르며, 해석 가능한 피싱 단서 주석이 달린 정상·피싱 이메일 쌍으로 구성된다(여기서 '정상'은 실제 조직 이메일이 아니라 비피싱 클래스를 의미). 사람 대상 분류 실험과 분류기 평가 결과, 이 데이터셋은 피싱 판단에 의미 있는 편차를 반영하면서도 지도학습 탐지에 유용한 신호를 제공하는 것으로 나타났다. 공개된 이 자원은 피싱 탐지, 인간의 취약성, 설명가능성, 기업 환경에서의 벤치마크 개발 연구를 지원하기 위한 것이다.
- •가상 기업 Nebulon을 배경으로 한 합성 기업 피싱 이메일 데이터셋 NEST-Phish 공개
- •해석 가능한 피싱 단서 주석이 달린 정상·피싱 이메일 쌍으로 구성
- •사람 대상 실험에서 피싱 판단의 의미 있는 편차를 반영함을 확인
- •분류기 평가에서 지도학습 탐지에 유용한 학습 신호를 제공함을 확인
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Nebulon Enterprise Simulated Threats for Phishing Research (NEST-Phish): A Synthetic Enterprise Phishing Email Dataset for Behavioral and Machine-Learning Research
- 1.가상 기업 'Nebulon'을 배경으로 한 합성 기업 피싱 이메일 데이터셋 NEST-Phish 공개
- 2.정상·피싱 이메일을 짝지어 구성하고 피싱 단서에 해석가능한 주석 포함
- 3.사람 평가와 분류기 실험 모두에서 의미있는 판단 변이와 지도학습 활용 가능한 신호 확인
왜 중요한가?
실제 기업 환경을 반영한 공개 피싱 데이터셋이 부족했는데, 해석가능한 주석이 달린 이 데이터셋은 피싱 탐지·인간 취약성 연구·설명가능 AI 벤치마크 개발에 실질적 연구 인프라를 제공한다.
언급 프로젝트
본문 미리보기
arXiv:2609.04474v1 Announce Type: new Abstract: Phishing remains one of the most persistent cyber threats, yet publicly shareable datasets for studying phishing in realistic enterprise email settings remain limited. To address this gap, we introduce a synthetic enterprise phishing email dataset built around a fictitious organization, Nebulon. The dataset spans a broad set of workplace communication themes and includes matched synthetic legitimate and phishing emails with interpretable phishing-
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:24AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
