DimensionV/KR-Mobile-Smishing-SIEM-Dataset-2026
license: cc-by-nc-nd-4.0 task_categories: text-classification language: ko tags: cybersecurity smishing phishing siem mobile-security synthetic-data korean mitre-attack threat-detection fraud-detection pretty_name: 2026 Korean Mobile Smishing SIEM Dataset size_categories: 1K<n<10K ๐ก๏ธ KR-Mobile-Smishing-SIEM-Benchmark-2026 "2026๋ ํ ํ๊ตญ ๋ชจ๋ฐ์ผ ์ค๋ฏธ์ฑ ํฌ์ฒด์ธ์ SIEM ํ๊ฒฝ์์ ํ์งยทํ๊ฐํ๊ธฐ ์ํ ํฉ์ฑ ๋ฒค์น๋งํฌ ๋ฐ์ดํฐ์ " ๋ฐฐ๊ฒฝ ๊ธฐ์กด ์ค๋ฏธ์ฑ ํ์ง ๋ฐ์ดํฐ์ ์ SMS ํ ์คํธ ๋ถ๋ฅ์ ํ์ ๋์ด, SIEM ํ๊ฒฝ์์์ ๋ค๋จ๊ณ ๊ณต๊ฒฉ ํ์ง(๋ฆฌ๋๋ ํธ ์ฒด์ธ, ํผ ํ์ทจ, MFA ํผ๋กโฆ See the full description on the dataset page: https://huggingface.co/datasets/DimensionV/KR-Mobile-Smishing-SIEM-Dataset-2026.
license: cc-by-nc-nd-4.0 task_categories:
- text-classification language:
- ko tags:
- cybersecurity
- smishing
- phishing
- siem
- mobile-security
- synthetic-data
- korean
- mitre-attack
- threat-detection
- fraud-detection prettyname: 2026 Korean Mobile Smishing SIEM Dataset sizecategories:
- 1K<n<10K
๐ก๏ธ KR-Mobile-Smishing-SIEM-Benchmark-2026
"2026๋ ํ ํ๊ตญ ๋ชจ๋ฐ์ผ ์ค๋ฏธ์ฑ ํฌ์ฒด์ธ์ SIEM ํ๊ฒฝ์์ ํ์งยทํ๊ฐํ๊ธฐ ์ํ ํฉ์ฑ ๋ฒค์น๋งํฌ ๋ฐ์ดํฐ์ "
๋ฐฐ๊ฒฝ
๊ธฐ์กด ์ค๋ฏธ์ฑ ํ์ง ๋ฐ์ดํฐ์ ์ SMS ํ ์คํธ ๋ถ๋ฅ์ ํ์ ๋์ด, SIEM ํ๊ฒฝ์์์ ๋ค๋จ๊ณ ๊ณต๊ฒฉ ํ์ง(๋ฆฌ๋๋ ํธ ์ฒด์ธ, ํผ ํ์ทจ, MFA ํผ๋ก ๊ณต๊ฒฉ ๋ฑ)๋ฅผ ํ๊ฐํ ์ ์์์ต๋๋ค. ์ด ๋ฐ์ดํฐ์ ์ SMS ์์ ๋ถํฐ ๊ธ์ต ํผํด ์ฐจ๋จ๊น์ง์ ์ ์ฒด ํฌ์ฒด์ธ์ SIEM ๋ก๊ทธ ํํ๋ก ์ฌํํฉ๋๋ค.
์ ์ ๋ฐฉ์
- ํ์ดํธํด์ปค ํ๋ฅด์๋๋ฅผ ํ์ฌํ AI ๊ธฐ๋ฐ ์๋๋ฆฌ์ค ์ค๊ณ + ์ฌ๋ ์ง์ ๊ฒ์ (Human-in-the-Loop)
- MITRE ATT&CK for Mobile (v16+) ํ๋ ์์ํฌ ๊ธฐ๋ฐ ๋ผ๋ฒจ๋ง
- 5๊ฐ ์๊ด๋ถ์ ํ์ง ๊ท์น์ ๋ํ ์ ๋ต์ง(rulefireverification) ํฌํจ
- RFC 2606 / RFC 5737 ์ค์: ๋ชจ๋ ๋๋ฉ์ธยทIPยท์ ํ๋ฒํธ ๋นํ์ฑํ ์ฒ๋ฆฌ
๐ ๋ฐ์ดํฐ ํน์ง (Key Features)
Platform: iOS / Android ๋ชจ๋ฐ์ผ ํ๊ฒฝ
Scenarios: ๊ฒฐ์ ์ฌ์นญ, ๊ณต๊ณต๊ธฐ๊ด ์ฌ์นญ, ํ๋ฐฐ ์ฌ์นญ, ์ธ์ฆ์ ๊ฐฑ์ ์ฌ์นญ ๋ฑ 10์ข +
Case Types: malicious(๊ณต๊ฒฉ ์ฑ๊ณต) / benign_lookalike(๊ณต๊ฒฉ ์ค๋จ) / benign(์ ์) 3์ข ํผํฉ โ True Positive Rate์ False Positive Rate ๋์ ์ธก์ ๊ฐ๋ฅ
Log Sources: messaging, network, browser_security, identity, financial, noise
Labels: ์ด๋ฒคํธ ๋จ์ ground_truth(malicious/suspicious/benign) + MITRE ATT&CK tactic/technique ID
Detection Rules: SMISHREDIRECTCHAIN, PHISHWARNINGBYPASS, SENSITIVEFORMSEQUENCE, PLATFORMDIVERGENCE, POSTLUREFINANCIALRISK_SIGNAL โ ๊ฐ ๊ท์น์ ๋ฐ๋ ์ฌ๋ถยท๊ฒฝ๋กยท๊ทผ๊ฑฐ ํฌํจ
Noise Model: ์ค์ ๊ธฐ์ ํ๊ฒฝ์ ๋ชจ์ฌํ ๋ฐฐ๊ฒฝ ํธ๋ํฝ 8๊ฐ ์นดํ ๊ณ ๋ฆฌ, 200 ์ด๋ฒคํธ ์ค์ผ์ผ๋ง ์ง์
๐ ๋ฐ์ดํฐ์ ๊ตฌ์ฑ (Dataset Composition)
๐ ์์ ์ฑ (Safety & Compliance)
- ๋ชจ๋ ๋๋ฉ์ธ:
.exampleTLD (RFC 2606) โ DNS ํด์ ๋ถ๊ฐ - ๋ชจ๋ IP: TEST-NET ๋ฒ์ (RFC 5737) โ ๋ผ์ฐํ ๋ถ๊ฐ
- ๋ชจ๋ ์ ํ๋ฒํธ: ๋ฏธํ ๋น ๋ฒํธ ๋์ญ
- ์ค์ ๋ธ๋๋๋ช
ยท๋ก๊ณ ยทUI ๋ฏธํฌํจ (
no_brand_copy: true) - SMS ๋ณธ๋ฌธ์
[TRAINING]์ํฐ๋งํฌ ์ฝ์
ํ์ฉ ์์
- SIEM ํ์ง ๊ท์น์ TPR / FPR ๋ฒค์น๋งํฌ
- SOC ๋ถ์๊ด ํ๋ จ์ฉ ์๋๋ฆฌ์ค
- ๋ชจ๋ฐ์ผ ์ํ ํ์ง ML ๋ชจ๋ธ์ ํ์ต ๋ฐ ํ๊ฐ
โ๏ธ Contact & License
์ด ๋ฐ์ดํฐ์ ์ ์์ ์ ์ด์ฉ์ด๋ 1000๊ฑด ์ด์์ ํ ๋ฒ์ ๊ตฌ๋งค๋ฅผ ์ํ์๋ฉด [senimanyc@gmail.com]๋ก ๋ฌธ์ ๋ฐ๋๋๋ค.
