Infosec
Datasets
All datasets matching “Infosec”infosec-security-qainfosec-tool-output
Infosec Tool Output
Security-tool output → evidence-backed, plain-English interpretation.
A dataset for training and evaluating models that interpret security-tool output, explain the limits of the evidence, and recommend defensive next steps.
v2.0.0: 1,004 canonical examples across 19 tools. This includes all 776 original records with traceable interpretation changes, plus 228 newly authored synthetic fixtures. The deduplicated training views contain 1004 examples, not… See the full description on the dataset page: https://huggingface.co/datasets/tegridydev/infosec-tool-output.infosec-dataset-training
InfoSec Dataset Training
网络安全/信息安全领域训练数据集集合,汇聚多个开源安全数据集,提供统一的下载、转换和格式适配工具链。
数据集概览
数据集
来源
格式
语言
条目数
说明
cybersecurity_hq
自建
Alpaca
中文
20
网络安全基础问答
cybersecurity_sharegpt_chinese
ystemsrx/Cybersecurity-ShareGPT-Chinese
ShareGPT
中文
32,008
网络安全多轮对话
cybersecurity_chinese_mixed_v2
qingmian/CyberSecurity-Chinese-Mixed-V2
ShareGPT
中文
16,004
网络安全混合对话
trendyol_cybersecurity
Trendyol/Trendyol-Cybersecurity-Instruction-Tuning-Dataset
Alpaca
英文
53,201
网络安全指令微调… See the full description on the dataset page: https://huggingface.co/datasets/lxcxjxhx/infosec-dataset-training.RealMythosReasoning-English
RealMythosReasoning — Unofficial English Translation
This is an unofficial, machine-translated English derivative of
RealMythos/RealMythosReasoning at pinned revision
d363dda86d9316c29a181da042812050772bbf36. It is not produced, endorsed,
or maintained by the upstream RealMythos authors.
The release contains 6,159 training records. Chinese-language text
found in code comments, selected string literals, review flags, questions,
additional context, responses, and PoC evaluation… See the full description on the dataset page: https://huggingface.co/datasets/PNU-Infosec/RealMythosReasoning-English.infosecforsmollminfosec_harmful_behaviors
Infosec Harmful Behaviors
Offensive-security instruction prompts for refusal-direction research and abliteration of code/security models.
Dataset Details
This dataset contains infosec-domain harmful prompts intended to elicit refusal behavior from aligned instruction models. It is designed as the harmful side of a harmful/harmless contrast pair, analogous to mlabonne/harmful_behaviors but focused on offensive-security and malicious-coding requests.
Rows:
train:… See the full description on the dataset page: https://huggingface.co/datasets/zaakirio/infosec_harmful_behaviors.
