WHITZARDAGENT

白泽开放生态

开放智能体框架、安全评测、模型与数据基础设施。

GitHub 组织 ↗Hugging Face ↗

核心能力

四项开放技术基础

覆盖智能体开发、安全评测、思维矫正与行为链审计。

01智能体开发框架

WhitzardOS

构建、复现与观测长程智能体任务。

GitHub ↗
02安全评测基础设施

WhitzardEval

统一组织安全基准、风险测试与评测流程。

GitHub ↗

开放项目

完整项目目录

01

运行时安全

面向智能体真实行动过程的控制、防护与隔离能力。

开放项目社区版

AgentGuard

智能体运行时访问控制框架,支持策略配置、执行检查与审计。

查看社区版 ↗
开放项目开源

qise

面向智能体的运行时安全框架,集成规则、小模型与大模型检测。

GitHub ↗
开放项目即将开放

XuanwuBox

面向智能体运行环境的安全执行层,控制容器化沙箱风险。

GitHub ↗
02

安全模型

用于思维校准、意图、信任与推理安全的轻量模型。

开放项目开源

ReasoningShield

检测大型推理模型思维轨迹中的内容风险。

GitHub ↗
开放项目开源

IntentNet

识别多轮交互中的欺骗、操纵与恶意意图。

HF ↗
开放项目开源

TrustNet

评估多轮人机交互中的用户信任程度。

HF ↗
03

安全评测

评测框架、基准与渗透测试基础设施。

开放项目开源

WhitzardEval Evals

统一接入第三方智能体安全与前沿风险评测。

GitHub ↗
开放项目持续维护

LLMPentest

测量大模型渗透测试能力与行为。

GitHub ↗
开放项目持续维护

NVWA Project

研究自主性、扩散、失控与控制技术等前沿风险。

GitHub ↗网站 ↗
04

智能体基础设施

框架、中间表示、模拟器与智能体系统基础组件。

开放项目开源

YOGA

模块化、可扩展的通用智能体框架。

GitHub ↗
开放项目开源

Mirror-GUI

用于合成和评测桌面智能体轨迹的 GUI 模拟器。

GitHub ↗
开放项目开源

agentir

智能体轨迹的中间表示与转换工具。

GitHub ↗HF ↗
05

网络安全

网络安全智能体、训练流程、代码仓库与数据集。

开放项目持续维护

cyberhunter

从大规模网络语料中筛选高质量安全训练数据。

GitHub ↗HF ↗
开放项目开源

CyberSecurity-100B

面向持续预训练的大规模双语网络安全语料。

GitHub ↗HF ↗
开放项目开源

CyberSecurity-1M

覆盖漏洞、威胁情报、响应、工具与 CTF 的精选数据。

GitHub ↗HF ↗
开放项目开源

CyberRepo-10K

包含仓库、修复提交、补丁与漏洞版本的审计任务集。

GitHub ↗HF ↗
开放项目持续维护

CyberTrainer collection

汇集网络安全语料与漏洞审计任务的训练数据集合。

HF ↗