跳到主要内容
身份学员
场景库

内容审核文本对抗

NLP · 内容审核真实推理 · CPU
待运行00:00

运行配置

目标模型
数据集
焦点样本(前后文本对比)

暂无样本

真实攻击对全部 10 条违规样本逐条执行;焦点样本用于展示前后文本 diff。

攻击方法
20
11530

真实改写预算:限制被替换/扰动的字/词数量,越少越隐蔽但绕过难度越高(直接传给真实服务)

500 queries
505001000

黑盒场景下允许查询审核 API 的次数,越多越易搜索到绕过样本

扰动粒度

真实评测使用镜像内置的约 10 条违规样本(固定),逐条真实推理

资源限额

CPU2 vCPU内存4 GB超时600s

真实推理:本次运行调用真实 CPU 文本对抗服务(DeepWordBug / TextFooler / HotFlip on char-level 违规/正常 分类器),返回真实 违规→正常 标签翻转、真实绕过率与真实前后文本 diff。

加载模型1 / 7
攻击成功
待运行
攻击失败
待运行
平均耗时
待运行
ASR
0.0%
峰值 0.0%
当前 ASR
0.0%step 0
Peak
0.0%
等待数据流...
0.000.250.500.751.00013253850
[xterm] 终端加载中...

结果画廊

演示数据
运行结束后展示对抗三联图 / 终态 ASR / 产物
点击右上「开始运行」