尧图网络 高端网站定制 · 原创设计
免费咨询热线
400-888-6620
免费获取方案
收藏 _ DSH红队模式:渗透测试、代码审计、免杀检验,小白也能上手的攻防实战配置
收藏 | DSH红队模式渗透测试、代码审计、免杀检验小白也能上手的攻防实战配置本文介绍了如何将开源智能体DeepSeek Harnessdsh配置为服务攻防任务包括渗透测试、红队评估、代码审计和免杀检验的具体做法。文章强调了授权测试的重要性详细阐述了在本地或私有模型下通过配置工作区、权限档和技能目录来搭建“红队模式”的步骤。对于渗透测试dsh能自动化信息处理和编排侦察命令但关键路径需人工验证。红队评估利用subagent并行处理信息和ATTCK覆盖管理技能。代码审计部分介绍了如何利用dsh进行高危面定位、污点数据流推理以及修复回归闭环。最后文章指出免杀检验的重点在于建立检验流水线与检测工程而非提供绕过配方并强调了人在攻防中的关键作用和风险控制。智能体安全 · 2026.09.04DSH 红队模式渗透测试、红队评估、代码审计、免杀检验——每块都给到能上手的操作层 9 月 4 日 智能体 × 攻防⚠️ 仅限授权测试全文约 5600 字,预计阅读 15 分钟。面向安全从业者,含可上手的配置与工作流。文中不提供免杀 payload 代码或针对特定 EDR 的绕过配方,免杀一节讲的是检验流水线与检测工程。· · ·01先把话说在前面:这篇的适用边界这篇讲的是:把开源智能体运行时 DeepSeek Harness(命令行dsh)配置成服务攻防任务的一套具体做法——怎么配、写哪些 skill、接哪些工具、每个阶段的工作流长什么样。渗透测试、红队评估、免杀检验,全部只在书面授权范围内合法。读者预设是:在 SRC、护网、有委托合同的渗透项目、CTF、或自建靶场里工作的安全人员,以及要理解攻击面的防守方。脱离授权范围使用其中任何能力都是违法,与工具无关。下文给操作细节,不等于给可以随便用的许可。前一篇《DeepSeek-Harness 到底是个啥》讲清了它作为通用运行时的定位。这一篇往下走一层,全部落到操作。02一、红队模式不是开关,是一份配置——先把底座搭好dsh官方运行模式是 Standard / Code / Minimal / Creator,没有红队模式。所谓红队模式,是基于它一切皆插件的架构自己组装的一份配置:换系统提示、挂攻防工具与 MCP、设权限档、配 skill 目录。第一步:模型层——涉密测试一律用本地/私有模型。在Settings → Models里,把 provider 指向本地或内网私有部署,不要用云端 API。原因很实在:授权测试里的目标信息、漏洞细节属于客户敏感数据,走云端 API 就等于把它发到外部。dsh 模型无关,接 Ollama 或任意 OpenAI 兼容端点即可:// ~/.dsh/config.jsonc(示意) { model: { provider: ollama, endpoint: http://127.0.0.1:11434/v1, name: your-local-model }, permission: workspace-write, // 默认收紧,别一上来就 full-access approval: on-danger, // 高危动作停下来问人 workspace: /opt/redteam/engagement-2026-09 }第二步:权限——用工作区和审批闸门把授权范围硬约束住。这一条是操作里最重要的。智能体不理解授权范围,它只执行你给的目标。所以别指望模型自觉,要用配置硬约束:permission默认workspace-write,把可读写目录锁在本次任务的工作区里;approval: on-danger,让外连、写系统目录、执行高危命令这类动作在执行前停下来问人;目标范围(IP/域名白名单)写进系统提示和检测插件里双重兜底(下一节给例子)。第三步:目录结构。 一次授权任务开一个独立工作区,把 skill、凭据、产物、轨迹全隔离在里面:/opt/redteam/engagement-2026-09/ ├── .dsh/ # 本次任务的会话轨迹(append-only) ├── skills/ # 攻防 skill(下面各节给例子) │ ├── recon/ │ ├── redteam/ │ └── codeaudit/ ├── scope.txt # 授权范围白名单 ├── findings/ # 结构化发现 └── report/ # 报告产物搭好这个底座,后面四块能力都是往这个骨架上挂 skill 和工具。03二、渗透测试:把侦察串成一条 skill,让它自动编排dsh 在渗透里最直接的增益是信息处理自动化:把十几条侦察命令的编排、结果归并、路径推理交给它,人只做验证和决策。接工具:通过 bash 工具或 MCP 把现成侦察工具串进来。dsh 内置 bash 工具,最简单的接法是直接让它调用你机器上已装好的 subfinder / httpx / nuclei / nmap。更规范的做法是写成 MCP 服务或社区的dsh-mcp-bridge批量接入。先给 bash 版,门槛最低。写一个侦察 skill。 dsh 的 skill 就是一份带说明的 Markdown,放在skills/recon/。它告诉智能体这个任务该按什么顺序、用什么工具、产出什么结构:!-- skills/recon/asset-mapping.md -- # 资产测绘 ## 触发 用户要求对授权范围内目标做资产收集时使用。 ## 前置约束(硬性) - 只处理 scope.txt 白名单内的域名/IP,范围外的一律拒绝并提示。 - 所有工具调用限速,避免对目标造成压力。 ## 流程 1. 读 scope.txt,逐个根域跑 subfinder 收子域。 2. 子域喂给 httpx,识别存活、标题、指纹、状态码。 3. 存活资产喂给 nuclei 跑信息类模板(不跑破坏性模板)。 4. 把结果归并成一张表:资产 / 服务 / 指纹 / 已知风险点,写到 findings/assets.md。 ## 输出 findings/assets.md,含关联分析:哪些资产同源、哪些指纹组合值得优先看。任务提示词长这样:按 skills/recon/asset-mapping.md,对 scope.txt 里的授权目标做资产测绘。 只在白名单内操作,跑完给我 findings/assets.md,并标出你认为优先级最高的 三个资产和原因。智能体会按 skill 编排 subfinder→httpx→nuclei,把散在各工具输出里的结果拼成一张带关联的资产图。人省掉的是手动跑二十条命令再拼表的时间。攻击路径推理:让它出假设,你来验。 拿到资产图后:基于 findings/assets.md,列出你判断可能存在的攻击路径,每条给出: 依据、验证方法、以及不成立的可能。按可信度排序,不要下结论。模型的长处是在弱信号里做关联假设(版本号对应哪些已知问题、两个服务组合有没有横向可能)。它给的是假设不是结论——它会把不成立的路径也讲得头头是道,每条都得人去验。临门一脚不要交给它自动做。需要精确构造、和环境强耦合、一次性机会的利用动作,人必须在回路:一是模型对环境细节掌握不足,自动化利用极易造成非预期破坏(授权测试里不破坏业务是硬约束);二是全自动执行会让你失去对打到哪一步的控制。把approval: on-danger开着,让这类动作停下来问你。报告成稿:纯增益。 dsh 的 append-only 轨迹记录了每一步,喂给模型加模板直出初稿:读取本次任务的会话轨迹,按 report/template.md 生成渗透测试报告初稿: 每个发现要有复现步骤、影响分析、修复建议、风险定级。04三、红队评估:用 subagent 铺面,用 skill 管 ATTCK 覆盖红队评估追求的是模拟真实攻击者,检验整个防御体系多久能发现并响应,和渗透的证明有洞不同。dsh 在这里提供三样操作层的东西。一个 ATTCK 覆盖管理 skill。 红队最繁琐的是覆盖度管理——一条杀伤链要覆盖多种 TTP,还要和检测点对齐。写成 skill 让它编排与记录:!-- skills/redteam/attack-coverage.md -- # ATTCK 覆盖管理 ## 流程 1. 读演练计划,把每个动作映射到 ATTCK technique(给出 T 编号)。 2. 生成一张覆盖矩阵:tactic × technique × 本次是否检验 × 检验点。 3. 演练执行后,从轨迹里回填每个 technique 的实际执行时间与结果。 4. 和蓝队检测日志对齐,算停留时间、检测覆盖率、告警延迟。 ## 强约束 只做编排、映射、记录。不自动发起任何攻击动作。用 subagent 做并行信息铺面。 dsh 的 subagent 能派生多个带独立上下文的子智能体并发工作:派生 3 个子智能体,分别对 scope 内的三个网段并行做资产梳理和情报关联, 各自写到 findings/net-a.md / net-b.md / net-c.md,最后你汇总成一张总图。注意:并发的是信息处理,不是并发攻击。把这两者搞混,是高估 AI 攻击能力的根源。演练留痕与复盘——这一条对蓝队价值更大。 复盘最缺攻击方每一步几点做了什么的精确记录,以便和检测日志对齐。dsh 的只追加轨迹天生就是这份记录,可回放、可回退、可分支:从会话轨迹导出本次演练的完整动作时间线,按 ATTCK technique 分组, 标出哪些动作触发了告警、哪些没有,输出到 report/purple-team-timeline.md。05四、代码审计:四块里最该先上手的,给完整审计流水线代码审计本质是防御性工作,是四块里下行风险最低、最成熟的一块。建议把它作为团队引入 dsh 的起点。大仓库通读 高危面定位。 用 grep/glob/read 加 subagent 并行扫面:!-- skills/codeaudit/sink-hunting.md -- # 危险汇聚点定位 ## 流程 1. glob 全仓库,按语言分类源文件。 2. grep 高危模式:反序列化入口、拼接 SQL、命令执行、SSRF 可达的请求、 未鉴权路由、硬编码密钥、不安全的文件操作。 3. 每命中一处,read 上下文,判断是否真的可达用户输入。 4. 输出候选清单:文件:行 / 汇聚点类型 / 初判可达性 / 需人工确认点。配合 semgrep 一起用效果更好——让 dsh 先跑 semgrep 出机检结果,再由模型做上下文复核,补 SAST 跟不动的跨文件数据流。污点数据流推理。 模型的长处正是补 SAST 的短板:针对 skills/codeaudit/sink-hunting.md 找出的第 3 个汇聚点, 从污点源开始,跨函数、跨文件把数据流讲清楚,判断用户输入 能否走到这个危险点。给出完整调用链,不确定的地方明确标出。它会漏、会误判,所以定位是它的强项、定性仍需人复核,不能把它的结论直接当审计结果。修复 回归闭环。 这是 dsh 相比纯扫描器的结构性优势:对已确认的这个注入点,给出修复补丁草案和对应的回归测试用例, 我审过再合入。06五、免杀检验:给的是检验流水线与检测工程,不是绕过配方到免杀这块,操作细节换一个方向给——给怎么系统化检验你自己的 EDR和怎么用 dsh 自动生成检测规则的流水线,不给任何免杀技术、payload 或针对某款产品的绕过方法。先立清概念:免杀检验是授权红队里的真实环节,目的是验终端防护(EDR/杀软)的检测能力到底行不行,在授权、在靶场、针对自己的防护体系做,是正当研究;脱离这个前提就是制作恶意软件,是犯罪。这条线不因为用了 AI而改变。AI 在这一块真正改变的是门槛。免杀过去是高技术活,AI 辅助会把门槛显著拉低——这正是它最危险的地方:可能让原本不具备能力的人更快做出有危害的东西。所以一篇公开文章能给的操作细节,只能是检验方法与检测工程,绝不能是可复制的绕过技战术。本文不提供任何免杀技术、代码或绕过方法。操作层能给的,是把免杀检验建成一条可度量的流水线。第一,用 ATTCK Defense Evasion 战术当检验清单。 MITRE 的 TA0005 战术下的 technique 列表是公开分类法,把它当我的 EDR 该覆盖哪些规避手法的检查表——注意这里用的是 technique 的分类和检测视角,不是实现细节。写成 skill:!-- skills/redteam/evasion-coverage.md -- # 免杀检验覆盖管理(防守视角) ## 流程 1. 拉取 ATTCK TA0005(Defense Evasion)下的 technique 列表。 2. 对每个 technique,查我方 EDR 是否有对应检测规则/行为模型。 3. 生成覆盖矩阵:technique × 是否有检测 × 检测类型(特征/行为/内存)。 4. 标出无任何检测的空白项,作为检测工程的优先补齐清单。 ## 强约束 只做检测覆盖度评估与规则生成,不产出任何规避实现。第二,把检测规则生成自动化。 攻击方能用智能体批量生成变体,防守方就用智能体批量分析样本、提取行为特征、生成检测规则。这是对称的军备升级,防守方没理由缺席:分析 samples/ 下这批(已在隔离环境引爆的)样本的行为日志, 提取共性行为特征(而非静态特征),生成 Sigma 规则草案, 写到 detections/,每条标注对应的 ATTCK technique 和预期误报面。第三,红蓝自动化回归。 用 dsh 的 headless 模式 定时触发,把检验我方 EDR 覆盖度 → 找空白 → 生成规则 → 回归验证跑成周期性流水线,轨迹留痕可复盘。为什么防守要这么做——三条判断:其一,检测别只靠特征。 变体能被快速批量生成时,静态特征查杀越来越被动,重心要往行为检测、内存检测、动作层异常识别挪。其二,盯行为不盯样本。 免杀改的是长什么样,改不掉要干什么——最终还是要落地执行、注入、外连、持久化。把检测建在行为和动作层,是对抗 AI 加持免杀最稳的方向。这和智能体安全里审动作而非审意图是同一套哲学。其三,AI 用在防守侧同样有效。 上面那条规则生成流水线就是例子。07六、为什么是 dsh:四个契合点(对攻防对称)前面反复用到 dsh 的几个特性,集中说清——注意它们对攻防两边对称,防守方一样能用来搭评测与检测。插件化让能力可拆可审。 每个动作经由可插桩的扩展点(如agent/request),你能在动作执行前插入自己的审查、记录、拦截逻辑。给个把授权范围硬约束住的检测插件骨架:// plugins/scope-guard.ts(示意) export default definePlugin((ctx) { ctx.on(agent/request, async (action) { const target extractTarget(action) // 从动作里解析目标 if (target !inScope(target, loadScope())) { // 不在白名单 action.deny(目标 ${target} 超出授权范围,已拦截并记录) } }) })对红队这是可定制,对蓝队这是可观测。权限分级 沙箱是双刃的。workspace-write/danger-full-access分级、默认 fail-closed,既是约束红队别误伤的护栏,也是研究智能体在什么权限下会做什么动作的天然实验台。轨迹日志让每一步可复盘。 append-only 会话轨迹是演练留痕事后复盘的基础设施。模型可换让它能内网私有部署。 MIT 协议 模型层可替换 本地运行,敏感攻防研究可在完全离线环境做,不必把测试数据发外部。08七、风险与合规:七条必须守住的线除了法律授权这条大前提,工程上还有一批坑,攻防场景后果更重:授权范围是唯一合法性来源。 书面授权、明确目标范围、明确时间窗,缺一不可。约束授权范围是人的责任,要在工作区和白名单里硬约束,别指望模型自觉。自动化利用要人在回路。 越有破坏力的动作越要设审批闸门,approval: on-danger不能关。插件即供应链风险。 dsh 的插件构建脚本在沙箱之外执行,装一个来路不明的攻防插件,安装过程本身就不受你设的权限约束——攻防插件恰恰最可能被投毒,安装前必须审源码。别把敏感目标数据喂给外部模型。 接云端 API 会让目标信息、漏洞细节离开本地,涉及真实客户的授权测试应当用本地/私有模型。沙箱不是铁桶。node:vm不构成真正的安全边界,真隔离靠进程级机制(bwrap/Landlock/Seatbelt),尤其跑不可信样本时,配置不当等于没有隔离。它会自信地胡说。 模型给的攻击路径、漏洞判断含相当比例幻觉,当待验证假设用,别当结论。攻防里信错一条,轻则浪费时间,重则误伤业务。它还在 developer preview。 官方明确会有破坏性变更,跨平台(尤其 Windows)坑多,现在适合研究和内部试点,不适合托管到无人值守的高权限生产流程。09八、给两边的一句话给红队: dsh 帮你省的是信息处理和文书的时间——侦察聚合、路径推理、覆盖管理、报告成稿、代码审计,纯增益。省不掉、也不该替你做的,是需要精确控制和承担后果的动作,以及守住授权边界的判断。把它当高效但不可全信的助手,不是自动打手。给蓝队: 这篇真正的重点其实给你。攻击门槛正被智能体拉低,基于特征的防御会越来越吃力,检测必须往行为层和动作层走;而 dsh 这类可插桩、可留痕的运行时,也是你搭智能体安全评测场、做红蓝自动化对抗的好抓手。这是一场对称升级,别让攻击方单方面用上 AI。10总结DSH 没有红队模式开关,但一切皆插件让你能自己装配出一套攻防配置:底座是模型本地化 权限收紧 工作区隔离;渗透靠侦察 skill 自动编排、靠人验证路径;红队靠 subagent 铺面、靠 skill 管 ATTCK 覆盖与留痕;代码审计是最该先上手的闭环;免杀这块,操作层只谈检验流水线与检测工程,绕过实现不写。贯穿始终的只有两条:一切以书面授权为前提;越关键的动作,越要人在回路。工具是中性的,守住这两条的是人。· · ·资料来源deepseek-ai/deepseek-harness(GitHub 官方仓库):https://github.com/deepseek-ai/deepseek-harnessDeepSeek Harness 官方页面:https://deepseek.com/harness/en/MITRE ATTCK 框架 / Defense Evasion(TA0005):https://attack.mitre.org/tactics/TA0005/Sigma 检测规则项目:https://github.com/SigmaHQ/sigma本文配置与工作流为操作层示意,免杀部分只含检验方法与检测工程,不含任何规避实现细节。想从事网络安全的同学找工作最怕“理论都懂实战发懵”。在面试中HR和面试官更看重你对真实攻防场景的理解和动手能力。为了帮大家搞定面试我帮大家准备了一份360智榜样学习中心独家《网络攻防知识库》。这份资料最大的亮点在于**“实战性”**知识库由360智榜样学习中心独家打造出品旨在帮助网络安全从业者或兴趣爱好者零基础快速入门提升实战能力熟练掌握基础攻防到深度对抗。从零到精通完整闭环基础攻防→渗透测试→应急响应→CTF实战5大模块200课时比大学教材更贴近企业实战”涵盖渗透测试案例分析与实战技巧直接对应面试真题包含CTF竞赛基础与HW行动攻防对抗实录丰富你的简历项目经验深入十大安全漏洞与利用技巧掌握这些高阶技能实战SRC挖洞赚钱。实战教学专属靶场掌握这些高阶技能谈薪更有底气。无论你是找渗透测试岗还是安全服务岗这些项目都是加分项。点击下方链接补齐实战短板拿下心仪Offer**读者福利 |***CSDN大礼包《网络安全入门进阶学习资源包》免费分享 ***安全链接放心点击**
RELATED

相关推荐

AI工程从零搭建:环境配置到模型部署的完整实践指南

AI工程从零搭建:环境配置到模型部署的完整实践指南

AI工程这几年算是彻底从一个“实验室里的名词”变成了实打实的岗位和工程学科。随手一刷就能看到各种“AI工程师”的招聘和课程,但真正能把手上的东西从零搭起来、跑通、再稳稳上线的人,反而是少数。这个“ai-engineering-from-scratch”的标题勾起了我不…

📅 2026/10/1 7:42:47
企业私有化RAG知识库搭建实战:架构设计、技术选型与踩坑总结

企业私有化RAG知识库搭建实战:架构设计、技术选型与踩坑总结

1. 为什么企业最终都得走私有化 RAG 这条路先交代一下背景。前阵子公司内部积压了大量制度文档、技术规范、项目验收报告和售后知识,分布在钉盘、Confluence、NAS 甚至个人微信里,找一份三年前的配置说明要比新写一份还费劲。内部做过一次统计&#xff1…

📅 2026/10/1 7:42:47
PB 设置 lock_timeout 参数(当前连接生效):TaoToken 统一 Key 接入 AI 工具配置骨架

PB 设置 lock_timeout 参数(当前连接生效):TaoToken 统一 Key 接入 AI 工具配置骨架

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

📅 2026/10/1 7:42:47
MORE NEWS

更多资讯

📰

2026游戏客服成本高、响应慢、出海合规难?这套一体化方案被多家头部公司验证过了

引言做游戏运营的人,对下面这些场景一定不陌生:玩家半夜充值不到账,客服没人响应,第二天差评已经刷屏;出海游戏玩家用LINE咨询,客服团队却只会用微信后台;每月客服人力成本几十万,但…

📰

Kali Linux渗透测试环境搭建:新手必学工具与基础配置详解

一、引言:装好 Kali ≠ 能干活 几乎所有网安新手的第一个动作都是"装个 Kali"。但真实情况往往是:虚拟机装完了,apt upgrade 一跑,桌面崩了;工具装了一堆,扫描时却连靶机都 ping 不通&#xff1b…

📰

linux-command 项目实战:grub2-set-default 命令详解——设置 GRUB 默认启动内核的完整指南

文档教程 【免费下载链接】linux-command Linux命令大全搜索工具,内容包含Linux命令手册、详解、学习、搜集。https://git.io/linux 项目地址: https://gitcode.com/GitHub_Trending/linux/linux-command 点击查看 免费下载 导读 grub2-set-default 是…

📰

en.javascript.info 逻辑运算符实战:深入解析 `alert( alert(1) alert(2) )` 的输出与短路求值

文档/教程前端 【免费下载链接】en.javascript.info Modern JavaScript Tutorial 项目地址: https://gitcode.com/gh_mirrors/en/en.javascript.info 点击查看 免费下载 导读 本篇文章基于 en.javascript.info(Modern JavaScript Tutorial&#xff09…

📰

Grok 4.7 API升级详解:稳定性优化与开发者适配指南

1. Grok 4.7 不是“新模型”,而是API层的一次精准外科手术 Grok 4.7 这个名字一出来,很多开发者第一反应是:“又出新大模型了?”——其实不是。它既不是参数量翻倍的下一代,也不是架构重构的全新版本,而是…

📰

Agent 开发实战:用 Laya 和 Jev 构建判断器,让智能体从能跑到靠谱

1. 从“能跑”到“靠谱”:为什么你的 Agent 需要一个判断器做 Agent 开发的朋友大概率都经历过这个阶段:Demo 跑通了,工具调用也接上了,看着模型一步步执行任务,感觉一切都很美好。但一旦把它放到真实场景里&#xff0…

TODAY

今日更新

THIS WEEK

本周精选

THIS MONTH

本月热门

读完文章,想聊聊您的网站?

告诉我们您的行业与需求,资深顾问一对一梳理方案与报价,全程免费。

📞 💬