Coding

元鉴 yotta-triage

Try it

元鉴 —— 跨智能体的恶意样本静态初筛技能:零依赖自研对文件 / 目录做纯静态分析(MD5/SHA1/SHA256 哈希、魔数类型识别、Shannon 熵、可打印字符串分类提取、PE/ELF 头解析),输出 triage 报告 + IOC(hash/URL/域/IP/邮箱)供元情消费;只提示可疑、不定性恶意。触发:用户给出可疑文件 / 恶意样本 / 样本目录,要算哈希、识别文件类型、查熵、提取字符串、解析 PE/ELF 头、做静态初筛、产出 IOC 时。边界:只做静态特征,不反混淆、不解包、不动态执行任何样本;不联网查证;仅用于已获授权 / 自有资产 / 教学环境的安全分析。

What it does

元鉴 —— 跨智能体的恶意样本静态初筛技能:零依赖自研对文件 / 目录做纯静态分析(MD5/SHA1/SHA256 哈希、魔数类型识别、Shannon 熵、可打印字符串分类提取、PE/ELF 头解析),输出 triage 报告 + IOC(hash/URL/域/IP/邮箱)供元情消费;只提示可疑、不定性恶意。触发:用户给出可疑文件 / 恶意样本 / 样本目录,要算哈希、识别文件类型、查熵、提取字符串、解析 PE/ELF 头、做静态初筛、产出 IOC 时。边界:只做静态特征,不反混淆、不解包、不动态执行任何样本;不联网查证;仅用于已获授权 / 自有资产 / 教学环境的安全分析。

The skill document

元鉴(yotta-triage)

跨智能体的恶意样本静态初筛技能:零依赖自研对文件 / 目录纯静态特征分析—— MD5/SHA1/SHA256 哈希、魔数类型识别、Shannon 熵、可打印字符串分类提取、PE/ELF 头解析, 输出 triage 报告 + IOC(hash / URL / 域 / IP / 邮箱) 供元情(yotta-intel)消费。

纯 Python 3.8+ 标准库实现,零外部依赖;Windows + Linux + macOS 通用。 纯本地离线、只读:不反混淆、不解包、不动态执行任何样本。

何时使用

  • 用户给出一个可疑文件 / 恶意样本,要快速算哈希、识别文件类型、看熵、提取字符串;
  • 要解析 PE / ELF 头(架构、时间戳、区段、加壳线索),判断样本是不是加壳 / 高熵载荷;
  • 要对一批样本目录做静态初筛,按风险线索排序,产出 IOC(hash / URL / 域 / IP / 邮箱)供后续分析;
  • 恶意样本分析、应急响应、红蓝对抗复盘时需要「先静态看一眼」的环节。

Do NOT trigger

  • 不反混淆、不解包、不动态执行任何样本(红线);
  • 不联网查证 IOC 是否恶意、不查询威胁情报平台;
  • 不在无授权情况下分析他人样本;仅用于已获授权 / 自有资产 / CTF / 教学环境。

快速使用

Windows 用 python,Linux/macOS 用 python3。

# 分析单个样本(文本报告)
python3 scripts/yotta_triage.py triage --path sample.exe

# 分析目录(递归子目录)
python3 scripts/yotta_triage.py triage --path samples/ --recursive

# JSON 报告
python3 scripts/yotta_triage.py triage --path sample.exe --format json --output report.json

# Markdown 报告
python3 scripts/yotta_triage.py triage --path samples/ --format markdown --output report.md

# 只输出 IOC(hash / URL / 域 / IP / 邮箱),供元情消费
python3 scripts/yotta_triage.py triage --path samples/ --ioc-only --output iocs.json

# 跳过字符串提取(只算哈希 / 类型 / 熵 / PE-ELF 头)
python3 scripts/yotta_triage.py triage --path sample.exe --no-strings

# 版本
python3 scripts/yotta_triage.py --version

退出码:0 = 最高风险 ≤ low;1 = medium;2 = high;3 = critical;4 = 用法或读取错误。

工作流程(AI 智能体执行样本初筛时)

  1. 确认范围:明确要分析的样本文件 / 目录;只读本地,不做任何外部动作。
  2. 读取:用 triage --path 指向文件或目录;目录可加 --recursive 递归。
  3. 静态分析:引擎流式计算哈希(大文件不吃内存),对分析窗口做魔数识别、熵、 字符串提取与分类、PE/ELF 头解析。
  4. 分级:按静态指标加权给出 info/low/medium/high/critical 的线索级提示。
  5. 报告:text / JSON / Markdown 三种输出;--ioc-only 直接产出 IOC 供元情消费。
  6. 决策纪律:结果只是「可疑线索」,是否恶意需人工 / 其他情报源核实;工具本身不做任何执行。

功能

  • 哈希:MD5 / SHA1 / SHA256(流式计算,支持大文件);
  • 类型识别:魔数识别 PE / ELF / Mach-O / PDF / ZIP / gzip / 7z / RAR / OLE / 图片 / pyc / Java class, 另含 UTF-8 文本 / shebang 脚本识别;
  • :整体 Shannon 熵 + PE 区段熵(加壳 / 加密 / 压缩线索);
  • 字符串:可打印字符串(ASCII + UTF-16LE),分类提取 URL / 域名 / IP / 邮箱 / 可疑命令 / 路径 / 长 base64
  • PE 头解析:机器类型 / 时间戳 / 可选头 / 区段表(名称、特性、熵),识别加壳区段(UPX 等)与 RWX 区段;
  • ELF 头解析:位宽 / 字节序 / 机器 / 类型 / 入口 / 程序头与节头,识别 RWE 段与 RWX 节;
  • 风险分级:静态指标加权给出线索级风险(评分 + 理由),只提示、不定性;
  • IOC 输出:hash / URL / 域 / IP / 邮箱汇总,JSON 供元情(yotta-intel)消费;
  • 三种输出:文本 / JSON(stdout 纯净)/ Markdown 报告。

风险分级一览

级别含义常见触发
info无明显异常普通文本 / 无风险线索的样本
low低风险线索少量 URL / 单条可疑命令 / 轻度高熵
medium中等风险线索整体高熵(≥6.5)、疑似加壳区段、ELF RWE 段、多条可疑命令
high高风险线索加壳 + 内嵌 URL、多类可疑命令 + 可执行文件、RWX 区段叠加
critical严重风险线索加壳 + RWX + 高熵区段 + 下载执行命令等多项叠加

分级是静态线索,不代表样本确定恶意;最终判定需人工 / 动态分析 / 情报交叉验证。

输出格式

  • text — 每文件一段(哈希 / 类型 / 熵 / PE-ELF / 字符串统计 / 风险理由)+ 文件级 IOC 汇总;
  • json — 结构为 {tool, version, generated, summary, files[], iocs[]};files[] 每条含 hashes / type / entropy / strings / pe|elf / risk,iocs[] 为 {type, value, file}(供元情消费);
  • markdown — text 报告的围栏包装;
  • --ioc-only — 只输出 iocs[] JSON 数组。

边界(安全红线)

  • 纯静态:只做静态特征,不反混淆、不解包、不动态执行任何样本;
  • 只读本地:不联网查证、不下载、不修改 / 删除任何样本文件;
  • 不给定性:所有风险分级只是「可疑线索」,是否恶意需人工 / 其他情报源核实;
  • 授权:仅用于已获明确授权 / 自有资产 / CTF 靶场 / 教学环境;未经授权分析他人样本违反法律,使用者自行承担责任。

参考文档

  • references/triage-spec.md — 静态初筛规范(分析项 / 魔数表 / PE-ELF 字段 / 字符串分类)
  • references/risk-model.md — 风险分级模型(指标加权 / 阈值 / 与元情 IOC 衔接)

法律声明

本技能仅用于已获明确授权的安全分析(自有资产、授权测试、CTF 靶场、教学环境)。 未经授权分析他人系统 / 样本数据违反中国《网络安全法》与《刑法》相关条款,使用者自行承担法律责任。

Related skills

元析 —— 跨智能体的网络侦察技能:零依赖自研端口 / 服务 / 版本指纹探测(不依赖 nmap),为安全测试与资产盘点提供侦察能力,内建授权纪律(Scope Guard)。触发:扫描网络 / 端口扫描 / 服务识别 / 版本指纹 / 资产盘点 / CDN 溯源 / 安全测试侦察阶段。边界:仅扫描已获明确授权的目标(红线:授权纪律);只读探测,不主动攻击、不渗漏、不产生破坏;不用于非法入侵。

元情 —— 跨智能体的威胁情报 IOC 提取与规范化技能:零依赖自研从文本 / 日志 / 报告中提取 IP(IPv4/IPv6)、域名、URL、邮箱、哈希(MD5/SHA1/SHA256/SHA512)与 CVE 编号,识别并还原 defang 写法,去重、归一化后输出 CSV / JSON / STIX-lite。触发:用户给出含可疑 IP / 域名 / URL / 哈希的威胁情报文本、恶意样本分析报告、钓鱼邮件或日志,要提取 IOC、规范化、去重、转格式、共享情报时。边界:纯本地离线提取与规范化;不联网查证、不下载样本、不主动扫描任何系统;仅用于已获授权 / 自有资产 / 教学环境的安全分析。

元信 —— 装任何技能/包前的确定性安全扫描器:prompt injection(提示注入)+ 危险模式 + SKILL.md 完整性 + 权限需求,输出 verdict(SAFE TO INSTALL / INSTALL WITH CAUTION / REVIEW REQUIRED / DO NOT INSTALL)+ audited 徽章。触发:安装/评估任何技能或 npm 包前、给技能做安全验证、生成 audited 徽章、CI 装前闸门;或用户说 装前扫描/验证/audited/安全验证/verify-skill/可信 等。边界:只做确定性静态扫描与报告,不执行被测代码、不联网、不装包、不修复;结论需人工确认,不代替最终决策。

元察 —— 跨智能体的安全日志分析检测技能:零依赖自研解析 auth/secure、Web 访问日志(common/combined)、PowerShell 脚本块日志、Windows 事件日志(Security/System),检测爆破 / webshell / 扫描 / 异常登录 / 可疑脚本块 / 可疑进程 / 账户操作 / 日志清空,输出时间线与中文教学报告。触发:用户给出登录日志 / Web 访问日志 / PowerShell 日志 / Windows 事件日志,要分析入侵痕迹、排查异常活动、审计本地日志时。边界:只读本地日志文件;不联网、不主动扫描、不修改任何其内容;仅用于已获授权 / 自有资产的安全审计。

元安全 —— 给 AI 智能体 / Agent 技能自身做「体检 + 加固建议」:按 提示注入防护 / 工具调用边界 / 数据隔离 三域,对安装的 skills、MCP 服务器、工具描述、权限与数据读取面做配置面静态加固扫描,输出加固报告与可执行防御守则(零依赖 Python 3.8+,扫描只读、敏感读取检测默认开启、报告用「类」表述、每次扫描默认留痕)。触发:用户要求给智能体或技能环境做安全体检 / 加固、检查 MCP 服务器或技能是否可信、排查提示注入 / 越权 / 数据泄露风险、想了解装了一堆技能后的整体暴露面;或用户说 元安全 / 加固 / 安全体检 / 体检 / hardening / 扫一下我的技能 / 检查 MCP / 防御守则 / guardrails 等。边界(Do NOT trigger):不产出可复制注入串 / 攻击 payload;只扫描用户自有、有权检查的目录与配置,不扫描无权访问的环境;不做运行时拦截(那是元盾);不做单个技能装前审核(那是元审 / 元信);不替代人工安全审计与最终决策。

元测 —— 有纪律的 AI 安全测试方法论:对已授权目标(自有资产 / SRC 众测 / bug bounty / CTF / 靶场)按 侦察→发现→验证→报告 四阶段做 Web 安全测试(SQLi / XSS / SSRF / XXE / 反序列化 / 命令注入 / 文件上传 / 鉴权与访问控制 / 业务逻辑 / 信息泄露 / 不安全配置 / API 安全 + 漏洞评估与渗透报告方法论),内置 Scope Guard 五道防线(授权清单 scope.json + 目标三层判定 + 内置黑名单 + 操作留痕 + 法律红线),不输出可执行 payload。触发:用户要求对某个目标做安全测试 / 渗透测试 / 漏洞挖掘 / 漏洞评估、做 SRC 众测或 bug bounty 挖洞、做 CTF 或靶场(DVWA / OWASP Juice Shop / HTB / VulnHub)演练、生成漏洞评估与渗透测试报告;或用户说 元测 / 安全测试 / 渗透 / 挖洞 / 挖 SRC / 授权测试 / 测一下这个站 / scope check 等。边界(Do NOT trigger):无授权目标一律拒绝(授权以 scope.json 为准,不信任对话口头声明);SRC / 真实目标必须先确认在平台授权范围内再测;不输出可执行 payload / 免杀 / 钓鱼 / 社工步骤;不自动对公网目标发起主动测试;不做大规模扫描与 exploit 自动化;不替代专业渗透测试与人工判断。