Prompt Injection 防御源码拆解:Hermes 如何用 36 条正则 + 三级作用域对抗 AI Agent 攻击
安全专题第一篇:从 Brainworm 到 C2 持久化,拆解
threat_patterns.py的完整攻击模型
TL;DR
2026 年,AI Agent 面临的最大安全威胁不是 SQ...
吾有三剑,唯子所择。一曰含光,视之不可见,运之不知有。其所触也,泯然无际,经物而物不觉。
作者
安全专题第一篇:从 Brainworm 到 C2 持久化,拆解
threat_patterns.py的完整攻击模型
2026 年,AI Agent 面临的最大安全威胁不是 SQ...
2026 年 6 月,PyTorch 官方发布了一篇 devlog:《When does fragmentation occur in the CUDA caching allocator?》...
"EngineCore encountered an issue. See stack trace (above) for the root cause."——你在 vLLM 的日志里看到这句...
前四篇拆解了四个框架的源码和架构,这篇把它们放在一起,帮你 30 秒做出选型决策。
如果你只想看一句话结论:
- 个人开发者写代码 → Claude Code(最简洁,@agen...
四框架对照:IDE Agent(Cursor/Windsurf)vs CLI Agent(Claude Code/Codex)vs 自主 Agent(Hermes)
Cursor...
Qwen3 是阿里巴巴 2025 年发布的最新大模型系列,从 0.6B 到 235B MoE 全覆盖。但它在 vLLM 和 SGLang 上的崩溃方式跟 Llama/DeepSeek 完全不同...
装上 Ollama 能跑模型之后,99% 的人下一步就是装 Open WebUI——一个 ChatGPT 风格的本地聊天界面。然后第一个画面往往是红字:「Server Connection E...
Ollama 是大多数人第一个接触的本地大模型工具。但它的问题也是最多的——不是因为它质量差,而是因为它被用在太多奇奇怪怪的硬件组合上了。
Dify 是中国最火的自部署 AI 应用平台,vLLM 是生产级推理引擎。但把它们连起来——插件 404、SDK 版本冲突、模型直接炸引擎——这些坑比想象中多得多。
三角对照:Claude Code 子进程模型 → Codex 多宿主架构 → Hermes 单循环
Codex CLI 是 OpenAI 的编程 Agent CLI。它经历了一次...