Heretic — 全自动移除 LLM 审查限制的开源工具(14.8k ⭐)
p-e-w/heretic 是一个全自动化的语言模型去审查工具,无需手动微调,自动检测并移除模型内置的内容过滤和拒绝机制,让模型更自由地回答问题。
LLM
去审查
开源
+2
0

AI 黑客攻破麦肯锡内部平台实录 — 2 小时拿下 4650 万条聊天记录
安全研究员用自主 AI Agent 发现 SQL 注入漏洞,2 小时内攻破麦肯锡内部 AI 平台 Lilli,获取 4650 万条对话、72.8 万份文件和 5.7 万员工账户,深刻揭示 AI 应用安全盲区。
AI安全
SQL注入
渗透测试
+3
2
Promptfoo — LLM 应用测试与红队攻防框架,本地运行不泄露提示词
开源 LLM 评测工具,系统化测试提示词、对比多模型表现、自动化红队安全扫描,支持 CI/CD 集成,评测数据本地运行不上传。
LLM测试
AI安全
红队
+3
0