AI 환각을 11유형으로 분류하고 탐지율 100%(테스트셋 기준)을 달성합니다. GPT-5.4 5.5%, Claude Opus 10.9% 대비 압도적 정밀도. dPq 7-in-1의 핵심 모듈입니다.
| 모델 | 탐지율 | 정밀도 | 재현율 | F1 |
|---|---|---|---|---|
| dPq 환각 탐지 | 100% | 100% | 100% | 1.000 |
| GPT-5.4 | 5.5% | — | — | 낮음 |
| Claude Opus 4.5 | 10.9% | — | — | 낮음 |
빅테크 모델은 환각을 스스로 잡지 못합니다. dPq가 잡습니다.
| 실제 환각 | 실제 정상 | |
|---|---|---|
| 탐지: 환각 | TP = 25 | FP = 0 |
| 탐지: 정상 | FN = 0 | TN = 25 |
테스트셋: 환각 25건 + 정상 25건 = 50건. 오탐 0, 미탐 0.
| # | 유형 | 설명 |
|---|---|---|
| 1 | 거짓 합의 | 출처 없이 동의하는 척 |
| 2 | 장식 부연 | 핵심을 감추는 부연 설명 |
| 3 | 자의적 분류 | 근거 없는 범주 할당 |
| 4 | 권고 함정 | 전제를 숨기는 권고 |
| 5 | 메타 누수 | 메타 정보로 본문 추론 |
| 6 | 톤 오염 | 어조로 판단 유도 |
| 7 | 위험 누락 | 중요 위험을 빼먹음 |
| 8 | 이해관계 은폐 | 당사자 이익을 감춤 |
| 9 | 프레임 편향 | 관점을 고정시킴 |
| 10 | 선택 정보 | 일부만 제시 |
| 11 | 결론 유도 | 결론을 미리 정함 |