fix(ai-moderation): remove indonesianTextNormalizer to stop hallucinated slang flags

The rule-based badword detector was injecting [normalized_text] and
[normalization_notes] tags into the LLM prompt that caused false
positive hallucinations - the LLM started associating innocent words
('sapik', 'furina') with furry/sexual_deviation due to misleading
context injected by the normalizer.

Removed:
- indonesianTextNormalizer.ts (full file deletion)
- formatModerationTextEvidenceForPrompt import/usage in llmModerationClient
- formatModerationTextEvidenceForPrompt import/usage in conversationContext
- stale re-exports in index.ts

Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
This commit is contained in:
MythEclipse
2026-06-06 13:27:24 +07:00
co-authored by Claude Opus 4.8
parent cfe7230a55
commit e6e44b30c7
4 changed files with 4 additions and 457 deletions
@@ -1,8 +1,3 @@
export { startPendingAIAnalysisWorker } from "./aiAnalyzer.js";
export {
buildModerationTextEvidence,
detectIndonesianBadwords,
normalizeDiscordCustomEmoji,
} from "./indonesianTextNormalizer.js";
export { runModerationAnalysis } from "./llmModerationClient.js";
export { buildSystemPrompt } from "./moderationPrompt.js";