한국어 AI 티를 줄이는 사용 매뉴얼
korean-humanizer는 한국어 AI 생성 텍스트의 번역체, 과한 격식, 반복 연결어, 빈말, 톤 불일치를 줄이는 Codex/Claude Code skill 및 범용 system prompt입니다. 핵심 원칙은 간단합니다. 의미는 그대로 두고 표현만 고칩니다.
개요
이 도구는 글을 새로 쓰는 생성기가 아니라, 이미 있는 한국어 텍스트를 공개 가능한 수준으로 다듬는 편집 레이어입니다. 사실, 숫자, 고유명사, 인용문, 링크는 그대로 둡니다.
- 12 카테고리 / 100개 이상의 한국어 AI 티 패턴을 도메인별로 적용합니다.
- 블로그, 마케팅, 이메일, LinkedIn, YouTube, 뉴스레터, 위키, 학술, 뉴스, 채팅, 리뷰, B2B 메시지를 지원합니다.
- 사용자가 "짧게"를 요청하지 않으면 원문 대비 90% 미만으로 줄이지 않습니다.
- 전체 문장 수의 20% 이상 수정하지 않고, 한 문단에서는 3곳 이하만 손댑니다.
설치와 빠른 시작
Codex에서는 install script로 현재 repo를 active skills 디렉터리에 링크합니다. 다른 LLM에서는 PROMPT.short.md 또는 PROMPT.md를 system prompt로 붙여 넣으면 됩니다.
# Codex
git clone https://github.com/dotoricode/korean-humanizer.git
cd korean-humanizer
bash scripts/install-codex-skill.sh
# 빠른 사용 예
이거 AI 티 빼줘:
[한국어 텍스트]
- 설치 동작을 바꾼 뒤에는
bash scripts/check-codex-skill.sh로 링크 상태를 확인합니다. - 수동으로
~/.codex/skills에 복사하지 않습니다. 이 repo는 install script를 기준으로 관리합니다.
기본 작업 흐름
작업은 입력 확인, 도메인 확인, 보존 영역 표시, 카탈로그 적용, 과교정 검토 순서로 진행합니다. 짧은 글일수록 더 적게 고치고, 긴 글은 문단별로 high-confidence 패턴만 손댑니다.
| 단계 | 하는 일 | 주의 |
|---|---|---|
| 입력 확인 | 한국어 여부와 요청 목적 확인 | 영어, 법률, 코드 문서는 기본 제외 |
| 도메인 확인 | 이메일, 블로그, YouTube 등 분류 | raw 종결어미를 우선 보존 |
| 보존 영역 | 팩트, 숫자, 링크, 인용문 표시 | 절대 바꾸지 않음 |
| 패턴 적용 | 12 카테고리와 advanced pass 적용 | 삭제보다 약화/치환 우선 |
| 최종 검토 | 20% cap, 문단 3곳, 90% 길이 확인 | 초과하면 작은 변경부터 되돌림 |
작업 모드
기본은 rewrite입니다. 사용자가 직접 판단하고 싶거나 원문을 바로 고치기 위험한 상황에서는 detect 또는 audit 모드가 더 적합합니다.
| 모드 | 출력 | 사용 상황 |
|---|---|---|
| rewrite | 다듬어진 전체 텍스트 | 일반 humanize 요청 |
| detect | AI 티 후보와 이유 | 게시된 글, 타인의 글, 인용문 많은 글 |
| audit | 줄별 문제와 개선안 | 사용자가 직접 고치고 싶을 때 |
| edit-plan | 파일 수정 계획 | 긴 문서나 여러 파일 대상 |
도메인과 톤
같은 표현도 도메인마다 다르게 봅니다. 학술/뉴스/이메일은 필요한 격식을 보존하고, 채팅/리뷰/YouTube는 말투와 감정 강도를 과하게 정리하지 않습니다.
- 발화체 도메인에서는 raw가
~해요체나~합니다체라면~다체글말체로 바꾸지 않습니다. - 이메일의 인사, 감사, CTA는 장식이 아니라 기능이면 보존합니다.
- 학술/뉴스의 정형 표현은 AI 티가 아니라 장르 관습일 수 있습니다.
- 마케팅/LinkedIn은 hook이 중요하지만, 본문이 약속하지 않는 자극적인 첫 문장은 만들지 않습니다.
Advanced Passes
기본 12 카테고리 위에 선택적으로 얹는 보수적 점검입니다. 외부 writing skill의 장점을 흡수했지만, korean-humanizer에서는 새 글 생성이 아니라 최소 수정 필터로만 작동합니다.
| Pass | 잡는 문제 | 제한 |
|---|---|---|
| Voice DNA | 사용자의 문장 습관과 멀어짐 | 사용자가 준 샘플 안에서만 적용 |
| Hook / 첫 문장 | 주제가 늦게 나오거나 opener가 흐림 | 첫 1-2문장만, 클릭베이트 금지 |
| Story / 흐름 | 그리고/또한/그다음 나열 | 원문 안의 관계만 드러냄 |
| Dumbify | 긴 중첩절, 어려운 한자어, 추상 명사 | 생각을 단순화하지 않음 |
| Anti-AI final | hollow contrast, 과장, generic authority | 없는 숫자/사건/경험 생성 금지 |
Personal List
금지어, 선호어, 유지어는 카탈로그보다 먼저 적용됩니다. 매번 같은 취향이 있으면 인라인으로 넘기거나 examples/personal-list.md에 정리합니다.
금지=활용, 매우, 다양한;
선호=유용하다→쓸만하다, 사실상→실제로;
유지=딥다이브
[다듬을 텍스트]
preserve또는 유지어는 자동 치환보다 강합니다.- 선호어는 단방향 매핑입니다.
A→B가 보이면 A를 B로 바꿉니다. - 자연어로 "활용은 쓰기로 바꿔줘"라고 말해도 같은 세션 안에서 적용합니다.
Brand Voice
팀이나 제품 톤을 반복해서 써야 하면 brand voice profile을 사용합니다. frontmatter의 preserve, ban, prefer와 본문 톤 가이드가 카탈로그보다 먼저 적용됩니다.
/korean-humanizer brand=examples/brand-voice-toss-style.md
[다듬을 텍스트]
| 필드 | 역할 |
|---|---|
| domain_default | 도메인 미지정 시 기본 도메인 |
| ending_default | 기본 종결어미. raw와 충돌하면 도메인 규칙 확인 |
| emoji_policy | none, sparse, liberal |
| length_bias | concise, neutral, verbose |
| preserve / ban / prefer | 보존, 금지, 선호 치환 |
Voice DNA
Voice DNA는 특정 개인의 실제 글 샘플에서 문장 길이, 호흡, 시작/전환/마무리 습관, anti-voice를 추출하는 세션 범위 profile입니다. 내용을 요약하지 않고 "어떻게 쓰는지"만 봅니다.
- 최근 글 10-20개, 영상 transcript, 뉴스레터 원문이 좋은 입력입니다.
- 샘플에 없는 표현을 추천하지 않습니다.
- 원문에 없는 사실, 경험, 수치, 감정은 voice를 맞추기 위해서도 만들지 않습니다.
- 템플릿은
examples/voice-dna-template.md, 추출 가이드는examples/voice-dna-extraction.md에 있습니다.
평가와 회귀 확인
eval harness는 humanized 결과가 정량 규칙을 지키는지 확인합니다. 현재 기본 지표는 수정 비율, 문단 cap, 길이 비율, 발화체 다체 침입, brand preserve 보존입니다.
bash scripts/check-codex-skill.sh
bash scripts/eval-harness.sh
bash scripts/lint-patterns.sh
bash scripts/lint-cross-file.sh
bash scripts/lint-examples.sh
git diff --check
eval/scorecard.md는 자동 생성됩니다.- 일반 품질 fixture에는 expected failure를 붙이지 않는 것이 원칙입니다.
- M6-M9 후보는 첫 문장 delay, AI tell residue, voice DNA coverage, reading load입니다.
안전 규칙
korean-humanizer는 탐지 회피나 사칭 도구가 아닙니다. 공개 글을 자연스럽게 다듬는 편집 보조 도구이며, 신뢰를 깨는 사용을 지원하지 않습니다.
- 타인의 voice를 무단으로 모방하거나 사칭하지 않습니다.
- 없는 경험담, 성과 수치, 출처, 인용을 만들지 않습니다.
- 법률, 의료, 보안, 재무 텍스트는 비격식 변환이나 생략을 기본 금지합니다.
- AI 탐지 우회를 목적으로 한 사용을 권장하지 않습니다.
파일 지도
사용 목적에 따라 봐야 할 파일이 다릅니다. 사용자는 prompt와 examples를, maintainer는 references, eval, scripts를 함께 봅니다.
| 파일 | 역할 |
|---|---|
| SKILL.md | Codex / Claude Code skill 동작 정의 |
| PROMPT.md | ChatGPT, Cursor, Gemini 등에 넣는 전체 system prompt |
| PROMPT.short.md | 빠른 사용용 짧은 prompt |
| references/ko-ai-signals.md | 12 카테고리와 advanced pass 레퍼런스 |
| examples/ | before/after, brand voice, voice DNA 사례 |
| eval/ | fixture, scorecard, 회귀 평가 문서 |