말투
좋은 문장도 다른 사람처럼 들릴 수 있습니다
매끄러운 답변이 캐릭터의 어휘, 경계, 감정 온도를 잃을 수 있습니다. 문단의 완성도보다 필요한 말투 표지를 확인하세요.
롤플레이 실전 가이드 / KIMI K3
Kimi K3는 생생한 대화를 쓸 수 있지만 롤플레이 품질은 문장력만으로 결정되지 않습니다. 커뮤니티에서는 과도한 사고, 반복, 느린 턴, 장면 대신 요약하는 답변, 긴 대화에서 지시가 흐려지는 문제가 언급됩니다. 짧은 테스트와 계층별 해결 경로를 정리했습니다.
공식 사실과 커뮤니티 경험을 구분했습니다. jailbreak, 안전 우회, 만능 프리셋은 제공하지 않습니다.

RP에서 볼 점
Kimi K3 API Quickstart는 1M 토큰 컨텍스트와 항상 켜진 thinking을 확인합니다. Reddit에서는 대화와 소설풍 문체를 칭찬하는 의견과 지시 이탈, 긴 추론, 공급자 차이를 말하는 의견이 함께 보입니다. 어느 하나만으로 다음 턴을 보장할 수 없습니다.
말투
매끄러운 답변이 캐릭터의 어휘, 경계, 감정 온도를 잃을 수 있습니다. 문단의 완성도보다 필요한 말투 표지를 확인하세요.
기억
큰 창은 공간을 주지만 카드, 요약, 최근 턴, 공급자 처리도 주의를 나눕니다. 여러 턴 뒤에 사실을 테스트하세요.
템포
K3는 항상 생각합니다. 높은 effort는 깊이와 지연, 긴 서문을 만들 수 있고 낮은 effort는 장면을 빠르게 할 수 있습니다. 같은 시드로 비교하세요.
10분 기준선
캐릭터 카드 하나, 장면 시드 하나, 새 채팅을 사용하세요. 아래 세 테스트를 실행하고 실패한 테스트만 반복합니다. 점수는 판단 도구이지 benchmark가 아닙니다.
각 테스트를 0–2점으로 채점하세요: 0 = 실패, 1 = 혼합, 2 = 안정적. 같은 테스트가 두 번 실패했을 때만 변수 하나를 바꿉니다.
대화, 공급자, 모델 alias, 출력 길이, reasoning effort를 점수와 함께 저장하면 비교를 재현할 수 있습니다.
160–220단어를 요청하세요. 카드에 말투 표지 5개와 금지 습관 1개를 적고 사용자 턴에서 다시 말하지 않습니다.
↳ 표지의 등장 수, 금지 습관, 불필요한 메타 발언을 기록합니다.
8–12턴 뒤 카드를 다시 붙이지 않고 정해진 사실 두 개와 미해결 줄거리 하나를 물어보세요.
↳ 각 사실을 정확, 창작, 누락으로 기록하고 답이 요약이 되는지 봅니다.
조용한 순간, 사용자 행동, 열린 결말을 번갈아 둡니다. 캐릭터는 장면을 진행하되 사용자의 행동을 결정하지 않습니다.
↳ 템포, 주도성, 반복, 계속할 수 있는 결말을 기록합니다.
증상 → 계층 → 다음 테스트
카드는 429를 고칠 수 없고 reasoning을 낮춰도 기록에 없는 사실을 되돌릴 수 없습니다. 이 표로 원인을 분리하세요.
Thinking / prompt / 기록
새 채팅에서 시작하고 지시를 줄이며 장면 길이를 지정하세요. 공급자가 지원하면 `reasoning_effort=low`와 비교합니다.
카드 / 최근 컨텍스트
말투 앵커 3개를 활성 지시 가까이 옮기고 충돌하는 예시를 제거한 뒤 10턴에서 재시험합니다.
주도권 계약
캐릭터와 환경만 묘사하고 플레이 가능한 시작점에서 끝내라는 경계를 추가하세요. sampler는 같이 바꾸지 않습니다.
Reasoning / 예산 / 공급자
같은 시드에서 low와 max를 비교하고 첫 토큰 대기와 길이를 기록하세요. X의 속도 경험은 SLA가 아닙니다.
공급자 호환성
Partial Mode를 끄고 기준선을 실행한 다음 공급자가 K3 Partial Mode를 지원하는지 확인하세요.
정책 / prompt
안전장치를 우회하지 마세요. 규칙 안에서 장면을 바꾸고 분위기와 준수를 따로 평가하세요.
공식 K3 API는 `reasoning_effort=low|high|max`를 제공하고 일부 생성 필드를 고정합니다. 일반 프리셋이 아니라 현재 공급자의 계약을 따르세요.
브라우저 컨텍스트 경로
롤플레이가 위키, 조사 페이지, 글쓰기 brief에 기반한다면 Tabbit에서 자료를 보며 Kimi-K3에 질문할 수 있습니다. SillyTavern의 카드, lorebook, 확장 기능을 대체하는 기능은 아닙니다.
캐릭터 카드, lore, 장면 개요를 탭에 남겨 두세요. 브라우저가 참고 화면이 됩니다.
✓ 대화 중에도 자료가 보입니다.

새 탭 또는 Chat의 현재 모델 선택기를 사용하세요. 접근 가능 여부는 실제 목록, 에디션, 요금제가 기준입니다.
✓ 기록한 테스트와 같은 모델입니다.

Chat으로 집중 질문을 하거나 멀티 모델 화면에서 말투와 템포를 비교하세요. 카드와 기록을 평가 자료로 보관합니다.
✓ 어떤 모델과 컨텍스트가 결과를 만들었는지 설명할 수 있습니다.

맞는 작업 화면 고르기
기능의 경계를 분명히 하면 빠진 기능을 모델 오류로 오해하지 않습니다.
| SillyTavern | Tabbit | |
|---|---|---|
| 캐릭터 카드와 lorebook | 이를 위한 제어와 확장 생태계 | 보이는 페이지나 파일을 컨텍스트로 사용 |
| 공급자와 프리셋 | Endpoint, sampler, 템플릿, 기록 제어 | 실시간 모델 선택과 브라우저 채팅 |
| 일관성 테스트 | 반복 가능한 카드 기반 RP에 적합 | 자료 옆에서 응답 비교에 적합 |
| 멀티 모델 비교 | 설정과 확장에 따라 다름 | 빠른 나란히 비교 화면 |
KIMI K3 롤플레이 FAQ
대화와 긴 prose를 원한다면 시험할 가치가 있지만 보편적 결론은 없습니다. 좋은 글이라는 경험과 과도한 사고, 이탈, 지연, 반복이 모두 보고됩니다. 자신의 카드로 세 테스트를 실행하세요.
아니요. 용량을 제공할 뿐 완벽한 검색을 보장하지 않습니다. 카드, 최근 턴, 요약, 공급자 직렬화와 출력 예산이 주의를 좌우합니다.
K3는 thinking이 항상 켜져 있습니다. 공식 API는 low, high, max `reasoning_effort`를 제공합니다. 같은 시드에서 템포와 품질을 비교하세요.
새 채팅을 열고 지시를 짧게 하며 중복을 제거하고 장면 길이를 지정하세요. 가능하면 낮은 effort도 테스트하되 한 번에 한 계층만 바꾸세요.
기준선에는 필요하지 않습니다. Partial Mode는 assistant 접두사를 이어 쓸 수 있지만 공급자 호환성이 다릅니다. 깨끗한 실행 뒤 변화로 기록하고 추가하세요.
Tabbit은 브라우저 컨텍스트 채팅이며 SillyTavern 카드, lorebook, 확장을 가져온다고 약속하지 않습니다. 해당 기능은 SillyTavern에 두고 페이지나 파일이 컨텍스트일 때 Tabbit을 사용하세요.
카드 하나, 테스트 세 개, 한 번에 한 가지 변경으로 확인하세요. 컨텍스트가 페이지나 파일에 있다면 Tabbit을 열고 옆에서 Kimi-K3를 사용해 보세요.
macOS와 Windows에서 사용할 수 있습니다. 모델 접근과 quota는 에디션과 요금제에 따라 다릅니다.