Qwen3.8-27B · SillyTavern 실전 가이드

SillyTavern에서 Qwen3.8-27B 사용하기

이 이름은 실제 모델을 가리키지만 다른 모델과 섞이기 쉽습니다. Qwen은 Qwen3.8-27B라는 공식 dense 비전 언어 체크포인트를 공개했습니다. Qwen3.8-Max는 총 2.4T, 활성 95B인 별도 구성원입니다. 먼저 실제 체크포인트와 공급자를 확인하세요.

모델 정체 확인

상위 문서의 사실과 커뮤니티 경험을 분리합니다. 특정 공급자, 양자화 파일 또는 모든 Tabbit 계정의 접근을 보장하지 않습니다.

모델 선택기와 @ 참조 입력란을 보여주는 Tabbit 새 탭

이름 확인

27B는 2.4T 모델이 아니다

검색 결과에는 여러 라벨이 함께 보입니다. 서로 다른 산출물이므로 이름만 복사하면 로컬 설정이 잘못된 경로로 갈 수 있습니다.

01

공식 dense 체크포인트

Qwen 모델 카드는 Qwen/Qwen3.8-27B입니다. 27B 파라미터, 비전 인코더, Apache-2.0 라이선스와 기본 262,144 토큰 컨텍스트를 기재합니다.

02

Qwen3.8-Max 제품군

Qwen 발표와 오픈 웨이트 이름은 Qwen3.8-Max를 총 2.4T, 활성 95B로 설명합니다. 오픈 웨이트는 Qwen3.8-2.4T-A95B이며 27B 별칭이 아닙니다.

03

커뮤니티 파일

GGUF, FP8, GPTQ와 RP 파인튜닝에는 제작자 이름이나 접미사가 붙습니다. 각 저장소를 별도 산출물로 보고 형식과 템플릿을 읽으세요.

04

호스팅 ID

SillyTavern에는 공급자가 노출한 정확한 모델 ID가 필요합니다. 표시 이름만으로 Qwen3.8-27B라고 판단할 수 없습니다.

모델 카드

공식 27B 페이지에 적힌 내용

아래 사실은 실행 환경을 고르는 데 쓰세요. 모든 양자화 파일의 메모리 사용량을 뜻하지는 않습니다.

27B 파라미터

dense 언어 모델은 27B 파라미터입니다. safetensors 크기 표시에 28B라는 라벨도 있으므로 다운로드 표시를 새 모델명으로 바꾸지 마세요.

이미지와 영상

image-text-to-text로 표시되고 이미지와 영상 이해가 설명됩니다. 백엔드에는 맞는 프로세서와 멀티모달 지원이 필요합니다.

262K 컨텍스트

기본 컨텍스트는 262,144 토큰이며 카드에는 1M 확장도 설명됩니다. 긴 컨텍스트를 어떤 GPU에서나 사용할 수 있다는 뜻은 아닙니다.

서빙 선택지

Transformers, vLLM, SGLang, TokenSpeed와 Docker 예제가 있습니다. 이 아키텍처를 명시적으로 지원하는 현재 버전을 고르세요.

모델 문서를 확인하는 Google 검색과 실행 단계를 보여주는 Tabbit Deep Research

SillyTavern 설정

엔드포인트부터 안쪽으로 확인하기

캐릭터 카드는 잘못된 경로나 중복 템플릿을 고치지 못합니다. 호스팅 API와 로컬 서버 모두 이 순서를 사용하세요.

공급자 라벨, 커뮤니티 프리셋과 양자화 저장소는 상위 모델 카드의 일부가 아닙니다. 각 주장을 출처에 붙여 두세요.

  1. 1. 산출물 이름 확정

    저장소 이름 또는 공급자 ID를 그대로 복사합니다. Qwen/Qwen3.8-27B, 양자화 파생물, Qwen3.8-2.4T-A95B를 구분하세요.

  2. 2. 백엔드 확인

    Transformers, vLLM, SGLang, llama.cpp 또는 사용하는 앱이 체크포인트와 비전 경로를 지원하는지 확인합니다. GGUF는 모든 멀티모달 기능을 제공하지 않을 수 있습니다.

  3. 3. SillyTavern 연결

    OpenAI 호환 서버라면 Chat Completions를 선택하고 문서의 Base URL과 서버가 반환하는 model ID를 입력합니다. 키를 카드에 넣지 마세요.

  4. 4. 템플릿은 한 곳에서

    호스팅 경로가 직렬화하도록 두거나 로컬 tokenizer 문서를 사용합니다. 둘 다 적용하면 역할과 태그가 깨질 수 있습니다.

  5. 5. 사고 모드 비교

    공급자가 제공한다면 같은 카드로 비활성화 또는 low, medium, xhigh를 비교합니다. 스타일 프리셋을 바꾸기 전에 지연을 기록하세요.

빠른 진단

먼저 흔한 고장을 고치기

카드와 첫 메시지를 고정하고 한 번에 하나만 바꾸세요. 각 응답의 model ID를 기록합니다.

증상먼저 확인작은 수정
모델 없음 또는 조용한 fallback공급자 목록과 응답 model노출된 ID를 복사하고 추측한 별칭을 지웁니다.
역할, 태그, 형식이 깨짐템플릿을 담당하는 위치템플릿 경로 하나만 남기고 새 채팅으로 테스트합니다.
VRAM 부족형식, 컨텍스트와 이미지 입력작은 양자화, 짧은 컨텍스트, 텍스트 기준선을 시도합니다.
생각은 긴데 장면이 진행되지 않음사고 모드, 출력 한도, 프리셋 길이같은 카드에서 low 또는 medium과 xhigh를 비교합니다.
공급자마다 문체가 다름필터, 샘플러와 시스템 프롬프트경로를 변수로 기록하고 모델의 사실로 부르지 않습니다.

RP 테스트 카드

짧은 계약만 전달하기

문제 해결 중에는 짧은 테스트 프롬프트를 사용하면 템플릿, 사고와 공급자 차이가 보입니다.

Role: 당신은 [캐릭터]입니다.
Scene: [장소, 관계, 현재 갈등].
Style: [시점, 언어, 문장 길이].
Direction: 관찰 가능한 행동 하나를 진행합니다. 사용자를 대신해 말하지 않습니다.
Continuity: 확인된 사실만 사용하고 모르면 질문합니다.
Format: 행동 먼저, 대화 다음. 250에서 450단어. 요약하지 않습니다.
Check: 이전 턴의 말투, 경계와 미해결 단서를 유지합니다.

같은 카드를 세 번 보냅니다. 지연, 불필요한 태그, 형식과 장면 변화를 비교한 뒤 온도나 프리셋을 바꾸세요.

브라우저 경로

모델 문서와 설정 자료를 한 공간에 두기

카드와 lorebook은 SillyTavern이 전문입니다. Tabbit은 모델 카드를 읽고 공급자를 비교하며 참고 자료를 곁에 두는 작업을 돕습니다.

  1. 1

    자료 열기

    Hugging Face 카드, 공급자 문서 또는 캐릭터 위키를 탭에 남겨 둡니다.

  2. 2

    실제 선택기 확인

    Tabbit 모델 선택기를 열고 버전과 계정에 정확한 Qwen3.8-27B가 표시될 때만 선택합니다. 선택기가 사용 가능 여부의 기준입니다.

  3. 3

    @로 참조

    @로 페이지, 스크린샷 또는 파일을 질문에 넣습니다. 다른 모델에 템플릿 조건과 양자화 주석을 비교하게 할 수 있습니다.

  4. 4

    응답 비교

    멀티모델 채팅으로 같은 자료를 여러 관점에서 읽습니다. 이미지는 브라우저 흐름을 보여줄 뿐, 모두에게 같은 모델 접근을 약속하지 않습니다.

참고 글과 AI 메모를 함께 보여주는 Tabbit 페이지 요약 사이드바

브라우저 경로

응답 비교

참고 글과 AI 메모를 함께 보여주는 Tabbit 페이지 요약 사이드바모델 문서를 확인하는 Google 검색과 실행 단계를 보여주는 Tabbit Deep Research

작업 화면 선택

SillyTavern과 Tabbit 비교

RP 작업 흐름에서 맡는 부분이 다릅니다. 세밀한 제어는 전문 도구에 두고 자료가 병목이면 브라우저를 사용하세요.

필요SillyTavernTabbit
캐릭터 카드와 lorebookRP 전용 제어페이지와 파일 참조
프리셋과 프롬프트 순서세밀한 제어시스템 프롬프트와 Skills
문서를 보며 RP확장 또는 복사 붙여넣기열린 탭을 컨텍스트로 사용
응답 비교공급자 설정 또는 확장브라우저 멀티모델 채팅
첫 단계ID, 백엔드, 템플릿 확인자료를 열고 선택기 확인

FAQ

Qwen3.8-27B SillyTavern 질문

Qwen3.8-27B는 공식 모델인가요?+

네. Qwen/Qwen3.8-27B에는 공식 Hugging Face 모델 카드가 있으며 27B dense 비전 언어 체크포인트입니다. Qwen3.8-Max와 Qwen3.8-2.4T-A95B는 별도입니다.

27B가 Qwen3.8-Max와 같은 모델인가요?+

아닙니다. Qwen3.8-Max는 총 2.4T, 활성 95B로 설명됩니다. 27B를 테스트할 때 Max ID나 2.4T 양자화를 사용하지 마세요.

어떤 양자화를 받아야 하나요?+

GPU, RAM, 컨텍스트와 백엔드에 따라 다릅니다. 형식과 loader 지원을 명시한 저장소에서 시작하고 GGUF, FP8, GPTQ와 파인튜닝을 별도 산출물로 보세요.

SillyTavern 채팅 템플릿은 무엇인가요?+

호스팅 공급자는 보통 메시지를 직렬화합니다. 로컬 서버는 tokenizer 또는 체크포인트 문서를 따릅니다. 두 번 적용하지 마세요.

RP가 느리거나 너무 짧은 이유는?+

사고 모드, 출력 한도, 컨텍스트, 샘플러와 경로를 따로 확인하세요. 같은 카드로 경로를 기록한 뒤 프롬프트를 바꾸세요.

Tabbit에서 Qwen3.8-27B를 실행할 수 있나요?+

Tabbit 모델 선택기에 정확한 모델이 보일 때만 선택하세요. 사용 가능 여부는 에디션, 지역, 계정과 배포 상태에 따라 달라집니다.

참고 자료를 열어 두기

macOS 또는 Windows용 Tabbit을 받고 모델 선택기를 확인한 뒤 모델 카드나 캐릭터 위키를 같은 브라우저 대화로 가져오세요.

모델 접근과 공급자 조건은 에디션과 배포 상태에 따라 달라집니다.

© 2026 Tabbit Browser. 당신의 맥락을 이해하는 AI 네이티브 브라우저.