GEMINI API × SILLYTAVERN

추측 없이 API 연결하기

Google AI Studio를 통해 SillyTavern에서 안정 버전 Gemini 2.5 Flash-Lite를 사용하세요. provider, 키, 정확한 모델 ID, 첫 요청, thinking과 정상 연결을 고장처럼 보이게 하는 오류를 확인합니다.

설정 과정 보기
주황색 마크, 채팅 입력창, 여러 탭이 보이는 Tabbit 데스크톱 화면.

모델 확인

프리셋보다 이름이 먼저입니다

Google은 Gemini 2.5 Flash-Lite를 안정적이고 빠른 멀티모달 모델로 안내합니다. 텍스트, 이미지, 동영상, 오디오와 PDF를 입력하고 텍스트를 출력합니다. 큰 컨텍스트 한도가 프로젝트 할당량이나 provider 검사를 없애지는 않습니다.

01

안정 ID

`gemini-2.5-flash-lite`를 사용하세요. Google은 `gemini-2.5-flash-lite-preview-09-2025`를 종료된 모델로 표시합니다. temperature를 바꿔도 종료된 ID는 고쳐지지 않습니다.

02

문서화된 한도

모델 페이지의 입력 한도는 1,048,576 tokens, 출력 한도는 65,536 tokens입니다. 실제 RPM, TPM, RPD는 Google 프로젝트와 사용 등급에 따라 달라집니다.

03

Thinking 지원

Google은 thinking, 함수 호출, 구조화된 출력, URL context, Search grounding, 코드 실행, 캐시와 파일 검색을 지원한다고 안내합니다. SillyTavern에 표시되는 옵션은 더 적을 수 있습니다.

04

실시간 상태 확인

무료와 유료 사용의 한도는 다릅니다. 긴 RP 세션 전에 AI Studio 사용량과 가격을 확인하세요. 무료가 무제한이라는 뜻은 아닙니다.

페이지 참조 또는 파일 업로드 입력창 옆에 열린 Tabbit 모델 선택기.

SILLYTAVERN 설정

먼저 짧은 요청 하나를 성공시키세요

SillyTavern 공식 가이드는 Google AI Studio를 Chat Completion에서 선택하도록 안내합니다. 첫 요청은 짧게 유지하세요. 텍스트가 반환된 뒤 캐릭터 형식, lore와 긴 컨텍스트를 하나씩 추가합니다.

  1. 01

    Google AI Studio 키 만들기

    Google AI Studio API keys를 열고 로그인한 뒤 Get API Key를 선택합니다. 약관에 동의하고 키를 만든 후 복사하세요. 비밀번호처럼 보관하고 캐릭터 카드나 공개 캡처에 넣지 마세요.

  2. 02

    맞는 provider 선택

    SillyTavern에서 API Connections를 열고 Chat Completion, Google AI Studio를 차례로 선택합니다. API Key에 붙여 넣고 Connect를 누르세요. Vertex AI는 다른 provider와 인증 방식입니다.

  3. 03

    안정 모델 선택

    반환된 목록에서 `gemini-2.5-flash-lite`를 선택합니다. 직접 입력할 때도 정확한 안정 ID를 쓰고 종료된 preview alias는 사용하지 마세요.

  4. 04

    간단한 테스트 보내기

    짧은 사용자 메시지와 작은 캐릭터 카드로 테스트합니다. 테스트 중 streaming 상태를 일정하게 유지하고 provider, 모델, 컨텍스트 크기와 응답 상태를 기록하세요.

  5. 05

    RP 설정은 마지막에

    일반 텍스트가 작동한 뒤 system instruction, 메시지 형식과 lore를 추가합니다. 응답에 템플릿 표시가 나오면 sampler보다 connector template을 먼저 확인하세요.

Google의 RPM, TPM, RPD 제한은 프로젝트 단위입니다. 같은 프로젝트의 새 키로 할당량이 늘지 않습니다.

요청 형태

API 계층의 역할을 구분하세요

Google 공식 REST 예제는 API key 헤더와 JSON을 사용합니다. SillyTavern은 provider 요청을 직접 만들므로 이 예제는 API 개념 확인용이며 UI 필드 목록이 아닙니다.

POST https://generativelanguage.googleapis.com/v1beta/interactions
Headers: x-goog-api-key: $GEMINI_API_KEY
         Content-Type: application/json
Body: {
  "model": "gemini-2.5-flash-lite",
  "input": "한 문장으로 짧게 답하세요."
}

Google 문서의 최소 REST 형태

System instruction

connector가 지원하면 system instruction을 사용자 턴과 분리하세요. Chat Completion 필드가 Google REST JSON과 정확히 일치한다고 가정하지 마세요.

Thinking과 출력

Google은 thinking 지원과 최대 65,536 출력 tokens를 안내합니다. 현재 SillyTavern connector가 문서화한 설정만 사용하세요.

Streaming

Google은 `stream: true`와 SSE를 통한 스트리밍을 문서화합니다. 빈 응답이면 streaming을 끈 짧은 테스트로 화면 또는 파싱 문제를 분리하세요.

문제 해결

프리셋을 바꾸기 전에 상태를 확인하세요

상태 코드, provider와 요청의 모델부터 확인합니다. 한 번에 하나만 바꾸고 키는 보호하세요.

신호먼저 확인다음 조치
400 INVALID_ARGUMENT모델 이름, JSON, 메시지 순서와 지원되지 않는 설정.최소 프롬프트로 돌아가 선택 설정 하나를 제거한 뒤 하나씩 되돌립니다.
401 UNAUTHENTICATED키, 헤더, 공백과 선택한 provider.AI Studio에서 키를 다시 복사하거나 만들고 Google AI Studio에 재연결합니다. Vertex 자격 증명을 섞지 마세요.
403 PERMISSION_DENIED프로젝트 권한, API 상태, 지역 또는 policy 응답.Google 프로젝트와 AI Studio 상태를 확인합니다. 보안 또는 접근 제어를 우회하지 마세요.
404 NOT_FOUND정확한 모델 ID와 provider endpoint.`gemini-2.5-flash-lite`를 사용하고 종료된 preview alias를 지운 뒤 목록을 새로 고칩니다.
429 RESOURCE_EXHAUSTEDAI Studio 프로젝트의 RPM, TPM, RPD와 결제 등급.기다리고 빈도, 컨텍스트, 출력을 줄인 뒤 현재 할당량을 확인합니다. 같은 프로젝트의 새 키로 해결되지 않을 수 있습니다.
200인데 비어 있음streaming parser, 종료 정보, 안전 피드백, 형식과 실제 텍스트 필드.streaming을 끈 짧은 프롬프트를 보내고 카드 변경 전에 콘솔과 응답 상세를 확인하세요.

TABBIT을 컨텍스트로

조사를 SillyTavern 옆에 두세요

Tabbit은 SillyTavern provider를 실행하지 않으며 Google AI Studio API 키도 받지 않습니다. 소스 페이지, 캐릭터 참고자료, 캡처, PDF와 브라우저 작업에 적합합니다.

  1. 1

    참고 페이지 열기

    canon wiki, 문서 또는 설정 노트를 보이는 탭에 둡니다. Tabbit은 사이드 패널에서 페이지를 요약할 수 있습니다.

  2. 2

    @로 컨텍스트 참조

    요약이나 연속성 확인이 필요하면 @로 열린 페이지, 캡처 또는 로컬 파일을 참조하세요. 모든 문단을 붙여 넣을 필요가 없습니다.

  3. 3

    실시간 선택기 확인

    현재 국제판 프로덕션 스냅샷에는 `gemini-2.5-flash-lite`가 표시되고 활성화되어 있습니다. 계정, edition, 할당량과 향후 배포는 다를 수 있으니 실시간 picker를 사용하세요. Tabbit은 SillyTavern 연결이 아닙니다.

Tabbit Agent 모드가 Google Sheets를 조작하며 지시와 실행 패널을 표시하는 화면.

서로 다른 두 작업

API 제어는 SillyTavern에 남기세요

SillyTavern은 캐릭터 카드와 provider 요청을 관리합니다. Tabbit은 브라우저 컨텍스트와 브라우저 내 도우미를 관리합니다. 경계를 지키면 없는 키 입력창을 잘못된 단계로 만들지 않습니다.

여러 모델 열과 공유 프롬프트 영역을 보여 주는 Tabbit 멀티 모델 화면.
필요한 것SillyTavern + Google AI StudioTabbit
Gemini API 키AI Studio에서 만들고 Google AI Studio provider에 붙여 넣습니다.이 연결용 키 입력창이 없습니다.
안정 모델 ID실시간 목록에서 `gemini-2.5-flash-lite`를 선택합니다.Tabbit이 실제로 표시하는 모델을 사용합니다.
캐릭터 카드와 loreRP 제어, 템플릿과 컨텍스트 설정을 사용합니다.탭의 wiki, 노트 또는 파일을 참조합니다.
웹 조사ST 워크플로로 컨텍스트를 추가합니다.@로 페이지, 캡처와 파일을 참조합니다.
Agent 작업SillyTavern 설정에 따라 다릅니다.지원되는 웹 작업에 브라우저 Agent를 사용합니다.

FAQ

첫 연결이 막힐 때 보는 짧은 답변

어떤 모델 ID를 입력하나요?+

`gemini-2.5-flash-lite`를 사용합니다. `gemini-2.5-flash-lite-preview-09-2025`는 종료되었습니다.

어떤 provider를 선택하나요?+

API Connections에서 Chat Completion, Google AI Studio를 선택하고 AI Studio 키를 붙여 넣어 연결합니다. Vertex AI는 별도 provider입니다.

OpenAI 호환 endpoint를 써도 되나요?+

Google이 호환 가이드를 제공하지만 SillyTavern provider 동작은 다를 수 있습니다. 먼저 공식 문서가 있는 Google AI Studio provider를 쓰고 현재 문서와 connector가 지원할 때만 호환 경로를 사용하세요.

몇 메시지만 보냈는데 왜 429인가요?+

Google의 RPM, TPM, RPD 제한은 프로젝트 기준입니다. AI Studio 사용량과 등급을 확인한 후 기다리거나 빈도, 컨텍스트와 출력을 줄이세요.

왜 응답이 비어 있나요?+

streaming을 끈 짧은 프롬프트를 테스트하고 콘솔, 종료 정보, 안전 피드백과 connector 형식을 확인하세요. 먼저 캐릭터 카드를 바꾸지 마세요.

100만 token 한도면 긴 RP 채팅을 보낼 수 있나요?+

Google은 입력 1,048,576 tokens와 출력 65,536 tokens를 문서화합니다. 이는 상한이며 오래된 모든 세부사항을 동일하게 불러온다는 보장은 아닙니다.

SillyTavern에서 thinking을 켤 수 있나요?+

Google은 thinking을 지원한다고 안내합니다. 현재 connector가 노출하는 제어는 다를 수 있습니다. 문서화되지 않은 필드는 provider 기본값을 유지하세요.

Tabbit에서 SillyTavern provider를 사용할 수 있나요?+

아니요. Tabbit은 SillyTavern provider나 Google AI Studio 키를 받지 않습니다. 이 연결은 SillyTavern에 두세요.

각 작업을 맞는 도구에 맡기세요

Gemini 2.5 Flash-Lite는 SillyTavern에서 연결하세요. 대화에 웹 페이지, 파일 또는 브라우저 작업이 필요할 때 Tabbit을 사용하세요.

macOS와 Windows에서 사용 가능합니다. Tabbit 모델 및 provider 지원은 바뀔 수 있습니다.

© 2026 Tabbit Browser. 당신의 맥락을 이해하는 AI 네이티브 브라우저.