정확한 ID 사용
gemini-2.5-flash-lite를 입력하세요. gemini-2.5-flash-lite-preview-09-2025 preview ID는 종료되었습니다.
GEMINI 2.5 FLASH-LITE × SILLYTAVERN
SillyTavern은 Google AI Studio를 통해 Gemini 2.5 Flash-Lite에 연결할 수 있습니다. 문제는 provider, 정확한 모델명, API 키, 매 턴의 컨텍스트, 429와 빈 응답의 원인에서 생깁니다.

모델 확인
Google은 Gemini 2.5 Flash-Lite를 빈번한 경량 멀티모달 작업에 적합한 안정 모델로 소개합니다. 텍스트, 이미지, 비디오, 오디오, PDF를 입력하고 텍스트를 출력합니다.
gemini-2.5-flash-lite를 입력하세요. gemini-2.5-flash-lite-preview-09-2025 preview ID는 종료되었습니다.
문서상 입력 한도는 1,048,576 tokens, 출력 한도는 65,536 tokens입니다. 실제 RPM, TPM, RPD는 Google 프로젝트와 사용 등급에 따라 달라집니다.
thinking, function calling, 구조화 출력, URL context, Search grounding, 코드 실행, 캐시와 파일 검색을 지원합니다.
Google AI Studio 무료 등급은 제한된 모델 접근과 무료 입력 및 출력 tokens를 제공합니다. 많이 사용할 때는 현재 quota를 확인하세요.
SILLYTAVERN 설정
SillyTavern의 Google 안내는 Chat Completion을 사용합니다. AI Studio에서 키를 만들고 모델 목록을 불러오게 하세요. 짧은 요청으로 키, quota, 형식 문제를 나눠 확인합니다.
API key 페이지에 로그인하고 Get API Key를 선택한 뒤 약관에 동의해 키를 만듭니다. 키는 비밀로 보관하고 카드나 공개 이미지에 넣지 마세요.
SillyTavern의 API Connections에서 Chat Completion과 Google AI Studio를 차례로 선택하고 API Key에 붙여넣은 뒤 Connect를 누릅니다.
목록에 gemini-2.5-flash-lite가 보이면 선택하세요. 직접 입력할 때도 정확한 ID를 사용합니다. 종료된 preview ID는 temperature로 고칠 수 없습니다.
간단한 캐릭터 카드와 짧은 메시지로 테스트하세요. streaming 설정을 고정하고 모델, provider, 컨텍스트와 응답 상태를 기록합니다.
일반 요청이 성공한 뒤 system prompt, instruct 형식과 lore를 추가하세요. 제어 마커가 답변에 나오면 template을 먼저 점검합니다.
Google 제한은 RPM, TPM, RPD로 측정되며 API 키만이 아니라 프로젝트에 적용됩니다. Preview 모델은 더 엄격할 수 있습니다.
TABBIT의 위치
Tabbit은 SillyTavern frontend, 로컬 Gemma runner 또는 AI Studio 키 관리자가 아닙니다. 캐릭터 wiki, 설정 자료, PDF, 스크린샷과 모델 비교를 채팅 옆에서 다루는 브라우저입니다.
canon 메모, 설정 wiki와 문서를 탭에 남겨두면 Tabbit이 사이드 패널에서 요약할 수 있습니다.
@로 열린 페이지, 스크린샷이나 로컬 파일을 prompt에 넣고 연속성을 확인하세요.
현재 국제판 프로덕션 스냅샷에는 gemini-2.5-flash-lite가 표시되고 활성화되어 있지만 계정, edition, quota와 향후 배포에 따라 달라질 수 있으니 SillyTavern의 실시간 모델 선택기를 확인하세요. Tabbit은 SillyTavern provider나 Google AI Studio API 키를 받지 않으며 이 연결을 대신할 수 없습니다.

맞는 환경 선택
캐릭터 카드, 메시지 형식과 생성 설정은 SillyTavern에서 관리하세요. 자료가 웹과 파일에 흩어져 있다면 Tabbit을 사용하세요.
| 필요한 것 | SillyTavern + Google AI Studio | Tabbit |
|---|---|---|
| Gemini 2.5 Flash-Lite endpoint | 정확한 ID로 연결하고 실시간 선택기를 확인 | Tabbit 연결이 아니므로 SillyTavern에서 사용 |
| API 키와 quota | AI Studio에서 관리 | 이 키를 붙여넣는 입력란 없음 |
| 캐릭터 카드와 lore | 상세한 RP 제어 | wiki 또는 파일 참조 |
| 웹 컨텍스트 | 붙여넣거나 직접 통합 | @ 탭, 스크린샷과 파일 |
| Agent 동작 | ST 설정에 따라 다름 | 브라우저 Agent 모드 |
공식 자료
Google AI Studio 무료 등급은 제한된 모델 접근과 무료 입력 및 출력 tokens를 제공합니다. 많이 사용할 때는 현재 quota를 확인하세요.

FAQ
안정 모델은 gemini-2.5-flash-lite입니다. gemini-2.5-flash-lite-preview-09-2025는 종료되었습니다.
API Connections에서 Chat Completion과 Google AI Studio를 고른 뒤 API Key를 붙여넣고 연결합니다.
속도 또는 지출 제한을 넘었다는 뜻입니다. AI Studio에서 프로젝트의 RPM, TPM, RPD를 확인하고 기다리거나 요청 빈도, 컨텍스트, 출력을 줄이세요.
콘솔과 응답 세부 정보를 확인하고 streaming을 끈 짧은 prompt로 안정 ID를 테스트하세요. 형식, 안전 피드백과 finish details도 확인합니다.
입력 한도는 1,048,576 tokens, 출력 한도는 65,536 tokens입니다. 긴 RP에서 초기 정보가 모두 동일하게 검색된다는 보장은 없습니다.
Google은 지원한다고 문서화했습니다. SillyTavern connector와 설정에 따라 UI가 다릅니다. 스위치가 없으면 파라미터를 만들지 마세요.
AI Studio에 제한된 무료 등급이 있습니다. quota는 프로젝트와 등급에 따라 다르므로 현재 가격 페이지를 확인하세요.
아니요. Tabbit은 SillyTavern provider와 Google AI Studio 키를 받지 않습니다. 웹 컨텍스트와 Tabbit에 표시된 모델에 사용하세요.
Gemini API 연결은 SillyTavern에서 하세요. 채팅 주변의 웹 페이지, 파일과 브라우저 작업에는 Tabbit을 사용하세요.
macOS와 Windows 지원. 모델 목록과 provider 지원은 바뀔 수 있습니다.