«Kimi K2 para roleplay» no identifica una configuración única. Puede referirse al checkpoint original Kimi-K2-Instruct, a una ruta del proveedor etiquetada K2 0905 o a un modelo posterior de Kimi. La ficha oficial de Kimi-K2-Instruct lo describe como modelo general de chat y agentes, y declara una ventana de contexto de 128K. No evalúa voz de personaje, continuidad en roleplay ni ritmo narrativo.
La respuesta práctica depende, por tanto, de la ruta: Kimi K2 merece una prueba si el checkpoint y endpoint que puedes usar encajan con tu ficha y tus preferencias. Haz una evaluación breve y repetible antes de empezar una historia larga. Esta guía ofrece un método para separar el comportamiento del modelo del montaje del prompt y los ajustes del proveedor. No presenta un benchmark ni una sesión propia con K2.
128K es una especificación de capacidad. No garantiza que la aplicación envíe toda la conversación, que el proveedor permita usar la ventana completa ni que el modelo recupere un detalle cuando importa. Son cuestiones distintas y conviene comprobarlas por separado.
Ideas clave
Anota el checkpoint o el model ID exacto del proveedor. «Kimi K2» no identifica por sí solo una ruta.
Trata K2-Instruct, cualquier endpoint llamado K2 0905 y las versiones posteriores como candidatos distintos.
Compara con la misma ficha, apertura, formato de prompt, proveedor y número de turnos.
Evalúa por separado voz, continuidad, seguimiento de instrucciones, agencia del jugador, ritmo y repetición. Una respuesta brillante no representa una sesión.
Este borrador no contiene una prueba controlada de K2 ni testimonios o capturas comunitarias verificados. El método no demuestra que K2 funcione bien o mal.
Kimi K2 para roleplay, de un vistazo
| Versión o capa | Qué confirma la fuente disponible | Qué no confirma para roleplay |
|---|---|---|
Kimi-K2-Instruct | La ficha oficial lo presenta como modelo general de chat y agentes, «sin razonamiento largo»; indica 128K y ejemplos de servicio local con vLLM y SGLang. | Voz, memoria en sesiones largas, ritmo, respuesta ante límites de una escena o calidad de una ruta alojada concreta. |
| Etiqueta K2 0905 | La investigación registra referencias encontradas en búsquedas a una actualización fechada; no se pudo abrir el original ni verificar una ruta actual del proveedor. | Que haya una ruta disponible, que distintos proveedores usen los mismos pesos o cómo rinde en RP. |
| Endpoint del proveedor | La página de un proveedor puede indicar el model ID, el límite de contexto, el tratamiento de solicitudes y las restricciones del servicio. | La etiqueta por sí sola no demuestra el checkpoint, la ventana completa ni los mismos valores predeterminados. |
| Nombres posteriores de Kimi | K2.5, K2.6, K2.7 Code, K2.8 y K3 son nombres de versiones distintas dentro del alcance de esta investigación. | Sus documentos, ajustes o impresiones no se trasladan automáticamente al K2 original. |
| Interfaz de roleplay | SillyTavern compone los datos del personaje y la conversación en una solicitud; sus documentos distinguen formas de construir el prompt. | La interfaz no garantiza qué recibe el endpoint ni cómo responderá el modelo. |
Los datos de Kimi-K2-Instruct proceden de la ficha oficial. El plan de investigación incluye el proyecto oficial Kimi K2 para verificar nombres de versiones, pero no se volvió a abrir durante esta revisión. Antes de basarte en disponibilidad o nombres actuales, revisa las páginas oficiales y la del proveedor. Un fragmento de búsqueda, el título de un foro o una versión cercana no sustituyen esa comprobación.
Identifica la versión y la ruta antes de comparar
Empieza copiando el model ID que muestra el proveedor o el nombre exacto del checkpoint en tu configuración local. Guarda también la fecha, el proveedor y la interfaz. Si solo aparece «Kimi K2», déjalo como pendiente; no supongas que significa Kimi-K2-Instruct o K2 0905.
Una respuesta de roleplay recorre varias capas: la ficha y el historial se convierten en un prompt, se envían por una ruta y se decodifican con opciones de generación. El proveedor puede cambiar el model ID disponible, limitar el contexto, aplicar una plantilla o definir valores predeterminados. El resultado corresponde a esa ruta concreta, no a todo servicio que use el nombre K2.
Separa las preguntas sobre versión de las preguntas sobre calidad. La ficha pública puede confirmar la descripción del modelo y ejemplos documentados de servicio. La página de un proveedor puede confirmar su endpoint y condiciones actuales. Ninguna de las dos mide si un personaje resulta convincente durante cincuenta turnos. Del mismo modo, una escena que guste a una persona no confirma capacidad de contexto ni licencia.
Si encuentras K2 0905, verifica primero la ruta y su procedencia. La investigación de este borrador solo conserva referencias descubiertas en búsquedas, no una página primaria accesible que confirme un endpoint actual. Por eso no se presenta como modelo probado o disponible ahora. Para versiones posteriores, consulta por separado la visión general de Kimi K2.6 y la guía de roleplay con Kimi K3; no son pruebas de K2.
Prueba una ficha de personaje controlada
Elige una ficha que conozcas lo bastante bien como para detectar cambios de carácter. Antes de empezar, anota en tu hoja de evaluación los rasgos estables de voz, el objetivo inmediato, la relación con el personaje del usuario, un límite que no debe cruzarse y un hecho reciente que debería influir en la siguiente respuesta. Usa esta hoja para puntuar; no la añadas al prompt de un solo candidato.
Envía la misma ficha y apertura a la ruta exacta de K2 y a una alternativa. Mantén constantes, en lo posible, proveedor, prompt de sistema, contexto, muestreo, límite de salida e historial. Si el coste lo permite, abre tres conversaciones independientes y continúa cada una al menos seis turnos del asistente. Tres turnos sirven para detectar fallos evidentes, pero dicen poco sobre una sesión larga. No compares un chat nuevo de K2 con otro modelo que ya tenga lore adicional en el historial.
Usa una escala breve para cada dimensión: 0 = rompe la tarea; 1 = exige correcciones repetidas; 2 = aceptable con fallos ocasionales; 3 = encaja de forma consistente con esta ficha y tus preferencias. Puntúa cada conversación por separado y usa la mediana, no el mejor resultado. Para cada 0 o 3, guarda un ejemplo o el número de turno. Es una herramienta personal, no una prueba normalizada ni una afirmación sobre todos los usuarios.
| Dimensión | Qué observar en la transcripción | Señal para continuar | Señal para parar o corregir |
|---|---|---|---|
| Voz | Léxico, ritmo, matices emocionales y detalles propios | El personaje se reconoce sin recordatorios constantes | La prosa se vuelve genérica o repite una muletilla |
| Continuidad | Hechos, promesas, objetos, relaciones y sucesos previos | Recupera detalles relevantes cuando toca | Olvida, contradice o inventa un hecho importante |
| Instrucciones | Reglas de la ficha y límites recientes de la escena | Respeta la restricción actual sin perder el personaje | Ignora un límite claro o vuelve a una instrucción antigua |
| Agencia | Quién controla al jugador y las decisiones abiertas | Avanza la escena y deja al usuario elegir | Escribe la decisión, los sentimientos o el desenlace del usuario |
| Ritmo | Información nueva, longitud y movimiento de escena | Avanza a la velocidad que prefieres | La exposición retrasa la interacción o salta una elección |
| Repetición | Frases, gestos, resúmenes y emociones reiteradas | Resume solo cuando orienta | Repite sin aportar significado ni mover la escena |
Guarda el prompt, la versión de la ficha, el endpoint, la fecha, los ajustes y las salidas en una nota local. Elimina datos privados antes de compartirlos. Si un cambio mejora el resultado, conserva las dos versiones y anota qué variable cambió. Modificar a la vez el prompt y la temperatura no es una comparación controlada: no sabrás qué produjo la diferencia.
Comprueba por separado contexto, memoria y repetición
No deduzcas la memoria a partir del número de contexto. Coloca algunos hechos en posiciones distintas: uno al inicio, otro a mitad de conversación y otro en los últimos turnos. Pueden ser un detalle concreto, una relación o promesa, y una instrucción que siga vigente. Más tarde, pregunta algo natural dentro de la escena que necesite uno de esos hechos. Después introduce un suceso nuevo y observa si el modelo actualiza su interpretación o se aferra al estado anterior.
Registra por separado si el hecho se recuperó correctamente, se omitió o se transformó en algo sin respaldo. Comprueba también si estaba en el prompt enviado realmente. La interfaz puede resumir o truncar el historial. Si el dato no llegó al endpoint, puede ser un problema del montaje o la ruta; si estaba presente y se gestionó mal, anota el comportamiento observado. Sin inspeccionar el prompt enviado, deja la causa como desconocida.
Para detectar repetición, lee el intercambio completo y en orden. Marca oraciones repetidas, gestos recurrentes, declaraciones emocionales reiteradas y resúmenes innecesarios. Repetir puede ser intencional —por ejemplo, volver a una promesa o ritual—; cuenta como problema cuando no añade sentido, frena la escena o te obliga a repetir información. Registra el tipo, no solo «repetitivo».
Para comprobar el seguimiento de instrucciones, usa una regla visible y segura, como «no decidas las acciones del personaje del jugador» o «limita cada respuesta a dos párrafos breves». Inclúyela en la ficha o el prompt compartido y revísala al principio, después de un cambio de escena y tras una conversación larga. No cambies la regla durante la comparación. Un incumplimiento puede deberse a la posición del prompt, a un recorte del contexto o al modelo; la transcripción por sí sola quizá no permita distinguirlo.
Elige según el tipo de escena
Cada uso de roleplay expone fallos distintos. Decide qué te importa antes de probar; una nota global puede esconder concesiones importantes.
| Uso principal | Primera prueba | Conserva la ruta si… | Para o ajusta si… |
|---|---|---|---|
| Chat breve de personaje | Tres intercambios con una voz conocida y el turno del usuario claro | Mantiene la voz y deja una acción útil para continuar | Cada turno necesita corrección o el personaje se vuelve genérico |
| Relación de desarrollo lento | Introduce una promesa pequeña y recupérala varios turnos después | La relación evoluciona con momentos concretos, sin acelerar a la fuerza | Olvida la promesa o repite la misma emoción |
| Misterio o aventura | Da una pista pronto y añade otra limitación más adelante | Usa las pistas relevantes y deja que el usuario decida | Inventa hechos o resuelve la escena por el usuario |
| Campaña con mucho lore | Reparte unos datos en el prompt y pregúntalos de forma natural | Los detalles siguen disponibles y la interfaz los envía | El montaje ocupa demasiado contexto o los datos desaparecen |
| Escena con varios personajes | Define dos voces distintas y prueba un diálogo compartido | Distingue a los hablantes y mantiene turnos claros | Mezcla voces o atribuye mal quién sabe qué |
| Control estricto del personaje jugador | Añade una regla explícita sobre quién controla al jugador | Solo mueve a su personaje y el entorno | Narra los pensamientos o decisiones del usuario |
Son escenarios para probar, no resultados atribuidos a Kimi K2. Puedes tolerar menor continuidad en una escena improvisada y rechazarla en una campaña larga. Ajusta el criterio de parada al coste de reparar: cambiar una palabra puede ser trivial; inventar el historial de una relación puede invalidar la prueba.
Separa el modelo de SillyTavern y del proveedor
La interfaz influye en el prompt: ficha, ejemplos de diálogo, lore, notas y chat reciente pueden combinarse antes de enviar la solicitud. La documentación de API Connections de SillyTavern explica que Chat Completions y Text Completions describen distintas formas de construir prompts; no significan «alojado» y «local». El endpoint y el despliegue son otra capa.
Si una respuesta falla, revisa la ruta en orden. Confirma el model ID seleccionado; comprueba que la ficha e historial aparezcan una sola vez y en el orden esperado; verifica límites de contexto y salida; por último, ajusta la generación. Si el endpoint aplica otra plantilla o corta pronto el historial, cambiar la temperatura puede ocultar el síntoma sin corregir la causa.
Para conectar el modelo, consulta la guía de configuración de Kimi K2 en SillyTavern. Las guías de Kimi K3 en SillyTavern y de configuración de Kimi K3 cubren otra familia y no deben copiarse como instrucciones de K2. Para elegir candidatos, pueden servir las páginas de roleplay con DeepSeek V3.2, Mistral 24B en SillyTavern, GLM-5.3 en SillyTavern y Gemma 4 en SillyTavern. Usa la misma ficha y hoja de puntuación; esos artículos no son una comparación directa.
Tabbit puede servir como espacio de trabajo para reunir documentación oficial, páginas de proveedores y notas propias. Es un uso organizativo, no una afirmación de que Tabbit aloje Kimi K2 original, ofrezca un selector de K2 o se haya usado para esta prueba. Aquí no hay una sesión de roleplay con K2 dentro de Tabbit.
Veredicto: elige la ruta que supere tu prueba
La evidencia primaria disponible confirma unos pocos datos de Kimi-K2-Instruct: la ficha lo describe como modelo general de chat y agentes, declara 128K y muestra ejemplos de servicio local. No responde si mantendrá un personaje convincente durante una escena larga. Esta investigación tampoco consiguió originales comunitarios accesibles, capturas válidas ni una prueba controlada; por tanto, no permite declarar un ganador de roleplay.
Elige K2 solo si la ruta que usarás alcanza tus mínimos de voz, continuidad, seguimiento de instrucciones y ritmo. Si falla, guarda el intercambio y revisa una capa a la vez: ruta, montaje del prompt, contexto utilizable y, después, ficha o generación. Si la prueba breve sale bien, continúa con una sesión más larga antes de iniciar una campaña. Seis turnos pueden revelar fricciones, pero no demuestran fiabilidad a largo plazo.
El siguiente paso es concreto: copia el model ID exacto del endpoint, usa una ficha conocida con la misma apertura y guarda seis turnos antes de decidir. Vuelve a consultar la ficha oficial y la documentación del proveedor cuando hagas la prueba; las rutas y límites pueden cambiar. El borrador seguirá sin publicarse mientras falten las pruebas comunitarias y visuales.
Preguntas frecuentes
¿Kimi K2 sirve para roleplay?
La ficha oficial lo presenta como modelo general de chat, pero no mide personajes. Prueba la versión, ficha y proveedor exactos.
¿Qué versión trata esta guía?
Se centra en Kimi-K2-Instruct original; K2.5, K2.6, K2.7 Code y K3 son distintos.
¿128K garantiza memoria?
No. Es capacidad; la continuidad debe comprobarse entre turnos.
¿Puede ejecutarse en local?
La ficha oficial muestra vLLM y SGLang; los requisitos dependen de la configuración.
¿Cómo compararlo?
Mantén ficha, apertura, proveedor y turnos; registra voz, continuidad, ritmo y repetición.