MAR, 28 / JUL / 2026

Kimi ya no se presenta como Claude

Una buena cantidad de reportes señalaban que el modelo chino tendía a presentarse como la creación de Anthropic. Un duo de investigadores examinó si esto era verdad, cuando aceptaban varios modelos presentarse como otros y si afectaba el contenido que presentaban y el que censuraban.

Las sospechas de que los desarrolladores chinos utilizan sistemas de destilado para producir sus modelos en base a las creaciones de otras empresas en occidente son amplias y a menudo justificadas. Pero sería injusto simplemente asumir que es siempre el caso. Los investigadores Benji Berczi y Kyuhee Kim decidieron examinar 7 modelos occidentales y chinos.

Los elegidos fueron: GLM 5.2, Kimi K3, Claude Sonnet 4.6, GPT-5.2, Llama-3.3-70B, Qwen3-235B, and Gemma-3-27B. El objetivo era ver si los modelos eran capaces de asumir la identidad de otro y que consecuencias podía tener esto en su comportamiento y la información que suministraban.

Cambio de identidad

Sin consigna alguna la gran mayoría de los modelos se presentaron con sus correspondientes identidades. Sin embargo, Kimi afirmó ser Claude en 4 de 10 ocasiones. También apuntaba ser un desarrollo de la empresa Anthropic. Sin embargo, a partir del 20 de julio este comportamiento desapareció, lo que sugiere un corrección en los servidores.

Cuando se pidió a los modelos que se identificaran como otros la mayoría aceptó el encargo. Pero algunos se resistieron. Curiosamente Kimi es el que más rechaza las consignas. Aceptó llamarse Sidney en 1 de 10 ocasiones, DeepSeek en 2, Gemma y ChatGPT en 3 para cada una y Claude en 5 de 10. Gemma rechazó todas las consignas para ChatGPT, pero aceptó todas para Claude. Qwen rechazó todas para DeepSeek y aceptó solo 2 para ChatGPT y las 10 que se hicieron para que se identificara como Claude.

Los investigadores señalan que en ningún caso se prueba sin dudas una operación de destilación de un modelo específico. Pero los resultados en casos tales como Kimi son coherentes con la presencia de varios modelos durante el desarrollo.

Censura

Por regla general los modelos occidentales respondieron el 95% de las preguntas sin censura sin importar la identidad asumida. En el caso de GLM una serie de preguntas sensibles sobre las que solo respondía plenamente en el 17% de los casos paso al 85% cuando se le indicó que se identificara como Claude. Qwen no demostró cambio alguno en términos de censura al cambiar de identidad. Kimi demostró un comportamiento similar. Para el primero el filtro se da en los parámetros, para el segundo en la API.

Comentarios
¡Comparte esta noticia!

Comments are closed.