IA Sin Censura
Iniciar sesión Abrir chat

De dónde viene el filtro de una IA y cómo se elimina

2 min de lectura

De dónde viene el filtro de una IA y cómo se elimina

El filtro de un chat de IA se construye en 3 capas: el ajuste del propio modelo, las instrucciones ocultas del servicio y un sistema de moderación externo. Una IA sin censura parte de un modelo ajustado para responder y no añade las otras dos capas. No es un truco sobre un modelo con filtro: es otro modelo y otro servicio.

Se habla del filtro como si fuera un interruptor. En realidad es un conjunto de decisiones que se toman en distintos momentos, y entenderlas explica por qué unos chats rechazan y otros no.

En esta página
  1. Capa 1: el ajuste del modelo
  2. Capa 2: las instrucciones del servicio
  3. Capa 3: la moderación externa
  4. Qué hace una IA sin censura con cada capa
  5. Cómo se reajusta un modelo abierto
  6. Lo que no cambia
  7. Preguntas sobre IA sin censura y sin restricciones

Capa 1: el ajuste del modelo

Un modelo se entrena primero con una enorme cantidad de texto y luego se ajusta con ejemplos de cómo debe responder. En ese segundo paso se le enseña, entre otras cosas, a rechazar ciertas peticiones. Es la capa más profunda: el rechazo forma parte del modelo.

Capa 2: las instrucciones del servicio

Casi todos los chats añaden un texto oculto antes de tu pregunta, con reglas de tono, de temas y de identidad. Es la capa más fácil de cambiar, porque es solo un texto. Cada empresa decide qué incluir.

Capa 3: la moderación externa

Algunos servicios pasan la pregunta o la respuesta por otro sistema que clasifica el contenido y corta o sustituye lo que considera delicado. Esta capa actúa sobre el texto, y por eso los avisos que produce son siempre idénticos.

Qué hace una IA sin censura con cada capa

Parte de un modelo publicado de forma abierta y ajustado, o reajustado, para contestar en lugar de rechazar. Además, el servicio no añade instrucciones que limiten los temas ni una moderación externa que recorte la respuesta. Quitar solo una capa no basta, porque las otras siguen rechazando.

Cómo se reajusta un modelo abierto

Existen dos vías conocidas. Una es un nuevo ajuste con ejemplos donde el modelo sí responde. Otra es una técnica que reduce en el modelo la tendencia a rechazar sin volver a entrenarlo del todo. Ambas parten de modelos abiertos, cuyos pesos son públicos, algo que no ocurre con los modelos cerrados de las grandes empresas.

Lo que no cambia

El modelo sigue sabiendo solo lo que aprendió y puede equivocarse. Un modelo pequeño reajustado es franco y a veces impreciso. Y el límite sobre contenido sexual con menores se mantiene en todos los idiomas, se quite la capa que se quite.

Preguntas sobre IA sin censura y sin restricciones

¿Es lo mismo que un jailbreak?

No. Un jailbreak intenta convencer a un modelo con filtro para que lo ignore. Una IA sin censura usa otro modelo, sin ese rechazo, y no necesita convencerlo.

¿Es legal usar un modelo reajustado?

En general sí. Los modelos abiertos se publican con licencias que permiten ajustarlos. Lo que hagas con las respuestas debe cumplir la ley.

¿Por qué las grandes empresas no lo hacen?

Porque responden ante reguladores, anunciantes y millones de usuarios distintos, y prefieren rechazar de más. Es una decisión de riesgo, no técnica.

¿Se puede ejecutar uno en mi ordenador?

Si tu equipo tiene suficiente memoria, sí. Los modelos que caben en un ordenador normal son más pequeños que los de un servicio en línea.

Compara aquí cómo responde un modelo sin capas de rechazo.

Abrir chat sin censura

IA sin censura: explicaciones