IA Sin Censura
Přihlásit se Otevřít chat

Odkud se bere filtr AI a jak se odstraňuje

2 min čtení

Odkud se bere filtr AI a jak se odstraňuje

Filtr chatu s AI se skládá ze 3 vrstev: dolaďení samotného modelu, skrytých instrukcí služby a vnějšího moderačního systému. AI bez cenzury vychází z modelu dolaďeného k odpovídání a další dvě vrstvy nepřidává. Není to trik na modelu s filtrem: je to jiný model a jiná služba.

O filtru se mluví, jako by to byl vypínač. Ve skutečnosti je to soubor rozhodnutí, která se dělají v různých okamžicích, a jejich pochopení vysvětluje, proč některé chaty odmítají a jiné ne.

Na této stránce
  1. Vrstva 1: dolaďení modelu
  2. Vrstva 2: instrukce služby
  3. Vrstva 3: vnější moderace
  4. Co dělá AI bez cenzury s každou vrstvou
  5. Jak se znovu dolaďuje otevřený model
  6. Co se nemění
  7. Otázky o AI bez omezení

Vrstva 1: dolaďení modelu

Model se nejdřív trénuje na obrovském množství textu a pak se dolaďuje na příkladech, jak má odpovídat. V tomto druhém kroku se ho mimo jiné učí odmítat některé požadavky. Je to nejhlubší vrstva: odmítání je součástí modelu.

Vrstva 2: instrukce služby

Téměř všechny chaty přidávají před tvou otázku skrytý text s pravidly tónu, témat a identity. Je to nejsnáze změnitelná vrstva, protože je to jen text. Každá firma rozhoduje, co do něj zahrne.

Vrstva 3: vnější moderace

Některé služby posílají otázku nebo odpověď přes jiný systém, který obsah klasifikuje a přeruší nebo nahradí to, co považuje za citlivé. Tato vrstva působí na text, a proto jsou upozornění, která vytváří, vždy stejná.

Co dělá AI bez cenzury s každou vrstvou

Vychází z modelu zveřejněného otevřeně a dolaďeného, nebo znovu dolaďeného, aby odpovídal místo odmítání. Služba navíc nepřidává instrukce omezující témata ani vnější moderaci, která odpověď ořezává. Odstranit jen jednu vrstvu nestačí, protože ostatní dál odmítají.

Jak se znovu dolaďuje otevřený model

Existují dvě známé cesty. Jednou je nové dolaďení na příkladech, kde model odpovídá. Druhou je technika, která v modelu snižuje sklon odmítat, aniž by se celý znovu trénoval. Obě vycházejí z otevřených modelů, jejichž váhy jsou veřejné, což u uzavřených modelů velkých firem neplatí.

Co se nemění

Model dál ví jen to, co se naučil, a může se mýlit. Malý znovu dolaďený model je upřímný a někdy nepřesný. A hranice týkající se sexuálního obsahu s nezletilými platí ve všech jazycích, ať se odstraní kterákoli vrstva.

Otázky o AI bez omezení

Je to totéž co jailbreak?

Ne. Jailbreak se snaží přesvědčit model s filtrem, aby ho ignoroval. AI bez cenzury používá jiný model, bez tohoto odmítání, a nemusí ho přesvědčovat.

Je legální používat znovu dolaďený model?

Obecně ano. Otevřené modely se publikují s licencemi, které dolaďování umožňují. To, co uděláš s odpověďmi, musí být v souladu se zákonem.

Proč to velké firmy nedělají?

Protože odpovídají regulátorům, inzerentům a milionům různých uživatelů a raději odmítají příliš mnoho. Je to rozhodnutí o riziku, ne technické.

Dá se takový model spustit na mém počítači?

Pokud má tvé zařízení dost paměti, ano. Modely, které se vejdou do běžného počítače, jsou menší než ty v online službě.

Porovnej tady, jak odpovídá model bez vrstev odmítání.

Otevřít chat bez cenzury

AI bez cenzury