Jak „trenować” towarzysza AI – co naprawdę zmienia twoja opinia

Jak to działa

Wielu użytkowników ocenia każdą odpowiedź, wierząc, że uczy swojego towarzysza. Najczęściej nie, a przynajmniej nie tak, jak myślą. Oto co naprawdę robi każdy rodzaj opinii.

Za linki na tej stronie możemy otrzymać prowizję. Nigdy nie zmienia to oceny.

„Trenowanie” towarzysza AI sugeruje, że oprogramowanie stopniowo uczy się twoich preferencji, jak zwierzę. Rzeczywistość ma więcej części: kilka dźwigni zmienia zachowanie od razu, niektóre zmieniają je powoli dla wszystkich, a niektóre głównie dają ci poczucie zaangażowania.

Co naprawdę kształtuje odpowiedź

Każda odpowiedź jest generowana z tego, co model widzi w danej chwili – mechanizm opisuje jak towarzysz AI pisze swoją odpowiedź:

  1. Opis postaci i jej ustawienia.
  2. Zapisane wspomnienia i streszczenia pobrane do tej rozmowy.
  3. Sama ostatnia rozmowa.
  4. Model bazowy, w wersji, którą firma ostatnio zaktualizowała.

Twoja opinia ma znaczenie w takim stopniu, w jakim zmienia jedną z tych czterech rzeczy.

Dźwignie, od najsilniejszej do najsłabszej

Dźwignie kształtowania towarzysza AI uszeregowane według szybkości i siły działania: edycja postaci, edycja odpowiedzi, notatki w pamięci, ponowne generowanie, notatki poza rolą i oceny

Zmieniaj to, co model czyta, a nie to, co czuje do ciebie.

DźwigniaCo zmieniaJak szybkoJak mocno
Edycja opisu postaciInstrukcje czytane przed każdą odpowiedziąNatychmiastMocno i trwale
Edycja odpowiedziRozmowę, z której model kopiujeNastępne odpowiedziMocno, dopóki jest w polu widzenia
Notatki w pamięciFakty pobierane do przyszłych rozmówOd następnego pobraniaMocno dla faktów, słabo dla stylu
Notatki poza roląBieżącą scenęNatychmiastSłabnie wraz ze wzrostem czatu
Ponowne generowanieTylko tę jedną odpowiedźNatychmiastBrak poza tą odpowiedzią
Oceny (kciuki, gwiazdki)Zwykle dane do przyszłych aktualizacji modeluTygodnie lub miesiące, jeśli w ogóleSłabo dla twojej postaci

Edytuj, nie spieraj się

Spieranie się w roli – „nie zachowujesz się jak ty” – rzadko działa, bo sam spór staje się częścią rozmowy, którą model kopiuje. Edycja odpowiedzi do tego, co postać powinna była powiedzieć, daje modelowi poprawny przykład do naśladowania. Jeśli aplikacja pozwala na edycję, to najprzydatniejszy nawyk, jaki możesz zbudować.

Styl w opisie, fakty w pamięci

  • Styl – ton, długość zdań, humor, to, jak czuła jest – należy do opisu postaci, bo musi dotyczyć każdej odpowiedzi. Nasz poradnik o kreatorze postaci opisuje, które pola mają znaczenie.
  • Fakty – twoja praca, imię twojego psa, co się stało w zeszłym tygodniu – należą do pamięci, z której są pobierane, gdy są potrzebne.

Pomieszanie ich powoduje problemy: notatki o stylu w pamięci są pobierane niespójnie, a długie listy faktów w opisie wypierają osobowość.

Do czego naprawdę służą oceny

W większości aplikacji oceny zasilają dane firmy służące do ulepszania modeli, często dla wszystkich użytkowników. Może warto je dawać – pomagasz przyszłym wersjom – ale to nie jest bezpośrednia linia do twojej postaci. Niektóre aplikacje mówią, że oceny wpływają konkretnie na twojego towarzysza; nawet tam efekt jest stopniowy i znacznie słabszy niż edytowany opis.

Jeśli ci zależy, sprawdź politykę prywatności: ocenienie odpowiedzi może oznaczyć tę rozmowę do przeglądu lub trenowania, co jest kompromisem prywatności. Zobacz kto czyta rozmowy z towarzyszem AI.

Cotygodniowe strojenie

  1. Zanotuj dwie rzeczy, które ci się podobały, i jedną, która cię w tym tygodniu irytowała.
  2. Zamień irytację w pozytywną instrukcję w opisie („Odpowiada krótkimi, suchymi zdaniami”, a nie „Nie gadaj za dużo”).
  3. Dodaj do pamięci nowe ważne fakty.
  4. Zacznij nowy czat, jeśli stary dryfuje – długie rozmowy gromadzą nawyki, jak wyjaśnia dryf osobowości.

Towarzysz nie uczy się ciebie tak jak człowiek. Ale czyta cię za każdym razem – przez swój opis, swoją pamięć i twoje ostatnie słowa. Zmień to, co czyta, a zmienisz to, kim jest.

Najczęstsze pytania

Czy kciuk w górę i w dół zmienia mojego towarzysza AI?

Rzadko od razu i często nie twojego konkretnego towarzysza. W większości aplikacji oceny zbiera się, by w przyszłych aktualizacjach ulepszać model dla wszystkich. Kilka aplikacji używa ich do korygowania twojej postaci, ale efekt jest mały i powolny w porównaniu z edycją opisu.

Jaki jest najszybszy sposób, by zmienić, jak mówi mój towarzysz AI?

Edytuj pole opisu lub osobowości postaci i poprawiaj odpowiedzi, edytując je, zamiast się spierać. Model kopiuje to, co jest w jego instrukcjach i w ostatniej rozmowie – to dwie dźwignie, które działają od razu.

Czy mój towarzysz AI uczy się z naszych rozmów?

Zapisuje fakty i streszczenia w systemie pamięci, więc potrafi przypominać szczegóły. Zwykle nie trenuje na twoich rozmowach swojego modelu bazowego w czasie rzeczywistym. To, czy twoje rozmowy posłużą do trenowania przyszłych wersji, zależy od polityki firmy.