Kontakt z pomocą

Odpowiadamy e-mailem, zwykle w ciągu dwóch dni.

Google reCAPTCHA sprawdza to zgłoszenie pod kątem nadużyć; dane trafiają do Google. Skrypt ładuje się dopiero po otwarciu formularza.

← Wszystkie wpisy

Co wolno modelowi

Na górze publicznej strony statystyk mogą tu stać dwa albo trzy zdania opisujące, co licznik robił w tym miesiącu. Napisał je model językowy. Model niczego przy tym nie wymyśla, a układ, który to zapewnia, wart jest opisania — bo oczywisty sposób zbudowania tej funkcji tej własności nie ma.

Pi znajduje liczby Pi jeden prompt na fakt Model jedno zdanie Pi sprawdza każdą cyfrę wobec promptu zdanie się pokazuje zdanie odrzucone

Pi wykonuje SQL, decyduje, która liczba warta jest wzmianki, i pisze prompt. Model zamienia jeden fakt w jedno zdanie w żądanym języku. Potem Pi czyta odpowiedź z powrotem i wyrzuca ją, jeśli któraś cyfra w niej nie pochodzi z promptu.

Jedyną swobodą modelu jest więc sformułowanie. Nie wybiera, nie liczy, nie zaokrągla. Wnosi dokładnie to, czego szablony nie potrafią: jedenaście języków, które w czytaniu brzmią jak język.

Trzy kontrole i błąd, dla którego każda istnieje

Żadna nie powstała z ostrożności. Każda istnieje, bo 17 sierpnia 2026 coś konkretnego poszło nie tak. Mały model dostał dwa fakty o jednym liczniku — najmocniejszy dzień tygodnia poniedziałek z 46 %, oraz 76 % odwiedzających z Polski przy 5 krajach — i napisał z tego zdanie, w którym najmocniejsza była środa, a 46 % odwiedzających przychodziło z Polski.

Dwa różne błędy w jednym zdaniu, i żaden z nich nie jest wymyśloną liczbą.

  • Każda cyfra musi występować w promptcie. To łapie liczby wymyślone. Ma to następstwo, które później łatwo popsuć: część instrukcyjna promptu nie zawiera żadnych cyfr. Stoi tam „one or two sentences", nigdy „1-2", bo inaczej 1 i 2 stałyby się dozwolonymi liczbami w odpowiedzi.
  • Jeden prompt na fakt. To łapie liczby zamienione. Owe 46 było prawdziwe — należało tylko do drugiego faktu, a kontrola nad zbiorem liczb tego nie widzi. Skoro model widzi zawsze tylko jeden fakt, nie ma czego zamieniać.
  • Sprawdzane są też nazwy. To łapie poniedziałek, który staje się środą. Nazwa stoi w fakcie w języku docelowym, musi wystąpić w odpowiedzi dosłownie, a jej rodzeństwo nie może.

Czego nie łapią

To należy powiedzieć jednym tchem z resztą. Dwie rzeczy przechodzą.

Zdanie, które bez cyfr twierdzi coś fałszywego — „większość odwiedzających", gdy było 46 % — nie zostanie złapane przez żadną z trzech. Przechwytuje to zamiast tego sama konstrukcja: ocena tkwi już w fakcie, który wybrał Pi, a nie w swobodzie modelu.

I zdanie o czymś zupełnie innym niż jego fakt przechodzi, dopóki cyfry się zgadzają. Na to pomaga tylko model, który wykonuje polecenia. Przy cechach mających nazwę — dzień tygodnia, urządzenie, bot, strona — pokrywa to dodatkowo trzecia kontrola.

Kontrola, która łapie wyłącznie liczby wymyślone, przepuściłaby powyższe zdanie bez zmian. To były prawdziwe liczby w złych miejscach, a ten rodzaj błędu widzi się tylko wtedy, gdy patrzy się na wyjście, a nie na pomysł.

Reklama