💻
💻 Technologia

Narzędzie wizualizuje i edytuje "myśli" modeli językowych w czasie rzeczywistym

Twórca małego laboratorium AI zbudował darmowe narzędzie webowe oparte na metodzie "Jacobian Lens" z artykułu Anthropic, które pozwala podejrzeć wewnętrzne warstwy otwartych modeli językowych zanim wygenerują odpowiedź. Narzędzie pokazuje np. jak model przetwarza symbol "trzech zakrzywionych linii wody" — kolejno aktywują się tokeny "ocean", "sea" i "surf", zanim model zatrzyma się na "waves". Użytkownicy mogą też edytować ten wewnętrzny stan: wstrzyknięcie słowa "fire" do środkowej warstwy zmienia finalną odpowiedź. Narzędzie jest dostępne publicznie i bezpłatnie.

Komentarze

Brak komentarzy