Wayfinder je referenční implementace pro učení a stavbu evaluačních systémů nad AI aplikacemi. Autoři na jednom vyhledávači letů postupně ukazují pravidlové vyhodnocování, lidské hodnocení, LLM-as-a-Judge, online evaluace a porovnávání experimentů. Repo obsahuje také práci s trasováním interakcí, explicitní zpětnou vazbou, datovými sadami, hodnoticími rubrikami a regresními testy. Projekt nemíří na nový model ani hotovou univerzální platformu. Jeho smyslem je ukázat, jak se kontrola kvality může vyvíjet od jednoduchých pravidel k provoznímu sledování skutečných odpovědí. Dokumentace počítá s Pythonem, uv a volitelným napojením na LangSmith. Část příkladů používá modely OpenAI, takže některé scénáře vyžadují vlastní klíče. Wayfinder může posloužit jako praktická kostra pro týmy, které nechtějí kvalitu AI aplikace měřit jen jedním benchmarkem nebo dojmem z několika ručních testů.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.