Przejdź do głównej treści

Kurs

LLM Application Evaluation with LangSmith

Średniozaawansowany2 godz.

Learn to systematically measure and improve LLM application quality.

Python1 godz. - 3 godz.3,500 XPOświadczenie o ukończeniu

Utwórz bezpłatne konto

Kontynuuj z Google
lub
Kontynuując, akceptujesz nasz Warunki użytkowania, nasz Polityka prywatności i że Twoje dane są przechowywane w USA.

Uwielbiany przez uczących się w tysiącach firm

Szkolisz zespół?

Wypróbuj dla firm

Opis kursu

A description of the course.

Wymagania wstępne

Program kursu

Plan kursu

1

Ewaluacja aplikacji LLM

  • Podstawy ewaluacji

    Nauczysz się projektować kompleksowe systemy ewaluacji aplikacji AI, które mierzą wydajność w wymiarach dokładności, kosztów i opóźnień (latency), wykorzystując zbiory danych ewaluacyjnych oraz wiele typów ewaluatorów — od dopasowania algorytmicznego po podejście LLM-as-judge — co pozwoli Ci na ustalenie kryteriów sukcesu już na samym początku i mierzenie postępów w tworzeniu aplikacji gotowych do wdrożenia.

  • Implementacja ewaluacji

    Nauczysz się wdrażać systemy ewaluacji w praktyce, wykorzystując LangSmith do tworzenia zbiorów danych, definiowania ewaluatorów i przeprowadzania eksperymentów — budując ewaluatory algorytmiczne do obiektywnych porównań, ewaluatory typu LLM-as-judge do ocen subiektywnych oraz ewaluatory wielometryczne do kompleksowej analizy jakości.

  • Ocena konwersacji

    Nauczysz się oceniać aplikacje Conversational AI, wykorzystując ewaluację online z oceną opartą na kryteriach — wdrażając wzorce ewaluacji na poziomie pojedynczych wypowiedzi (turn-level) oraz całych konwersacji za pomocą ewaluatorów typu LLM-as-judge — co umożliwi Ci systematyczne mierzenie jakości chatbotów pod kątem spójności, stopnia realizacji zadań oraz wydajności.

Zacznij z AI Tutor

LLM Application Evaluation with LangSmith

Kurs
ukończony

Zdobądź Certyfikat Ukończenia

Zapisz się

Rozwijaj swoje umiejętności danych z DataCamp for Mobile

Rozwijaj się w drodze dzięki naszym kursom mobilnym i codziennym 5-minutowym wyzwaniom kodowania.