メインコンテンツにスキップ

コース

LLM Application Evaluation with LangSmith

中級2 時間

Learn to systematically measure and improve LLM application quality.

Python1 時間 - 3 時間3,500 XP1修了証明書

無料アカウントを作成する

Googleで続行
または
続行すると、次に同意したものとみなされます: 利用規約プライバシーポリシー 、およびデータが米国内に保管されることに同意したものとみなされます。

何千もの企業の学習者に愛されています

チームでトレーニングをお考えですか?

法人向けプランを試す

コースの説明

A description of the course.

前提条件

カリキュラム

コース概要

1

LLMアプリケーションの評価

  • 評価の基礎

    精度、コスト、レイテンシの各側面からパフォーマンスを測定する、包括的なAIアプリケーション評価システムの設計方法を学びます。評価データセットと、アルゴリズムによるマッチングからLLM-as-a-judgeのアプローチまで、複数のエバリュエータータイプを活用することで、事前に成功基準を確立し、リリース可能なアプリケーションに向けた進捗を測定できるようになります。

  • 評価の実装

    LangSmithを使用したデータセットの作成、評価器の定義、実験の実行を通じて、評価システムを実践的に実装する方法を学びます。客観的な比較のためのアルゴリズム評価器、主観的な評価のためのLLM-as-judge評価器、そして網羅的な品質分析のためのマルチメトリクス評価器を構築していきます。

  • 対話の評価

    基準ベースのアセスメントを用いたオンライン評価による、会話型AIアプリケーションの評価方法を学びます。 — LLM-as-judgeエバリュエーターを通じてターンレベルおよび会話全体の評価パターンを実装することで — 一貫性、タスク完了度、効率性にわたるチャットボットの品質を体系的に測定できるようになります。

LLM Application Evaluation with LangSmith

コース修了

修了証明書を取得

今すぐ登録する

DataCamp for Mobileでデータスキルを伸ばしましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進められます。