メインコンテンツへスキップ

コース

LLM Application Evaluation with LangSmith

中級2 時間

Learn to systematically measure and improve LLM application quality.

Python1 時間 - 3 時間3,500 XP修了証明書

無料アカウントを作成

Google で続行
または
続行することで、 利用規約、私たちの プライバシーポリシー そして、あなたのデータが米国に保存されること。

何千もの企業の学習者に支持されています

チームのトレーニングをお考えですか?

ビジネス向けに試す

コース説明

A description of the course.

前提条件

カリキュラム

コース概要

1

LLMアプリケーションの評価

  • 評価の基礎

    精度、コスト、レイテンシの各側面からパフォーマンスを測定する、包括的なAIアプリケーション評価システムの設計方法を学びます。評価データセットと、アルゴリズムによるマッチングからLLM-as-a-judgeのアプローチまで、複数のエバリュエータータイプを活用することで、事前に成功基準を確立し、リリース可能なアプリケーションに向けた進捗を測定できるようになります。

  • 評価の実装

    LangSmithを使用したデータセットの作成、評価器の定義、実験の実行を通じて、評価システムを実践的に実装する方法を学びます。客観的な比較のためのアルゴリズム評価器、主観的な評価のためのLLM-as-judge評価器、そして網羅的な品質分析のためのマルチメトリクス評価器を構築していきます。

  • 対話の評価

    基準ベースのアセスメントを用いたオンライン評価による、会話型AIアプリケーションの評価方法を学びます。 — LLM-as-judgeエバリュエーターを通じてターンレベルおよび会話全体の評価パターンを実装することで — 一貫性、タスク完了度、効率性にわたるチャットボットの品質を体系的に測定できるようになります。

AI Tutor で始める

LLM Application Evaluation with LangSmith

コース修了

達成証明書を取得する

今すぐ登録

DataCamp for Mobileでデータスキルを磨きましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進めましょう。